Grok 4.5 测评报告!真的能打吗?
发表于|更新于|大语言模型
Grok 4.5是xAI(马斯克旗下)推出的最新大语言模型。本视频对其进行独立的全面测评,测试其在编程能力、科学推理、幽默感(Grok的特色)和多语言支持等方面的表现。与GPT-5、Claude Fable 5等模型的横向对比,以及Grok特有的实时信息访问能力是否真的是一个差异化优势。
相关推荐

2026-08-06
8月6 AI早报!阿里 Qwen-Image-3.0 上线!
欢迎收看 8 月 6 日新鲜出炉的六条重磅 AI 资讯,本期涵盖文生图接口、三模态实时模型、Grok 新版本、低价 AI 视频工具、分层式 AI-Design 还有 CUDA 生态迎来变局,带大家一次性吃透今日行业动态: 阿里 Qwen-Image-3.0 上线双版本 API,低廉单价还支持复杂图文排版 字节 SeedRealtime 三模态模型登录豆包,优化实时交互体验 马斯克接连准备上线两款高参数 Grok 大模型 秘塔 AI 接入平价高清视频生成工具 兔展 RabbitVis 支持图层独立编辑图片 AI 智能体耗时十小时完成底层适配,撬动英伟达 CUDA 的行业壁垒 访问入口
2025-10-31
Grokipedia是什么鬼?马斯克新宠初体验!
今天我们来体验下马斯克最新推出的 Grokipedia。不过开始之前,我们先来了解下这个 AI 百科全书是怎么运作的。简单讲,它最大的卖点就是,内容都是由马斯克家的 Grok AI 模型自动生成的,效率极高,号称能迅速创建大量条目,来挑战人工编辑的维基百科。 最酷的地方在于它的交互性:你在阅读文章时,可以随时选中任何不理解的段落,让 Grok AI 立即为你做详细解释。这功能对学习和研究来说简直太方便了… 访问入口
2025-12-29
Grok:免费Sora 2!支持中文对话!
刚发现grok也可以免费生成带声音和中文对话的视频,上去玩了下,发现效果还不错… 访问入口
2026-01-15
LTX2:AI视频圈变天了!LTX 2免费开源!
兄弟们,AI视频圈这回真炸了,刚开源的LTX-2简直就是“白嫖党”的福音!这玩意儿好的简直不像免费的,,画质还能直接拉到4K,50帧的画面丝滑得冒油,甚至连音效和对话都能一键生成,一段视频能跑20多秒,你只要用大白话描述下脑子里的场景,不管是电影级的运镜还是精细的纹理,它都能给你整得明明白白,简直是一个人就能顶起一支特效团队!趁现在这波红利还没火透,大伙赶紧先去占个坑,别等以后满大街都是这种视频了你才拍大腿后悔! 访问入口
2025-06-25
可灵 PK Midjourney:谁才是视频生成王者?
不得不服,果然是出道即巅峰!Midjourney 视频生成模型横空出世! 视频生成质量直接SOTA级别!忍不住和我们国产的SOTA 可灵AI来PK下,大家看下究竟是可灵更胜一筹还是midjourney的质量更好 Midjourney访问入口 可灵AI访问入口
2024-11-29
LLM的各种基准测试Benchmarks
在评测大语言模型性能时,各种基准测试(Benchmarks)是衡量模型能力的重要标准。常见的基准测试涵盖了不同维度:MMLU(大规模多任务语言理解)测试模型在57个学科上的知识广度;GSM8K和MATH用于评估数学推理能力;HumanEval和MBPP测试编程能力;HellaSwag和WinoGrande评估常识推理;BENCH和MT-Bench则关注模型的对话质量。不同的基准测试各有侧重点,没有任何一个测试能全面反映模型能力,因此需要综合看待多个Benchmark的结果。本视频系统梳理了主流LLM基准测试的含义、测试方法和注意事项。
公告





