小米打败阿里?开源视觉大模型新王者!
发表于|更新于|大语言模型
兄弟们!小米这波真的跟风。。哦,不是,杀疯了 —— MiMo-VL 多模态大模型开源仓库直接甩出王炸!7B 参数的 SFT 和 RL 双模型全开源,Huggingface 和 ModelScope 一键下载,连技术报告都把四阶段预训练细节、2.4T 数据投喂逻辑全摊开了!实测数据直接看呆
相关推荐
2025-10-31
混元世界模型!免费在线随便玩!
想体验一把用几张照片就能秒变 3D 模型的黑科技吗?快来试试 HunyuanWorld-Mirror!也就是网上说的 HunyuanWorld 1.1了。这模型可厉害了,不管你给几张角度不同的图片,它唰一下就能生成点云、深度图、相机参数这些 3D 数据,甚至还能直接渲染出新视角的画面… 访问入口

2025-04-07
文心4.5测评报告:编程能力很拉胯!
这两天测评了Llama-4,感觉不尽如人意。今天打算用同一套测试用例测试下刚出来没多久的文心4.5和推理模型X1, 先测评4.5吧… 访问入口
2025-12-17
Wan 2.6:国内版Sora 2?生成长叙事多镜头带声音视频!
阿里推出wan 2.6,可以通过参考视频生成带声音的视频,生成长叙事多镜头视频等 访问入口

2025-01-17
Minimax 01:国产最新开源大模型测评.mp4
支持400万Tokens的免费开源够产大语言模型啊!今天我们要测评下的是minimax最新的01模型,这是个MoE模型,也就是Mixture of Expert,混个专家模型了,大家不清楚的可以翻下我以前视频有专门介绍这些概念的。然后它的总参数是456亿,最牛逼的是他一个开源模型竟然支持400万个tokens,这基本就是其他模型的20到32倍啊。不过今天我们不会测试这么大的tokens输入,我们还是循例问下一些其他大语言模型经常做错的题目… 访问入口

2025-03-26
DeepSeek V3.1 测评:最强非推理大语言模型!
DeepSeek 推迟最新非推理模型 DeepSeek v3.1升级,大幅度提升数学和编程等能力,今天我们来测评下它的能力去到哪… 访问入口
2025-09-09
Qwen3最新王者出炉!吊打一众海内外大模型!
万亿参数的通义千问 Qwen3 Max Preview 来了,作为通义千问系列目前的最强王者,在众多主流权威基准测试中,实力碾压对手,成绩相当耀眼。无论是 SuperGPQA 通用知识测试,还是 AIME25 数学推理、LiveCodeBench v6 编程能力评测,Qwen3-Max-Preview 都能一骑绝尘,号称吊打海外 Claude Opus 4 和我海内Kimi K2, DeepSeek V3.1等强劲对手 访问入口
公告





