运行大模型要多大GPU?一分钟教会你!
发表于|更新于|大语言模型
经常有朋友问一个问题,怎么快速估算一个大语言模型究竟需要多大的 GPU 才能跑起来?其实这事儿很简单,记住个公式就行。大模型推理的显存主要靠模型参数和占其 20% 左右的 自注意力 KV Cache,通用估算公式就是推理显存 = 模型参数量 × 精度字节数 ×1.2,多乘的 0.2 就是给 KV Cache留的空间…
相关推荐
2025-12-25
智普GLM 4.7!要做国内版Claude?
智谱GLM-4.7以”要做国内版Claude”为目标,在对话质量、安全性、代码能力和多轮交互方面进行了针对性优化。本视频对比测试GLM-4.7与Claude在各维度上的表现差异。虽然在某些方面还有差距,但GLM-4.7在中文场景和安全性方面展现出了独特的优势。对于需要在合规环境下使用AI的国内用户来说,GLM-4.7是一个非常值得关注的选择。 访问入口
2026-04-08
即梦一键CLI化!小龙虾直接用!
即梦一键CLI化是一款值得体验的AI产品,本文带你了解它的主要功能和适用场景。

2025-03-01
Claude3.7 + Trae:最强AI编程组合?
Claude 3.7 Sonnet免费用啊!我昨天分享了个视频对全球首个混合推理模型Claude 3.7进行了测评,同一套测试用例打败了DeepSeek r1。可惜官网的免费额度有限。今天我们看一个可以完全免费用的方法,那就是字节的Trae这个AI编程IDE了… 访问入口
2025-11-25
Claude夺回王座!同时解决MCP难题!
前两天我们分享的谷歌 Gemini 3才大杀四方!今天 Anthropic 就祭出 Claude Opus 4.5 来夺回AI编程老大的皇冠。它不仅是 Claude 系列的又一次飞跃,更凭借其在多项关键基准测试中的卓越表现,一举登上编程、智能体和计算机使用(也就是computer use)能力领域的巅峰。Opus 4.5 在业界公认难度极高的 Swebench Verified 编程基准测试中,以超过 80% 的高分领跑,并在 OSWorld 和 Agentic Tool Use 等测试中同样位居榜首,充分证明了其在复杂任务执行、代码自动修复和系统级操作方面的超凡实力…展开更多 访问入口

2025-02-08
DeepSeek是怎么做到的?
首先,我们看数据,V3训练用了2788K的GPU Hours,相当于一块GPU用了近300多年,而他们用了2000块GUP,所以用了越2个月时间就训练出来了。对比下LLama 3.1 405B, 它们用了近3100万个GPU Hours来训练,deepseek的11倍还多,同时还要考虑deepseek用的GPU肯定是没有人家老美的性能好的,这也就是为什么V3的训练花费比海外这些同等级别模型低几个数量级的原因,从而打破老美的算力霸权,也打破了顶尖大模型只能掌握在OpenAI和谷歌这些屯了大量卡的大公司的垄断… 官网入口

2025-01-16
Immersive Translate:免费一键翻译网页AI
通过AI免费一键翻译网页啊!大语言模型出来后,各种应用场景都有不错的落地app,但我一直没有找到一款免费的可以帮我翻译整个网页的好的AI工具,理论上大语言模型应该是最适合做地道翻译的… 官网入口
公告





