Kimi K2.5 结果不是我要的!测评报告!
发表于|更新于|大语言模型
昨天被刚出来的Kimi k2.5给惊艳到了,特意做了个视频分享了它根据我博客录制的视频就能帮我完美复刻出一模一样的网站。今天打算搬出我们得那套测试用例,探一探它推理和编程能力的深浅…
相关推荐
2026-01-27
Qwen3-Max-Thinking吊打GPT 5.2?测评报告!
阿里发布千问旗舰推理模型 Qwen3-Max-Thinking,总参数超万亿。据说在 19 项权威基准测试中,其性能可媲美 GPT-5.2-Thinking、Claude-Opus-4.5 和 Gemini 3 Pro 等顶尖模型。如此牛逼,赶紧拿出我们的那套测试用测试下… 访问入口
2026-02-15
Kimi K2.5 集群!100智能体同时干活!
Kimi K2.5集群模式——让100个AI智能体同时并发工作!这是月之暗面推出的创新功能,可以将一个大型任务分解为100个子任务,由100个AI智能体同时处理,最后汇总结果。例如”分析1000份合同”这样的任务,原本需要很长时间,现在可以并发处理,速度提升近百倍。本视频介绍Kimi K2.5集群的配置方法和实际应用场景。 访问入口
2026-01-28
Kimi K2.5:国产模型新高度!录屏即可完美复刻网站!
Kimi K2.5是月之暗面(Moonshot)推出的最新大语言模型,其最大亮点是”录屏即可完美复刻网站”——你只需录下一段网站操作视频,Kimi K2.5就能分析录屏内容并自动生成对应的网站代码,实现”所见即所得”的网站复刻。这个能力在AI编程领域引起轰动,代表着多模态模型在代码生成方面的重要突破。本视频全面测评Kimi K2.5的这一核心功能。 访问入口
2025-11-03
AI编程王者回归!开源免费随便造!
码农兄弟们,还记得 Aider 吗?它可是最早一批、也是公认最强的 AI 编程智能体之一!它的核心能力在于能够直接理解和修改 Git 仓库中的代码文件,那叫一个专业又高效。不过,之前它一直是个命令行工具,对很多人来说可能有点门槛。好消息是,现在它带着 Aider Desk 杀回来了!这是一个超级好用的图形界面GUI版本,把 Aider 的强大能力一下子拉到了你的桌面上。你可以轻松管理多个项目,不用再跟复杂的命令行斗智斗勇,所有操作都变得直观简单,就连安装都是一键搞定,简直是懒人福音… 访问入口
2024-11-29
Hamming Prompt Optimizer:提示词工程优化器
Hamming是一款AI提示词工程优化工具,它能帮助你测试、优化和管理大语言模型的提示词(Prompt)。与手动反复调试提示词不同,Hamming提供了系统化的提示词测试平台:你可以批量测试不同的提示词变体,对比它们在各种输入下的表现,分析失败案例,并自动生成优化建议。对于需要构建稳定可靠AI应用的开发者来说,Hamming大大提升了提示词开发的效率和质量。它还支持多种LLM提供商(OpenAI、Anthropic等),可以一站式管理所有提示词。 访问入口
2026-01-20
longcat:这个模型编程就是个笑话!美团最新模型实测!
标题用”这个模型编程就是个笑话”来评价美团最新AI模型的编程能力。本视频通过实际编程测试,展示该模型在编写代码时出现的各种问题——逻辑错误、语法错误、理解偏差等。虽然有些夸张,但确实反映出当前某些AI模型在编程能力上的局限性。不过也需要理性看待——没有完美的模型,每个模型都有自己的优势和短板。 访问入口
公告





