Reasonix!Deepseek官方认可Harness!
发表于|更新于|编程工具
DeepSeek 官方文档正式收录 Reasonix 接入方案,释放生态布局关键信号,自研 Harness 开发者内测开启,8 月随 V4 Pro 上线。二者分层布局抢占编程智能体赛道,Reasonix 深度适配底层 API,超高缓存节省调用成本,自带动态纠错、双模型切换、MCP 拓展等能力,轻量化适合个人开发者;官方 Harness 底层深度优化,面向企业复杂项目,轻重搭配完善代码开发生态,对标 Claude Code、Codex 同类工具…
相关推荐

2026-05-27
Deepseek 原生 Codex 杀到!AI编程神器!
DeepSeek推出了原生Codex——一款对标OpenAI Codex的AI编程助手。与通过API接入的第三方方案不同,DeepSeek原生Codex深度整合了DeepSeek模型的能力,在代码理解、生成和调试方面更加高效。它支持类似Codex的Agent模式、TAB补全和自然语言交互。作为国产AI编程工具的重要里程碑,本视频全面测评DeepSeek原生Codex的能力和实际体验。 访问入口

2026-08-01
Deepseek V4 Flash最新测评!Claude Code版!
上期完成 DeepSeek V4 Flash 在 Codex 平台测评,本期统一拉满 High 思考深度接入 Claude Code 复测,用全套标准化用例横向对比模型真实表现: 基础指令、24 点运算、密码锁逻辑推理全部答对,仅十条顺序句子存在单句通顺度瑕疵 代码生成环节暴露统一痛点,所有大型开发任务耗时动辄数十分钟,判断是新模型上线调用高峰算力拥堵导致 自制桌面操作系统成品完整性不及 Codex 版本,太空射击游戏交互简陋体验一般 3D 赛车等待 44 分钟但画面与操控效果出色 无第三方库 Trello 看板 UI 清爽,增删拖动全功能无异常 两次跨工具测评输出水准稳定没有大幅波动,能兼顾低成本开发需求,但重度代码项目等待成本偏高。程序员、AI 开发智能体玩家可结合自身任务轻重按需选择使用。 访问入口

2026-08-22
Deepseek最新多模态模型测评报告!
万众期待的 Deepseek V4-Flash-Vision-Exp 识图专项测评来了!上期测完推理编程能力,本期专门实测它的图片解析实力,注意这款模型仅支持读取图片,并不能生成图像。 测试前记得将 Deepseek-Harness 升级至 0.1.1-rc2 最新版本,目前也仅有官方 Harness 适配该模型。本次准备了三张实测素材:JS 报错截图、大模型 SWEbench 评分图表、个人博客页面截图。 上传 JavaScript 报错图,模型精确定位未定义变量并给出修复方案;解析跑分图片,完整提取全部数据并整理成表格,解读出关键信息;博客截图转 HTML 代码,生成页面外观高度还原原图,仅次要菜单未开发。整体识图表现亮眼,那么在你心里这款多模态模型究竟打几分…… 访问入口

2026-05-27
Reasonix:Deepseek原生AI编程智能体!安装使用教程!
Reasonix是DeepSeek推出的原生AI编程智能体工具,深度整合了DeepSeek模型的编程能力。它提供了类似Claude Code和Codex的编程辅助功能——包括自然语言编程、代码生成、调试优化和项目管理。本视频提供Reasonix的详细安装和使用教程,帮助开发者快速上手这个DeepSeek原生的AI编程工具。 访问入口

2026-09-13
Deepseek V4.1 Flash 鹈鹕SVG测评报告!
本期视频把祖传测试用例升级到了 V2.2,其中第二、第三道题做了替换:原本的两道推理题换成「鹈鹕土星环骑自行车 SVG 测试」和「复合弓射箭 SVG 测试」,其余题目保持不变。这一集先用这两道新题试水,看看 DeepSeek 最新的 V4.1 Flash 表现如何。 第二题「鹈鹕土星环骑自行车 SVG 测试」出师不利。模型完全没有按照提示让鹈鹕沿着土星环骑行,看起来是对提示词里「土星环环形跑道」的理解出了问题。考虑到这是新题第一次测,我给了它第二次机会重新跑,结果依然不行——自行车踩到环道左右两侧时完全不懂得转弯,而是快要踩出环道的时候突然「闪现」回正确方向。不过值得一提的是,两轮测试里鹈鹕和自行车的结构都没有出现任何问题,画面本身是立得住的。 第三题「复合弓射箭 SVG 测试」同样暴露出三个明显问题:第一,拉弓时上下两个滑轮转动方向相同,但按真实复合弓的机械结构,上面滑轮逆时针时下面应该顺时针才对;第二,人物的两只手像麻花一样纠缠在一起,手部结构明显不对;第三,人物是直面屏幕,而不是面向靶子射击。 需要说明的是,本期只重测了升级后的第二、第三题,其他题目的分数继续沿用 V...

2026-09-08
Deepseek V4.1 测评报告!究竟有多能打?
Deepseek 全新内测 v4.1‑flash 中间版实测来了!模型标识为 deepseek‑v4.1‑flash‑expires‑on‑0910,直接搬出祖传全套测试用例,在 pi 环境把思考模式拉满开启测评。 第一题强约束指令生成测试,句子结尾全部满足 1‑10 格式,仅有第七句语句不通顺其余表现尚可。 第二题新版 24 点需要输出三组解法,三个答案全部正确。 第三题七位数密码锁推理也成功算出标准答案。 来到编程能力测试,第四题精美浏览器操作系统出现桌面空白,推测背景图加载失败,弹窗与 Dock 栏功能正常,但太空射击游戏直接报错无法运行。 第五题 3D 赛车游戏完成度很高各项功能运行正常。 第六题零第三方库 Trello 看板界面中规中矩,列表、卡片的增删改拖拽全部可以正常使用。 整套测评下来浏览器操作系统项目拖了后腿,否则可以拿到更高分数,不过作为 flash 版本整体响应速度十分出众,大家对这个模型有什么想法欢迎评论区留言。 访问入口
公告






