DeepSeek R2泄露:联袂华为突破封锁!
发表于|更新于|编程工具
DeepSeek R2 遭泄露?当国产大模型之光碰上国产硬件之光,会碰出什么样的火花呢?我们知道R1出来有段时间了,最近通用版本V3.0也升级到v0324, 大家一直翘首以盼R2究竟什么时候出来,将会是什么样的一个配置…
相关推荐
2025-04-02
DeepSite:免费AI小应用编程工具
快速分享个刚淘到的免费AI工具,叫做deepsite,基于最新的deepseek 3.1,可以快速生成一些小工具小游戏的APP, deepseek 3.1的编程能力我之前已经测试过了,确实接近甚至超越claude 3.7的水平。 好废话不多说,赶紧去demo下… 访问入口

2024-12-28
DeepSeek V3:打败GPT4O的国产开源大模型
最新开源大语言模型王者出炉啊。国产开源模型DeepSeek v3发布,在各种benchbarks上超越llama3等一众大模型,更在编码领域打败Claude 3.5 sonnect和GPT 4o。循例,我们今天的任务就是快速对这种新模型做一次测评… 访问入口

2025-03-08
QwQ-32B测评报告:能打败DeepSeek r1吗?
阿里最新QwQ-32B推理模型测评报告啊,最终结果是否能打败DeepSeek r1呢?废话不多说,直接开测,先先选择好QwQ-32B模型,下面深度思考也确认打开… 访问入口

2025-02-08
DeepSeek是怎么做到的?
首先,我们看数据,V3训练用了2788K的GPU Hours,相当于一块GPU用了近300多年,而他们用了2000块GUP,所以用了越2个月时间就训练出来了。对比下LLama 3.1 405B, 它们用了近3100万个GPU Hours来训练,deepseek的11倍还多,同时还要考虑deepseek用的GPU肯定是没有人家老美的性能好的,这也就是为什么V3的训练花费比海外这些同等级别模型低几个数量级的原因,从而打破老美的算力霸权,也打破了顶尖大模型只能掌握在OpenAI和谷歌这些屯了大量卡的大公司的垄断… 官网入口

2025-03-26
DeepSeek V3.1 测评:最强非推理大语言模型!
DeepSeek 推迟最新非推理模型 DeepSeek v3.1升级,大幅度提升数学和编程等能力,今天我们来测评下它的能力去到哪… 访问入口

2025-02-10
DeepSeek Browser Use:OpenAI Deep Research免费平替
DeepSeek版Deep Research啊!上两天我才分享了个视频介绍OpenAI最新推出的Deep Research,可以自动搜索上百个网页来帮我们生成专业的报告,可惜需要价值200刀每月的Pro账号才能用。今天我想给大家介绍一个免费的使用方案,就是DeepSeek加我之前介绍过的Browser Use,如果大家不清楚Browser Use的,可以先去翻看下我这个视频。而DeepSeek呢,我们只需要用免费的蒸馏模型就能达到想要的效果…
公告





