从头写ChatGPT!手把手实现教学!
发表于|更新于|大语言模型
兄弟们,手把手教你从头打造自己的ChatGPT!你是不是也好奇,那些像ChatGPT一样聪明的AI,到底是怎么跑起来的?AI大神卡帕西现在有个叫“Nanochat”的项目,直接把你这个好奇心满足了!它玩的就是一个“少即是多”,所有代码都清清楚楚地摆在你面前,让你从头到尾都能看明白AI是怎么炼成的…
相关推荐

2025-02-25
腾讯元宝DeepSeek r1:不是满血版?
这两天分享了不同平台接入的deepseek r1,避开官方deepseek访问经常服务不可用的问题,但是用起来总感觉不顺手,比如知乎接入的太卡顿,AskManyAI界面又太杂,今天我们看下腾讯元宝的这个介入效果如何… 访问入口
2025-11-24
手动RAG已死!凶手是谷歌!
这两天都在谈微调和RAG,其实一个好的RAG搭建起来还是需要点技术的,比如你首先要去对文档分片,然后要找到好的word embeddings词向量数据库来将你文档分片进行向量化,好进行检索。 然而,正是这些对分片策略、向量模型选择以及高昂数据库运维的持续投入,让许多希望快速部署知识问答系统的开发者望而却步。Google 文件搜索 API 的推出,正是为了终结这种复杂性。这项集成在 Gemini API 中的托管式 RAG 解决方案,将所有繁琐的底层工程——包括智能分块、高性能向量嵌入和索引管理——全部自动化封装,让您无需再为此耗费精力。它不仅提供了企业级的 RAG 能力,更以颠覆性的成本结构改变了游戏规则:文档存储完全免费,您只需为计算嵌入和模型使用检索到的上下文付费,极大地降低了应用的边际成本…展开更多 文档入口
2025-05-03
文心Turbo 4.5测评:效果炸裂!
最近百度文心发布了最新的4.5 Turbo和推理模型x1 turbo,据说performance都有很大提升,这一集准备先测评下通用的4.5 turbo,下一集再测评下x1 turbo。废话不多说,我们赶紧去测评下… 访问入口
2025-04-21
Gemini Code Assist:免费用Gemin 2.5 Pro!
Genmini Code Assist升级免费使用上顶尖Gemini 2.5 Pro模型啊!我之前就跟大家分享过Gemini 2.5 Pro的测评,编码能力和Claude 3.7已经到了同一个水平。值得庆幸的是,Gemini Code Assist的这次更新是免费的,提供了聊天对话框并对你在写的代码进行感知,自动进行代码补全,并根据需要生成完整的函数和文件,每天给我们提供6千次代码相关的请求,240次的聊天请求…
2025-05-03
小米MiMo全网首评:这个模型两极分化!
关键代码123456789101112131415161718from transformers import AutoTokenizer, AutoModelForCausalLMtokenizer = AutoTokenizer.from_pretrained("XiaomiMiMo/MiMo-7B-RL")model = AutoModelForCausalLM.from_pretrained("XiaomiMiMo/MiMo-7B-RL", device_map="auto", torch_dtype="auto")messages = [ {"role": "user", "content": "如果晾干5件衬衫需要4小时,那么晾干20件衬衫需要多久?"},]inputs = tokenizer.apply_chat_template(messages, tokenize=Tru...

2025-01-31
Qwen 2.5-vl + Browser Use:打造本地Operator
通义千问版Operator啊!我们知道OpenAI推出的Operator震撼全球,可以像真人般操作浏览器去完成不同的任务。今天我们说下怎么用通义千问最新推出的开源免费的Qwen2.5-VL视觉大模型加上我们之前分享过的Browser Use来搭建本地跑的Operator… “Qwen2.5-vl API Server” github 入口 “Browser Use web-ui” github 入口
公告





