微软最新GraphRAG和普通RAG有什么区别?
发表于|更新于|大语言模型
GraphRAG(基于图结构的检索增强生成)是微软推出的一项创新RAG技术。与传统的RAG(向量检索+生成)不同,GraphRAG在检索阶段不仅考虑文本的语义相似度,还利用了知识图谱中的实体关系和结构信息。这意味着GraphRAG能够理解文档中概念的层级关系和连接路径——当用户问”苹果公司的创始人是谁”时,GraphRAG能准确关联”苹果→史蒂夫·乔布斯”的关系路径,而不是仅仅找文本相似片段。本视频深入浅出地对比两种技术的原理和适用场景。
相关推荐

2024-12-12
Gemini 2.0:6大原生多模态炸裂新功能
Gemini 2.0 原生多模态模型炸裂功能初体验啊!它在benchmarks上有多炸裂我这就不说了,这里是迫不及待的想和大家分享它的几个炸裂功能。首先,我们进入到谷歌ai studio上进行gemini 2.0的访问,免费的credits足够我们用的了。先试下第一个功能实时语音,Hi Gemini, how are you,(Hi,I am doing great , thanks for asking, how can I help you today)can you speak faster please, (sure , …..), can you speak in a way that you are so quiet and whispering?(回答: ….)牛逼吧?第二个功能,视频对话。can you let me know what i am holding now, and count number of items。(回答:。。。。)第三个功能,屏幕分享。what do you see in my screen,( i can se…),ok , wh...
2024-11-29
OmniVision: 可本地跑的多模态大模型
OmniVision是一款由Nexa AI开发的多模态大语言模型,它能够在本地设备上运行,支持同时处理文本、图像和视频输入。与云端多模态模型不同,OmniVision针对移动设备和边缘计算进行了优化,可以在手机上流畅运行。它能够理解图片内容、分析视频帧、回答关于视觉输入的问题。本视频介绍OmniVision的安装部署和实际使用体验。 官方博客
2024-11-29
八款最新大模型,千问支持上传视频
2024年底迎来了一波大模型更新热潮!本视频汇总了当时发布的八款最新大语言模型,其中最引人注目的是通义千问新增了视频上传功能——用户可以直接上传视频文件让AI进行分析和理解,这标志着多模态能力迈上新台阶。除此之外还涵盖了其他几款新模型的性能评测和特点对比,帮助你在众多AI模型中找到最适合的那一款。无论你是AI开发者还是普通用户,了解这些最新模型的能力边界都至关重要。
2024-11-29
Claude Computer Use API - 大模型如真人操纵电脑
Claude Computer Use API是Anthropic为Claude模型推出的革命性功能,它让AI能够像真人一样操控电脑屏幕——移动鼠标、点击按钮、输入文字、滚动页面、浏览文件等。与传统的API调用不同,Computer Use API让Claude能”看”到屏幕截图,理解界面布局,然后自主执行操作。这意味着Claude可以帮你完成填写表单、查找文件、操作软件等一系列需要图形界面交互的任务,真正实现了”AI替你用电脑”。
2024-11-29
Nexa AI OmniVision:可本地跑多模态大模型
Nexa AI OmniVision是一款可以在本地设备上运行的多模态大语言模型。与依赖云端API的多模态模型(如GPT-4V)不同,OmniVision经过优化可以在消费级硬件上运行,无需联网即可处理文本、图像和视频输入。它能够理解图片内容、回答关于视觉输入的问题,适合隐私敏感场景和离线环境使用。本视频介绍OmniVision的本地部署方法、性能表现和实际使用体验。 官方博客
2024-11-29
Moshi:实时语音通话大语言模型
Moshi是由法国AI研究机构Kyutai开发的实时语音对话大语言模型,被广泛认为是”语音版GPT-4o”。与传统的语音助手不同,Moshi具备真正的实时语音对话能力——它能同时理解和生成语音,支持打断、语气感知、情感表达等自然对话特征。Moshi的延迟极低(约200ms),对话体验接近真人交流。Kyutai将Moshi完全开源,包括模型权重和训练代码,这对于语音AI领域来说是一个里程碑式的事件。 访问入口
公告






