nari-lab dia:能生成笑声咳嗽的开源TTS工具!
发表于|更新于|音频工具
今天的AI日报分享了可以生成笑声和咳嗽等的开源TTS项目DIA, 这么牛,肯定得去demo下了。 我们先来到github对应的repo看下,它在hugging face有提供托管,一会可以上去玩下。 如果想自己部署的,看快速入门这里,没有几步的。好,我们去到hugging face上…
相关推荐
2026-01-09
Chatterbox:开源版 11 Labs!支持中文情绪语气!
我们都知道海外的 ElevenLabs 很牛逼,是 AI 语音方面的翘楚,但可惜价格不菲。今天大家走运了,刚淘到个开源免费的平替,新出来的,叫做 … 访问入口
2026-01-27
开源最强声音克隆!Qwen 3 TTS!
Qwen3-TTS是通义千问(Qwen)开源的最强声音克隆TTS(文本转语音)系统。你只需提供几秒钟的语音样本,Qwen3-TTS就能精准克隆该声音,并用这个声音朗读任意文本。合成效果极其自然——包括语调、停顿、情感表达都接近真人。与其他声音克隆方案相比,Qwen3-TTS在中文语音合成方面表现尤为出色。完全开源免费,支持本地部署。本视频详细介绍安装使用方法和效果测评。 访问入口
2025-09-09
告别手搓SQL语句!自然语言分析数据库!
这款WrenAI 的 开源AI工具,能让你用日常用语轻松查询任意数据库,瞬间生成精准 SQL、可视化图表和 AI 分析报告,哪怕是零基础也能秒变数据分析师… 访问入口

2025-11-24
Gemini CLI终于可以用Gemini 3.0了!
Gemini CLI 也可以免费用 Gemini 3 了。 兄弟们,着实炸裂啊!想用上这个最新的超级模型,其实操作不复杂:你得先把手上的 Gemini CLI 更新到最新版,然后可能需要去排个等待名单。不过据说排队挺快的。一旦搞定,你就能在咱们平时用的命令行里直接让最厉害的 Gemini 3 来帮你干活了!而且这次升级不光是模型牛… 访问入口 文档入口

2026-06-07
Arena AI:全球顶尖模型不限量免费用!
本视频汇总了当前所有可以”不限量免费使用”全球顶尖AI模型的方法和平台。涵盖了多个渠道——部分平台提供不限量免费API、一些开源方案让你本地免费运行、还有一些聚合平台通过交叉补贴提供免费额度。无论你想要免费使用GPT-4、Claude、Gemini还是国产顶级模型,这里都有对应的方案。视频详细介绍了每种方法的优缺点和获取方式。 访问入口

2026-06-07
Agnes AI:图片和视频生成自由!小龙虾接入教学!
本视频教你如何在小龙虾(Clawdbot/OpenClaw)AI Agent平台中接入AI图片和视频生成能力。通过配置文生图/文生视频的API接口,你可以让AI Agent直接根据对话内容生成图片和视频,实现真正的”AI图片和视频生成自由”。视频详细介绍了:支持的生成模型、API配置方法、提示词优化技巧和实际使用案例。 访问入口
公告






