AI今日新闻 · 2026-08-06
AI News

今日AI新闻精选

每日精选 · 人工筛选 · 拒绝算法推荐

2026-08-06

01

阿里 Qwen-Image-3.0 上线,双版 API 开放,文生图 0.18 元 / 张起,Arena 榜单国内第一

阿里千问 Qwen-Image-3.0 上线千问AI平台,开放 Pro 与 Standard 双版 API,文生图 0.18 元/张。指令输入最高 4.5k token,一次生成试卷、分镜、UI 等复杂版面,文字渲染达 10px,支持 12 种语言,Arena 文生图榜单位列国内第一、全球第二。

展开 ∨
zx.sina.cn
02

字节发布 SeedRealtime 音视频全双工大模型,已全量上线豆包 App

字节跳动 Seed 团队发布原生音视频全双工大模型 SeedRealtime,已在豆包 App 全量上线。采用统一端到端架构,原生融合音频、视频与文本三种模态,实现边看、边听、边说的实时交互,支持音视频联合理解、主动提醒与自然接话,端到端评测显示对话节奏问题较级联模型减少约一半。

展开 ∨
t.cj.sina.com.cn
03

马斯克官宣下周推 1.5T 参数 Grok4.6,3-4 周上线 2.1T 更强 Grok4.7

马斯克宣布 xAI 将于下周发布 1.5 万亿参数(1.5T)的 Grok 4.6,并在 3-4 周后上线 2.1 万亿参数(2.1T)的 Grok 4.7。Grok 4.6 将在监督微调与强化学习上显著改进,Grok 4.7 各方面更强但服务速度略慢、token 使用效率更高。

展开 ∨
t.cj.sina.com.cn
04

秘塔接入 MiniMax H3 视频模型,768P 仅 0.09 元 / 秒,免本地部署

秘塔接入 MiniMax 开源的 H3 全模态视频生成模型,支持 768P 分辨率按秒计费,无需本地部署即可调用。H3 统一处理文本、图像、视频、声音多模态上下文,输出原生双声道音视频,最高支持 15 秒、2K 分辨率,并已获 ComfyUI 适配。

展开 ∨
www.qbitai.com
05

兔展推出 RabbitVis,支持图层级 AI 生图编辑,解决传统图片不可修改痛点

兔展基于自研 UniWorld-Design 视觉大模型推出图层级 AI 设计工具 RabbitVis,解决传统 AI 生图一次成型、难以修改的痛点。支持生成 RGBA 透明底素材、将完整图像拆解为可编辑图层,并通过自然语言调整版式与文字,生成、编辑、排版、协作一站式完成。

展开 ∨
www.qbitai.com
06

AI 编程 Agent 仅 10 小时开发类 CUDA 适配软件,推理市场 CUDA 壁垒开始松动

AI 初创公司 Infinity 用自研编程 Agent 仅 10 小时为 d-Matrix 搭建出类 CUDA 软件,自动生成 GPU Kernel、测试并优化代码。分析认为训练侧 CUDA 壁垒仍稳固,但推理侧软件可跨芯片运行、客户更看重成本,CUDA 锁定效应开始松动。

展开 ∨
www.qbitai.com