Qwen image 2512:文生图开源王者出炉!2025最后一弹!
发表于|更新于|图像工具
大家元旦快乐,2026之前最后一个视频了,就在刚刚,千问的qwen image2512发布,主要是提升了人物生成的真实感和更细腻的细节,在Elo benchmark勇夺开源模型冠军…
相关推荐

2025-03-02
Weights:免费训练自己的语音和图像模型
免费训练自己的语音和图片模型啊。今天快速分享一个刚淘到的一个叫做weights的AI工具,在上面我们可以免费使用各种lora创建图像和视频,还可以快速的训练自己的语音和图像模型,比如可以用刘德华的声音训练个刘德华的模型,然后用这个模型来生成刘德华唱张学友的歌等… 访问入口

2025-03-02
DeepSeek文生图:实现和工作原理!
免费DeepSeek文生图啊!我们知道DeepSeek本身不是一个多模态模型,也就是说模型本身是不支持图片等的输入和输出的。这么好的一个文本生成模型不能直接生成图片,着实有点可惜。但是也不是不可为,这里跟大家说个技巧,通过直接交deepseek生成一个文生图的提示词,然后叫它填写到一个可以url中,我们就可以生成图片了,这样我们就能结合deepseek强大的文本能力以及第三方免费的文生图能力了。 这里的url其实就是第三方的一个文生图服务,叫做pollination的免费AI工具,我们只需要在它提供url,事实上就是一个http的api,url上提供文生图提示词就能能生成图片了… DeepSeek访问入口 Pollinations访问入口
2025-12-12
Titans:Transformer危险!Titans打破记忆瓶颈
Transformer危险了! 大家看了我今天的《AI早报》没有?头条就是“谷歌发Titans新架构破Transformer长上下文瓶颈”。为什么说它危险?因为它直击了我们现在用的所有AI模型的核心痛点!平时跟ChatGPT、Gemini聊天是不是总觉得它记性不太好?稍微聊长一点就“失忆”,让它读长文就崩溃? 这要怪现在主流的 Transformer 架构。它的核心要求是模型每处理一个新的字,就必须回头把前面所有字 挨个看一遍,并且计算它们之间所有复杂的关系。你可以想象一下,如果文本长度翻了一倍,它需要做的计算量和花的精力,可不是简单地翻倍…

2025-02-18
OmniParser v2:开源AI自动控制电脑完成任务
免费开源AI自动控制你的电脑执行你下达的任务啊。今天要介绍的是微软的OmniParser V2,其实大家如果还记得的话,我接个月前就介绍过OmniParser的v1版本了,这次的升级版本比v1快了60%,能理解更多的屏幕和浏览器上的元素,它的工作原理就是对电脑截屏,然后通过各种视觉大语言模来解析应该操作当前屏幕的哪个位置… Github入口

2025-02-17
知乎直答:满血版DeepSeek r1免费用
DeepSeek R1满血版免费用啊!我们知道国产之光DeepSeek r1火遍全球,奈何官方托管访问量过大及其他原因导致老是出现服务繁忙,自家部署的话有只能部署个蒸馏小参数版本。上个视频我们介绍了如何在AskManyAI上用上满血版的DeepSeek r1, 这一集要跟大家介绍在知乎上怎么用上,我们先去到官网,然后点击这里的知乎直答… 访问入口
2025-11-24
实锤了!谷歌Antigravity套壳Windsurf!
我这两天都在玩随着谷歌刚推出的 Gemini 3 一起出来的 Antigravity。有人说为什么这玩意儿和 VS Code 这么像,特别是和从 VS Code fork 出来的另外一个 IDE Windsurf 也太像了吧。其实大家说的没有错,这是怎么一回事呢,我来跟大家说道说道。 背后的故事其实挺有意思,甚至带着点硅谷圈内的“瓜”… 访问入口
公告






