ControlNet究竟是什么鬼?
发表于|更新于|学习
我们有玩过Stable DIffusionffusion的应该对这个不陌生,比如通过OpenPose可以控制我们生成图片人物的姿态。那么ControlNet究竟是怎么工作的呢?首先,我们得知道Stable Diffusion本身的工作方式就是…
相关推荐
2024-11-29
最新Stable Diffusion 3.5 Large Turbo
Stable Diffusion 3(SD3)是Stability AI推出的最新一代文生图模型,采用了全新的MMDiT(多模态扩散Transformer)架构。相比于SDXL,SD3在图像质量、提示词理解、文字渲染和面部生成方面都有质的飞跃。它支持多种分辨率输入,生成的图片在不同比例下都能保持高质量。SD3有多个版本(从8亿到80亿参数),适应从消费级GPU到企业级服务器的不同部署需求。本视频测评SD3的实际效果和性能表现。 访问入口
2024-11-29
怎么通俗的理解Diffusion model?
扩散模型(Diffusion Model)是当前AI图像和视频生成(如Stable Diffusion、Midjourney、DALL-E)背后的核心技术。通俗理解,扩散模型的原理可以这样想象:先用一张完整图片,逐步添加噪声直到完全变成随机噪点(前向过程),然后训练AI学会”逆向操作”——从纯噪点一步步去噪,最终还原出清晰图片(反向过程)。当模型学会了去噪,给它任意随机噪点就能生成全新的图片。本视频用最通俗的方式帮你理解这一复杂概念。
2026-01-06
Qwen image 2512:文生图开源王者出炉!2025最后一弹!
大家元旦快乐,2026之前最后一个视频了,就在刚刚,千问的qwen image2512发布,主要是提升了人物生成的真实感和更细腻的细节,在Elo benchmark勇夺开源模型冠军… 访问入口

2025-03-02
DeepSeek文生图:实现和工作原理!
免费DeepSeek文生图啊!我们知道DeepSeek本身不是一个多模态模型,也就是说模型本身是不支持图片等的输入和输出的。这么好的一个文本生成模型不能直接生成图片,着实有点可惜。但是也不是不可为,这里跟大家说个技巧,通过直接交deepseek生成一个文生图的提示词,然后叫它填写到一个可以url中,我们就可以生成图片了,这样我们就能结合deepseek强大的文本能力以及第三方免费的文生图能力了。 这里的url其实就是第三方的一个文生图服务,叫做pollination的免费AI工具,我们只需要在它提供url,事实上就是一个http的api,url上提供文生图提示词就能能生成图片了… DeepSeek访问入口 Pollinations访问入口

2025-03-02
Weights:免费训练自己的语音和图像模型
免费训练自己的语音和图片模型啊。今天快速分享一个刚淘到的一个叫做weights的AI工具,在上面我们可以免费使用各种lora创建图像和视频,还可以快速的训练自己的语音和图像模型,比如可以用刘德华的声音训练个刘德华的模型,然后用这个模型来生成刘德华唱张学友的歌等… 访问入口
2025-12-26
Turbo Diffusion:视频生成要逆天了!实时生成视频不是梦!
把视频生成速度速度提升上百倍!清华最新推出的这个TurboDiffusion真是逆天了!就以加速前后的Wan 2面模型为例,单块RTX 5090上,加速潜生成这个猫需要75分钟,加速后只需要38秒。我就问你炸裂不炸裂,牛逼不牛逼… 访问入口
公告





