最新Stable Diffusion 3.5 Large Turbo
发表于|更新于|学习
Stable Diffusion 3(SD3)是Stability AI推出的最新一代文生图模型,采用了全新的MMDiT(多模态扩散Transformer)架构。相比于SDXL,SD3在图像质量、提示词理解、文字渲染和面部生成方面都有质的飞跃。它支持多种分辨率输入,生成的图片在不同比例下都能保持高质量。SD3有多个版本(从8亿到80亿参数),适应从消费级GPU到企业级服务器的不同部署需求。本视频测评SD3的实际效果和性能表现。
相关推荐
2024-11-29
CLIP:怎么评判文生图质量的好坏?
CLIP(Contrastive Language-Image Pre-training)是OpenAI开发的跨模态模型,它能够将文本和图片映射到同一个向量空间,从而衡量文本描述与图片内容的匹配程度。在文生图领域,CLIP常被用作自动评估工具——当AI生成一张图片后,可以用CLIP计算”提示词”与”生成图片”之间的相似度分数,以此评判文生图的质量和一致性。CLIP打分的优点在于速度快、可重复,不需要人工评价。但它的局限性也同样明显:CLIP分数高并不一定代表人类觉得好,因为审美、创意、情感等主观因素很难被量化。本视频带你全面了解CLIP的原理及其在文生图评估中的正确使用方式。
2024-11-29
怎么通俗的理解Diffusion model?
扩散模型(Diffusion Model)是当前AI图像和视频生成(如Stable Diffusion、Midjourney、DALL-E)背后的核心技术。通俗理解,扩散模型的原理可以这样想象:先用一张完整图片,逐步添加噪声直到完全变成随机噪点(前向过程),然后训练AI学会”逆向操作”——从纯噪点一步步去噪,最终还原出清晰图片(反向过程)。当模型学会了去噪,给它任意随机噪点就能生成全新的图片。本视频用最通俗的方式帮你理解这一复杂概念。

2025-03-08
ControlNet究竟是什么鬼?
我们有玩过Stable DIffusionffusion的应该对这个不陌生,比如通过OpenPose可以控制我们生成图片人物的姿态。那么ControlNet究竟是怎么工作的呢?首先,我们得知道Stable Diffusion本身的工作方式就是…

2024-12-10
Sora:三大独有炸裂功能!
Sora独有功能快速体验!早上的视频跟大家分享了OpnAI最新发布的视频生成工具Sora,并了解了它的使用界面。 这一集视频准备快速给大家介绍下Sora与其他视频生成工具不同的独特功能。 第一个是remix合成,可以通过指令修改已有视频,比如叫他把这个视频的房子变成中世纪的房子。 第二个就是blend混合功能,提供两个视频,然后将它们混合在一起,大家看下这个别人做的比较好的例子,将城堡和两人跑步的视频混合起来。 第三个就是storyboard故事板功能,通过在时间线中的不同时间描述你的故事,然后就能生成很平滑过度的完成故事,比如第一个时间点描述一只鹤在小溪中左顾右盼,第二个时间点描述这只鹤低头喝水,就能产生这样的效果。 好,今天分享就到这,欢迎点赞关注分享! 访问入口
2024-11-29
Forge UI:Stable Diffusion最新免费客户端
Forge UI是Stable Diffusion的一款现代化免费客户端,专为追求高性能和丰富功能的用户设计。相比于Automatic1111的WebUI,Forge UI在内存优化、生成速度和功能扩展方面都有显著提升。它支持最新的SDXL、SD3和FLUX模型,提供了更清晰的界面布局、更快的图像生成速度和更低的显存占用。对于Stable Diffusion的进阶用户来说,Forge UI是一个值得尝试的客户端选择。 访问入口
2024-11-29
Freepik:顶尖模型Flux免费用
Freepik(知名的免费图库网站)现在集成了顶尖的Flux AI模型,让用户可以在Freepik平台上免费使用Flux生成图片。你只需在Freepik的AI图片生成器中输入提示词,选择Flux模型,就能生成高质量的图片。Freepik的免费账户每天提供一定的生成额度,对于需要大量生成图片的用户来说是非常划算的选择。本视频介绍如何在Freepik上使用Flux模型,以及与其他平台的对比。 访问入口
公告





