扩散生图
🕒 阅读时间:约 13 分钟
📅 2026-03 深度精选
Stable Diffusion 3.5 Large 扩散生图模型:MMDiT 架构与 ComfyUI 工作流实操
Stability AI 发布的 SD 3.5 Large 拥有 80 亿参数,画质细节与排版提示词遵循度大幅飞跃。本文详解其多模态 Diffusion Transformer 架构及 ComfyUI 实战配置。
🎨 一、SD 3.5 Large 与 MMDiT 架构解析
Stable Diffusion 3.5 Large 采用了多模态扩散变压器(MMDiT, Multimodal Diffusion Transformer)。文本嵌入与图像潜变量使用独立的 Transformer 权重处理并在注意力层双向交叉,极大幅度提升了复杂构图与英文字体渲染的准确度。
⚡ 二、镜像拉取与 ComfyUI 目录归档
export HF_ENDPOINT="https://hf-mirror.net"
COMFY_DIR="/data/ComfyUI"
# 下载 SD 3.5 Large 权重 (约 16GB)
huggingface-cli download stabilityai/stable-diffusion-3.5-large sd3.5_large.safetensors \
--local-dir "$COMFY_DIR/models/checkpoints" \
--local-dir-use-symlinks False
# 下载专用文本编码器 (CLIP G / CLIP L / T5XXL)
huggingface-cli download stabilityai/stable-diffusion-3.5-large text_encoders/t5xxl_fp8_e4m3fn.safetensors \
--local-dir "$COMFY_DIR/models/clip" \
--local-dir-use-symlinks False