新闻详情

新闻详情

首页 / 资讯中心 / 详情

用 stable-diffusion.cpp 一次跑通 Chroma1-Radiance 文生图:权重、命令与排错

发布时间:2026/9/29 6:02:37来源:尧图网络
用 stable-diffusion.cpp 一次跑通 Chroma1-Radiance 文生图:权重、命令与排错
用 stable-diffusion.cpp 一次跑通 Chroma1-Radiance 文生图权重、命令与排错【免费下载链接】stable-diffusion.cppDiffusion model(SD,Flux,Wan,Qwen Image,Z-Image,...) inference in pure C/C项目地址: https://gitcode.com/GitHub_Trending/st/stable-diffusion.cpp这份实战只做一件事在纯 C/C 推理框架 stable-diffusion.cpp 里把 Chroma1-Radiance 文生图模型的权重准备好用一条命令跑起来得到一张举着 chroma radiance cpp 标语牌的猫。跑通之后你就有了一条可以照搬到任意 Linux 机器的 Radiance 蒸馏推理链路也能自行排查结构与参数问题。准备篇权重下载清单与环境先用一句话交代这个模型Chroma1-Radiance 是 Chroma 家族中走 Radiance 蒸馏路线的文生图模型属于 Flux 一脉但直接在像素域工作结构上区别于标准 Chroma v4.0所以权重要单独准备。你需要拿到的只有两类文件扩散模型本体想自行转换 GGUF 的从lodestones/Chroma1-Radiance仓库取原始 safetensors想直接跑的从silveroxides/Chroma1-Radiance-GGUF仓库取预转换 GGUF示例文件名Chroma1-Radiance-v0.4-Q8_0.gguf。文本编码器flux_text_encoders 仓库的t5xxl_fp16.safetensors。为什么只挂 t5xxl 就够了因为在 src/pipeline/model_builders.cpp 里一旦检测到 Chroma 权重conditioner 就按false, 1, false参数构建T5CLIPEmbedder默认不启用掩码、mask_pad 为 1不需要额外 CLIP 权重。下载清单与 docs/chroma_radiance.md 一致内网环境请提前把文件放进本地 models 目录。实战篇可直接运行的完整命令两个权重就位后执行下面这条命令Linux/macOS 写法文档里的.\bin\Release\sd-cli.exe是 Windows 构建产物请以本地构建目录为准./build/bin/sd-cli --diffusion-model models/diffusion_models/Chroma1-Radiance-v0.4-Q8_0.gguf --t5xxl models/clip/t5xxl_fp16.safetensors -p a lovely cat holding a sign says chroma radiance cpp --cfg-scale 4.0 --sampling-method euler -v参数说明示例取值--diffusion-model扩散模型本体的加载位置GGUF 与 safetensors 均可Chroma1-Radiance-v0.4-Q8_0.gguf--t5xxlT5-XXL 文本编码器权重位置该模型唯一需要的文本编码器t5xxl_fp16.safetensors-p/--prompt想生成的画面内容Radiance 直接据此出图a lovely cat holding a sign says chroma radiance cpp--cfg-scale引导强度示例取 4.0Flux 系一般落在 1~4 区间4.0--sampling-method去噪求解器与 4.0 搭配推荐 eulereuler-v输出 LOG_VERBOSE 级细节是核对结构识别是否生效的必备开关—用日志确认配置被正确识别这一步别省。打开-v后有三行输出可以逐条核对自动检测结果using x0 prediction权重中扫到__x0__标识x0 预测已开启src/model/diffusion/flux.hppactual radiance patch size: N从img_in_patch.weight读到的真实 patch 尺寸using fake x2 patch size真实 patch 只有配置值一半时x2 缩放路径被激活src/model/diffusion/flux.hpp。跑通之后输出应该是类似这样的图深入篇原理速览如果想进一步理解 Radiance 和普通 Flux 到底差在哪看 src/model/diffusion/flux.hpp 的forward_chroma_radiance就够了forward()在 L1366-L1396 按版本分流。结构差异集中在四点像素空间输入。版本为VERSION_CHROMA_RADIANCE时in_channels取 3、patch_size取 16L79-L81进网络的就是像素张量本身而非 latent示例命令里没有--vae也是这个原因。Patch 化与可选缩放。先按 patch_size 做 padding 与 patchify若fake_patch_size_x2生效先双线性插值缩小一半再进img_in_patch卷积L1219-L1224源码注释说明这比最近邻插值更稳定。NeRF 解码器。Transformer 主干forward_orig算完后输出 token 与原始 patch 像素经带 DCT 频域条件的NerfEmbedder融合再穿过 4 层NerfGLUBlockunpatchify 后由末层卷积出图L1235-L1261。解码器规模由ChromaRadianceConfigL22-L29默认值决定nerf_hidden_size64、nerf_depth4、nerf_max_freqs8构建期据此生成nerf_blocks.*与nerf_final_layer_conv子图L972-L987。x0 预测。权重含__x0__时输出再经_apply_x0_residual按(noisy - predicted) / timesteps还原预测目标L1184-L1191。调优与排错篇进阶参数与常见问题进阶参数 model-argsRadiance 的文档没有单列 model-args但姊妹篇 docs/chroma.md 暴露了 Chroma 家族的文本编码器参数本模型同样适用chroma_use_t5_maskfalseT5 是否使用注意力掩码chroma_t5_mask_pad掩码 padding 大小传统 Chroma 示例里的--model-args chroma_use_dit_maskfalse --clip-on-cpu可参照迁移。这些参数在 src/conditioning/conditioner.hpp 的parse_key_value_args中解析布尔走parse_strict_bool、整数走parse_strict_int不合规则直接丢弃并打印ignoring invalid Chroma T5 model arg警告。所以务必严格写成keyvalue值类型也要对。量化格式选择两条路。省事路线直接拿 silveroxides 的预转换 GGUF如示例中的 Q8_0跳过转换步骤。自己来路线参照 docs/chroma.md 的-M convert流程输入 safetensors、--type q8_0即可产出同名规则的 Q8_0 GGUF输出文件名可自定义。现象 → 原因 → 处理提示词没生效、画面异常→--t5xxl没加载上日志里有IMPORTANT NOTICE: No text encoders provided, cannot process prompts!src/conditioning/conditioner.hpp→ 检查 t5xxl 权重路径。怀疑结构识别不对→ 没开 verbose → 加-v逐行核对using x0 prediction、actual radiance patch size。找不到可执行文件→ 照抄了文档路径 → 文档里的sd-cli.exe是 Windows 产物Linux 下请找本地构建输出目录里的sd-cli。Chroma1-Radiance 在 stable-diffusion.cpp 里的全部链路就是两份权重加一条命令剩下的结构适配都由源码自动完成。想再看标准 Chroma 与转换流程查 docs/chroma.md想补全 Flux 推理管线的整体图景查 docs/flux.md。【免费下载链接】stable-diffusion.cppDiffusion model(SD,Flux,Wan,Qwen Image,Z-Image,...) inference in pure C/C项目地址: https://gitcode.com/GitHub_Trending/st/stable-diffusion.cpp创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
网站建设高端定制企业官网
RELATED

相关资讯

更多精彩内容,欢迎继续阅读

较早相关资讯

最新相关资讯

GPU利用率低?PyTorch数据加载与预处理优化实战 2026/9/29 7:53:29

GPU利用率低?PyTorch数据加载与预处理优化实战

GPU利用率卡在40%上下,显卡风扇转得跟没转一样,训练一个batch要等半天——跑PyTorch训练的都会遇到这种“显卡罢工”的场面。多数人第一反应是加num_workers,结果往往只是从40%挪到55%,问题依旧。我这些年处理过不少这类性能排查&…

阅读更多 →
TensorFlow实战指南:从环境配置到模型部署的完整链路 2026/9/29 7:53:29

TensorFlow实战指南:从环境配置到模型部署的完整链路

打开TensorFlow官方文档的那一刻,我相信很多人和我一样——本来只是想快速跑通一个模型,结果面对版本号、CUDA、GPU驱动、环境变量这一堆名词,整整折腾了一个下午。2024年的深度学习框架圈子里,"TensorFlow是不是已经被PyTor…

阅读更多 →
银河麒麟高级服务器操作系统V10SP3-2403部署 Kubernetes 1.33.7+containerd + Calico 完整实战 2026/9/29 7:53:29

银河麒麟高级服务器操作系统V10SP3-2403部署 Kubernetes 1.33.7+containerd + Calico 完整实战

环境说明:本文基于银河麒麟高级服务器操作系统 V10 SP3 2403(x86_64)搭建 Kubernetes 集群,部署规模为 1 master 1 node。 组件版本: Kubernetes:v1.33.7containerd:containerd.io 1.6.33CNI&a…

阅读更多 →
NG-ZORRO Tabs 标签页组件实战指南:完整 API 解析与源码级原理剖析 2026/9/29 7:53:22

NG-ZORRO Tabs 标签页组件实战指南:完整 API 解析与源码级原理剖析

UI组件前端 【免费下载链接】ng-zorro-antd Angular UI Component Library based on Ant Design 项目地址: https://gitcode.com/gh_mirrors/ng/ng-zorro-antd 点击查看 免费下载 标签页(Tabs)是 NG-ZORRO 中最常用的导航类组件之一&#xf…

阅读更多 →
ARTEMIS:视觉语言模型驱动的Android移动端自动化智能体实战解析 2026/9/29 7:53:22

ARTEMIS:视觉语言模型驱动的Android移动端自动化智能体实战解析

做移动端自动化这块快十年了,我一直觉得有两件事特别拧巴:一是用例维护成本,UI一变,定位符全废;二是跨应用流程,比如“把相册里第一张图发给微信好友”,写起脚本来能让人加班到怀疑人生。直到看…

阅读更多 →
RFID智能柜的核心引擎:天线与读写器的选型之道 2026/9/29 7:52:56

RFID智能柜的核心引擎:天线与读写器的选型之道

在智能制造与数字化转型的浪潮中,RFID智能柜正以前所未有的速度渗透进各行各业——从医院手术室的高值耗材管理,到电力行业工器具的自动化盘点,从档案馆的“秒级定位”借阅,到企业固定资产的全生命周期追踪。然而,许多…

阅读更多 →

今日资讯

本周资讯

本月资讯

看完文章仍有疑问?

联系尧图顾问,获取一对一建站咨询

立即免费咨询 📞 400-888-8888
📞 ✉