新闻详情

新闻详情

首页 / 资讯中心 / 详情

baoyu-image-gen 的 DashScope 提供方全解析:Qwen-Image 家族、Wan 2.7 尺寸规则与引用图机制

发布时间:2026/9/20 23:51:44来源:尧图网络
baoyu-image-gen 的 DashScope 提供方全解析:Qwen-Image 家族、Wan 2.7 尺寸规则与引用图机制
baoyu-image-gen 的 DashScope 提供方全解析Qwen-Image 家族、Wan 2.7 尺寸规则与引用图机制【免费下载链接】baoyu-skills项目地址: https://gitcode.com/gh_mirrors/ba/baoyu-skills本篇技术指南围绕 baoyu-image-gen 技能中的 DashScope阿里通义万象提供方展开完整梳理其四大模型家族qwen-image-2.0*、固定尺寸 Qwen、wan2.7-image*、Legacy、尺寸解析与校验规则、--ref引用图支持边界以及n1计费保护机制并结合仓库源码与测试用例给出底层实现依据。读完本文你将掌握在 baoyu-image-gen 中正确选择 DashScope 模型、配置--size/--ar/--quality并规避分辨率与计费陷阱的完整实战能力。何时需要阅读这份 DashScope 指南baoyu-image-gen 的 SKILL.md 只给出默认模型而 dashscope.md 负责提供该提供方的完整行为细节。当用户出现以下任一情况时应读取本指南在命令行中显式选择--provider dashscope在 EXTEND.md 中配置default_model.dashscope提出与 Qwen-Image 相关的能力诉求如自定义比例、中文/英文文字排版、引用图编辑。从 SKILL.md 的提供方清单可见DashScope 的核心差异化价值在于Qwen-Image 家族 自定义尺寸 中英文文字渲染这也是本文反复强调的选型主线。模型家族四条能力分界线源码 providers/dashscope.ts 用DashScopeModelFamily类型将模型划分为四类qwen2、qwenFixed、wan27、legacy并通过MODEL_SPEC_ALIASES表完成模型名到规格的映射。测试 dashscope.test.ts 中的family routing用例直接验证了这一分派逻辑。qwen-image-2.0*推荐的新一代家族成员包括qwen-image-2.0-pro、qwen-image-2.0-pro-2026-03-03、qwen-image-2.0、qwen-image-2.0-2026-03-03。支持自由格式size格式为宽*高总像素数必须在512*512到2048*2048之间对应源码中的MIN_QWEN_2_TOTAL_PIXELS与MAX_QWEN_2_TOTAL_PIXELS常量默认尺寸约为1024*1024是自定义比例如21:9与中英文密集文字排版场景的首选。源码 dashscope.ts 中DEFAULT_MODEL qwen-image-2.0-pro与getDefaultModel()的DASHSCOPE_IMAGE_MODEL环境变量覆盖逻辑共同确认了该模型是内置默认。固定尺寸家族qwen-image-max / plus / image成员包括qwen-image-max、qwen-image-max-2025-12-30、qwen-image-plus、qwen-image-plus-2026-01-09、qwen-image。仅允许五种固定尺寸1664*928、1472*1104、1328*1328、1104*1472、928*1664默认尺寸为1664*928对应源码QWEN_FIXED_SPEC.defaultSize即 16:9 比例qwen-image当前能力与qwen-image-plus相同。源码将五种尺寸与比例绑定在QWEN_FIXED_SIZES_BY_RATIO表16:9、4:3、1:1、3:4、9:16validateQwenFixedSize()会拒绝这五者之外的任何显式尺寸错误信息会列出全部合法值。wan2.7-image*多模态 Wan 2.7 家族成员包括wan2.7-image-pro、wan2.7-image是 DashScope 中唯一支持--ref引用图的家族支持宽*高自由尺寸并具备比例推断能力wan2.7-image-pro纯文生图无--ref总像素在[768*768, 4096*4096]内比例在[1:8, 8:1]内wan2.7-image-pro带引用图以及wan2.7-image所有场景总像素在[768*768, 2048*2048]内比例在[1:8, 8:1]内默认尺寸1024*1024--quality normal或2048*2048--quality 2k4K 必须显式传--size单个请求最多支持 9 张--ref引用图图编辑 / 多图融合引用图以内联 base64 发送若路径是http(s)://URL 则原样透传API 不使用prompt_extend技能对 Wan 家族会省略该参数Wan 2.7 API 在非拼图模式下默认n为4且按生成张数计费baoyu-image-gen 强制n: 1并拒绝--n 1避免静默付费生成多余图片再丢弃。关于第 2 点有个值得注意的像素天花板差异getWan27MaxPixels()判断pro 模型且无引用图时返回4096*4096否则一律回落为2048*2048——这正是提供任何--ref都会自动把 pro 模型上限从 4K 钳制到 2K的源码级实现。Legacy仅显式要求时才使用z-image-turbo、z-image-ultra、wanx-v1属于旧代模型仅在用户显式要求旧行为时使用。从源码看未在别名表中登记的任何模型名都会回落到LEGACY_SPEC其默认尺寸为1536*1536并沿用旧的就近匹配标准尺寸启发式LEGACY_STANDARD_SIZES/LEGACY_STANDARD_SIZES_2K两张表。尺寸解析--size、--ar、--quality 的优先级与换算优先级总则--size优先于--ar对qwen-image-2.0*优先使用显式--size否则按下表由--ar推断对qwen-image-max/plus/image只能使用五种固定尺寸若请求的比例不在其中应切换到qwen-image-2.0-pro对wan2.7-image*显式--size会按当前模式的像素/比例上限做校验否则尺寸由--ar与--quality推导normal≈ 1K2k≈ 2K。要在wan2.7-image-pro纯文生图下请求 4K必须显式传--size如4096*4096、3840*2160重要前提--quality是 baoyu-image-gen 的预设preset并非 DashScope 官方字段。它到qwen-image-2.0*与wan2.7-image*尺寸表的映射是技能侧的实现选择而非 API 保证。推荐的 qwen-image-2.0* 尺寸表源码QWEN_2_RECOMMENDED表与测试用例如21:9的2k对应2048*872完全对齐比例normal2k1:11024*10241536*15362:3768*11521024*15363:21152*7681536*10243:4960*12801080*14404:31280*9601440*10809:16720*12801080*192016:91280*7201920*108021:91344*5762048*872非推荐比例的推导细节当--ar不在上表中时qwen2家族走getQwen2SizeFromAspectRatio()的自由尺寸推导按目标像素预算normal 为1024*1024像素2k 为1536*1536像素结合比例算出原始宽高再经fitToPixelBudget()在[512*512, 2048*2048]像素区间内缩放并以 16 为步长SIZE_STEP取整。测试用例验证了5:2这类非常见比例同样能落在像素预算内且比例误差小于 0.08。Wan 2.7 家族在推导后会额外经过clampWan27DerivedSizeToRatioBounds()确保取整后比例不越过[1:8, 8:1]边界测试用例对8:1、1:8边界比例做了专门回归。显式尺寸的校验qwen-image-2.0*validateQwen2Size()只校验总像素区间因此2048*872合法而4096*4096会被拒绝测试用例直接覆盖这两种情况固定尺寸家族validateQwenFixedSize()强制命中五种固定尺寸之一wan2.7-*validateWan27Size()同时校验总像素区间与[1:8, 8:1]比例区间错误信息会按当前模式给出4096*4096或2048*2048的上限提示。此外normalizeSize()会把 CLI 常见的WxH写法如2048x872转换为 API 使用的宽*高格式2048*872。引用图--ref只有 Wan 2.7 家族可用仅wan2.7-image-pro与wan2.7-image接受--ref其余 DashScope 模型qwen-image-2.0*、qwen-image-max/plus/image、Legacy都会拒绝--ref此时 dashscope.ts 的generateImage()会抛出错误提示改用 Wan 2.7 模型或切到--provider googleGemini 多模态每个请求最多 9 张引用图超限会报错对应WAN27_MAX_REFERENCE_IMAGES 9本地文件内联为 base64 data URLMIME 类型依据扩展名推断jpg/jpeg →image/jpeg、webp →image/webp、bmp →image/bmp其余默认image/pnghttp(s)://URL 则原样转发只要提供了任一--refwan2.7-image-pro 的像素上限就会从 4K 自动钳制到 2KAPI 仅对无图片输入的纯文生图开放 4K。请求构造上引用图会以{ image: dataURL 或 URL }消息项排在{ text: prompt }之前共同组成input.messages[0].content数组。测试用例分别验证了本地图片内联与远程 URL 透传两种请求体的内容顺序。请求参数细节n1 强制、prompt_extend 省略与负向提示词buildParameters()按家族构造parameters字段Wan 2.7 家族只发送size、n: 1、watermark: false三个字段刻意省略prompt_extend与negative_prompt测试用例用Object.keys(...).sort()断言参数键集合恰好为[n, size, watermark]qwen2 / qwenFixed 家族发送prompt_extend: false、size、watermark: false并附带源码内置的中文负向提示词QWEN_NEGATIVE_PROMPT涵盖低分辨率、肢体/手指畸形、蜡像感、AI 感、文字模糊等Legacy 家族仅prompt_extend: false与size。其中n1的强制是最关键的计费保护测试Wan 2.7 rejects --n 1 to prevent silent multi-image billing验证了传入n: 2会直接报错。SKILL.md 的--n选项说明同样强调 Replicate 要求--n 1而对 DashScope Wan 家族则是多余图片会被计费但被丢弃的硬性约束。未暴露的参数与边界说明DashScope 官方 API 还支持negative_prompt、prompt_extend、watermark、thinking_mode、seed、bbox_list、enable_sequential、color_palette等字段。baoyu-image-gen 目前不将它们开放为 CLI 参数Wan 2.7 家族依赖 API 默认值例如thinking_modetrue由服务端默认开启技能对 Wan 2.7 始终发送n1若你需要网格/拼图collage模式现阶段只能绕过技能直接调用 API。这也意味着想用--seed复现结果想用bbox_list做目标框选等需求在 CLI 层尚不可达属于刻意收敛的边界。环境变量与配置接线关键环境变量变量说明DASHSCOPE_API_KEYDashScope API 密钥必填缺失时generateImage()直接报错DASHSCOPE_IMAGE_MODEL默认模型覆盖默认qwen-image-2.0-proDASHSCOPE_BASE_URL自定义端点默认https://dashscope.aliyuncs.com源码会去除尾部斜杠EXTEND.md 中的 DashScope 配置在 preferences-schema.md 的 YAML 中通过default_model.dashscope指定默认模型例如--- version: 1 default_provider: dashscope default_quality: 2k default_model: dashscope: qwen-image-2.0-pro batch: max_workers: 10 provider_limits: dashscope: concurrency: 3 start_interval_ms: 1100 ---模型解析优先级对所有提供方一致CLI--model EXTEND.mddefault_model.[provider] 环境变量PROVIDER_IMAGE_MODEL 内置默认。DashScope 的批处理限流默认并发 3、启动间隔 1100ms见 main.ts 的dashscope: { concurrency: 3, startIntervalMs: 1100 }。首次配置流程见 first-time-setup.mdDashScope 模型选择面板推荐qwen-image-2.0-pro并明确提示需要自定义--size、非常见比例如 21:9或强中英文文字渲染时优先选它wan2.7-image-pro/wan2.7-image是仅有的两个支持--ref的 DashScope 模型。实战命令示例以下命令来自 usage-examples.md其中${BUN_X}优先解析为bun否则用npx -y bun{baseDir}为skills/baoyu-image-gen/scripts# DashScope 默认模型qwen-image-2.0-pro ${BUN_X} {baseDir}/scripts/main.ts --prompt 一只可爱的猫 --image out.png --provider dashscope # Qwen-Image 2.0 Pro自定义尺寸 中文文字21:9 横幅海报 ${BUN_X} {baseDir}/scripts/main.ts --prompt 为咖啡品牌设计一张 21:9 横幅海报包含清晰中文标题 --image out.png --provider dashscope --model qwen-image-2.0-pro --size 2048x872 # 固定尺寸家族五种固定尺寸之一 ${BUN_X} {baseDir}/scripts/main.ts --prompt 一张电影感海报 --image out.png --provider dashscope --model qwen-image-max --size 1664x928 # Wan 2.7 Image Pro4K 纯文生图必须显式 --size ${BUN_X} {baseDir}/scripts/main.ts --prompt 一间有着精致窗户的花店 --image out.png --provider dashscope --model wan2.7-image-pro --size 4096x4096 # Wan 2.7 Image Pro引用图多图融合把图2的涂鸦喷绘在图1的汽车上 ${BUN_X} {baseDir}/scripts/main.ts --prompt 把图2的涂鸦喷绘在图1的汽车上 --image out.png --provider dashscope --model wan2.7-image-pro --ref car.webp paint.webp使用注意事项带--ref时wan2.7-image-pro 的像素上限自动降为 2K--size 4096x4096会触发校验错误--n对 Wan 2.7 只能为 1--n 2直接报错固定尺寸家族若请求21:9这类不存在的比例会得到仅支持固定比例的错误提示并建议切换到qwen-image-2.0-pro参考图最多 9 张本地路径自动转 base64URL 透传批量场景下建议复用 EXTEND.md 的provider_limits.dashscope限流配置并在批处理文件中为任务显式指定provider: dashscope与model。小结DashScope 提供方的使用主线可概括为三条按诉求选家族文字/自定义比例选 qwen-image-2.0*引用图选 wan2.7-image*兼容旧行为才碰 Legacy、按规则算尺寸--size优先于--ar--quality只是技能侧预设、按边界防浪费Wan 2.7 强制n1带--ref自动限 2K。上述行为均可在 providers/dashscope.ts 与其测试 providers/dashscope.test.ts 中得到逐一印证是排查尺寸被拒引用图不支持多余计费等问题的第一手依据。【免费下载链接】baoyu-skills项目地址: https://gitcode.com/gh_mirrors/ba/baoyu-skills创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
网站建设高端定制企业官网
RELATED

相关资讯

更多精彩内容,欢迎继续阅读

较早相关资讯

最新相关资讯

无人机油气管道巡检解决方案:从航线规划到AI识别的落地实践 2026/9/21 0:39:51

无人机油气管道巡检解决方案:从航线规划到AI识别的落地实践

简介:一份十九页PPT《无人机油气管道巡检解决方案》,面向油气管道运营企业、无人机服务商及方案规划人员,系统梳理无人机巡检在能源数字化转型中的落地路径。压缩包内仅一个演示文稿文件,大小约五十点零三兆字节,完整呈…

阅读更多 →
本地AI视频剪辑实战:Palmier Pro完整体验与避坑指南 2026/9/21 0:39:51

本地AI视频剪辑实战:Palmier Pro完整体验与避坑指南

在 Mac 上折腾视频剪辑这些年,我见过太多“新概念剪辑工具”,上来都说自己有多智能,结果百分之八十是套了一层 AI 壳,剪个片子还是得靠手。2024 年底我开始用 Palmier Pro,本来没抱太高期待,几周体验下来反…

阅读更多 →
DeepSeek-V4-Pro深度解析:Agent原生API与DeepSWE工作流引擎 2026/9/21 0:39:51

DeepSeek-V4-Pro深度解析:Agent原生API与DeepSWE工作流引擎

1. 项目概述:这不是一次普通模型更新,而是一次Agent架构级跃迁最近几天,朋友圈和开发者群都在刷屏“DeepSeek-V4-Pro正式版突袭上线”——这个词组本身就很值得玩味。“突袭”不是营销话术,而是真实节奏:没有长周期预告…

阅读更多 →
四款AI编程助手深度对比:OpenClaw、Hermes Agent、Claude Code、Codex CLI选型指南 2026/9/21 0:39:51

四款AI编程助手深度对比:OpenClaw、Hermes Agent、Claude Code、Codex CLI选型指南

1. 四款 AI 编程助手到底怎么选:先搞清楚它们各自是什么过去一年我陆续把 OpenClaw、Hermes Agent、Claude Code、Codex CLI 这四款工具都装了一遍,有的留在主力机上天天用,有的试完就卸了。身边不少朋友问我“到底哪个好用”,我发…

阅读更多 →
MATLAB自适应均衡器仿真:从ISI码间干扰到LMS/RLS算法完整实现 2026/9/21 0:39:51

MATLAB自适应均衡器仿真:从ISI码间干扰到LMS/RLS算法完整实现

简介:这是一份面向通信工程、电子信息类专业学生及科研人员的MATLAB仿真学习资料,聚焦ISI信道建模与自适应均衡器设计这一经典课题,适合需要理解码间干扰抑制原理、LMS算法实现及误码率仿真分析的读者。资源为单个PDF文档,大小约5…

阅读更多 →
页面停留时长统计:从可见时长到心跳上报的完整埋点实践 2026/9/21 0:36:50

页面停留时长统计:从可见时长到心跳上报的完整埋点实践

简介:面向移动端开发、产品运营及数据分析人员,这份资源围绕“用户停留浏览页面的时间统计”场景,提供一套完整且可直接落地的原生iOS实现方案,覆盖事件监听、时间戳记录、间隔奖励与超时累积等关键逻辑,可帮助开发者快…

阅读更多 →

今日资讯

本周资讯

本月资讯

看完文章仍有疑问?

联系尧图顾问,获取一对一建站咨询

立即免费咨询 📞 400-888-8888
📞