Files
tech/.claude/memory/dreamina.md
T
arno 10366e344c 配置(命令): 添加即梦AI生成命令与文章摘要配图流程
- 新增 arno-dreamina 命令,支持文生图/图生图/文生视频等 AI 生成能力
- 更新 arno-article-summary 命令,添加配图生成步骤(调用即梦 AI)
- 添加 2026-06-05 金鹏文章摘要(AI+业务赋能、Hy-Memory 记忆演化)
- 添加文章配图(20260605-001.png、20260605-002.png)
- 添加即梦 CLI 模型对比与使用记忆
2026-06-04 10:33:42 +08:00

12 KiB
Raw Blame History

name, description, metadata
name description metadata
dreamina-model-reference 即梦(Dreamina)各模型对比测试数据与场景推荐参考,从 arno-dreamina 命令文件精简时移出
type
reference

即梦(Dreamina)模型对比测试参考数据

测试日期:2026-05-29 | 账号等级:maestro(大师级 VIP)

各命令支持的模型

命令 可选 model_version 默认模型
text2image 3.0, 3.1, 4.0, 4.1, 4.5, 4.6, 5.0 省略时为默认
image2image 4.0, 4.1, 4.5, 4.6, 5.0 省略时为默认
text2video seedance2.0, seedance2.0fast, seedance2.0_vip, seedance2.0fast_vip seedance2.0fast
image2video 3.0, 3.0fast, 3.0pro, 3.5pro, seedance2.0, seedance2.0fast, seedance2.0_vip, seedance2.0fast_vip 省略时为默认
multimodal2video seedance2.0, seedance2.0fast, seedance2.0_vip, seedance2.0fast_vip 省略时为默认
multiframe2video 不支持选择模型 —
smart_reference 命令当前不可用 —

模型分辨率与额度

模型 分辨率 输出数量 maestro 额度消耗
3.0 2048×2048(2K) 4 张 免费
3.1 2048×2048(2K) 4 张 免费
4.0 4096×4096(4K) 1 张 免费
4.1 4096×4096(4K) 1 张 2 积分
4.5 4096×4096(4K) 1 张 4 积分
4.6 4096×4096(4K) 1 张 免费
5.0 4096×4096(4K) 1 张 免费

文生图(text2image)模型对比

测试提示词:Professional medical technology promotional poster, a surgeon wearing AR glasses analyzing patient data holograms, blue and white color scheme, clean modern design, 8K quality

模型 内部队列名 画质评价 主要特点
3.0 high_aes_general_v30_18b_fangzhou ⭐⭐⭐ 2K 分辨率,构图清晰,色彩协调,文字拼写易出错
3.1 high_aes_general_v30l_art_fangzhou_v2 ⭐⭐⭐ 2K 分辨率,虚拟界面细节好,悬浮感稍生硬
4.0 high_aes_general_v40s ⭐⭐⭐⭐ 4K 分辨率,细节显著提升
4.1 high_aes_general_v41 ⭐⭐⭐⭐ 4K,构图层次分明,综合表现均衡
4.5 high_aes_general_v40l ⭐⭐⭐⭐½ 4K,骨骼/手套/金属质感最佳,消耗 4 积分
4.6 high_aes_general_v42 ⭐⭐⭐⭐⭐ 4K,光影层次最丰富,AR 眼镜等细节最细腻,科技感最强
5.0 high_aes_general_v50 ⭐⭐⭐⭐ 4K,全息屏发光效果出色,文字拼写易出错

共性缺陷:所有模型在生成文字时均会出现拼写错误或乱码,海报类需求需后期修图。

文生视频(text2video)模型对比

测试提示词:一只金毛犬在阳光明媚的草地上奔跑,慢动作,电影级画质,花瓣随风飘落,金色的阳光透过树叶洒下光斑 测试参数:duration=5s, ratio=16:9, video_resolution=720p(默认)

模型 内部队列名 额度消耗 状态 画质评价
seedance2.0_vip dreamina_fusion_video40_pro_vision 70 积分 ✅ 完成 ⭐⭐⭐⭐⭐
seedance2.0fast_vip dreamina_fusion_video40_vision 55 积分 ✅ 完成 ⭐⭐⭐⭐
seedance2.0 非 VIP 队列 15 积分 ❌ 排队 33 万+ —
seedance2.0fast 非 VIP 队列 — ❌ 并发限制(重试 4 次均失败) —

结论:非 VIP 模型容量严重受限,实际不可用;实际可用的只有 seedance2.0_vip 和 seedance2.0fast_vip。

seedance2.0_vip vs seedance2.0fast_vip 详细对比(文生视频)

维度 seedance2.0_vip (Pro) seedance2.0fast_vip (Fast)
画面清晰度 ⭐⭐⭐⭐⭐ 毛发根根分明,边缘锐利,画面通透立体 ⭐⭐⭐⭐ 细节保留尚可,边缘锐度不足,画面偏"平"
运动流畅度 ⭐⭐⭐⭐⭐ 运动轨迹精准,慢动作丝滑,符合生物力学 ⭐⭐⭐⭐ 整体流畅,部分动作过渡略有卡顿
光影层次 ⭐⭐⭐⭐⭐ 阴影渐变柔和,高光自然,丁达尔效应出色 ⭐⭐⭐⭐ 光影基本自然,阴影边缘偏生硬,高光偶有过曝
色彩表现 ⭐⭐⭐⭐⭐ 层次丰富(草地深绿/浅绿分明,花瓣粉中带紫) ⭐⭐⭐⭐ 暖色调协调,但色彩层次不够丰富
物理合理性 ⭐⭐⭐⭐⭐ 肌肉线条明显,花瓣飘落随机自然,草叶细节丰富 ⭐⭐⭐⭐ 基本合理,花瓣轨迹较单一,肌肉感稍弱
电影感 ⭐⭐⭐⭐⭐ 景深渐进虚化,画面层次感强,专业影视级 ⭐⭐⭐⭐ 构图合理氛围到位,更像"高质量图片序列"
生成速度 较慢(约 90s) 较快(约 60s)
文件大小 4.3 MB 4.2 MB
技术参数 1280×720, 24fps, 5.042s, MP4 1280×720, 24fps, 5.042s, MP4

关键发现:

  1. Pro 版是"电影级",Fast 版是"够用级"
  2. 非 VIP 模型实际不可用(排队 33 万+ / 并发限制)
  3. 视频时长固定约 5s,帧率统一 24fps

图生视频(image2video)模型对比

输入图片:4096×4096(text2image 4.6 模型生成) 运动提示词:camera slowly pushes in, surgeon's AR glasses flickering with blue data streams, holographic patient data rotating gently in the air 测试参数:duration=5s, video_resolution=720p 注:图生视频分辨率继承输入图片比例(1:1 → 960×960),不可通过参数调整

模型 内部队列名 额度消耗 输出分辨率 状态
seedance2.0_vip dreamina_fusion_video40_pro_vision (i2v) 70 积分 960×960 ✅ 完成
seedance2.0fast_vip dreamina_fusion_video40_vision (i2v) 55 积分 960×960 ✅ 完成

seedance2.0_vip vs seedance2.0fast_vip 详细对比(图生视频)

维度 seedance2.0_vip (Pro) seedance2.0fast_vip (Fast)
原图忠实度 ⭐⭐⭐⭐⭐ 像素级还原,AR 眼镜、全息骨骼、手术服细节完全保持 ⭐⭐⭐⭐⭐ 高度还原,无明显变形,与 Pro 版基本持平
运动自然度 ⭐⭐⭐⭐⭐ 全息旋转平滑(角度精准),镜头推进曲线符合物理规律 ⭐⭐⭐⭐ 旋转/数据流尚可,但动态层次较"简洁",运动幅度更克制
画面稳定性 ⭐⭐⭐⭐⭐ 无闪烁/抖动/撕裂,帧间过渡无缝 ⭐⭐⭐⭐⭐ 同样优秀,稳定性与 Pro 版一致
新增细节质量 ⭐⭐⭐⭐⭐ 主动添加数据标签弹出、骨骼高亮、动态光影反射 ⭐⭐⭐⭐ 新增元素更克制(仅基础旋转+数据流),未过度添加
光影一致性 ⭐⭐⭐⭐⭐ 全息蓝光在人物面部动态反射,阴影随运动自然变化 ⭐⭐⭐⭐ 光影过渡偏"平",层次感不如 Pro 版丰富
生成速度 较慢(约 180s) 较快(约 120s)
文件大小 4.2 MB 4.2 MB
技术参数 960×960, 24fps, 5.042s, MP4 960×960, 24fps, 5.042s, MP4

关键发现:

  1. i2v 的 Pro/Fast 差异小于 t2v:原图忠实度和画面稳定性两者几乎持平
  2. Pro 版"锦上添花"(主动添加更多动态细节),Fast 版"恰到好处"(更克制,不易出现违和感)
  3. 分辨率继承输入图比例,i2v 不提供 --ratio 参数
  4. 生成速度约为 t2v 的 2 倍(需额外处理输入图片特征提取和融合)

多模态生视频(multimodal2video)模型对比

输入图片:4096×4096(text2image 4.6 模型生成) 提示词:Camera slowly zooms into the surgeon's AR glasses, holographic data panels float and rotate in the air, blue light particles drift through the scene, cinematic quality, 4K 测试参数:duration=5s, ratio=16:9, video_resolution=720p

模型 内部队列名 req_key 额度消耗 状态 画质评价
seedance2.0_vip dreamina_fusion_video40_pro_vision ...Pro_Vision_unified_edit_720p 70 积分 ✅ 完成 ⭐⭐⭐⭐⭐
seedance2.0fast_vip dreamina_fusion_video40_vision ...Vision_unified_edit_720p 55 积分 ✅ 完成 ⭐⭐⭐⭐½

seedance2.0_vip vs seedance2.0fast_vip 详细对比(多模态生视频)

维度 seedance2.0_vip (Pro) seedance2.0fast_vip (Fast)
画面清晰度 ⭐⭐⭐⭐⭐ 细节锐利,AR 眼镜反射面/全息骨骼/数据面板高保真 ⭐⭐⭐⭐⭐ 同样出色,细节清晰锐利,皮肤/衣物/设备质感丰富
运动流畅度 ⭐⭐⭐⭐⭐ 镜头推进流畅,全息元素旋转/浮动自然,无抖动 ⭐⭐⭐⭐⭐ 镜头 dolly-in 平稳精准,运动节奏感好,无抖动/跳帧
光影层次 ⭐⭐⭐⭐⭐ 全息蓝光在人物面部产生动态反射,阴影随运动自然变化 ⭐⭐⭐⭐⭐ 光影渲染出色,全息元素发出柔和蓝光并照亮周围
色彩表现 ⭐⭐⭐⭐⭐ 冷色调蓝白和谐,全息渐变平滑无色带 ⭐⭐⭐⭐⭐ 色彩深度丰富,渐变平滑无色带,冷暖平衡
全息元素真实感 ⭐⭐⭐⭐½ 浮空感/透明发光质感好,缺少真实光折射 ⭐⭐⭐⭐ 发光/微光效果真实,缺少与环境的物理交互阴影
新增动态细节 ⭐⭐⭐⭐⭐ 主动添加数据标签弹出、骨骼高亮、蓝色粒子流等 ⭐⭐⭐⭐ 动态元素更克制,仅基础旋转+光粒子
电影感 ⭐⭐⭐⭐⭐ 构图、推进、光影配合形成专业影视级效果 ⭐⭐⭐⭐⭐ 高质量科幻广告级效果,画面纯净专业
生成速度 ~4.5 分钟(273s) ~10 分钟(596s)⚠️ 异常偏慢
文件大小 4.2 MB 4.2 MB
技术参数 1280×720, 24fps, 5.042s, MP4 1280×720, 24fps, 5.042s, MP4

关键发现:

  1. multimodal2video 的 Pro/Fast 画质差异远小于 text2video:有参考图片作为"锚点",两个模型差距显著缩小
  2. 生成速度出现反转:本次测试中 Fast 版(~10分钟)反而比 Pro 版(~4.5分钟)慢约 2 倍,可能与服务器负载有关,不代表固定规律
  3. multimodal2video 使用独立的多模态融合管线(req_key 包含 _unified_edit_)
  4. 支持 --ratio 参数(1:1/3:4/16:9/4:3/9:16/21:9),输出比例不受输入图约束
  5. seedance2.0_vip 额外支持 1080p(--video_resolution=1080p),Fast 版仅支持 720p
  6. 两个模型均无可见瑕疵:无闪烁/撕裂/压缩伪影/运动模糊异常

场景推荐矩阵

视频生成场景选择

场景 推荐命令+模型 理由
纯文字描述生成视频 text2video + seedance2.0_vip 无参考图时 Pro 版画质优势明显
让静态图动起来(简单动画) image2video + seedance2.0fast_vip 速度快,动态克制不易出错,55 积分够用
图片+详细运动指令生成视频 multimodal2video + seedance2.0fast_vip 有参考图时画质差距小,Fast 版 55 积分性价比高
广告/影视级多模态视频 multimodal2video + seedance2.0_vip + 1080p 最高画质+最高分辨率,适合最终交付
图片+音频/视频参考融合 multimodal2video + seedance2.0_vip 多参考源融合时 Pro 版细节处理更好

图生视频 vs 多模态生视频 选择

场景 推荐 理由
简单镜头推进/拉远 image2video + seedance2.0fast_vip 够用且快
需要控制输出比例(16:9 等) multimodal2video i2v 不支持 ratio 参数
复杂运动描述 multimodal2video + seedance2.0_vip 运动指令跟随更好
需要 1080p 输出 multimodal2video + seedance2.0_vip 仅有此组合支持
快速原型/概念验证 image2video + seedance2.0fast_vip 55 积分,120s 出结果