Files
tech/.claude/memory/dreamina.md
T
arno 10366e344c 配置(命令): 添加即梦AI生成命令与文章摘要配图流程
- 新增 arno-dreamina 命令,支持文生图/图生图/文生视频等 AI 生成能力
- 更新 arno-article-summary 命令,添加配图生成步骤(调用即梦 AI)
- 添加 2026-06-05 金鹏文章摘要(AI+业务赋能、Hy-Memory 记忆演化)
- 添加文章配图(20260605-001.png、20260605-002.png)
- 添加即梦 CLI 模型对比与使用记忆
2026-06-04 10:33:42 +08:00

12 KiB
Raw Blame History

name, description, metadata
name description metadata
dreamina-model-reference 即梦(Dreamina)各模型对比测试数据与场景推荐参考,从 arno-dreamina 命令文件精简时移出
type
reference

即梦(Dreamina)模型对比测试参考数据

测试日期:2026-05-29 | 账号等级:maestro(大师级 VIP)

各命令支持的模型

命令 可选 model_version 默认模型
text2image 3.0, 3.1, 4.0, 4.1, 4.5, 4.6, 5.0 省略时为默认
image2image 4.0, 4.1, 4.5, 4.6, 5.0 省略时为默认
text2video seedance2.0, seedance2.0fast, seedance2.0_vip, seedance2.0fast_vip seedance2.0fast
image2video 3.0, 3.0fast, 3.0pro, 3.5pro, seedance2.0, seedance2.0fast, seedance2.0_vip, seedance2.0fast_vip 省略时为默认
multimodal2video seedance2.0, seedance2.0fast, seedance2.0_vip, seedance2.0fast_vip 省略时为默认
multiframe2video 不支持选择模型
smart_reference 命令当前不可用

模型分辨率与额度

模型 分辨率 输出数量 maestro 额度消耗
3.0 2048×20482K 4 张 免费
3.1 2048×20482K 4 张 免费
4.0 4096×40964K 1 张 免费
4.1 4096×40964K 1 张 2 积分
4.5 4096×40964K 1 张 4 积分
4.6 4096×40964K 1 张 免费
5.0 4096×40964K 1 张 免费

文生图(text2image)模型对比

测试提示词Professional medical technology promotional poster, a surgeon wearing AR glasses analyzing patient data holograms, blue and white color scheme, clean modern design, 8K quality

模型 内部队列名 画质评价 主要特点
3.0 high_aes_general_v30_18b_fangzhou 2K 分辨率,构图清晰,色彩协调,文字拼写易出错
3.1 high_aes_general_v30l_art_fangzhou_v2 2K 分辨率,虚拟界面细节好,悬浮感稍生硬
4.0 high_aes_general_v40s 4K 分辨率,细节显著提升
4.1 high_aes_general_v41 4K,构图层次分明,综合表现均衡
4.5 high_aes_general_v40l ½ 4K,骨骼/手套/金属质感最佳,消耗 4 积分
4.6 high_aes_general_v42 4K,光影层次最丰富,AR 眼镜等细节最细腻,科技感最强
5.0 high_aes_general_v50 4K,全息屏发光效果出色,文字拼写易出错

共性缺陷:所有模型在生成文字时均会出现拼写错误或乱码,海报类需求需后期修图。

文生视频(text2video)模型对比

测试提示词一只金毛犬在阳光明媚的草地上奔跑,慢动作,电影级画质,花瓣随风飘落,金色的阳光透过树叶洒下光斑 测试参数duration=5s, ratio=16:9, video_resolution=720p(默认)

模型 内部队列名 额度消耗 状态 画质评价
seedance2.0_vip dreamina_fusion_video40_pro_vision 70 积分 完成
seedance2.0fast_vip dreamina_fusion_video40_vision 55 积分 完成
seedance2.0 非 VIP 队列 15 积分 排队 33 万+
seedance2.0fast 非 VIP 队列 并发限制(重试 4 次均失败)

结论:非 VIP 模型容量严重受限,实际不可用;实际可用的只有 seedance2.0_vipseedance2.0fast_vip

seedance2.0_vip vs seedance2.0fast_vip 详细对比(文生视频)

维度 seedance2.0_vip (Pro) seedance2.0fast_vip (Fast)
画面清晰度 毛发根根分明,边缘锐利,画面通透立体 细节保留尚可,边缘锐度不足,画面偏"平"
运动流畅度 运动轨迹精准,慢动作丝滑,符合生物力学 整体流畅,部分动作过渡略有卡顿
光影层次 阴影渐变柔和,高光自然,丁达尔效应出色 光影基本自然,阴影边缘偏生硬,高光偶有过曝
色彩表现 层次丰富(草地深绿/浅绿分明,花瓣粉中带紫) 暖色调协调,但色彩层次不够丰富
物理合理性 肌肉线条明显,花瓣飘落随机自然,草叶细节丰富 基本合理,花瓣轨迹较单一,肌肉感稍弱
电影感 景深渐进虚化,画面层次感强,专业影视级 构图合理氛围到位,更像"高质量图片序列"
生成速度 较慢(约 90s 较快(约 60s
文件大小 4.3 MB 4.2 MB
技术参数 1280×720, 24fps, 5.042s, MP4 1280×720, 24fps, 5.042s, MP4

关键发现

  1. Pro 版是"电影级"Fast 版是"够用级"
  2. 非 VIP 模型实际不可用(排队 33 万+ / 并发限制)
  3. 视频时长固定约 5s,帧率统一 24fps

图生视频(image2video)模型对比

输入图片4096×4096text2image 4.6 模型生成) 运动提示词camera slowly pushes in, surgeon's AR glasses flickering with blue data streams, holographic patient data rotating gently in the air 测试参数duration=5s, video_resolution=720p :图生视频分辨率继承输入图片比例(1:1 → 960×960),不可通过参数调整

模型 内部队列名 额度消耗 输出分辨率 状态
seedance2.0_vip dreamina_fusion_video40_pro_vision (i2v) 70 积分 960×960 完成
seedance2.0fast_vip dreamina_fusion_video40_vision (i2v) 55 积分 960×960 完成

seedance2.0_vip vs seedance2.0fast_vip 详细对比(图生视频)

维度 seedance2.0_vip (Pro) seedance2.0fast_vip (Fast)
原图忠实度 像素级还原,AR 眼镜、全息骨骼、手术服细节完全保持 高度还原,无明显变形,与 Pro 版基本持平
运动自然度 全息旋转平滑(角度精准),镜头推进曲线符合物理规律 旋转/数据流尚可,但动态层次较"简洁",运动幅度更克制
画面稳定性 无闪烁/抖动/撕裂,帧间过渡无缝 同样优秀,稳定性与 Pro 版一致
新增细节质量 主动添加数据标签弹出、骨骼高亮、动态光影反射 新增元素更克制(仅基础旋转+数据流),未过度添加
光影一致性 全息蓝光在人物面部动态反射,阴影随运动自然变化 光影过渡偏"平",层次感不如 Pro 版丰富
生成速度 较慢(约 180s 较快(约 120s
文件大小 4.2 MB 4.2 MB
技术参数 960×960, 24fps, 5.042s, MP4 960×960, 24fps, 5.042s, MP4

关键发现

  1. i2v 的 Pro/Fast 差异小于 t2v:原图忠实度和画面稳定性两者几乎持平
  2. Pro 版"锦上添花"(主动添加更多动态细节),Fast 版"恰到好处"(更克制,不易出现违和感)
  3. 分辨率继承输入图比例,i2v 不提供 --ratio 参数
  4. 生成速度约为 t2v 的 2 倍(需额外处理输入图片特征提取和融合)

多模态生视频(multimodal2video)模型对比

输入图片4096×4096text2image 4.6 模型生成) 提示词Camera slowly zooms into the surgeon's AR glasses, holographic data panels float and rotate in the air, blue light particles drift through the scene, cinematic quality, 4K 测试参数duration=5s, ratio=16:9, video_resolution=720p

模型 内部队列名 req_key 额度消耗 状态 画质评价
seedance2.0_vip dreamina_fusion_video40_pro_vision ...Pro_Vision_unified_edit_720p 70 积分 完成
seedance2.0fast_vip dreamina_fusion_video40_vision ...Vision_unified_edit_720p 55 积分 完成 ½

seedance2.0_vip vs seedance2.0fast_vip 详细对比(多模态生视频)

维度 seedance2.0_vip (Pro) seedance2.0fast_vip (Fast)
画面清晰度 细节锐利,AR 眼镜反射面/全息骨骼/数据面板高保真 同样出色,细节清晰锐利,皮肤/衣物/设备质感丰富
运动流畅度 镜头推进流畅,全息元素旋转/浮动自然,无抖动 镜头 dolly-in 平稳精准,运动节奏感好,无抖动/跳帧
光影层次 全息蓝光在人物面部产生动态反射,阴影随运动自然变化 光影渲染出色,全息元素发出柔和蓝光并照亮周围
色彩表现 冷色调蓝白和谐,全息渐变平滑无色带 色彩深度丰富,渐变平滑无色带,冷暖平衡
全息元素真实感 ½ 浮空感/透明发光质感好,缺少真实光折射 发光/微光效果真实,缺少与环境的物理交互阴影
新增动态细节 主动添加数据标签弹出、骨骼高亮、蓝色粒子流等 动态元素更克制,仅基础旋转+光粒子
电影感 构图、推进、光影配合形成专业影视级效果 高质量科幻广告级效果,画面纯净专业
生成速度 ~4.5 分钟(273s ~10 分钟(596s⚠️ 异常偏慢
文件大小 4.2 MB 4.2 MB
技术参数 1280×720, 24fps, 5.042s, MP4 1280×720, 24fps, 5.042s, MP4

关键发现

  1. multimodal2video 的 Pro/Fast 画质差异远小于 text2video:有参考图片作为"锚点",两个模型差距显著缩小
  2. 生成速度出现反转:本次测试中 Fast 版(~10分钟)反而比 Pro 版(~4.5分钟)慢约 2 倍,可能与服务器负载有关,不代表固定规律
  3. multimodal2video 使用独立的多模态融合管线(req_key 包含 _unified_edit_
  4. 支持 --ratio 参数(1:1/3:4/16:9/4:3/9:16/21:9),输出比例不受输入图约束
  5. seedance2.0_vip 额外支持 1080p--video_resolution=1080p),Fast 版仅支持 720p
  6. 两个模型均无可见瑕疵:无闪烁/撕裂/压缩伪影/运动模糊异常

场景推荐矩阵

视频生成场景选择

场景 推荐命令+模型 理由
纯文字描述生成视频 text2video + seedance2.0_vip 无参考图时 Pro 版画质优势明显
让静态图动起来(简单动画) image2video + seedance2.0fast_vip 速度快,动态克制不易出错,55 积分够用
图片+详细运动指令生成视频 multimodal2video + seedance2.0fast_vip 有参考图时画质差距小,Fast 版 55 积分性价比高
广告/影视级多模态视频 multimodal2video + seedance2.0_vip + 1080p 最高画质+最高分辨率,适合最终交付
图片+音频/视频参考融合 multimodal2video + seedance2.0_vip 多参考源融合时 Pro 版细节处理更好

图生视频 vs 多模态生视频 选择

场景 推荐 理由
简单镜头推进/拉远 image2video + seedance2.0fast_vip 够用且快
需要控制输出比例(16:9 等) multimodal2video i2v 不支持 ratio 参数
复杂运动描述 multimodal2video + seedance2.0_vip 运动指令跟随更好
需要 1080p 输出 multimodal2video + seedance2.0_vip 仅有此组合支持
快速原型/概念验证 image2video + seedance2.0fast_vip 55 积分,120s 出结果