即梦AI完整功能矩阵 —— 12项图片生成与编辑、7项视频生成、数字人、Octo协作叙事工具。
即梦AI的图像引擎 Seedream 5.0 Preview 支持4K直出,覆盖从文生图到精细编辑的完整链路。
| 功能 | 做什么 | 门槛 |
|---|---|---|
| 文生图 | 输入中文描述生成图片,4K分辨率,50+风格模板 | 零基础 |
| 图生图 | 上传参考图+文字,定向变体,参考强度可调 | 零基础 |
| 局部重绘 | 涂抹指定区域,仅重绘该区域,其余不变 | 入门 |
| 消除笔 | 抹除水印/物体/文字,AI自动补全背景 | 零基础 |
| 扩图 | 向外扩展画幅边界,AI补全扩展区域 | 零基础 |
| 抠图 | 自动去背景,输出透明PNG | 零基础 |
| 智能超清/HD | 提升分辨率,增强细节 | 零基础 |
| 画面微调 | 整图小幅调质感/风格,不改构图 | 入门 |
| 改文字 | 替换图中文字,保留字体风格 | 零基础 |
| 智能改图 | 自然语言描述修改,AI自动判断修改区域 | 零基础 |
| 多角度生成 | 单张角色图生成正面/侧面/背面等多角度 | 入门 |
| 组图生成 | 一次生成最多14张连续图片,统一风格 | 入门 |
提示词公式:风格词 + 主体 + 场景 + 画质词。示例:「赛博朋克风格,一只戴墨镜的布偶猫在霓虹灯街头,4K高清」
Seedance 2.0 支持四模态输入(图/文/音/视),实现音画同步生成和多镜头连贯创作。
| 功能 | 做什么 | 上限 |
|---|---|---|
| 文生视频 | 纯文字描述生成视频,含运镜、时长、风格 | 15秒 |
| 图生视频 | 单张/双张图片转视频,首尾帧控制 | 15秒 |
| 智能多帧 2.0 | 2-10张关键帧→一镜到底长镜头 | 54秒 |
| 多镜头连贯生成 | 多模态输入→多镜头序列,@角色引用 | 理论不限 |
| 音画同步 | 同时生成画面+音效+配乐+人声 | 原生 |
| 对口型 | 按音频对口型说话,普通话+8种方言 | 9秒 |
| 速度/镜头控制 | 正常/快/慢速,推拉摇移 | 独立可调 |
长视频拼接三大路径:智能多帧(关键帧过渡,54秒)| 多镜头生成(角色引擎+四模态输入,理论不限)| 分镜拼接(seed锁定+首尾帧控制,不限)
OmniHuman —— 单张照片即可生成数字人,支持8种方言口型精准匹配。
| 功能 | 说明 |
|---|---|
| 自定义数字人 | 上传正面照+音频/文字,3步生成 |
| 免费形象库 | 50+商用合规形象,无需个人照片 |
| 动作复刻 | 上传参考视频,数字人复刻动作与情绪 |
| 分身合拍 | 双角色同框互动 |
2026年4月发布,协作型AI叙事工具,支持灵感→资产→剧本→分镜→成片全闭环。
| 能力 | 说明 |
|---|---|
| / 对话入口 | 画布任意位置按 / 即与AI对话 |
| 资产卡系统 | 风格卡/角色卡/环境卡/物体卡,@引用贯穿全流程 |
| 故事大纲生成 | 从碎片灵感到结构化故事 |
| 分镜自动编排 | 资产→剧本→分镜一键生成 |
| 视频并行生成 | 多分镜同跑,多版本筛选 |
| XML工程导出 | 直接导入Premiere/Final Cut Pro |
Octo 全流程:灵感碰撞(/键对话)→ 风格资产锁定 → 角色/场景资产建立 → 故事大纲生成 → 分镜自动编排 → 视频并行生成 → 画布时间轴编排 → 导出XML(无缝衔接Pr/FC精剪)
| 入口 | 说明 |
|---|---|
| 灵感 | 社区广场,浏览他人作品、找参考风格 |
| 生成 | 生图/生视频主入口,输入提示词创作 |
| 资产 | 所有生成历史、收藏、素材库 |
| 画布 | 在线编辑画布,拼图、加文字、图层操作 |
| Octo | 协作型AI叙事创作工具,支持图片+文字组合输入 |