AI Canvas 操作说明书
从首次生成到完整创作
用一张无限画布连接文本、图像、视频与音频。从第一次出图,到剧本分集、逐镜生成和剪辑成片;需要接入自己的服务时,再按示例配置接口与工作流。
0.9.23 源码基线2026-10-04 核对截图内嵌 · 可离线阅读先找到你要做的事
第一次使用可走第一条路线。每章保留原有编号,旧链接仍可直接定位。
00 · 界面位置图
下面保留此前桌面应用的真实截图,用于辨认主要区域;近期入口变化按对应章节核对。画布中的媒体是位置演示素材,不是安装后自动提供的内容。
- 1项目区域:当前画布名称、新建画布及项目切换。
- 2添加与素材:添加节点、项目、资产、角色等入口。
- 3助手与设置:打开 AI 助手;齿轮菜单内有设置、帮助、关于。
- 4节点工作区:每个节点承载内容、参考素材或生成结果。
- 5画布笔记:矩形、箭头、自由绘制、文字与图片笔记。
- 6视图控制:小地图、缩放比例、网格和连线样式。
应用设置从哪里找
01 · 创作前先配好项目设置
开始做一组图片、短片或分集前,先给当前项目确定画风、通用要求和常用模型。后续创建节点和生成内容时,就能沿用这些设置。第一次试用也可以保留默认值,等模型配置好后再补充。
1.1 · 打开入口与作用范围
- 在左上角新建或切换到要制作的画布。点击顶部当前画布名称右侧的滑杆图标,打开“项目设置”。
- 先核对面板标题下的项目名称;下面所有设置针对这个项目。正在编辑分集时,针对当前这一集。
- 面板内部可以向下滚动。截图下方还有视频、音频、视觉理解、Agent 自动选模型以及“输出默认”,不要只看首屏。
- 修改后点击底部保存,出现“项目设置已保存”后再关闭或切换项目。可重新打开一次,核对已保存的值。
每个项目、每一集都可以有自己的设置。新增分集会带入剧集当时的设置,之后独立保存;修改当前集,不会同步改掉其他分集。需要全剧统一时,应逐集核对,而不是只改其中一集。
1.2 · 整体画风(文字预设)与锁定
- 点击选择画风,选用写实摄影、动漫、水彩、电影质感等预设,也可在画风选择器中添加自己的预设。
- 希望各镜头统一使用这一文字画风时,开启旁边的锁定;必须先选中画风,锁定开关才可用。
- 需要某个节点采用不同画风时,回到这里解除锁定并保存,再到该节点选择画风。
| 状态 | 生成时怎样选择画风 |
|---|---|
| 未锁定 | 节点已有画风时优先用节点画风;节点未选时使用项目画风。 |
| 已锁定 | 图像、全景和视频生成使用项目画风;节点内的画风选择按钮会不可修改,并提示项目已锁定画风。 |
| 修改或解锁 | 影响之后的设置选择和生成;已有图片、视频不会被重新生成,也不会随之改变。 |
这是给模型的文字风格要求。锁定只管理画风选择,不会锁住节点内容、模型、尺寸或提示词编辑,也不能保证所有模型生成完全一致的风格。
修改已经保存的自定义画风
在节点的画风选择器中找到自定义画风,点击该项的编辑图标,可修改名称、提示词和缩略图后保存。后续使用前重新核对画风内容;修改预设不会重新生成已有图片。内置画风与自己的画风分别管理,只有提供编辑入口的自定义项可修改。
1.3 · 风格母图:自动提供视觉参考
- 点击上传风格母图,选择希望作品参考的图片,例如卡通、电影画面或已确认的风格样片。支持 PNG、JPG/JPEG、WebP、GIF、BMP。
- 上传后检查缩略图与文件名,保持启用开关打开,再点击保存。
- 在当前项目中继续生图。软件会把母图放在图像参考输入的第一位,再加入节点里的角色、场景等内容参考,不必每次手动 @ 母图。
- 临时不用时关闭“启用”;换样片时点击更换;不再使用时点击清除,然后保存。清除解除母图设置,不等于删除已上传的素材文件。
母图用于传递画风、色彩、材质和光影,角色身份、具体场景和构图仍应通过内容参考图与提示词说明。文字画风和风格母图可以同时使用,建议选成一致的方向。
1.4 · 项目提示词后缀:按类型填写通用要求
点击文本 / 图像 / 视频 / 音频标签,分别填写该类节点长期共用的要求。四个标签各存一份内容,每类最多 2000 个字符;切换标签是切换编辑对象,最后统一点击“保存”。
| 标签 | 适合填写的示例 |
|---|---|
| 文本 | 使用简体中文,按场景分段,人物称呼前后一致。 |
| 图像 | 保持主要角色的发色、服装配色与材质一致,背景整洁,光线柔和。 |
| 视频 | 动作连贯,镜头移动平稳,人物外观保持一致,避免突然切换场景。 |
| 音频 | 普通话发音清晰,情绪自然,保持同一角色的声音特点。 |
在接入项目设置的节点生成中,最终要求会组合为:本次提示词 → 适用的画风文字 → 对应类型后缀。这些内容在生成时加入,不一定直接显示在节点提示词编辑框里。图像后缀也用于归到图像类别的动画与全景;助手调用媒体生成时沿用对应后缀,普通聊天不会因此自动追加“文本”后缀。
后缀适合放跨镜头的固定要求,每一镜的动作、场景与台词仍写在节点中。它是提示文字,不能替代比例、分辨率、时长或音色等真实参数;个别工作流或专用入口是否采用这些内容,应先验证一次。
1.5 · 默认模型、视觉理解与 Agent 选模型
在“默认模型”里分别选择文本、图像、视频和音频模型。保留跟随应用默认表示不为本项目指定独立默认值;下拉里找不到目标模型时,先在 API Key 设置中添加并启用,再回到这里选择。工作流不在这组项目默认模型菜单中,仍在节点模型选择器里选择。
| 设置项 | 用途与使用方法 |
|---|---|
| 文本 / 图像 / 视频 / 音频 | 作为相应类别新建节点的默认模型;项目文本模型也是助手默认文本模型的优先候选。已有节点不会因保存设置而全部换模型,生成前仍要看节点实际选择。 |
| 视觉理解 | 给看图分析、生成视觉描述选择能接收图片的文本模型。保留“自动选择可看图模型”时从已配置、具备看图能力的模型中选择;它与生成图片的模型是两种用途。 |
| 允许 Agent 自动选媒体模型 | 开启并保存后,自主模式在未显式指定模型时,可以按需求从可用媒体模型中选择。显式 @model 始终优先;自动选择可能产生实际模型费用,应检查任务使用的模型。 |
1.6 · 输出默认:图片与视频的常用参数
向下滚动到输出默认。图片、视频各有独立开关;关闭时显示跟随节点,开启后可编辑项目偏好。
| 项目 | 可以设置什么 | 首次开启时的初始值 |
|---|---|---|
| 图片输出 | 比例与画质档位。 | 没有已保存值时为 16:9、1K。 |
| 视频输出 | 比例、分辨率与时长。 | 没有已保存值时为 16:9、720p、5 秒。 |
这些值用于新建节点的初始化和部分助手生成的默认参数,不会批量重设已有节点,也不会改变已生成文件。当前模型支持哪些值,应以节点参数选项与接口要求为准。
1.7 · 保存后怎样检查
- 点击保存,确认“项目设置已保存”;若提示保存失败,先处理失败原因再继续。
- 重新打开项目设置,检查画风、母图启用状态、四类后缀及模型是否保留。
- 创建一个新的图像节点,检查默认模型、画风与输出参数;用一条小任务验证后缀和母图效果,确认后再批量制作。
- 切换项目或分集后重新核对设置,尤其是复制项目、追加分集或使用已有节点时。
底部取消、右上角关闭、点击面板外或按 Esc 都不会提交这次项目设置草稿。上传文件和在画风选择器里新建预设是独立操作,取消项目设置不等于撤销这些操作。
02 · 先跑通一次生成
初次使用,先完成一张图片,再逐步增加参考素材、视频或工作流。已经配好厂商和模型的用户,可以从第 3 步开始。
- 点击左侧底部齿轮 → 设置 → API Key。添加已开通的厂商,填好 API Key,勾选要使用的模型并保存。使用自己的中转服务或专用接口时,阅读第 06 章。
- 回到画布,在左上角新建一个画布,或进入项目库选择已有项目。开始制作前,按第 01 章检查项目画风、后缀与默认模型。
- 点击左侧添加节点 → 生成图像;也可以在未输入文字时按 2。
- 选中节点,按 Space 打开完整编辑面板。填写提示词,例如:
一只坐在窗边的小猫,清晨柔和自然光,干净背景,水彩插画。 - 选择已配置的图像模型,按模型可用选项设置比例或尺寸。第一次可以不加参考图。
- 确认后点击生成。这一步会真实调用模型,可能产生服务商费用。完成后查看节点结果和输出历史,再决定是否重新生成或接到视频节点。
03 · 项目、剧本与分集
从原著或全剧剧本出发,先确定每集讲什么,再写成本集正文,最后进入分镜和画布制作。剧集栏负责资料与分集管理,剧本创作工作台负责逐集写作。
新建、切换与整理项目
- 打开左上角画布 / 项目入口,进入项目库。新建画布后,为它起一个容易辨认的名字,例如“短片 · 第一次测试”。
- 在项目库点击卡片进入项目;最近打开的项目可通过顶部标签快速切换。
- 项目卡片菜单可重命名、复制、导出项目包或删除。需要试不同方案时,先复制项目再继续编辑。
- 点击当前项目名称右侧的设置图标,按第 01 章确认画风、母图、后缀及默认模型。
3.1 · 准备原著或全剧剧本
单击窗口右侧中部的细竖条展开剧集栏。剧集栏管理整部剧共用的原著、全剧剧本和分集;进入工作台后,再分别编写每一集的大纲与正文。
- 已有小说或原文:点击“原著”右侧上传按钮,选择
.txt / .md文件。原著需要保存到项目素材目录,使用桌面版添加。添加后检查显示的文件名。 - 已有完整剧本:点击“剧本”下方的未填写,点击编辑或铅笔图标,粘贴全剧内容,点击弹窗底部保存。
- 原著与全剧剧本可以同时保留。后面进行 AI 拆分时,明确选择本次使用哪一种素材。
- 需要更换原著时使用更换按钮;移除引用(不删文件)只解除当前登记,项目目录里的原稿仍保留。
| 内容放哪里 | 应填写什么 | 影响范围 |
|---|---|---|
| 剧集栏 → 原著 | 小说、故事原文等源资料文件。 | 整部剧共用。 |
| 剧集栏 → 剧本 | 完整剧本或用于拆分的全剧内容。 | 整部剧共用;不会自动拆到每一集。 |
| 工作台 → 本集大纲 | 本集任务、冲突、主要事件及结尾。 | 当前分集。 |
| 工作台 → 本集剧本 | 按场号、场景、人物、动作和对白编写的完整正文。 | 当前分集;与大纲分别保存。 |
| 工作台 → 创作要点 | 结构化记录钩子、冲突、情节点、目标时长等。 | 当前分集;不会从大纲自动填满全部字段。 |
3.2 · 按章节浏览原著,并交给助手分析
- 在剧集栏的“原著”旁点击章节浏览;也可从剧本创作工作台 → 章节浏览进入。剧集栏入口需先添加原著;只有全剧剧本时可从工作台进入。
- 在素材来源切换“原著 / 全剧剧本”,从左侧目录选择章节。软件可识别常见中文章节、英文 Chapter / Part 和 Markdown 标题;没有标题时按“全文”阅读。
- 在搜索章节或正文输入关键词,点击匹配章节定位相关段落。正文较长时使用上一段 / 下一段续读;左侧的更多章节展开剩余目录。
- 点击让助手分析本章,回到对话输入框,补充需要分析的人物、情节或改编目标,检查文本模型后发送。这个按钮只准备草稿,尚未调用模型。
- 更换原著或修改全剧剧本后,点击重新读取,重新选择章节。若助手提示材料版本已变化,也应重新准备章节引用。
从工作台交给助手前,会先保存本集未保存的编辑,保存失败则留在当前操作。章节浏览读取的是整部剧的原著或全剧剧本,不会自动写入本集正文,也不会自动创建分集。
3.3 · 手动建立和管理分集
想自己决定每集内容时,点击剧集栏中的转为剧集并新增分集或新增分集。前一个按钮会先保留原画布为第 1 集,再额外新增一集空白画布;已经因添加原著或保存剧本而有了第 1 集时,可以直接编辑它,不必再为“第一集”多建一次。
点击分集名称切换画布,双击名称改名;鼠标移到分集行可看到上移、下移和删除入口。删除按钮需要再次点击确认,应先核对集名。每集分别创作,素材、角色、原著和全剧剧本按剧集共享;删除单集不删除整部剧共用的素材目录。
3.4 · 让 AI 先生成分集草案
- 点击剧集栏的生成 AI 拆分草案,或进入剧本创作工作台后点击右上角AI 拆分草案。
- 在拆分素材中选择全剧剧本或原著。所选素材未添加时,“在对话中生成预览”按钮不可用,需要先回到剧集栏准备资料。
- 填写目标总集数和单集秒数。初始值为 24 集、每集 90 秒;允许范围分别为 1–100 集、15–600 秒。按作品需要修改,不必使用默认值。
- 点击在对话中生成预览。这一步只把请求放进对话输入框,不会自动发送。关闭工作台,回到 AI 助手,选择已配置的对话文本模型,核对请求后发送;实际模型调用可能计费。
- 检查 AI 给出的逐集标题、本集任务、核心冲突、3–5 个情节点、开场钩子、反转或情绪爆点、结尾卡点,以及原著来源范围。还应检查它列出的遗漏和重复剧情。
- 不满意时,继续在对话中要求调整节奏、集数或事件分配。确认后,明确指出哪些草案需要创建,并要求先核对已有分集,避免重复。
- 创建分集需要可写模式。规划模式可看草案,但不能创建;协作模式会对创建操作请求确认,自主模式按已授权任务执行。完成后返回剧集栏,检查新增的分集名称和大纲。
拆分创建会得到新的空白分集画布,并写入对应的本集大纲。完整剧本正文和结构化创作要点还需要逐集编写;看到“已创建分集”不代表这些内容已经全部完成。
先核对当前已有分集,列出这次需要新增的分集清单,避免重复。
只按我确认的清单新增分集并写入对应大纲,保留已有分集。
本轮先不生成完整剧本正文,也不调用图片、视频或音频模型。
3.5 · 在剧本创作工作台逐集编辑
- 点击打开剧本创作工作台,在左侧选择要写的分集,先核对顶部显示的剧集和集名。
- 在本集大纲写清这集要推进的事件、主要冲突和结尾。已由 AI 拆分创建的分集,可以从已写入的大纲继续调整。
- 切到创作要点,补充下表中的字段,尤其是本集任务、主要情节点和目标时长。
- 切到本集剧本,手动输入完整正文,或使用右侧的根据集纲写正文准备 AI 写作请求。
- 编辑后点击底部保存本集,或在工作台内按 Ctrl + S;底部显示已保存后再切换到下一集。
| 创作要点 | 怎么填写 |
|---|---|
| 本集任务 | 用一句话写清本集必须完成的叙事推进。 |
| 核心冲突 | 谁与谁争夺什么,失败的代价是什么。 |
| 开场钩子 | 开场几秒用什么冲突、悬念或异常信息吸引观看。 |
| 反转或情绪爆点 | 本集最强的变化,以及支持这一变化的铺垫。 |
| 结尾卡点 | 让观众继续看的未完成事件、强台词或证据揭露。 |
| 主要情节点(每行一条) | 按发生顺序写,通常先整理为 3–5 条,每条推进信息、关系或情绪。 |
| 原著来源范围 | 填写对应章节或范围,例如“第 3 章 20%–45%”,方便回查。 |
| 目标时长(秒) | 填写希望本集达到的时长,例如 90;它是创作目标,不会自动设定后续成片长度。 |
本集任务、核心冲突、开场钩子、反转、结尾卡点和主要情节点旁有 AI 生成 / AI 润色:字段为空时显示生成,已有内容时显示润色。点击后会准备该字段的对话请求,通常给出三个候选;选择后只回填确认的字段,也可以手动复制到相应输入框并保存。来源范围和目标时长直接手动填写。
3.6 · 从全剧剧本提取人物、场景和道具
在剧集栏 → 剧本填写并保存完整的全剧剧本,再打开剧本创作工作台。右侧的全剧资产提取提供提取人物、提取场景、提取道具三个按钮;全剧剧本为空时按钮不可用。这里读取的是整部剧共用的剧本,不是当前分集的正文,也不是原著文件。
- 确认当前项目已配置可用的文本模型,并检查全剧剧本内容已经保存。
- 按需要分别点击提取人物、提取场景或提取道具。每次点击都会调用文本模型分析全剧剧本;请等待结果提示,模型调用可能计费。
- 成功后,提示会显示本次提取的数量,结果自动合并到剧集共享的创作资产库。打开左侧的创作资产核对人物、场景和道具;人物还可继续在角色库补充形象图、声音等资料。
- 提取结果仍需人工审阅:检查重名、重复条目、描述是否准确,并按实际制作需要补充或修订。需要更新时,先保存新的全剧剧本,再重新提取。
3.7 · 右侧 AI 写作按钮怎样使用
这些按钮共用同一套流程:选择分集 → 点击创作按钮 → 回到对话核对并发送 → 审阅草案 → 确认写回或手动粘贴 → 检查保存结果。点击创作按钮时,工作台会先尝试保存当前未保存的编辑;保存失败则不继续准备请求。工作台仍挡住对话时,先关闭工作台再查看输入框。
| 按钮 | 适合什么时候用 |
|---|---|
| 优化本集大纲 | 调整本集结构,同时保留人物关系、关键事件顺序和结局。 |
| 调整情节点 | 把内容整理为有递进关系的主要事件。 |
| 深度创作诊断 | 让 AI 从结构、冲突、节奏、对白可拍性、开场和结尾提出建议。 |
| 根据集纲写正文 | 已有大纲与创作要点,需要完整、可拍的本集剧本。 |
| 重写本集剧本 | 已有正文,希望先诊断,再得到完整修订稿。 |
| 对白润色 | 改善口语感、人物区分和对抗效率。 |
| 动作可拍化 | 把小说化心理或作者解释改成可见动作、对白、OS、道具或画面证据。 |
| 加强开场钩子 | 让开场更快建立冲突、悬念或异常信息。 |
| 加强核心冲突 | 明确对立双方、目标和代价,让矛盾有升级。 |
| 设计反转 | 设计有前置铺垫的反转或情绪爆点。 |
| 加强结尾卡点 | 把结尾收在未完成动作、强台词、证据揭露或关系变化上。 |
| 补表演标注 | 为关键情绪补充少量自然、可见的表演提示。 |
3.8 · 看懂创作诊断
右侧顶部的正文、场景、对白占比、预计时长和简短提示,会根据当前编辑内容做本地静态分析,不调用 AI。下方深度创作诊断则准备一条需要发送给模型的创作请求,两者的用途不同。
| 指标 / 提示 | 如何理解 |
|---|---|
| 正文 | 按去除空白后的正文字符数统计。正文为空时显示 0,不代表分集没建立。 |
| 场景 | 识别类似 1-1 场景名 内/外 日/夜 的场号。已有场景但统计为 0 时,先检查标题格式。 |
| 对白占比 | 按“人物名:台词”等可识别格式估算。比例低时检查是否有大量叙述或格式未被识别。 |
| 预计时长 | 按正文长度粗略估计,供节奏参考;不是朗读实测,也不是最终剪辑时长。 |
| 长对白、破折号或静态结尾 | 提示可能需要复核的写法,并不意味着每一处都必须修改。 |
| 长度与目标时长存在偏差 | 根据目标秒数给出字数参考,结合表演、动作和镜头节奏判断。 |
“仅提示,不阻断”表示这些提示不会阻止保存。没有发现静态格式问题,也不代表人物动机、剧情逻辑和情绪强度已经合格,仍需审稿。
1-1 旧书店 内 日
人物:林晚、店主
林晚把一封信放在柜台上。店主伸出的手停在半空。
林晚:这封信上的字,是你写的吗?
店主:谁让你找到这里的?
门外传来敲击声。林晚回头,信封里滑出一张旧照片。
3.9 · 保存、切集与排错
工作台里的大纲、正文和创作要点有独立的编辑草稿。底部显示有未保存修改时,使用保存本集或工作台内的 Ctrl + S 保存;不要仅凭画布有自动保存功能就直接退出。
有未保存内容时关闭工作台或在左侧切换分集,会提示当前修改还没有保存,要先保存吗?。选择继续编辑留在当前集;保存并继续保存后切换或关闭;放弃修改会丢弃本次未保存的编辑。剧集栏中的全剧“剧本”编辑弹窗使用自己的保存按钮,也应保存后再关闭。
| 看到的情况 | 检查与处理 |
|---|---|
| 还没有可编辑的分集 | 查看剧集栏是否已建立分集。生成草案后还需明确确认创建;单纯打开工作台不会建集。 |
| 在对话中生成预览不可点击 | 所选拆分素材未添加。选择已有的全剧剧本 / 原著,或先补充对应资料。 |
| 点了 AI 按钮,似乎没变化 | 关闭工作台,查看 AI 助手输入框;核对文本模型并发送已经准备的请求。 |
| 工作台右侧创作按钮变灰 | 先确认已经有分集可选,并等待项目加载或保存结束。截图中的空状态就是没有分集。 |
| 有大纲,正文或创作要点还是空的 | 拆分创建主要写入大纲;继续使用工作台逐集写正文、补充创作要点。 |
| 分集数量比目标多 | 原画布可能已成为第 1 集;批量创建只追加。核对原有分集与本次新增清单,不要重复执行整份草案。 |
| 提示只成功新增一部分 | 先检查实际新增列表,再只处理未完成项。当前画布保存失败时会取消新增,应先解决保存问题。 |
| 草案很多集,无法一次创建 | 草案目标最多 100 集,单次批量创建最多 60 集;确认清单后分批处理,每批核对结果。 |
| AI 给了新正文,工作台还是旧稿 | 确认是否只是聊天草案。明确要求写回当前集,或手动粘贴并保存;之后重新打开核对。 |
3.10 · 从本集剧本进入分镜制作
确认本集正文后,点击工作台的生成本集分镜。软件会先保存当前编辑,再在该集画布创建一份剧本来源快照和空分镜表,并打开生成弹窗。检查文本模型、正文引用与目标时长,再点击生成;创建表格本身不调用模型。
后续的镜头编辑、补图、改稿复核、配音/视频节点及时间轴操作见第 16 章。人物、场景、道具与角色动作库见第 14 章。修改剧本后请复核已有分镜;再次“生成本集分镜”会新建制作内容,不会自动同步旧表。
04 · 画布、节点与连线
| 想做什么 | 操作方法 |
|---|---|
| 选择与移动 | 单击节点选中;按 Shift 再单击追加选择。拖动节点标题移动节点。 |
| 编辑完整内容 | 选中一个内容节点后按 Space。输入文字时、多选时、分组或 Markdown 节点不使用这个快捷入口。 |
| 复制节点 | Ctrl + C / Ctrl + V;也可 Ctrl + 拖动非分组节点,在原位置留下副本。 |
| 建立上下游 | 从上游输出点拖到下游输入点。将连线拖到空白处,可创建已连接的下游节点。 |
| 整理布局 | 多选后用浮动工具栏对齐、分布或分组;Ctrl + G 分组 / 取消分组。调整尺寸时按 Shift 锁定宽高比。 |
| 找回视野 | 按 F 适配全部内容;M 开关小地图。右下角可直接调整缩放。 |
| 写批注与结构图 | 使用底部画布笔记工具绘制形状、箭头、文字和图片笔记。 |
两种画布交互方式
在设置 → 常规切换交互方式:Figma 模式用右键或中键拖动画布、滚轮缩放;经典模式用左键拖动画布、Ctrl + 滚轮缩放。刚切换模式时,先在空白处试一下拖动与缩放。
小地图统计、缩放与大画布浏览
按 M 显示小地图,再把鼠标移到小地图上方,可查看各类型节点数量和总数。统计跟随当前画布中实际展示的节点;被收纳隐藏的节点不计入,不等于磁盘素材文件数。
Figma 模式下普通鼠标滚轮直接缩放,macOS 普通鼠标也使用这一方式;触摸板保留双指平移与捏合。经典模式使用滚轮平移、Ctrl + 滚轮缩放。光标位于输入框、列表或弹窗时,先移回画布空白区域再操作。
缩到远景时,部分图片和视频节点会暂时只显示预览与连接点;停止缩放或平移后,软件逐步恢复细节。选中、编辑、播放、生成中或报错的节点会优先保留完整界面。此过程不删除节点、不压缩原始素材,也不产生新的撤销记录;检查清晰度时请打开全屏原图。
最近项目与画布操作记录
将鼠标移到窗口顶部中央的短横线,展开最近打开的项目栏;点击项目标签切换。剧集会归到整部剧的标签,当前分集的创作设置仍在项目设置中单独保存。
将鼠标移到画布右上方的短竖线,或用键盘聚焦入口,展开操作记录。可查看结构操作、撤销和还原;点击图钉可固定显示,再用展开 / 收起按钮控制列表。助手在主窗口展开时,入口会向左让出空间。
05 · 文本、图像、视频与音频
| 节点 | 典型操作 | 生成前检查 |
|---|---|---|
| 生成文本 | 输入写作、扩写或整理要求;连接上游资料,选择文本模型后生成。 | 资料是否引用完整,输出格式、语言和长度是否说明。 |
| 生成图像 | 写清主体、场景、构图和风格;按模型能力添加参考图。 | 模型是否支持参考图,比例/尺寸是否可用。 |
| 生成视频 | 描述动作和镜头变化;按模型选择文生视频、图生视频或首尾帧等能力。 | 时长、分辨率、首尾帧、参考图/音频/视频限制。 |
| 生成音频 | 选择语音或音乐模型,填写文本或歌词,再选择音色、格式等参数。 | 当前模型支持的是语音还是音乐;音色 ID 和输出格式是否有效。 |
| 全景 / 逐帧动画 | 从添加节点入口选择对应类型,设置适合的模型或工作流。 | 工作流分类、模型能力和输入要求是否匹配。 |
| 源文件节点 | 上传文件或拖入画布,作为可连接、可复用的素材。 | 文件能否正常预览,本地文件是否仍存在。 |
不同模型展示的参数不同。某个模型没有显示的能力,不能仅靠在提示词里写“8K”“60 帧”就当作已配置。更换模型后,重新检查参数和参考素材。
参考图、批量生成与输出历史
参考图可以来自上传、画布上的已有图片或角色库。添加后检查缩略图是否正确。普通图像模型支持批量且未选择工作流时,长按生成按钮可选择 2–8 张;不满足这些条件时,以当前按钮提供的选项为准。
同一节点可以多次生成,使用输出历史比较结果。实际失败或超时时,先检查服务端任务状态与输出历史,再决定是否重新提交,避免重复计费。
最近新增的内置媒体模型
在设置 → API Key打开相应厂商连接,勾选需要使用的模型并保存,再回到媒体节点选择。新模型不一定自动启用;不同平台的同名模型也可能具有不同参数。
| 入口 | 新增或调整 | 操作时注意 |
|---|---|---|
| APIMart 图像 | GPT Image 2.5 Flare / Sunburst,支持生成与参考图编辑。 | 当前应用配置支持 1K / 2K / 4K、最多 16 张参考图、每次最多 4 张结果;从节点实际提供的比例和批量选项中选择。 |
| APIMart 视频 | Gemini Omni 1.1 Flash、Flash Ext、Flash Preview。 | Flash / Preview 不发送手动时长;Ext 无参考视频时可选 4 / 6 / 8 / 10 秒,有参考视频时省略时长。Ext 参考图数量为 1 或 3 张,不能任意凑成 2 张;均不接收参考音频。 |
| CCC API 图像 | GPT Image 2.5 Flare / Sunburst。 | 在 CCC API 连接内启用后,从图像节点选择;不带参考图时生成,带参考图时按编辑请求提交。参数与可用能力以该连接为准,不直接套用 APIMart 的数量上限。 |
| RunningHub 标准模型 | 扩展图片、视频和音频模型,按具体模型提供专属参数。 | 展开节点的模型参数,补齐必填项;标准模型与云工作流的配置入口见13.4。 |
旧的 APIMart Omni-Flash-Ext 节点保留兼容处理;新建任务请在当前目录中选对应型号。APIMart 连接验证成功时可附带显示账户余额;余额查询失败不一定表示模型连接失败,也不表示本次生成免费。模型费用以服务商实际结算为准。
按分镜组织成片时,可直接用分镜表的推送时间轴,同时装配对白字幕和已就绪配音,再按下方流程精剪。
把素材剪成视频
- 选中有素材的视频节点,右键选择编辑视频;多选视频与图片后可选择编辑视频(N 个素材)。这个右键入口要求选择中至少包含一个视频。
- 在独立剪辑窗口点击添加素材加号,从素材库、本机文件或画布图片节点添加内容。
- 拖动时间轴片段调整顺序,拖动入点和出点裁切。把播放头放到需要切开的位置,点击分割或按 S;Space 播放 / 暂停。
- 按需要添加叠加轨、音频轨,在右侧属性 / 文字 / 转场中调整画面、文字和衔接。
- 右上角导出到本地保存 MP4;导出为新节点把成片回填画布;导出当前帧可回填图片节点。
在属性 → 导出查看当前使用“无损直通”还是“合成(重编码)”。混合分辨率、编码或使用叠加等处理时会走合成;尺寸和帧率按界面可用项选择,实际支持取决于本机编解码能力。
按节点编号连续查看图片
- 打开一个有图片的图像节点的全屏预览。
- 用两侧切换按钮,或 ↑ / ↓(也支持 ← / →),按当前项目的节点展示编号顺序浏览。
- 空图片节点和已收纳到角色库的隐藏节点会跳过;到第一张或最后一张时不循环。切换图片会复位缩放,不改变画布当前选择。
- 按 Esc 退出。切换项目或当前图片节点消失时,预览也会退出。
音频试听与全屏音乐播放器
有音频的节点,在尚未选中时单击先选中;已选中后单击音频展示区播放或暂停。双击音频展示区可打开占满应用窗口的音乐播放器,生成音频和源音频均可使用。
- 点击播放 / 暂停,拖动进度条定位,按需要调整音量或静音。
- 使用上一曲 / 下一曲,或方向键,按当前项目节点展示编号的数值顺序切换。空音频节点和已收纳隐藏的角色库节点会跳过,首尾不循环。
- 播放结束会顺序进入下一曲,最后一曲结束后停止。打开全屏会暂停节点内播放并接续当前位置,避免重复出声。
- 按 Esc 或关闭按钮退出;退出会停止全屏播放。切换项目也会关闭预览。
播放时的频率曲线来自实际音频信号。部分音源不能进行频谱分析时,会提示此音频暂不支持频谱分析,仍可正常播放;这与音频本身播放失败分别处理。频谱仅用于观察,不是降噪、修音或音色质量评分。
固定输出历史,连续定位结果
打开输出历史,启用顶部的固定面板。面板会缩成右下角常驻小窗,点击记录可定位对应节点并看到短暂的聚焦动效,面板保持打开,画布仍可操作。需要搜索、导出或清空历史时,先取消固定回到完整面板。固定状态下按 Esc 只折叠面板主体,也可用标题栏折叠按钮展开;固定选择随设置保存。这里的输出记录与画布撤销/重做的操作记录分别管理。
火山方舟:预计费用与本地用量记录
桌面版中,实际通过火山方舟连接执行的图片、视频节点可显示费用预估。点击节点模型选择器旁的预计金额 / 待估价,或在设置 → API Key → 火山方舟连接点击用量记录,打开同一份本地账本。
- 先检查项目、模型类型、状态、模型 ID 和日期筛选。默认查看当前项目、本月记录;查不到旧记录时先调整范围。
- 查看列表的预计与核算金额,打开详情核对提交参数、返回用量和价格快照。未知金额会显示待核对,不应当作免费。
- 需要留档时点击导出 Excel。默认脱敏;只有确实需要分享完整内容时,才勾选导出完整提示词并核对接收对象。
- 需要清理时切到清理记录,先核对筛选范围与数量、导出备份,再按界面要求输入确认文字。只清理已结束的本地记录,运行中和待核对任务保留。
| 看到的金额或状态 | 怎样理解 |
|---|---|
| 预计 | 按当前参数与本地价格规则估算;自动时长等不确定参数可能只能展示示例预算。 |
| 核算 | 依据实际返回的 Usage 或成功输出信息计算;优惠、资源包和税费仍可能与官方结算不同。 |
| 待核对 / 已取消 | 远端任务或金额证据不完整;先核对服务端和已有结果,不能直接按 0 元处理或自动重投。 |
| 没有记录 | 这份账本只覆盖已接入的方舟图片/视频节点调用;中转商的同名模型、文本/音频、其他入口不能据此认定已统计。 |
账本独立于项目包。需要更换存放位置时,在用量窗口点击更换目录,成功后再核对记录;原账本保留,目标目录已有同名账本时拒绝覆盖。清理本地记录不会删除媒体或云端账单。最终扣费以方舟官方账单为准。
06 · 自定义接口:先添加厂商与模型
先准备四项资料:服务基础地址、API Key、准确模型 ID,以及该模型的请求与响应文档。这些通常由你购买服务或部署网关的平台提供。
连接
保存“向哪里请求、用什么密钥”。同一厂商连接可以包含多个模型。
模型
决定“具体调用哪一个模型”。显示名称方便自己识别,模型 ID 要与平台完全一致。
调用协议
决定“怎样提交、怎样查询任务、怎样取结果”。特殊媒体接口需要单独配置。
- 打开齿轮 → 设置 → API Key → 添加厂商 → 自定义接口。
- 填写连接名称,例如“我的图像服务”。选择下面说明的对话协议。
- 在接口地址填写基础地址,例如
https://api.example.com/v1。这是占位域名,使用时换成服务商提供的地址;不要把管理后台网页地址填在这里。 - 把密钥填入专门的API Key输入框。密钥值是否带前缀要按配置方式判断,通常输入原始密钥;不要把整行
Authorization: Bearer …粘成密钥。 - 可点击验证连接、拉取模型。成功后勾选要启用的模型;平台没有模型列表接口时,也可手动添加。
- 手动添加时,在手动输入模型 ID中填写准确 ID,可再填写显示名称、选择文本 / 图像 / 视频 / 音频分类,然后点加号。
- 检查模型是否勾选、分类是否正确,以及是否允许在对应类型节点中显示。需要特殊请求格式时,先勾选模型,再点击该行调用协议。
- 检查完成后,点击底部添加厂商或保存更改。返回对应类型节点,确认模型已出现在选择列表里。
“对话协议”应该选哪个
| 协议选项 | 文档中的常见特征 | 选择依据 |
|---|---|---|
| OpenAI 兼容 | Chat Completions、Bearer Key、OpenAI SSE | 服务商明确使用 OpenAI 兼容对话格式。 |
| Anthropic 兼容 | Messages API、x-api-key、Anthropic 流式事件 | 请求和流式响应按 Anthropic 格式实现。 |
| Gemini 原生 | generateContent、x-goog-api-key、Gemini 内容结构 | 服务提供的是 Gemini 原生调用格式。 |
模型能选到,但参数缺了一项
视频模型行还提供视频参数能力配置。按文档声明任务类型、时长、比例、分辨率、帧率及参考素材限制。请求协议正确,和节点展示了正确参数,是两件需要分别核对的事。
接口地址失焦时会清理首尾空格、末尾斜杠及部分误贴的完整接口后缀;验证或拉取模型后也可能更正地址。操作后应再次检查界面中最终保存的基础地址。
07 · 自定义接口:从文档导入
已经拿到厂商调用示例时,可以先让软件识别,减少手填字段。支持 Fetch、Axios、cURL、Python、Raw HTTP 和 OpenAPI JSON 格式。
- 在厂商连接的模型区域点击导入文档。
- 将调用代码粘贴到提交请求示例;将对应接口的返回 JSON 粘贴到提交响应示例。优先使用完整示例,包括 URL、请求方法、请求体和响应结构。
- 如果提交只返回任务 ID,开启包含异步轮询,再提供轮询请求示例和任务完成时的轮询响应示例。仅提供“处理中”的响应,通常无法确定最终视频或图片的结果路径。
- 点击识别文档。核对识别出的基础地址、模型 ID、分类、提交路径、轮询路径,以及提示的警告。分类错误时可以修改后重新识别。
- 确认结果后点击应用配置。低可信结果需要按界面提示确认;要恢复本次导入前的内容,可用撤销导入。
- 进入该模型的调用协议,按后续章节检查请求预览与返回值结构,最后保存厂商设置。
也可以让 AI 助手协助整理
可以把厂商接口说明交给助手,请它核对提交、任务查询和结果字段,并预览配置草稿。描述任务时说明需要哪类模型、是否包含参考素材。仍按本章清单核对草稿;规划模式只读取资料,协作模式的配置写入需确认,自主模式会自动执行已授权配置写入。
08 · 自定义接口:手动配置调用协议
在模型行点击调用协议。接口与现成预设一致时使用对应预设;字段、路径或轮询方式不同,选择高级自定义。编辑器可切换表单 / JSON;初次配置可先填写表单,再用 JSON 核对整体结构。粘贴完整 JSON 后,切回表单,再使用其中的本地请求预览和返回值结构。
| 设置项 | 怎么理解与填写 |
|---|---|
| 执行模式 | 同步返回:首次响应直接包含结果。异步轮询:首次只给任务 ID,还需要持续查询。 |
| 鉴权方式 | 按文档选择 Bearer、自定义 Header、Query 参数或无需鉴权。Header/Query 名称要完全匹配文档。 |
| 密钥前缀 | Bearer 通常为 Bearer ,末尾有一个空格;不要重复拼接 Bearer。其他方式遵循平台说明。 |
| 方法与路径 | 方法支持 GET、POST;路径以 / 开头,填写同一服务下的相对路径,不填写另一个站点的完整 URL。 |
| 路径基准 | 连接地址保留基础地址的路径前缀;域名根路径从该域名根部开始。见下方示例。 |
| 请求体编码 | 提交支持 JSON、Form URL Encoded、Multipart Form Data;轮询支持前两者。上传式接口必须按文档选择,不能统一填成 JSON。 |
| Headers / Query / Body | 分别是请求头、URL 查询参数和请求体。字段名照文档;随节点变化的值用变量替换。密钥交给鉴权配置,不硬写进这些模板。 |
| 响应类型 | 同步可选 JSON、原始文本或原始二进制;异步提交与轮询按 JSON 配置。 |
| 结果与错误路径 | 告诉软件从响应的哪个字段取文本、媒体 URL、Base64 或错误消息。 |
地址拼接:最常见的 404 来源
假设连接地址是 https://api.example.com/v1,协议路径是 /images/generations:
| 路径基准 | 最终请求地址 |
|---|---|
| 连接地址(append) | https://api.example.com/v1/images/generations |
| 域名根路径(origin) | https://api.example.com/images/generations |
如果接口文档写 /v1/images/generations,可以用“不含 /v1 的连接地址 + 完整相对路径”,也可以用“含 /v1 的连接地址 + /images/generations”。不要在 append 模式里把 /v1 两边都写一遍。
这是说明书内的本地演示,只计算字符串,不联网、不保存配置。
自定义模型连接当前仍要求非空 API Key;新工作流 API连接则按每个工作流的鉴权设置检查,全部选择“无需鉴权”时可以不填密钥。平台若要求 Authorization 原样发送 Token,使用专门的鉴权设置并将前缀留空,不要在额外 Headers 中硬写 Authorization。详见13.6。
09 · 自定义接口:变量与结果路径
把固定示例改成跟随节点的请求
变量用双花括号,在 JSON 中写成字符串,例如 "{{prompt}}"。字段名必须保留服务商要求的名字;变量名表示从 AI Canvas 取哪一个值。
{
"model": "{{model}}",
"prompt": "{{prompt}}",
"n": "{{n}}",
"image_urls": "{{imageUrls}}"
}
整项变量会保留类型。"{{n}}" 可以替换为数字,"{{imageUrls}}" 可以替换为数组,不会因为模板中有引号就全部变成字符串。
| 变量 | 含义 | 使用时注意 |
|---|---|---|
{{model}} | 发送给接口的模型 ID | 不是自己起的显示名称。 |
{{prompt}} | 节点提示词 | 字段可能叫 prompt、text 或其他名称,按文档放置。 |
{{messages}} | 文本对话消息数组 | 用于接受消息数组的文本接口。 |
{{size}} | 如 1280x720 的宽高字符串 | 与 16:9、2K 不同。 |
{{aspectRatio}} | 如 16:9 的宽高比 | 使用平台允许的比例值。 |
{{width}} / {{height}} | 像素宽高 | 接口分开接收宽高时使用。 |
{{imageSize}} | 如 2K 的分辨率档位 | 具体枚举由模型决定。 |
{{n}} | 本次请求的结果数量 | 服务需要支持多结果。 |
{{imageUrls}} / {{imageUrls.0}} | 图片数组 / 第一张图片 | 数组下标从 0 开始,输入素材需满足接口格式。 |
{{firstImage}} / {{lastImage}} | 视频首帧 / 尾帧 | 模型和任务类型必须支持相应输入。 |
{{duration}} / {{durationText}} | 数字时长 / 字符串时长 | 按服务要求的值类型选择。 |
{{fps}} | 视频帧率 | 不能假设每个模型都接收。 |
{{audioVoice}} / {{audioFormat}} | 音色 ID / 音频格式 | 音色名称与平台 ID 可能不同。 |
变量按模型类别提供,以编辑器的可用变量为准,悬停可看解释。整项变量没有可用值时,该字段会省略;缺失变量如果嵌在普通文字里,例如 "prefix-{{missing}}",会报错。可选素材是否允许省略,还要符合服务端要求。
工作流 API 的自定义参数使用 {{parameters.参数名}},例如 {{parameters.duration}};这个参数对象由工作流的“能力与参数 JSON”提供,普通模型不会自动提供它。工作流媒体数组还包括 {{videoUrls}} 和 {{audioUrls}},完整配置见13.7 的可复制示例。
软件怎样从响应中找到结果
返回值路径用点号访问对象,数字访问数组,* 提取多个结果。不要把整个 JSON 对象当成媒体地址。
{
"data": [
{ "url": "https://media.example.com/result-1.png" },
{ "url": "https://media.example.com/result-2.png" }
]
}
| 路径写法 | 取到的内容 |
|---|---|
data.0.url | 第一张图片地址。 |
data.*.url | 全部图片地址;上述示例提取两项。 |
choices.0.message.content | 常见 OpenAI 文本响应中的正文,需与实际 JSON 对照。 |
error.message | 响应内错误说明;只适用于实际存在该字段的接口。 |
如果返回的是 Base64,填写对应的 Base64 路径,并提供 image/png、audio/wav 等正确 MIME 类型。原始二进制响应则选择对应响应类型,不要强行当作 JSON 解析。
10 · 完整示例:同步图像接口
教学占位示例 以下域名、模型 ID 和路径只演示配置方法。示例通过当前版本的静态校验与本地请求构建;没有调用真实厂商,不能作为任意平台的通用配置。
这个例子假设服务这样工作
- 基础地址:
https://api.example.com/v1。 - 模型 ID:
image-model-example,模型分类选择图像。 - 以 Bearer 密钥调用
POST /images/generations。 - 接口直接返回上一章
data[].url形式的图片地址。
- 按第 06 章添加连接和图像模型,勾选该模型。
- 打开调用协议 → 高级自定义 → JSON,将下面的完整协议粘贴进去。
- 切回表单,展开本地请求预览,在示例变量 JSON中填写模型 ID、提示词、尺寸和数量。确认相对路径为
/images/generations,请求体里的n是数字。该区域不展示真实连接地址;结合本例基础地址和 append 模式,实际请求地址应为https://api.example.com/v1/images/generations。 - 在表单的返回值结构粘贴示例响应,确认
data.*.url能提取图片地址。 - 改成真实厂商资料后,如需联调可执行一次试跑;检查返回结果,最后保存厂商设置,回到图像节点使用。
{
"model": "image-model-example",
"prompt": "一只坐在窗边的小猫,水彩插画",
"size": "1024x1024",
"n": 1
}
{
"version": 2,
"mode": "sync",
"auth": { "type": "bearer" },
"submit": {
"method": "POST",
"path": "/images/generations",
"pathMode": "append",
"bodyEncoding": "json",
"body": {
"model": "{{model}}",
"prompt": "{{prompt}}",
"size": "{{size}}",
"n": "{{n}}"
}
},
"response": {
"type": "json",
"result": { "urlPath": "data.*.url" },
"errorPath": "error.message"
}
}
换成你的平台,需要改哪里
核对实际基础地址、模型 ID、鉴权方式、提交路径、请求体字段与结果路径。例如服务只返回 {"output":{"image":"…"}},就将 urlPath 改成 output.image;服务不接受 n,按它的文档移除该字段。修改后重新检查预览与响应匹配。
11 · 完整示例:异步视频接口
很多视频接口先返回任务编号。AI Canvas 保存这个编号,再定期查询,直到任务成功、失败或超过限制。任务编号、状态、结果地址分别在不同位置,必须逐项配置。
教学占位示例 假设基础地址为 https://api.example.com/v1,模型 ID 为 video-model-example,分类选择视频。
{
"data": { "id": "job-example" }
}
{
"data": {
"status": "completed",
"output": { "url": "https://media.example.com/result.mp4" }
}
}
表单中逐项填写
手动填表单,或将下方完整协议粘贴到 JSON 页后切回表单。展开本地请求预览,在示例变量 JSON 中给 model、prompt 和数字 duration 赋值。预览展示相对路径,真实地址还需结合连接地址与路径基准核对。
响应示例与路径校验一次只有一个输入框:先粘贴上方提交响应,检查任务 ID;再换成完成响应,检查状态和最终视频地址。另一阶段的字段暂时未匹配是正常的,不要求两类响应在一次输入中同时通过。
| 配置项 | 本例填写 | 理由 |
|---|---|---|
| 执行模式 | 异步轮询 | 首次响应只返回编号。 |
| 提交方法 / 路径 | POST / /videos | 按本例假设,路径基准为连接地址。 |
| 任务 ID 路径 | data.id | 第一次 JSON 中编号所在的位置。 |
| 查询方法 / 路径 | GET / /tasks/{{submit.data.id}} | 从原始提交响应取得真实编号。 |
| 状态路径 | data.status | 查询 JSON 中的状态位置。 |
| 成功 / 失败值 | completed / failed、error | 需要匹配该厂商实际状态值。 |
| 最终结果路径 | data.output.url | 完成响应内真正的视频地址。 |
| 轮询间隔 | 3000 毫秒 | 每 3 秒查询一次。 |
| 最大次数 / 最长时长 | 200 次 / 表单填 600 秒 | JSON 最长时长使用毫秒,即 600000。 |
{
"version": 2,
"mode": "async",
"auth": { "type": "bearer" },
"submit": {
"method": "POST",
"path": "/videos",
"pathMode": "append",
"bodyEncoding": "json",
"body": {
"model": "{{model}}",
"prompt": "{{prompt}}",
"duration": "{{duration}}"
}
},
"response": {
"type": "json",
"taskIdPath": "data.id",
"errorPath": "error.message"
},
"poll": {
"method": "GET",
"path": "/tasks/{{submit.data.id}}",
"pathMode": "append",
"intervalMs": 3000,
"maxAttempts": 200,
"maxDurationMs": 600000,
"response": {
"statusPath": "data.status",
"successValues": ["completed"],
"failureValues": ["failed", "error"],
"result": {
"urlPath": "data.output.url",
"mimeType": "video/mp4"
},
"errorPath": "data.error.message"
}
}
}
带参考图的视频怎样改
先查服务要求。有的平台接收 "image_url":"{{firstImage}}",有的平台接收图片数组或嵌套对象;不能把它们互换。模型支持首帧时,才在节点中添加首帧,并将对应变量放进文档要求的字段。参考音频、视频同理,以编辑器可用变量和平台素材限制为准。
轮询限制与取消
最大次数或最长时长任一达到,就会超时;两项都留空表示不限,通常建议按服务预计耗时设置合理限制。查询过程可对部分临时网络错误重试,默认针对 408、429、500、502、503、504 等状态,连续最多 3 次;提交生成请求不会自动重试。
试跑中可点击取消。取消本地等待不代表服务商已经撤销云端任务或退费;再次提交前先查平台任务记录。服务端任务完成后,软件还需要成功提取结果地址,才算得到可用视频。
12 · 自定义接口:验证与排错
五种操作,不是同一个“测试”
| 按钮 / 区域 | 实际作用 | 是否向服务发请求 |
|---|---|---|
| 识别文档 | 从调用代码和响应示例生成配置草稿。 | 否,本地静态解析。 |
| 本地请求预览 | 显示变量替换后的方法、相对路径、Headers、Body;密钥显示掩码。真实连接地址需单独核对。 | 否。 |
| 返回值结构 | 用你粘贴的响应 JSON 检查路径是否能匹配结果。 | 否。 |
| 验证连接 / 拉取模型 | 检查服务连通性或获取模型列表。 | 是;不证明某个生成接口一定可用。 |
| 试跑 | 使用当前凭据和示例变量真实请求;异步接口继续轮询。 | 是,可能产生费用。 |
建议顺序:检查请求预览 → 检查返回值结构 → 需要时试跑一条最小任务 → 保存厂商设置 → 在实际节点中生成。
| 现象 | 优先检查 | 处理方向 |
|---|---|---|
| 模型不在列表中 | 模型是否勾选、分类是否正确、分类是否允许显示、是否保存连接。 | 重新检查模型行和连接保存状态,再打开相应类型节点。 |
| 拉取模型失败 | 地址、对话协议、密钥,以及服务是否提供模型列表接口。 | 核对文档;没有列表接口时手动添加准确模型 ID。 |
| 401 / 403 | 密钥、鉴权方式、Header/Query 名称和前缀。 | 检查密钥是否有效,避免 Bearer 重复或缺少空格。 |
| 404 | 最终 URL 是否正确,/v1 是否重复,append/origin 是否选对。 | 对照文档核对预览的相对路径,再结合连接地址与路径基准计算实际地址;可用第 08 章的地址演示辅助检查。 |
| 400 / unsupported field | 字段名、数字/字符串类型、枚举值及模型能力。 | 从最小请求开始,移除文档没有的字段,再逐项增加参数。 |
| 429 | 平台并发、频率、账户额度和响应中的错误说明。 | 降低并发,按平台要求等待;不要反复点击生成。 |
| 变量没有可用值 | 变量拼写、模型类别、节点是否提供对应素材。 | 只用可用变量;检查缺失变量是否嵌在普通字符串中。 |
| 未找到任务 ID | 首次响应 JSON 和 taskIdPath。 | 将任务 ID 路径指向实际字段,查询模板同样引用真实响应。 |
| 一直轮询 | 状态路径、成功/失败值、查询是否绑定本次任务。 | 用“完成”与“失败”的真实响应核对状态配置,并设置等待上限。 |
| 完成但未返回配置的结果 | 轮询中的结果路径,是否指向最终文件 URL。 | 修正结果路径;Base64、文本和 URL 要使用对应类型。 |
| 文本节点可用,助手不可用 | 对话协议与高级文本协议的流式能力。 | 高级文本协议用于助手 / Agent 时须真正支持并声明 OpenAI SSE。连接级 Anthropic/Gemini 是另一条适配路径。 |
| 重启后密钥失效 | API Key 页是否提示凭据无法保存、仅本次会话有效。 | 在支持凭据存储的桌面环境重新配置;普通连接配置不承载密钥。 |
13 · 本地与云端工作流
先确认工作流由哪里执行,再选择入口。保存工作流只是保存配置;在生成节点点击生成,或让助手实际执行时,才会运行任务。
| 类型 | 配置入口 | 准备的资料 |
|---|---|---|
| ComfyUI | 设置 → ComfyUI → 管理工作流 | 自己的 ComfyUI 服务、API 格式工作流 JSON,以及服务端所需模型和自定义节点。 |
| RunningHub 云工作流 / AI 应用 | API Key → RunningHub配置密钥;管理工作流中选择相应导入来源。 | 平台工作流或 AI 应用链接 / ID、API 定义与参数映射。 |
| 通用工作流 API | API Key → 添加厂商 → 工作流 API | 平台地址、鉴权要求、提交/查询文档、输入能力与结果示例;可从 AutoDL H3 模板起步。 |
| 普通厂商模型 | API Key → 相应厂商 / 自定义接口 → 模型 | 模型 ID 与模型调用协议,详见第 06–12 章。 |
13.1 · 配置 ComfyUI,并绑定服务器
- 先在自己的 ComfyUI 环境确认工作流能运行。在设置 → ComfyUI填写默认服务地址并检查连接;端口使用该服务的实际端口。
- 有多台机器时,添加额外服务器,分别填写便于识别的名称和地址,例如“本机生图”“远程视频”。连接状态只说明服务可达,不证明模型和节点已齐备。
- 进入管理工作流,将导入来源选为ComfyUI 工作流,填写名称、分类并导入API 格式 JSON。普通界面格式的 nodes / links 文件用于保留布局,不能直接代替执行所需的 API 格式。
- 检查识别出的输入并保存。在工作流卡片的服务器选择中绑定目标服务器;未绑定时使用默认服务。
- 回到对应图像、视频、动画或音频节点,在模型/工作流选择器中选中工作流,检查参数与素材,再生成一条验证。
工作流绑定的额外服务器被删除后,普通已保存工作流可能回落到默认地址,继续使用前应重新核对绑定。助手动态创建的工作流会在发现、校验和执行时核对所选服务器;地址变化后需要重新校验,不会沿用旧校验结果提交到另一台机器。
在对话中可先要求助手“列出已配置的 ComfyUI 服务器”,再明确指定服务器名称,让它检查模型和节点、校验工作流、执行并保存。实际执行沿用当前会话模式和生成权限;服务器名称应与设置一致。
13.2 · 默认输入、显式引用与参数
- 展开工作流卡片,点击输入节点徽章,把提示词、图片、视频或音频的目标设为★ 默认输入。
- 在生成节点中写提示词并添加参考素材。没有显式分配时,该类型内容交给对应默认输入。
- 需要指定具体位置时,在提示词里 @ 工作流输入节点并赋值。同一类型只要有显式分配,该类型就按显式输入处理,不再额外使用默认节点;其他类型的默认输入仍可生效。
- 检查比例、分辨率、帧率和时长在工作流中是否存在可识别的对应字段。自定义节点的特殊参数不能仅靠提示词中的数字来配置。
13.3 · 在 ComfyUI 编辑,再保存回 AI Canvas
- 在工作流卡片点击在 ComfyUI 中编辑,等待“正在载入”结束并确认节点图实际出现。失败时查看错误,再点击重试打开。
- 修改节点或参数后,在应用打开的 ComfyUI 窗口使用保存到 AI Canvas;要保留旧版则使用另存到 AI Canvas创建新记录。
- 多标签编辑时,先切到需要保存的那张图再保存。软件按标签对应的工作流保存;不要只凭同名文件判断覆盖目标,导出过程中也不要切换标签。
- 返回管理面板检查更新后的工作流和 ★ 默认输入。删除过的输入节点不会继续作为默认目标,必要时重新指定。
应用内编辑与保存回写依赖桌面版,自动载入/保存桥接仅用于本机回环服务。远程 ComfyUI 可以执行工作流,但编辑窗口不具备同样的自动回写能力;按提示在服务端编辑并重新导入。临时断线时先恢复连接,不必关闭已有未保存的编辑窗口。
13.4 · RunningHub:模型密钥与工作流密钥
打开设置 → API Key → RunningHub。连接卡片分别显示“模型连接”和“工作流连接”的配置状态,可只配置当前需要的一种。工作流缺少密钥时,不代表已经配置的模型密钥失效。
| 密钥字段 | 主要用途 | 接下来在哪里操作 |
|---|---|---|
| 模型 API Key(企业级 / 共享) | RunningHub 标准媒体模型。 | 勾选模型并保存,在生成节点展开模型参数。 |
| 工作流 API Key(消费级 / 会员) | 云工作流与 AI 应用。 | 进入管理工作流导入定义,再核对“使用连接”。 |
云工作流导入界面也允许选择“模型 API Key”连接;应使用平台授予该工作流访问权限的密钥,不要把两类凭据视为可无条件互换。
13.5 · 导入 RunningHub 云工作流或 AI 应用
- 打开管理工作流,在“导入工作流”的来源中选择“RunningHub 云工作流”或“RunningHub AI 应用”。右侧列表随来源筛选,找不到旧条目时先检查来源及输出分类。
- 填写名称、输出类型(图片 / 视频 / 音频)、使用连接,再填写平台链接或 ID。
- 点击从 RunningHub 读取定义。也可展开从官方 API JSON / 调用示例导入,粘贴 JSON / curl 或选择 JSON 文件,点击解析并预览。这两种读取操作不生成素材。
- 逐项检查参数映射中的节点 ID、字段名和类型。固定设置选“固定值 / 每次可调整”;文本输入映射“本次提示词”;媒体输入分别映射图片、视频或音频参考。
- 媒体参考序号在界面中从 1 开始,图片、视频、音频分别计数。检查必填项、默认值;不想覆盖的参数使用不覆盖此参数。只需某些结果时,可填写限定输出节点。
- 按实际账号权限选择默认 / Plus 实例和个人队列;Plus 可能增加费用。点击添加云工作流或保存修改。
- 在对应媒体节点选择工作流,展开云工作流参数填写本次值,并用连线或 @ 提供参考素材。检查后生成,在节点查看上传、排队、执行和保存结果。
本地参考素材通过 RunningHub 的上传入口处理。云工作流的类型化参数与 ComfyUI 的 ★ 默认输入是两套配置;切换导入来源后应按该平台的界面重新核对。
13.6 · 通用工作流 API:添加平台与多个工作流
这个入口适合平台已经把工作流发布成 HTTP API 的情况。一个连接保存平台地址和密钥,连接内可以创建多个命名工作流,每个工作流分别配置输入和输出。只有固定 AutoDL 模板、看不到下述按钮时,需要安装包含通用工作流 API 更新的版本。
- 进入设置 → API Key → 添加厂商 → 工作流 API,填写连接名称、平台基础地址及专用 API Key / Token。
- 点击添加自定义工作流,填写工作流名称并选择输出类型。需要 H3 时也可点击添加 AutoDL H3 模板,再按平台文档修改。
- 点击编辑调用路径与参数映射,配置同步/异步、鉴权、提交路径与请求体、任务 ID、查询路径、状态和结果路径。表单 / JSON 的用法与第 08–12 章相同。
- 在能力与参数 JSON声明需要多少图片、视频和音频,以及每次可以填写的参数。下面的 13.7 给出完整示例;能力声明和发给平台的请求体需要分别填写。
- 使用检查配置和协议编辑器里的本地预览排查格式。它们不会创建计费任务,也不证明 Token 权限或服务端运行已经验证;工作流卡片的协议编辑器用于本地校验,真实执行从生成节点发起。
- 点击底部添加厂商 / 保存更改。一个连接可继续添加多个工作流;每张工作流卡片都需填写有效名称、能力及协议,单张无效也会影响保存。
- 回到相同输出类型的生成节点,在选择器中选保存的工作流。展开工作流输入,填写本次参数,添加参考素材后生成。
节点中留空的参数使用工作流声明的默认值;必填但没有默认值的项需要填写。声明了一个参数不等于平台已经收到它,还要在请求体中用 {{parameters.参数名}} 映射。保存连接分享文件时不包含 Token,导入到另一连接或电脑后需重新配置凭据,并核对工作流的连接归属。
13.7 · 可复制示例:输入能力与请求协议怎样配合
下面假设一个视频工作流需要 1–4 张图片、可选 1 段音频,并接收时长、分辨率和随机种子。路径、字段、枚举及返回值均为占位示例,复制后按真实平台文档修改;它不是 AutoDL 或 RunningHub 的现成配置。
{
"references": {
"image": { "min": 1, "max": 4 },
"video": { "min": 0, "max": 0 },
"audio": { "min": 0, "max": 1 }
},
"parameters": {
"duration": { "type": "integer", "label": "时长(秒)", "required": true, "default": 5, "min": 1, "max": 15 },
"resolution": { "type": "string", "label": "分辨率", "default": "720p", "options": ["480p", "720p"] },
"seed": { "type": "integer", "label": "随机种子" }
},
"prompt": { "required": true, "maxLength": 10000 }
}
| 设置 | 界面与执行含义 |
|---|---|
references | 按 image / video / audio 分别声明 min / max;max 为 0 表示不接收该媒体。可额外用 extensions 声明允许的扩展名数组。 |
parameters | 支持 string、number、integer、boolean;label 是显示名,default 是留空时的默认值,min / max 限定数值,options 提供枚举。 |
prompt | required 控制提示词是否必填,maxLength 限定长度。 |
businessStatus(可选) | 平台 HTTP 成功后仍用 code 等字段表示业务结果时,配置 path、successValues 和可选 errorPath。它与轮询的“任务是否完成”状态分别判断。 |
{
"version": 2,
"mode": "async",
"auth": { "type": "bearer" },
"submit": {
"method": "POST",
"path": "/workflows/run",
"pathMode": "origin",
"body": {
"prompt": "{{prompt}}",
"image_urls": "{{imageUrls}}",
"audio_urls": "{{audioUrls}}",
"duration": "{{parameters.duration}}",
"resolution": "{{parameters.resolution}}",
"seed": "{{parameters.seed}}"
}
},
"response": { "type": "json", "taskIdPath": "data.task_id", "errorPath": "message" },
"poll": {
"method": "GET",
"path": "/tasks/{{submit.data.task_id}}",
"pathMode": "origin",
"intervalMs": 3000,
"maxDurationMs": 7200000,
"response": {
"statusPath": "data.status",
"successValues": ["completed"],
"failureValues": ["failed", "cancelled"],
"errorPath": "message",
"result": { "urlPath": "data.results.*.url" }
}
}
}
示例提交响应为 {"data":{"task_id":"demo-task-1"}};完成响应为 {"data":{"status":"completed","results":[{"url":"https://media.example.com/video.mp4"}]}}。若实际响应中任务 ID 叫 id,就需同时修改任务 ID 路径与查询变量。{{model}} 在工作流中表示工作流标识,不应盲目当作上游的模型名;接口要求固定模型或远端工作流 ID 时,按文档填入实际值。
多图、多音频的两种映射方式
接口接收数组时,使用上例的整项变量 "{{imageUrls}}"、"{{audioUrls}}"。接口使用编号字段时,逐项填写 "ref_image_0": "{{imageUrls.0}}"、"ref_image_1": "{{imageUrls.1}}" 等,直到覆盖允许输入的数量;音频同理。这里的数组下标从 0 开始。
未提供的编号变量会省略该字段。传入多张图却只映射 .0,会提示“未映射全部参考素材”;应补全数组或编号映射,而不是把几张 URL 拼成一个普通字符串。自定义参数整项替换会保留数字、布尔或字符串类型,seed 未填写且无默认值时可省略。
13.8 · 从 AutoDL H3 模板开始
在工作流 API 连接点击添加 AutoDL H3 模板,可得到“H3 多图多音频生视频(升级画质)”的起步配置。模板的地址、参数和映射均可编辑;使用前仍需确认所用平台部署的是对应工作流。
| 项目 | 当前模板设置 |
|---|---|
| 输出与素材 | 视频输出,1–9 张图片、0–3 段音频,不接收参考视频;图片按 ref_image_0 起、音频按 ref_audio_0 起依次传入。 |
| 时长与尺寸 | 1–15 秒整数,默认 5 秒;分辨率选 480p竖 / 768p竖 / 480p横 / 768p横 / 480p(1:1) / 768p(1:1),默认 768p竖;seed 可选。 |
| 提交路径 | /api/v1/comfyui/comfyui_workflow/minimax_h3_zm_u24,POST JSON,从域名根路径开始。 |
| 查询路径 | /api/v1/comfyui/comfyui_workflow/result/{{submit.data.task_id}},GET。 |
| 鉴权 | 通过专用 Authorization 鉴权发送原始 Token,前缀为空。不要额外加 Bearer,也不要把 Token 写进请求体。 |
| 业务状态 | 按 code 的 Success 判断请求业务成功,并从 msg 取错误说明;仍需继续查询任务完成状态。 |
H3 模板中的多张图片是按顺序提供的参考素材,不自动赋予视频首帧/尾帧的专属语义。旧版固定 H3 配置仍可使用;在新连接中编辑并保存后,以新版参数定义为准。
13.9 · 断线、停止等待与结果保存失败
| 当前状态 | 下一步 |
|---|---|
| 已有任务 ID,查询中断 | 恢复网络或凭据后,在原节点点击继续查询或继续查询 / 保存。继续处理原任务,不重新生成。 |
| 提交状态未知,没有收到 ID | 到对应平台核对是否创建了任务;找到后把 ID 填入节点恢复区,再继续查询。先核对再操作,避免重复计费。 |
| 生成完成,但保存失败 | 检查磁盘空间与下载网络,再继续查询 / 保存。平台已有结果时优先取回原产物。 |
| 点击停止后仍显示平台运行 | 停止本地等待不代表服务端任务停止。RunningHub 云工作流可尝试远端取消;标准模型与通用工作流 API 需按平台实际状态处理。 |
| 需要解除旧任务限制 | 先在平台确认任务未提交或已结束,再展开节点恢复区,勾选对应确认项后清除本地恢复记录。清理记录本身不会取消平台任务。 |
| 配置或站点已经更换 | 旧任务按提交时的服务和协议恢复;连接被删除、改到其他站点或原工作流不再匹配时,先到平台找回旧任务,不能靠更换新接口继续查询。 |
关闭 AI Canvas 会停止本地等待,平台已提交的任务可能继续运行。重新打开后回到原项目核对恢复记录和结果。ComfyUI 已取得任务 ID 的任务也按原服务地址续查;没有收到提交 ID 时,不应把重新生成当作恢复。
13.10 · 可选参考、时长与实时进度
ComfyUI 工作流中的图片、视频或音频输入如果确实是可选项,未提供素材时可以留空;提交前会绕过能够确认的空可选分支。必填连接、无法识别的结构和独立输出仍保留,不能靠留空来跳过必填条件。遇到校验错误时,检查节点是否缺失、文件输入是否有效,以及实际必填关系。
视频节点没有设置秒数或旧帧数时,ComfyUI 路径默认显示并提交 5 秒;已有旧帧数按帧率换算。实际工作流能否接受该时长还取决于节点声明的参数范围,修改后应核对服务端执行结果。
生成中可查看经过时间、当前执行节点和可用的采样进度。百分比表示当前执行节点的进度,不是整条工作流的总进度;切换执行节点后可能重置。当前节点达到 100% 后仍可能编码、保存和下载,只有媒体结果实际回到画布才算完成。实时进度连接不可用时仍可依靠任务查询判断状态,已有任务按 13.9 继续查询。
13.11 · AuK / Qwen3 语音工作流
在工作流管理查看内置语音工作流,按 13.1 绑定已准备好的 ComfyUI 服务器,再在生成音频节点中选择。内置模板不会自动安装节点、下载模型或启动 ComfyUI。缺少工作流所需节点或模型时,先在目标服务器解决依赖,再执行生成。
| 列表名称 | 输入与用途 | 选择前检查 |
|---|---|---|
| AuK 文生语音 | 填写新台词,通过声音类型与语速描述引导合成。 | 目标服务器具备 AuK 及保存音频所需节点和模型。 |
| AuK 参考音频与声音克隆 | 填写新台词,提供参考音频,沿用参考音色。 | 先确认样本可听,面板显示带参考语音;缺少样本时不按纯文本任务强行运行。 |
| Qwen3-TTS-01-原声1比1克隆 | 参考音频与新台词分开输入,参考转写由工作流处理。 | 需要 Qwen TTS、ASR 与对应模型。“1比1”为工作流名称,不是相似度保证。 |
| Qwen3-TTS-02-文生语音抽卡 | 用新台词和声音描述设计音色,不要求参考音频。 | 抽卡会改变声音设计种子;满意后可改固定种子,实际稳定性仍需试听。 |
| Qwen3-TTS-03-参考音频抽卡-支持方言 | 参考音频提供说话方式和方言参考,声音描述指定目标音色。 | 另需 SeedVC 转换节点及模型;节点缺失不能运行,方言效果需实测。 |
- 选择匹配任务的工作流,正文只写要生成的新台词。
- 克隆或参考路径通过角色主声音、@ 声音引用、连线或显式音频输入提供样本。先试听确认,避免多个不同样本来源混淆;工作流显式音频输入优先。
- 打开节点下方的语音参数。AuK 在纯文本状态显示声音类型;有参考时以参考音色为准,并支持添加、替换、移除参考。语速通过描述引导,不能当作精确倍速。
- Qwen3 按所选工作流显示原声克隆 · 参数、声音抽卡 · 参数或参考音频抽卡 · 参数。先设置语言、参考或声音描述、固定 / 抽卡模式;高级采样与模型运行选项可先保持默认。
- 先生成一小段并试听,检查漏字、截断、发音与音色,再按段落继续。生成完成后保存实际音频,用于 视频剪辑或角色库。
AuK 的生成时长与 Qwen3 的生成长度上限不是同一个参数。Qwen3 不提供精确生成秒数,token 上限过低可能截断台词;01 克隆不显示无效的描述式语速,02 用声音描述引导语速,03 的最终时长还受转换参数影响。切换 Qwen3 工作流会保留各自参数;恢复此工作流默认参数仅清除当前工作流的覆盖设置。
只有包含可识别语音节点与连接的工作流才显示专用参数面板。面板没出现时先核对所选工作流与实际结构,不要将其他厂商的音色 ID、语速倍率或秒数参数照搬进来。工作流提交后按 13.9 处理查询或保存失败。
14 · 资产库、节点、角色与动作
这一章把“剧本里的设定”连接到“生成时真正使用的素材”:先整理人物、场景和道具,再制作参考图,最后为角色积累形象、声音与动作资料。整部剧的分集共用创作资产和项目角色,切集时可继续引用。
14.1 · 四个页签与资产侧栏
通过原有资产入口打开大面板;在画布操作状态按 Tab 可打开或收起左侧资产库,便于同时看素材和画布。顶部有项目文件、全局资产、创作资产、节点列表四个页签,各自统计不同内容。输入框获得焦点时,Tab 仍用于正常输入导航。
| 标签 / 面板 | 管理什么 | 怎样继续使用 |
|---|---|---|
| 项目文件 | 当前项目素材目录中的图片、视频、音频等文件;剧集下按共享素材目录管理。 | 按类型、标签或名称筛选,把文件卡片拖到画布添加节点。 |
| 全局资产 | 可跨项目使用的全局素材文件。 | 找到素材后拖到当前画布,检查实际预览。 |
| 创作资产 | 人物、场景、道具的名称、简介、视觉要点及绑定图片。 | 在节点提示词中 @ 引用;人物还可进入角色库补充资料。 |
| 节点列表 | 当前画布上的所有节点类型,包括文字、图片、视频、音频、笔记和插件节点。 | 按名称、类型或编号搜索,查看节点内容、定位或拖线连接;不是另一份磁盘文件副本。 |
| 角色库 | 集中管理角色档案、多张参考图、声音和动作;有“本项目”“全局资产”两个范围。 | 先选择范围和角色,再编辑、复制或把参考素材放回画布。 |
通过上传文件或拖入画布可导入新素材。按 Alt + Space 搜索项目、全局及已添加外部目录中的素材;备用快捷键是 Ctrl + Shift + Space。资产管理里的“全局资产”文件页与角色库里的“全局资产”角色页,内容和数量分别统计。
左侧资产库:查找、定位与连线
- 按 Tab 打开左侧资产库。每次从画布打开默认跟随当前项目;项目文件可另选范围,节点列表始终是当前画布。
- 切到所需页签后搜索。项目文件按文件名、标签或类型筛选;节点列表按名称、类型或编号查找。列表较长时继续向下滚动加载。
- 在节点卡片点击查看节点定位到画布;左侧面板保持打开,大面板则关闭后定位。节点卡片直接展示图片、视频封面、文字摘要或音频播放器。
- 从卡片的输出端口拖到目标画布节点输入端口,或从卡片输入端口连接已有上游输出端口。也可落在目标节点对应的左右半区;检查实际连线方向与端口类型。
- 松开后生成正常画布连线,可以撤销/重做。重复连接、自连接和同方向端口连接会被拒绝;拖到空白处不会自动新建节点。笔记等没有对应端口的卡片不能强行连线。
- 按 Esc 或点击收起按钮关闭。拖线时按 Esc 会先取消当前拖线。
视频缩略图与悬浮播放
资产库、节点列表、角色库、创作资产、项目资产和输出历史中的视频优先显示静态封面。点击封面或播放入口后,在所属面板内展开播放器,列表位置保持不变。同一窗口一次只播放一个预览;点击其他视频、切换项目/页签/筛选或关闭面板,会收起旧预览。封面读取失败时可尝试播放或重试,预览过程不修改原视频。
14.2 · 创作资产:从剧本提取人物、场景和道具
截图中“项目文件 44、创作资产 0”表示已经有素材文件,但尚未建立人物、场景和道具资料。上传剧本文件、生成一张图片或打开面板,都不会自动完成资产提取。
- 在文本节点中准备需要分析的剧本内容,并选好可用文本模型。
- 输入
/,选择提取人物、提取场景或提取道具,按指令要求提供文章内容并执行。三类分别提取;这是实际文本模型调用,可能计费。 - 成功解析后,结果会整理成简介表并合并到创作资产。返回资产管理 → 创作资产,用“全部 / 人物 / 场景 / 道具”筛选,再搜索名称或简介。
- 检查角色是否重复、场景名称是否一致、重要道具有无遗漏。点击卡片编辑,修正名称、简介、外形/视觉要点和剧情功能,点保存。
- 需要更多人物资料时,点击打开角色库继续编辑该人物。创作资产里的本项目人物和角色库里的本项目角色是同一套资料。
14.3 · 先生成参考图,再绑回资产
- 创建或打开一个图像生成节点,在提示词中输入
@,切到资产,选择目标人物、场景或道具。 - 尚未绑图时,引用会提供该条资产的简介。继续输入
/选择适用的人设参考或场景参考等指令,也可以直接写清所需的定妆图、环境图或道具特写。 - 检查项目画风、模型、比例和提示词,执行生图。先确认图中的人物、空间或道具符合设定。
- 返回创作资产,在对应卡片点击绑图,从当前画布中选择已经有图片的节点。检查缩略图和“已绑图”标记。
- 之后在其他生成节点里再次 @ 这条资产,就可以使用绑定的图像参考。生成前仍需确认模型支持参考图,且自定义接口或工作流已正确映射图片输入。
| 资产状态 | @ 引用时的结果 |
|---|---|
| 没有可用图片 | 使用这一条资产的文字简介,不会把整张资产表全部放进去。 |
| 已有可用图片 | 把图片作为参考输入。要额外强调文字设定,可用卡片的“复制简介”粘入提示词。 |
| 人物有多张参考图 | 先选择单张参考图,或选择“全部拼成一张”;详见下一节的多图操作。 |
“绑图”记录参考关系,不会替你生成新图。绑定节点重新生成后,资产参考会跟随更新;需要保留已确认造型时,先保留那一版图片,再把资产绑定到保存该版本的节点。
14.4 · 角色库:新建档案与跨项目复用
- 点击左侧角色库图标,或在创作资产中点击打开角色库。
- 先选本项目或全局资产。只用于当前作品的角色放本项目;需要跨项目复用的角色可放全局。
- 点击右上角或空白区的新建角色。填写角色名称,再补充身份、故事定位、简介、外观特征、性格、默认服装和声音特征。至少需要角色名称;可以先保存纯文字档案,之后补图。
- 需要参考图时点击添加图片,可多选。选中每张图,设置图片用途并记录图片提示词;最后点击保存角色。
- 保存后从底部角色列表切换角色,用顶部搜索查找名称、身份或简介。已有角色点击编辑角色修改后再次保存。
- 选中本项目角色后,可点击复制到全局资产;选中全局角色后可复制到本项目。复制得到独立角色副本,之后的修改不会双向同步。
需要在当前项目的节点中 @ 一个全局角色时,先复制到本项目,再从节点的资产列表选择。全局角色复制会携带已保存的参考图、声音和动作资料;完成后应核对目标范围里的素材能否预览。
已有画布图片,直接收进角色库
- 在已有图片的画布节点上右键,选择添加到角色库。
- 选择形象参考,再选保存范围,以及新建角色或已有角色。设置图片用途和图片提示词。
- 检查添加后隐藏画布节点是否符合需要,再点添加到角色库。隐藏是收纳显示状态,图片仍可在角色库中使用。
- 需要回到画布时,在角色库选中参考图,点击显示并定位节点、定位画布节点或添加到画布;按钮会随当前是否已有对应节点而变化。
14.5 · 多视角参考图、头像与角色声音
| 要做什么 | 操作 |
|---|---|
| 整理参考图用途 | 编辑角色,选中图片,把“图片用途”设为主视觉、头像、全身、表情、转面、服装或其他,并记录图片提示词。 |
| 确定默认形象 | 选中已确认的图片,点击“主视觉”,再保存角色;仅修改“图片用途”标签不等于完成默认主视觉选择。 |
| 设置头像 | 选图后点击“设为头像”,调整出现的头像裁剪区域,再保存。头像用于角色识别,不会把整张参考图裁掉。 |
| 继续加画布视角图 | 在角色库选中角色,点击“从画布添加视角图”,选择有图片的节点并完成添加。 |
| 指定单张或多张参考 | 在图像节点的 @ 资产列表中选择多图角色,再选所需视角,或“全部拼成一张”。后者合成一张参考图供模型使用,并非把每个视角作为独立结果生成。 |
角色编辑弹窗中的参考图和声音各最多添加 16 份,超过时按提示处理。参考图应尽量保持同一人物的外观一致;多图拼接会缩小单张细节,特写镜头可优先选择最合适的单张。
保存角色声音并用于配音
- 在编辑角色 → 角色声音点击上传音频,补充名称、用途等信息,试听后保存。也可以直接在角色库中点击绑定画布音频节点,选择已有音频结果。
- 为多个样本按用途区分音色参考、台词样本、情绪演绎等,需要时点击设为主音色。文字“声音特征”只是描述,真实声音样本需要单独上传或绑定。
- 点击用这个声音生成台词,软件会创建配音节点,并把声音连线作为音色参考。接着填写台词,选择支持相应声音输入的模型,再执行生成。
创建配音节点不会直接得到配音成品。是否支持声音参考、音色复用或克隆,以所选音频模型的能力为准;先试听一条结果再批量使用。
展开、试听和引用已有角色声音
- 角色库中的声音列表默认收起。选中角色后,点击下方工具栏的展开角色声音图标;换角色或重新打开角色库时,需要再次展开。
- 在声音条目点击试听,确认样本内容,再按需要设为主音色。收起列表或关闭面板会停止试听。
- 在音频节点的 @ 资产列表中选择有声音的角色,插入角色声音引用;适用的参考语音工作流还提供角色主声音下拉,可先试听再选。下拉中的显式选择优先于 @ 或连线参考,清空后才恢复使用其他参考来源。
- 参考样本决定声音来源,节点正文填写这一次要朗读的新台词。不要把样本录音中的旧台词当作新文案,也不要把“声音特征”文字当作已经上传的音频。
- 在支持参考音频的视频节点中,用角色旁的声音入口选择具体片段;卡片的试听按钮只试听,不插入引用。需要该角色的画面时再引用其图片,并明确写出谁说什么。
引用会保留已选声音片段;后来更换角色主音色不会自动把旧引用换掉。片段已删除或失效时,重新选择有效声音。视频请求会整理角色图片和声音的对应关系,但实际外观、音色与口型效果仍取决于所选模型,不能由引用成功推定。
画布声音节点在哪里
声音条目在当前画布有来源节点时提供显示 / 隐藏操作。隐藏后可从角色库恢复,恢复显示后再定位;定位会有短暂聚焦动画。直接上传的音频可能没有画布来源节点,因此不一定有定位入口。解除声音关联时,没有其他角色库关联的隐藏来源节点会恢复显示;移除关联不等于删除磁盘音频。
14.6 · 角色动作库:保存动作说明与演示素材
动作库附属于具体角色。先在角色库建立并选中角色,再点击角色动作库按钮。截图中的“主角”是当前角色名;“0 个动作”表示还没有保存动作条目。
- 核对顶部角色名称,也可以在动作列表上方的角色下拉框切换。需要换“本项目 / 全局资产”范围时,先回角色库切换范围。
- 在右侧“添加动作”中选择动作类别。可选站立、行走、奔跑、跳跃、坐姿、蹲伏、躺卧、攀爬、游泳、攻击、防御、受击、死亡、施法、互动、舞蹈、表情动作或自定义;自定义时填写分类名。
- 填写动作名称,例如“警戒站姿”。在动作提示词中描述姿势、重心、手部动作、运动方向与节奏。
- 点击添加多份图片、GIF 或视频,选择演示素材并检查预览。不需要演示素材时也可以先保存名称和动作说明。
- 点击底部添加到动作库,看到“动作已添加”并在左侧出现卡片后才算完成。仅选好文件、仍显示在右侧待添加区时,动作条目还没有保存。
- 用左侧筛选 → 全部类别或具体类别查看动作。一个动作可包含多份不同视角、速度或阶段的演示,不必每次都建新条目。
双脚与肩同宽,左脚略向前,重心压低。
上身微微前倾,右手保持警戒,左手护住躯干。
头部先向右观察,再缓慢转回正前方;动作克制,保持人物外观一致。
给已保存的动作继续补素材
- 上传图片 / GIF / 视频:在该动作卡片内选择本机文件,可一次添加多份。常用支持格式为 PNG、JPG/JPEG、WebP、AVIF、GIF、MP4、WebM、MOV、M4V;视频能否播放还取决于编码。
- 从画布添加:在动作卡片中打开选择器,选当前画布已有图片、GIF 或视频结果的节点。同一节点已经加入该动作时,会提示已添加。
- 从节点直接收纳:在支持的图片/GIF/视频节点中打开“添加到角色库”,切到动作素材,选择已有角色,再选新建动作或追加到已有动作并保存。没有角色时,先回角色库建立档案。
- 预览与移除:视频卡片可以播放;媒体右上角的 × 移除单份演示,动作标题旁的垃圾桶删除整个动作条目及其媒体关联。这两类移除直接生效,操作前核对对象。
从画布收纳素材后,怎样找回节点
“从画布添加”和节点的“添加到角色库 → 动作素材”都提供添加后隐藏画布节点,默认勾选。保存动作素材后,来源节点会收起;在动作缩略图右下角点击显示画布节点 / 在画布中隐藏切换。
按钮提示“没有唯一对应的画布节点”时,当前画布没有可确认的唯一来源,不能直接切换显隐。移除动作素材、动作或角色后,没有其他角色库关联的隐藏节点会恢复显示;原媒体文件不会因此自动删除。
在生成提示词里 @ 指定动作素材
- 先在本项目角色中保存动作和图片、GIF 或视频素材。全局角色需要先复制到本项目,才能从当前项目资产引用。
- 打开生成节点,在提示词输入
@,切到资产并选择角色。即使角色没有主视觉,只要有动作,也能进入选择。 - 点击角色名称旁的动作入口,先选动作,再选具体的一份图片、GIF 或视频。一个动作的多份素材需要按实际用途分别选择,不会一次附带整个动作库。
- 补充动作说明、角色外观和镜头要求,再检查模型支持的参考类型。图片和 GIF 使用参考图通道;动作视频需使用支持参考视频的生成模型,并符合时长和数量限制。
- 检查引用标签后生成。提示“动作素材引用已失效”时,回角色库确认该素材仍存在,再重新选择;软件不会自动改用主视觉代替丢失的动作。
动作引用使用入库时保存的素材,来源节点隐藏、删除或重新生成不会自动替换已选动作;更新动作参考时,应把新结果重新加入动作库再选择。动作文字说明仍需按镜头需要写进提示词,不能仅靠素材标签传达全部要求。
14.7 · 保存、共享与常见问题
| 看到的情况 | 怎么处理 |
|---|---|
| 项目文件很多,创作资产仍为 0 | 文件导入与资料提取分开进行。先执行人物/场景/道具提取,或在角色库新建人物。 |
| 资产列表空白 | 核对当前项目、分类筛选与搜索词。搜索无匹配会显示空状态,不一定是资料被删除。 |
| 绑图列表为空 | 先在当前画布准备有实际图片结果的节点;仅创建空白图像节点还没有可用参考图。 |
| @ 角色只得到简介 | 检查是否已保存并绑定可用图片。多图角色在二级菜单中选择所需参考图。 |
| 找不到全局角色的 @ 项 | 先把角色复制到本项目,再到节点的资产列表选择。 |
| 添加角色图后节点不见了 | 可能启用了“添加后隐藏画布节点”。在角色库选图,用“显示并定位节点”找回。 |
| 动作库无法添加,按钮变灰 | 确认已有选中角色、动作名称不为空,并等待媒体处理或保存结束。 |
| 已添加动作但筛选后看不到 | 先确认当前角色,再把类别筛选恢复为“全部类别”。 |
| 改了本项目角色,全局角色没变 | 两个范围中的副本独立保存;需要同步内容时重新核对并复制,不会自动联动。 |
| 关闭窗口后编辑没有保留 | 资产简介编辑要点“保存”,角色编辑要点“保存角色”,新动作要点“添加到动作库”。已有动作补媒体或移除会立即保存;关闭窗口不能当作撤销。 |
创作资产删除和“清空本类”会请求确认,清空应先核对当前类别。本项目人物在创作资产和角色库中共享资料,删除会影响两处;剧集各分集也共用这些角色。全局角色删除会影响以后从全局复用,但已复制到项目的独立角色不会一起删除。需要保留内容时先做好项目与素材备份。
14.8 · 用 / 调用快捷指令和 Skill
在节点提示词中输入 /,或点击对应按钮,选择内置指令、自定义指令或 Skill。进入管理快捷指令可设置模板、模型、尺寸;高级模式可定义参数和多步骤序列。执行中某一步失败,后续步骤会停止,应先处理失败步骤。
15 · AI 助手与任务
- 点击左侧AI 助手,选择可用的对话模型。
- 描述你的目标,例如“整理这几个镜头的顺序,并指出缺少的画面”。先说清范围和期望输出。
- 用
@n引用节点、@a引用资产、@m引用模型;用/调用 Skill。引用能让助手更明确地使用指定材料。 - 如果要生成图片、视频或音频,建议在本轮消息中显式引用目标媒体模型,并说明参考素材及参数。未指定时,协作模式会弹出模型选择确认卡;自主模式可使用项目默认模型,或在项目开启自动选择后挑选模型。配置方法见项目默认模型。
- 选择合适模式后发送;在任务时间线查看步骤、处理确认或选择题,需要时暂停、继续或停止。
| 模式 | 适合什么情况 | 执行行为 |
|---|---|---|
| 规划 | 先分析需求、检查现状、制定方案。 | 只读,不执行写入和生成。 |
| 协作 | 希望逐步审核画布、文件、配置或媒体变化。 | 读取可执行;写入及媒体生成需要确认。 |
| 自主 | 任务范围清晰,希望连续完成。 | 自动执行已授权工具,包含媒体生成、文件及配置写入;选择题仍等待用户回答。 |
任务可在应用运行期间后台执行。关闭软件后不会继续运行;重启后未完成任务会处于暂停状态,需要检查后再恢复。切换画布时,可回到原项目的对话与任务中查看进展。
15.1 · 继续上次任务,或修改刚才的结果
- 回到同一个项目、同一个会话,检查上一轮回复、任务时间线及实际节点。
- 直接说明接下来要做什么,例如“继续刚才的镜头整理”“把刚才生成的三张图改为竖版”。多个结果容易混淆时,用
@n引用目标节点,补充需要保留或修改的内容。 - 执行中可以补充要求。助手会在后续轮次接收补充,不代表已经完成的付费请求能被撤回;查看时间线确认下一步采用了新要求。
- 遇到回复长度上限或上下文暂停,先阅读保留下来的部分回复,再点击任务继续或发送明确的后续要求。部分文本不代表本轮工具已执行。
续聊会利用近期对话及同会话的工具结果摘要,保留节点、资产等引用。跨项目或新建会话时,请重新说明目标与材料。输入框旁的上下文占用是估算;接近上限时,较早内容会被压缩为摘要,原始历史不会因此删除。长任务仍受预算约束,暂停后应先检查原因。
继续刚才的分镜整理,先核对已完成的节点和缺少的素材。
保留已有成品,只补充仍未完成的部分。
涉及状态未确认的生成任务,先查询原任务和输出,确认后再决定是否重新生成。
15.2 · 内嵌助手、独立窗口和会话草稿
- 在助手顶部点击独立窗口,把对话移到单独的桌面窗口;需要放回画布旁时点击收回内嵌。
- 切换展示方式后,继续查看原会话、模式、模型和任务。切换窗口不会重新启动任务;保持主应用运行。
- 切换会话后,各会话未发送的草稿会在当前运行期间分别保留。关窗或收回时会交接最后一次编辑,回到对应会话检查后再发送。
- 如显示初始化或同步等待,等真实会话状态就绪;不要把尚未同步的空白视图认定为历史丢失。
会话列表、对话和任务中心视图可随展示方式切换。未发送草稿只保证当前运行期间的交接,不保证退出或重启后恢复;重要长文先保存到自己的文档。智能体安装和项目记忆等管理入口在主窗口使用。
15.3 · 安装智能体包,并使用 Skill
- 在主窗口的助手顶部打开智能体中心。不安装任何包也可使用默认助手。
- 点击选择文件夹链接本机包,或选择压缩包导入
.aicanvas-agent / .tgz / .tar.gz。文件夹保持只读链接,压缩包导入应用管理目录。 - 先查看预检提醒、智能体大纲及 Skill 清单,确认来源和用途后安装 / 启用。上传预检不会执行包内脚本。
- 在助手输入框输入
/,选择已启用包中的 Skill,再补充当前项目目标与素材。节点的提示词润色入口也可使用受支持的智能体。 - 外部 MCP 客户端需要读取包内 Skill 时,按包开启MCP 只读;此开关允许列出、加载和读取 Skill,不授予执行包内脚本的能力。
Skill 提供操作知识和步骤,实际画布写入、文件操作或媒体生成仍遵循当前会话模式。智能体包与用户插件各有安装入口;不要把插件仓库地址填进智能体包导入。
15.4 · 项目记忆和只读子智能体
在主窗口助手顶部打开项目记忆,查看作品设定、偏好及来源。需要长期沿用时,明确让助手提议记忆并检查内容;规划模式不写入,协作模式确认后保存,自主模式可直接写入。关键设定变化后,请同步核对已有记忆。
在子智能体配置角色和允许读取的材料,再让父任务分配分析工作。子智能体只读,可辅助检查人物、剧情或镜头,不能直接写画布;父任务再根据结果及当前模式执行。每个父任务最多六个子任务,调用子智能体也可能产生模型费用。
16 · 分镜制作与 3D 导演台
用分镜表把剧本、画面、对白和时长关联起来,再准备各镜头的图片、视频与配音,最后推送剪辑时间轴。每一步都检查实际生成的内容,创建节点不等于媒体已经生成。
16.1 · 创建分镜表并核对镜头
- 从剧本创作工作台 → 生成本集分镜开始。软件先保存当前集,再创建剧本来源快照和空表,打开文本模型生成弹窗。也可在画布按 Alt + 6 手动建表。
- 检查当前分集、引用的剧本、文本模型和目标时长,点击生成。手动制作时使用加一镜;按需要用列控制显示字段。
- 逐镜核对镜号、画面内容、对白、时长、景别、运镜等字段。AI 拆分只是初稿,尤其要核对人物关系、剧情顺序、镜头连续性和总时长。
- 在镜头画面栏选择真实图片或视频节点。已有绑定需要调整时使用换画面;仅在描述中写一个文件名不会建立素材绑定。
一张表最多 200 镜。使用工作台创建的表会保留本集剧本快照,便于后续复核;手动创建或旧表没有明确来源时,不会自动猜测它对应哪一集。
16.2 · 为没有画面的镜头补图
- 先写好有效的镜头描述,并按第 01 章确认项目画风、母图与生成参数。
- 点击补齐空镜,选择图片模型,核对这批镜头数量。每批最多 12 镜,按顺序逐镜调用图片模型。
- 开始后查看进度;完成的结果会保存为真实图片节点并绑定对应镜头。
- 需要停止时点击取消补图。已经完成的图片保留;再次补图只处理仍未绑定画面的镜头。
16.3 · AI 诊断、单镜优化与改稿复核
| 按钮 | 准备的请求 | 后续操作 |
|---|---|---|
| AI 诊断 | 读取整张分镜表,检查节奏、连续性和遗漏。 | 在助手输入框核对后发送,先审阅建议。 |
| AI 优化本镜 | 限定到当前镜头,调整相应内容。 | 核对目标镜头和修改范围,再按会话模式执行写回。 |
| 剧本已修改 / 剧本改动复核 | 并排显示当前已保存剧本与创建来源的文本差异;勾选镜头后准备局部复核请求。 | 点击让助手调整所选镜头,审阅草稿并发送;未选择的镜头不会因这个入口而自动重建。 |
这些按钮都先准备对话草稿,不会自动发送、重建整表或生成媒体。复核显示的是文本变化范围,不能代替语义判断;来源快照会持续保留,因此“剧本已修改”也不等于助手一定尚未处理过。确认修改后再检查表格和素材绑定。
16.4 · 准备配音、视频和导演台节点
- 点击分镜表顶部或单镜行的镜头制作准备。
- 勾选要处理的镜头,每次最多 12 镜,再选择配音节点、视频节点或导演台节点。
- 应用会定位新建或已有的同类制作节点。分别检查内容,再选择模型、音色、参考素材或导演运行时。
- 需要媒体时,在相应节点实际生成并试听/预览;需要 3D 构图时,再打开导演台编辑。
| 制作类型 | 准备内容 | 仍需完成 |
|---|---|---|
| 配音 | 使用镜头对白作为朗读文本;没有对白的镜头不能创建该配音批次。 | 选择语音模型和音色,实际生成并试听。画面、运镜与音效说明不会一起当作对白朗读。 |
| 视频 | 填入镜头画面要求;已有真实画面绑定时添加相应引用。 | 检查模型支持的图生/视频参考、比例和时长,生成视频后按需要换绑到分镜表。 |
| 导演台 | 建立导演台节点及独立镜头说明。 | 自行打开运行时、布景和调整摄影机;不会自动构造完整 3D 场景。 |
重复准备同镜头、同类型时优先复用已有节点,不覆盖人工修改;改完剧本后也应自己核对已有制作节点内容。同一镜头出现多个同类来源时,先在画布处理重复关系,再继续操作。
16.5 · 从宫格分镜裁出一张真实画面
- 在同一画布准备已有图片的宫格分镜节点,核对分割方式与实际画面。它与记录镜头行的“分镜表”是不同节点。
- 打开目标镜头的画面选择器,点击从宫格取画面。
- 选择宫格节点,以及“第几行、第几列”的位置。均分网格、自定义分割线和已有单格覆盖图按当前宫格设置处理。
- 点击裁片并绑定镜头。已有画面时按钮为裁片并替换画面,先核对替换对象。
- 检查新图片节点和分镜缩略图。原宫格与原画面节点保留,当前镜头绑定改为裁出的图片。
已经提取为空且没有覆盖图的格子不能再次裁切;分割线无效时先修正宫格。失败或取消不会用整张宫格冒充单格结果,其他镜头不会被批量替换。
16.6 · 推送时间轴,附带对白字幕和配音
- 检查镜头顺序、每镜时长与实际绑定媒体。需要配音时,先从“镜头制作准备”创建配音节点,并完成生成。
- 需要对白文字时勾选附带对白字幕;需要声音时勾选附带已就绪配音,两个选项可分别使用。
- 点击推送时间轴。若提示分镜或素材在等待期间发生变化,回表格核对最新内容后重新推送。
- 进入独立剪辑窗口,播放并检查对白出现时间、配音起点和镜头切换,再调整字幕、音量与片段边界,按第 05 章导出成片。
| 内容 | 装配规则 | 需要手动检查 |
|---|---|---|
| 对白字幕 | 按镜头起止放到可编辑的底部文字叠加轨,没有对白的镜头保留空档。 | 保留对白原文,不自动断句或进行语音逐字对齐;长对白需自行分段和调整。 |
| 已就绪配音 | 按明确的镜头来源关联创建独立音轨;未生成的配音跳过,没有配音的镜头保留空档。 | 超出镜头时长的部分先裁到镜头末尾,原音频不变;试听是否截断台词,必要时调整时长。 |
| 缺失或重复来源 | 全部配音未就绪、同一镜头关联多份配音等情况会阻止对应推送。 | 先生成配音、修复缺失媒体或处理重复来源。旧音频不会仅凭“镜 1 配音”等名称自动匹配。 |
16.7 · 从 3D 构图得到参考画面
| 运行时 | 适合的任务 | 开始前准备 |
|---|---|---|
| 轻量导演台 | 手动摆放场景、构图与摄影机,取得参考画面。 | 按应用提示准备运行资源,打开后等待场景就绪。 |
| Blender | 使用本机 Blender 编辑场景、保存工程并渲染参考成果。 | 检测并选择兼容安装;保存返回后检查应用收到的真实画面。 |
| AI 镜头预演 | 用文字描述生成简模、人物走位与摄影机运动,再手动微调。 | 桌面版及可用文本模型;图片参考需要支持视觉输入的文本模型,见 16.9。 |
- 创建3D 导演台节点,也可在画布操作状态按 7,或从“镜头制作准备”建立。
- 选择可用运行时。使用 Blender 时,在设置 → 文件与应用 → Blender检测安装;存在多个版本时手动选择应用。Windows 选择
blender.exe;包含 macOS 安装检测更新的版本可选择Blender.app。 - 双击节点或点击打开导演台 / 打开 Blender,等待实际场景与摄影机就绪,再摆放场景和调整镜头。
- 回到节点点击同步当前帧,确认有效参考画面已经回填且可预览。
- 把参考画面交给图像或视频生成节点,继续设置风格、动作与镜头变化。
当前 Blender 兼容范围包含 4.5、5.0、5.1、5.2 系列的稳定版本;是否可用以应用检测结果为准。检测到安装路径不等于启动校验已通过,预览版或不支持的版本需按提示处理。安装选择可在本机保留,启动前仍会重新检查。
导出参考视频取决于运行时能力与状态。Blender 窗口关闭或进程退出不表示结果已经成功保存;仍需检查 AI Canvas 是否收到当前摄影机画面。没有活动摄影机、渲染失败或结果不完整时,根据具体错误修正后再同步。首次缺少运行时则按应用提示安装或下载。
16.8 · 逐镜工作台:检查物料与批量生成视频
画布存在镜头组、视频生成节点或已保存的视频批次时,底部会出现逐镜工作台。它处理已有视频节点,不自动把剧本拆成镜头;需要制作节点时先按 16.4 准备。
- 选择生成范围:本集镜头、选中镜头组,或待生成 / 失败项。需要整理镜头组时选择 1–4 列并点击统一布局。
- 点击检查物料或生成本集视频,先打开检查表。核对提示词、模型 / 工作流、引用素材和生成时长;点击镜头名称可定位节点。
- 修复缺项后重新检查。ComfyUI 会探测在线状态,其他接口的鉴权和可用性在提交时验证;预检通过不代表生成或画面质量已验收。
- 检查已有结果与待更新项。只有确实需要重做时,才勾选已有结果也重新生成,并保留旧版本。
- 点击生成就绪镜头开始付费提交。按镜号串行执行,每镜使用自己的参数;在查看队列检查完成数量、状态和错误。
- 失败项先定位节点排错,再用重试失败项重新预检;待核对项先核对平台原任务与输出,确认需要重新提交后再处理。
| 队列状态 | 下一步 |
|---|---|
| 等待 / 未提交 | 尚未完成提交;“取消等待”只处理未开始的项,不中断已提交的远端任务。 |
| 生成中 / 已完成 | 等待结果回填;完成后逐镜预览真实视频,旧结果可从输出历史核对。 |
| 失败 | 检查对应节点的错误与参数,修复后重新预检,再决定是否付费重试。 |
| 待核对 | 提交或执行状态不确定;重启、异常或项目切换后可能出现。先查远端任务和实际输出,不直接重投。 |
16.9 · 用文字生成 AI 镜头预演
- 在 3D 导演台节点选择AI 镜头预演,打开预演编辑器。
- 选择文本模型,在场景与运镜描述填写空间、人物走位、摄影机起止、焦距和时长。例:
人物穿过走廊,摄影机从背后跟拍,最后绕到正面,8 秒,35mm 起步,结尾 50mm 中近景。 - 需要参考图片或完整分镜表时,按
@或点击素材引用。仅连线不会发送材料;图片最多六张,需使用支持视觉输入的文本模型。 - 点击生成镜头预演,已有场景时为按描述修改预演。这一步调用文本模型,可能计费;生成并保存后检查空间、角色与运动方向。
- 在镜头 / 空间 / 俯视之间切换,播放时间轴查看轨迹。可调整片长、画幅、速度、焦距和摄影机关键帧;当前片长支持 1–60 秒。
- 手动调整后点击保存镜头调整。保存完成后使用同步当前镜头或导出参考视频,回到导演节点检查图片 / 视频成果。
场景保存后,节点可自动生成起始摄影机截图;在编辑器停到目标时间再同步,可取得该时刻画面。输出使用摄影机视角,空间视图的轨迹与摄影机辅助标记不会进入成果。浏览器模式可查看和调整示例,模型生成、项目保存及节点输出需要桌面版。
17 · 插件与 MCP 控制
安装与管理插件
在设置 → 插件查看市场,或填写 GitHub 仓库地址后点击从仓库安装。安装前核对名称、版本、说明和权限。安装后可启用、停用、更新或卸载;插件入口可能出现在节点右键菜单、浮动工具栏或节点选择器。
Python 插件作为可信本机代码运行,具有当前用户权限。只安装信任的来源,并按原生确认窗口审核。遇到按钮缺失,先确认插件启用状态以及它适用的节点类型。
已安装插件卡片的地址、权限等信息收在详细信息里,点击展开查看。节点右键菜单的插件操作集中在插件工具 → 具体工具二级菜单中;鼠标移入或点击即可展开。支持多语言的插件可跟随宿主语言切换,具体翻译内容仍由插件提供。
支持相应能力的插件可以把当前画面或本地线稿作为参考,调用已配置的图像模型并生成画布节点。实际入口与输入要求以该插件说明为准;先核对目标模型、当前画面和返回结果,不是所有插件都会提供此功能。
让外部工具通过 MCP 操作 AI Canvas
- 打开设置 → MCP 控制。默认不会自动启动;手动开启会话,或明确配置自动开启。
- 同一电脑上的客户端优先使用stdio,复制应用生成的配置到支持 MCP 的客户端。按该客户端要求完成配置。
- 保持 AI Canvas 主应用运行。会话重启、端口或令牌变化后,重新复制当前配置,必要时重连客户端。
- 先让外部工具读取项目或列出画布内容,确认连接到正确项目,再给出具体的编辑任务。
远程 Streamable HTTP 是另一种传输,开启前需要确认。它当前是明文 HTTP,只用于受信网络或隔离环境;令牌鉴权不等于传输加密。同机接入无需为了使用 MCP 而改成远程传输。
按需发现工具
在 MCP 设置的工具发现方式中,默认使用按需加载。客户端先通过 tools_search 查找能力,必要时用 tools_describe 读取完整参数,再由 tools_call 调用;后续可以复用已经取得的参数说明。需要完整列表时可切换模式,并在客户端刷新或重连;切换列表不会改变工具权限。
让 MCP 导入图片、媒体或界面截图
| 需求 | 工具与操作 |
|---|---|
| 导入本机图片、视频或音频 | file_import_media_to_canvas 一次导入 1–20 项,使用已授权的本地文件;按顺序返回节点 ID,可指定位置或采用网格布局。原文件保留,不调用生成模型。 |
| 把客户端持有的图片传入应用 | file_media_upload 按 begin → append → finish 完成 PNG / JPEG / WebP 分块上传,再把返回的 uploadId 交给批量导入工具。客户端应按工具 schema 发送字节,不把整张图片 Base64 当作聊天正文。 |
| 粘贴系统内容 | canvas_paste_external 读取系统图片或纯文本,不等同于复制已有画布节点;不会自动访问剪贴板里的网址或文件路径。 |
| 把应用界面变成参考图片 | ui_capture_to_canvas 把主窗口可见界面截图保存成图片节点,过滤敏感界面元素;它不是整个桌面截图。只需查看而不添加节点时使用 ui_capture_window。 |
上传绑定当前项目和 MCP 会话,空闲 10 分钟会失效;完成的 uploadId 在成功导入后消费一次。可以查询上传状态或取消,再根据实际返回继续。未授权目录需要先完成授权;上传或导入期间切换项目、修改相关画布或取消,可能使本次回填失效。
用 MCP 组装、导出和检查视频
- 先用
video_media_probe核对当前项目素材节点的真实参数,再用video_editor_list/video_editor_get查看已有工程,避免重复创建。 - 需要新工程时,使用
video_editor_create从有结果的图片/视频节点或分镜表建立时间轴。创建工程不打开窗口,也不代表已经导出成片。 - 用
video_editor_update编辑,携带读取到的expectedVersion。提交 tracks 时是完整替换轨道清单,不能把局部片段误当成完整清单。修改前先读最新工程。 - 关闭人工剪辑窗口后,用
video_editor_export后台合成 MP4。每次新导出使用唯一requestKey;收到 jobId 后,用video_editor_export_status查询直到成功、失败或取消。导出期间保持当前项目与工程稳定。 - 成功后核对返回的视频节点。需要停止时用
video_editor_export_cancel并继续查询状态;需验片时,用video_media_extract_frames按 1–6 个递增时间点读取实际画面。
上述剪辑控制入口目前供MCP 会话使用,支持最多 300 秒、8 轨、120 片段、1080p 等像素面积和 60 fps;它不是人工编辑器全部功能的等价控制接口。导出任务状态仅在当前应用会话内保留,重启后先查看实际工程和成片节点,不把未知状态当成已完成。抽帧可以检查画面,不能代替听取配音、音乐与最终成片审阅。
用 MCP 读写 AI 镜头预演
让客户端先取得 director_get_previs_schema 的场景合同与示例,再创建或查询导演节点、选择 AI 镜头预演运行时,通过 director_set_previs_scene 写入场景 JSON;用 director_get_previs_scene 读回核对。这里只接收受限的结构化场景,不接收或执行外部 JavaScript。直接写入场景不会额外调用应用内文本模型,截图和参考视频仍需核对实际成果。
连线按上游在左、下游在右整理:素材输出连接生成节点输入;分镜制作使用“分镜表 → 导演台”和“镜头说明 → 导演台”。工具返回的布局提醒用于检查,不会自动移动节点。多图视频的参考顺序应在提示词中明确引用,仅连线不能指定 Picture 顺序。
18 · 保存、备份与迁移
自动保存与手动保存
画布修改会自动保存,也可按 Ctrl + S 手动保存。剧本创作工作台中的编辑请使用保存本集或在工作台内按 Ctrl + S;全剧剧本编辑弹窗也需单独点击保存。出现保存失败提示时,检查磁盘空间和存储状态,尽快手动保存或导出备份。自动保存不能替代长期备份。
导出和导入项目包
- 在桌面版项目库打开项目卡片菜单,选择导出项目包,保存为
.aicanvas文件。 - 项目包包含该项目记录、对话、项目记忆和本地素材目录。运行中的 Agent 任务不作为可继续运行的任务一起迁移。
- 在目标桌面应用的项目库点击导入,选择项目包。导入会生成独立项目副本,不覆盖原项目。
- 打开导入项目,抽查图片、视频、音频和对话;重新配置目标电脑的 API Key、ComfyUI 地址及外部软件路径。
文件目录、外部软件与存储健康
在设置 → 文件与应用配置文件根目录,以及 Photoshop、剪映专业版、Premiere Pro 等外部应用;配置后,本地媒体节点右键会提供适用入口。移动电脑或更换安装位置后,需要重新核对这些路径。
存储健康用于查看空间、回收站残留、孤儿/重复文件和离线文件夹。清理前逐项核对用途。删除单集不会清理整部剧共用素材目录;处理共享素材时,应先检查其他分集是否仍在引用。
设置未保存、冲突或凭据读取失败
正常加载完成、没有未保存内容或错误时,设置页不常驻“已加载 / 已保存”提示条。修改后出现有未保存的设置或正在保存设置…时,等待保存结束;出现错误按下表处理。
| 情况 | 处理方法 |
|---|---|
| 保存失败 / 仍有未保存设置 | 保留当前草稿,检查空间、权限和存储状态,再点击重试保存。不要把关闭设置面板当作保存成功。 |
| 设置冲突 | 其他窗口可能修改了同一项;先记下本次需要保留的值,再点击重新加载读取最新设置,重新应用修改。重新加载会提示是否放弃未保存内容。 |
| 某个渠道 Key 暂时读不到 | 先使用重新加载重读;不要因为输入框暂时为空就删除并重建渠道。普通设置仍可使用,真实凭据读取或保存失败会单独报告。 |
| 首次加载失败 | 先解决读取问题并重新加载;软件会阻止用默认空配置覆盖原有数据。不能据此认定项目或 Key 已丢失。 |
| 关闭应用时保存未完成 | 退出流程会等待设置和工具栏草稿保存。失败时选择重试、取消退出继续处理,或明确放弃未保存修改;按提示核对后再决定。 |
自定义工具栏也有独立的加载和保存保护:加载失败时先重试读取,保存冲突时按提示重新加载该类型。项目备份和凭据存储分开,项目包不能代替 API Key 迁移。项目中的 .thumbnail 是可重建的显示缓存,不作为媒体源文件或项目归档内容。
19 · 快捷键速查
以下为 Windows 常用快捷键。创建节点的数字键在画布操作状态使用;输入提示词时正常输入文字。分镜表快捷键为 Alt + 6;其他快捷键也可在设置 → 快捷键查看。
| 操作 | 快捷键 |
|---|---|
| 文本 / 图像 / 视频 / 音频生成节点 | 1 / 2 / 3 / 4 |
| 全景 / 动画 / 3D 导演台 | 5 / 6 / 7 |
| 文本 / 图像 / 视频 / 音频 / Markdown 源节点 | Alt + 1 / Alt + 2 / Alt + 3 / Alt + 4 / Alt + 5 |
| 编辑单个内容节点 | Space |
| 保存 | Ctrl + S |
| 撤销 / 重做 | Ctrl + Z / Ctrl + Y 或 Ctrl + Shift + Z |
| 复制 / 粘贴节点 | Ctrl + C / Ctrl + V |
| 删除所选 | Delete / Backspace |
| 分组 / 取消分组 | Ctrl + G |
| 适配全部 / 小地图 | F / M |
| 关闭菜单或弹窗 | Esc |
| 打开 / 收起左侧资产库 | Tab(画布操作状态) |
| 全屏图片上一张 / 下一张 | ↑ / ↓,也支持 ← / → |
| 素材搜索 | Alt + Space 或 Ctrl + Shift + Space |
20 · 常见问题
找不到画布内容,或打开后只看到空白
先确认当前项目和分集,再按 F 适配全部内容;开启 M 小地图检查节点位置。若只是某个素材不显示,检查文件是否存在、能否正常预览。
按空格没打开编辑器
先退出文字输入,只选中一个普通内容节点;多选、分组和 Markdown 节点不使用该快捷入口。
图像没有批量生成选项
长按生成按钮只在普通模型支持批量且没有选择工作流时适用。先检查当前模型和工作流状态。
ComfyUI 没收到提示词或图片
确认服务连接和工作流正确;检查该类型 ★ 默认输入是否设置,或者提示词中是否 @ 了正确输入节点。工作流在 ComfyUI 中本身也应能运行。
工作流列表里找不到刚保存的条目
先检查当前导入来源和输出分类;RunningHub 云工作流、AI 应用与 ComfyUI 分开筛选。通用工作流 API 在厂商连接内编辑,保存后从对应图片/视频/音频节点选择,详见13.6。
工作流 API 检查配置成功,生成仍失败
“检查配置”只检查本地格式。继续核对真实平台地址、Token 鉴权前缀、输入数量、参数类型、提交/查询路径与结果 URL 路径;任务已经提交时使用继续查询 / 保存处理原任务。
角色动作入库后画布节点不见了
“添加后隐藏画布节点”默认开启。在动作素材缩略图右下角点击显示画布节点;隐藏不会使库中的动作引用失效。没有唯一对应节点时,先核对项目和来源,见动作引用说明。
生成本集分镜后只有空表,或制作准备后没有视频
前者先创建来源快照和空表,需要在弹出的文本生成窗口实际生成镜头;后者只准备制作节点,需要选择媒体模型并生成。完整步骤见第 16 章。
助手说创建完成,为什么还没有视频
先区分“创建视频节点”和“实际生成视频”。查看任务时间线是否已调用媒体模型,实际选择了哪个媒体模型,以及生成任务是否最终返回可用结果。未显式 @ 模型时,按项目默认、自动选择或模型选择确认卡检查。
插件安装后没看到按钮
在设置中检查是否启用,展开“详细信息”阅读入口及适用节点;打开节点右键菜单的“插件工具”二级菜单,或检查浮动工具栏。
导演台操作按钮是灰色
检查所选运行时是否可用、是否已经打开并就绪。某些操作取决于运行时支持,等待窗口打开不等于同步结果已经成功。
自动保存失败,或移动电脑后素材不见了
先按 Ctrl + S,检查磁盘空间和存储健康。迁移用桌面项目包,并在目标电脑实际打开检查素材;重新配置本机服务、凭据和外部软件路径。
自定义接口的 401、404、轮询不结束和结果提取失败,请查看第 12 章排错表。
资产库不见了,或按 Tab 没反应
先把焦点从输入框移回画布,再按 Tab。原资产入口仍可打开大面板;具体四页签和连线方式见资产侧栏。
ComfyUI 已显示 100%,为什么还没有视频
该数值是当前节点进度;之后仍可能执行其他节点、编码或保存。先检查任务查询结果,不要重复生成,见实时进度。
设置上方不再显示“已保存”,是不是没保存
正常状态不常驻提示条;未保存、正在保存、冲突或错误时才提示。遇到异常使用重试或重新加载,详见设置保存。
逐镜工作台没有出现,或批次中已有视频被跳过
需要当前画布已有镜头组、视频生成节点或批次记录。已有且未过期的结果默认跳过;确实需要重做时,在预检中勾选“已有结果也重新生成,并保留旧版本”,见逐镜视频批次。
重开应用后队列显示“待核对”,可以直接重试吗
先检查平台原任务和节点输出,避免重复计费。重开不会自动重投;“取消等待”也不会取消已提交的远端任务,见队列状态说明。
预演只有简模,参考图片好像没生效
简模用于检查空间和运镜。图片或分镜表需要在描述中显式 @,仅连线不会发送;图片需支持视觉输入的文本模型。手动调整后先保存,再同步当前镜头,见AI 镜头预演。
方舟用量列表为空,或金额与平台账单不同
先调整项目和日期筛选,确认实际使用的是火山方舟图片/视频节点连接。本地预计和核算不包含所有官方结算因素;中转商同名模型也不记入这份账本,见费用口径说明。
独立聊天窗口收回后,任务会重新执行吗
展示方式切换不重启任务。等待会话同步完成,检查同一会话的草稿与时间线;未发送草稿不保证应用重启后恢复,见双窗口与草稿。
改了外观,为什么保存的预设还是旧配色
普通调整会改变当前外观,已保存的自定义预设需要显式“覆盖当前预设”;也可保存为新预设。内置预设不可覆盖,见外观主题。
21 · 使用前检查单
勾选框用于本次阅读自查,不会修改应用配置或保存到软件。
首次生成前
工作流执行与分镜装配前
自定义接口保存前
视频批次与预演输出前
22 · 外观主题与预设
打开设置 → 外观,统一调整软件配色、画布、节点、连接线、连接手柄和动效。旧的“常规 → 画布背景”入口已由外观页接管;本说明书的明暗切换只改变阅读页面,不修改软件设置。
- 先选深色、浅色或跟随系统,也可选太阳系、磨砂暖光等内置完整预设。跟随系统会随系统明暗偏好调整。
- 按需修改主题色、页面 / 窗口 / 卡片 / 悬浮层配色,或选择纯色、图片等画布背景。节点圆角、边框、连线及手柄各有独立控件。
- 等待设置保存完成,实际打开画布和常用窗口检查文字、连线与控件是否清晰。遇到保存失败或冲突,按设置保存说明处理。
- 需要反复使用时,填写名称并点击保存预设。已保存的自定义预设名称可双击,或聚焦后按 Enter / F2 改名。
- 需要把当前调整写回原自定义预设时,点击覆盖当前预设并核对确认提示;内置预设不可覆盖。普通调整不会自动改写已保存预设。
导入、导出与恢复外观
点击导出保存当前完整外观为 .aicanvas-theme 文件,在另一份应用中使用导入并核对主题。它包含外观快照,不是项目包或 API 配置;需要恢复配色时可以重新选择内置深色 / 浅色预设。删除自定义预设前可先导出留档,删除需确认。
主窗口、独立聊天、素材搜索、视频编辑器和样式预览窗口沿用统一外观。项目的创作画风管理模型生成要求,软件的外观主题管理界面显示,两者分别配置。图片背景和手柄调整后,尤其要检查浅色主题中的文字、边框和连线对比度。
说明书范围与版本
本说明书以当前源码版本 0.9.23 为基线,核对日期 2026-10-04。本次补充外观主题、逐镜视频批次、方舟本地用量、AI 镜头预演、助手续聊与双窗口、智能体包等现有入口。源码范围不等于所有已发布安装包都包含这些功能;看不到入口时先核对实际构建。以 Windows 桌面版为主要操作环境,macOS 操作仅在相应功能可用时适用。
本次只更新说明书,未重新执行真实模型生成、声音克隆、官方费用对账或桌面多窗口验收。内置工作流表示已有配置模板,不代表本机已安装依赖或所有声音效果已验收;本地费用核算不等于官方扣费。
保留原有九张内嵌截图:主界面、设置分类、项目设置、画布右侧剧集栏入口、剧集栏、剧本创作工作台、创作资产、角色库和动作库。截图用于位置与空状态示意,来自此前构建;近期新增功能按本文步骤与当前界面核对,按钮可用性仍取决于资料、分集和模型配置。
内容依据应用现有帮助、新手引导、设置界面、模型调用协议及相关操作实现核对。接口示例用于本地配置校验,未调用真实厂商接口;所有 example.com 地址与示例模型 ID 均为占位内容。按钮准备草稿、创建节点、实际模型生成和媒体保存是不同步骤,请按各章检查实际结果。
页面所需样式、脚本和九张截图均在当前 HTML 内,无外部字体或 CDN 依赖。可直接双击离线打开;点击“返回软件首页”需同时保留 site 目录中的首页。打印按钮使用浏览器打印功能,可选择保存为 PDF。