Skip to main content
视频有两条路:直接生成一段短片(默认可用),和启用 Movie 插件做完整叙事影片(需勾选)。两者最终都调用同一个 video 工具产出画面,区别在于 Movie 多了一层编排和时间线。

video 工具的三个 action

video 属于 profy-creativeuser_selectable: false),任何对话都可用。

generate 的参数

默认时长是 5 秒。不说时长就只有 5 秒——想要更长必须明说「做一段 10 秒的」。

参数会被模型能力预校验

每个视频模型在后台声明了自己支持哪些参数档位。你要的分辨率或时长不在该模型的允许集合里时,工具不会去调供应商然后失败,而是直接返回 param_unsupported
专家收到这条会回来问你选哪个档位,而不是自作主张。这是好事——不校验的话你会等满一轮再拿到一个供应商侧的模糊报错。 另外,如果模型配置里给某个参数设了 default,那个默认值会覆盖你和专家商定的值。要求 1080p 却拿到 720p 时,先看模型配置。

直接生成

在对话里描述画面即可:
图生视频,把参考图发给专家再说:
描述画面时把运动方向(推进 / 横移 / 旋转 / 静止)和速度(缓慢 / 快速)说清楚,比堆形容词管用——这两项是视频区别于图片的核心变量。

视频理解(read)

read 走的是平台配置的多模态模型,不是视频生成模型:
约束:单次分析最多返回 2048 tokens 的描述,HTTP 超时 120 秒。后台没配默认多模态模型时返回:

生成过程中发生了什么

和音乐生成共用同一条异步管线: 等待期间可以让它转后台(桌面端不支持,本机没有 Redis 频道)。

Movie:七阶段编排

Movie 是 user_selectable: trueexclusive: true 的插件——需要在插件设置里勾选,勾选后它会独占对话,其它可选插件不会同时激活。
movie 工具本身不调用任何外部 API,它只输出结构化数据驱动前端渲染。真正产出画面的仍然是 video 工具。七个 action 对应七个阶段: 分镜阶段会给每个 element / segment / shot / audio 分配稳定 ID(sb- / el- / seg- / shot- 前缀),后续的时间线操作靠这些 ID 定位。

时间线编辑

timeline_edit 工具让专家按指令改时间线,10 个 action: 取值约束:片段类型 video / audio / image;轨道类型 video / audio / caption / music;导出格式 mp4 / mov;导出质量 high / medium / low。参数不合法时工具直接报错并列出合法值,不会静默取近似值。 所以你可以直接说「把第 3 个镜头砍掉后半段」「背景音乐音量降到 30%」「导出 mp4 高质量」,专家会翻成对应的 timeline_edit 调用。

失败与对策

计费

视频生成的计费单位由模型在后台的定价配置决定,工具上报的只是 hint。常见是 duration_secondceil(产出秒数 × 每秒费率)——按产出视频的时长计费,不是按生成耗时(等 3 分钟生成 5 秒视频,收的是 5 秒的钱)。 部分模型走 cost_matrix,此时分辨率、帧率、时长档位的组合决定价格,工具会把实际使用的参数一并上报用于匹配档位。
  • 失败的生成不计费(只有非 failed 结果才上报用量)
  • generate_batch 逐条计费,20 条就是 20 份钱
  • 同一次对话最多结算 100 条创作类用量事件
  • Movie 流程里 movietimeline_edit 本身不产生媒体费用,费用来自它们编排的 video / music / image 调用
各模型费率是运营数据,以模型选择器为准;算法固定,见 计费公式
Movie 一次完整流程会产生多次视频生成调用(一个分镜一段)。开始生成前先把分镜数和每段时长确认清楚,10 个 5 秒镜头就是 10 次计费。

继续阅读

音乐创作

Movie 配乐阶段调用的同一个工具

图片生成

分镜参考图常从这里来

计费公式

duration_second 与 cost_matrix 的完整算法

插件全表

哪些插件是独占的