Skip to main content
用文字描述风格、情绪、乐器,专家生成一段音频文件直接投递到对话里。不需要开插件——音乐能力属于 profy-creative,该插件 user_selectable: false,所有对话默认可用。

前置条件:必须先选一个音乐模型

音乐工具不会自己挑模型。模型选择器里没有选中音乐模型时,专家会直接拿到这条错误并转述给你:
这不是失败重试能解决的问题——去模型选择器选一个音乐模型再让专家重试即可。可选模型是运营配置的数据,以选择器里当前列出的为准。

工具参数

专家调用的是 music 工具,只有 generate 一个 action: 注意默认值 is_instrumental=true只给歌词而不说明要人声,多半会拿到一段纯音乐。要唱出来就明说「唱出来」「要人声」,专家才会把这个参数翻成 false

怎么描述

直接在对话里说,一句话包含风格、用途、时长三件事最省事:
要带唱的:
1

风格与类型

流行、摇滚、古典、电子、爵士、民谣、嘻哈、R&B,也可以混搭(「带电子元素的古典」)。参考一首具体的歌比形容词有效得多。
2

情绪与氛围

欢快、忧伤、紧张、放松、浪漫、神秘、激昂。
3

节奏与速度

慢板 / 中速 / 快节奏,或直接给 BPM(「大约 120 BPM」)。
4

乐器与人声

主要乐器;以及要不要人声——这一项不说会默认按纯音乐做。

生成过程中发生了什么

音乐生成是异步的,专家提交任务后等待结果,期间对话里会有一张进度卡: 「只重试快失败」这条值得解释:慢失败通常是供应商侧超时,重试一次就要再赔进去一个同量级的等待,很容易把 600 秒预算烧光却什么都没拿到。所以慢失败直接返回,让你决定是换模型还是改描述。 进度条卡在 95% 不动是正常的——那是估算曲线的上限,不代表任务快完成了。

后台运行

等待期间你可以让它转后台。转后台后专家立刻继续做下一件事,音乐好了自动投递。这条通道走 Redis 频道 agent:detach:{session_id}桌面端不支持(本机没有 Redis),桌面端只能等。

失败与对策

AI 生成的音乐在复杂编曲上不如人工作曲精细,副歌记忆点和结构完整度都不稳定。把它当创意起点或素材,必要时二次编辑。

与 Movie 的关系

Movie 插件做视频时,配乐阶段调用的就是同一个 music 工具,同一套参数、同一套计费。区别只在于 prompt 由专家根据画面自动拟好——你仍然可以在配乐阶段插话提要求(「副歌换更激昂的节奏」「结尾做渐弱」),专家会带着新要求重新生成。

计费

计费单位由模型在后台的定价配置决定,不由工具决定。工具上报的单位只是一个 hint:
DB pricing config is the single source of truth for pricingUnit.
实际可能落在 per_call(按次固定)或 duration_second(按产出时长)。两者的差别在于改时长会不会改价——per_call 下生成 30 秒和 2 分钟同价,duration_second 下不同价。不确定当前模型走哪种时,先生成一段短的看扣费。 两种算法本身固定,见 计费公式。失败的生成不计费(只有非 failed 结果才上报用量)。
同一次对话最多结算 100 条创作类用量事件。正常使用远达不到这个上限,批量生成脚本需要留意。

继续阅读

视频生成

同一套异步管线,参数校验更严格

图片生成

支持批量与参考图

计费公式

五种计费单位的完整算法

工具全表

每个工具的完整参数