Skip to main content
袋袋专家内置了完整的图片能力——你可以用自然语言生成图片、编辑已有图片,也可以让专家分析和理解图片内容。 三件事共用同一个工具(image),区别只在动作:

生成图片

直接在对话里描述你想要的画面:
专家会调用 image 工具生成,过程中卡片实时显示进度。

可调参数

除这三个之外,每个图片模型还可以有自己的参数(风格、质量档位、宽高比等)。这套参数由运营在模型配置里声明,随模型不同而不同,取值优先级是你在界面上选的 > 管理端默认值 > 系统默认值
传了当前模型不支持的参数,工具会在调用模型之前直接返回参数错误,不会产生任何费用。换模型后原来能用的参数可能失效,这是正常的——参数表属于模型,不属于平台。

编辑图片

编辑走的也是 generate,区别是带了参考图:
1

上传图片

把要编辑的图片拖进对话框,或点附件按钮上传。
2

描述修改

用自然语言说要改什么,例如「把背景换成海滩」「去掉右下角的水印」。
3

查看结果

返回的是新生成的一张图,不是在原图上就地修改。原图始终保留。
只有第一张参考图会被使用。想做「把 A 的风格套到 B 上」这类需要两张输入的操作,需要模型本身支持多图输入,且要通过该模型自己的参数传入——放在 image_urls 里的第二张会被丢弃。

批量生成

要一次出多张(比如网站配图、一组头像),专家会用 generate_batch
批量的实际耗时由并发度决定:24 张图在并发 20 下大约是两轮,而不是 24 倍单张耗时。
批量里每张成功的图各计一次费,失败的不计。所以 6 张图的成本就是单张价格 × 6,没有批量折扣,也没有批量惩罚。

图片理解

上传图片后直接提问:
理解能力用的是专门配置的视觉模型(和你在对话里选的聊天模型可能不是同一个,由管理端 tool_model_override_image_read 决定)。
桌面端超过 8 MiB 的本地图片会被拒绝并提示改用截屏工具——Retina 全屏 PNG 很容易超过这个线。云端上传的图片走对象存储链接,不受这条限制。

耗时、超时与重试

这几个数值决定了「等多久算卡住」:

转后台运行

生成中的卡片上有「转后台」的入口。点了之后:
  • 对话立刻继续,你可以接着提别的需求
  • 图片在后台继续生成,完成后自动送达
  • 刷新页面不影响,卡片会自己恢复到最新状态
转后台是云端专属能力。桌面端没有这条信号通道,生成必须在当前轮次内等完。

计费说明

计费单位是 per_call(按次),公式为 固定积分 × 张数——与图片复杂度、提示词长度、生成耗时都无关。部分模型使用 cost_matrix(按参数查表),此时分辨率与质量档位会改变单次价格。 各模型单价是运营数据,以模型选择器的当前值为准;算法固定,见计费公式
生成失败不计费。 计费事件只在任务成功时发出,三次内部重试也只算一次。真正要留意的是「成功但你不满意」——那次已经扣过了。所以批量出图前先用单张把提示词试准,是实打实省钱的做法。

失败态与排错

获得更好结果的提示

好的提示词能显著提升生成质量。从这几个维度描述:
  • 主体:画什么(一只猫、一栋建筑、一个人)
  • 风格:什么艺术风格(写实、卡通、水彩、像素艺术)
  • 构图:画面布局(特写、全景、俯视)
  • 色调:主要颜色和氛围(明亮、暗调、暖色系)
  • 细节:光线方向、材质、表情
「画一张好看的图」远不如「画一只橘色的加菲猫坐在窗台上看雨,水彩风格,暖色调,侧逆光」来得有效。

适用场景

快速生成 UI 原型图、图标、插画、Banner,适合创意初期的视觉探索。配合 Sites 插件时,网站配图会走批量生成并先给出费用预估。
换背景、调色调、去瑕疵、扩展画面,无需打开专业修图软件。注意结果是新图而非就地修改。
多轮对话迭代,用「再亮一点」「换成复古风格」不断调整。每轮都是一次新的计费,迭代次数直接等于成本倍数。
文章、社交媒体、PPT 的成组配图,用批量生成一次出齐,风格更统一。

相关页面

计费公式

per_call 与 cost_matrix 的完整算法

视频生成

按输出时长计费的生成能力

限额速查

平台全部硬限制

Sites

网站配图的批量生成与费用预估