नेटिव MiniMax Actions से चित्र, वाणी और संगीत बनाएँ तथा लागत-सचेत सुरक्षित डिलीवरी करें।
MiniMax 媒体生成 使用 MiniMax 原生 API 能力生成图片、语音和音乐。这个 Skill 不运行本地 CLI,也不要求用户在文件中保存 API Key。 Loadout capabilities 使用 api:minimax 提供的 MiniMax 原生 Actions:imagegeneration 执行 image-01 图像生成,t2av2 执行 Speech 2.8 或 2.6 文本转语音,generatemusic 执行歌曲或纯音乐生成。 只使用 capabilitiesget 返回的当前字段。不要把其他供应商的模型当作 MiniMax 的替代品。 通用流程 1. 判断用户需要图片、语音还是音乐。 2. 收集最少必需输入,并给出将要使用的模型、数量或音频规格。 3. 对涉及人物、声音或品牌的参考素材确认用户有权使用;不要克隆未授权声音。 4. 调用生成 Action 前先向用户展示预计操作。生成是付费写操作,遵循报价和确认流程。 5. 返回生成结果和实际参数。若 Action 返回明确的字段或内容安全错误,修正一次;不要重复付费重试。 图片
# MiniMax 媒体生成 使用 MiniMax 原生 API 能力生成图片、语音和音乐。这个 Skill 不运行本地 CLI,也不要求用户在文件中保存 API Key。 ## Loadout capabilities 使用 <integration-tag>api:minimax</integration-tag> 提供的 MiniMax 原生 Actions:`image_generation` 执行 `image-01` 图像生成,`t2a_v2` 执行 Speech 2.8 或 2.6 文本转语音,`generate_music` 执行歌曲或纯音乐生成。 只使用 capabilities_get 返回的当前字段。不要把其他供应商的模型当作 MiniMax 的替代品。 ## 通用流程 1. 判断用户需要图片、语音还是音乐。 2. 收集最少必需输入,并给出将要使用的模型、数量或音频规格。 3. 对涉及人物、声音或品牌的参考素材确认用户有权使用;不要克隆未授权声音。 4. 调用生成 Action 前先向用户展示预计操作。生成是付费写操作,遵循报价和确认流程。 5. 返回生成结果和实际参数。若 Action 返回明确的字段或内容安全错误,修正一次;不要重复付费重试。 ## 图片 使用 `image-01`。必填字段是 `model` 和 `prompt`。默认请求 1 张并使用 URL 输出;只有用户明确需要多张时才提高 `n`,且当前平台计费支持 1 至 9 张。URL 可能在 24 小时后失效,应立即把可用结果交付给用户。 当用户提供主体参考时,把当前 Action schema 支持的参考对象放入 `subject_reference`。不要自行发明字段或把本地路径传给托管 Action。 ## 语音 必填字段是 `model` 和 `text`。根据用途选择 HD 或 Turbo:成片旁白优先 HD,草稿和批量预览优先 Turbo。只有用户提出要求时才设置 voice、语速、音量、音高、格式、采样率、声道、字幕或发音词典。 文本上限和可用模型以 Action schema 与预检结果为准。长文本若超限,先按自然段分段并说明会产生多次调用。 ## 音乐 先确定用途、流派、情绪、速度、乐器、是否有人声和歌词语言。调用 `generate_music` 时必须提供 `model`;歌曲可提供 `prompt` 与 `lyrics`,纯音乐使用当前 schema 支持的 instrumental 字段。不要模仿在世艺术家的独特风格;改写为一般化的流派、年代、编曲和情绪特征。 ## 输出格式 ```markdown ## 生成计划 - 类型:<图片/语音/音乐> - 模型:<MiniMax 模型> - 关键参数:<摘要> - 付费确认:<待确认/已确认> ## 结果 <URL、资产 ID 或 Action 返回的结果> ## 备注 <内容安全、到期时间或失败恢复说明> ``` ## Attribution See [upstream attribution](UPSTREAM.md) and the preserved [MIT license](LICENSE.txt).