MiniMax Media Generation
Generate images, speech, and music with native MiniMax Actions and safe cost-aware delivery.
Works with
name: minimax-media-generation description: 通过 Aident Loadout 的 MiniMax Actions 生成图片、语音和音乐,包含模型选择、参数检查、成本确认和结果交付。
MiniMax 媒体生成
使用 MiniMax 原生 API 能力生成图片、语音和音乐。这个 Skill 不运行本地 CLI,也不要求用户在文件中保存 API Key。
Loadout capabilities
使用 <integration-tag>api:minimax</integration-tag> 提供的 MiniMax 原生 Actions:image_generation 执行 image-01 图像生成,t2a_v2 执行 Speech 2.8 或 2.6 文本转语音,generate_music 执行歌曲或纯音乐生成。
只使用 capabilities_get 返回的当前字段。不要把其他供应商的模型当作 MiniMax 的替代品。
通用流程
- 判断用户需要图片、语音还是音乐。
- 收集最少必需输入,并给出将要使用的模型、数量或音频规格。
- 对涉及人物、声音或品牌的参考素材确认用户有权使用;不要克隆未授权声音。
- 调用生成 Action 前先向用户展示预计操作。生成是付费写操作,遵循报价和确认流程。
- 返回生成结果和实际参数。若 Action 返回明确的字段或内容安全错误,修正一次;不要重复付费重试。
图片
使用 image-01。必填字段是 model 和 prompt。默认请求 1 张并使用 URL 输出;只有用户明确需要多张时才提高 n,且当前平台计费支持 1 至 9 张。URL 可能在 24 小时后失效,应立即把可用结果交付给用户。
当用户提供主体参考时,把当前 Action schema 支持的参考对象放入 subject_reference。不要自行发明字段或把本地路径传给托管 Action。
语音
必填字段是 model 和 text。根据用途选择 HD 或 Turbo:成片旁白优先 HD,草稿和Integration · Minimax率、声道、字幕或发音词典。
文本上限和可用模型以 Action schema 与预检结果为准。长文本若超限,先按自然段分段并说明会产生多次调用。
音乐
先确定用途、流派、情绪、速度、乐器、是否有人声和歌词语言。调用 generate_music 时必须提供 model;歌曲可提供 prompt 与 lyrics,纯音乐使用当前 schema 支持的 instrumental 字段。不要模仿在世艺术家的独特风格;改写为一般化的流派、年代、编曲和情绪特征。
输出格式
## 生成计划
- 类型:<图片/语音/音乐>
- 模型:<MiniMax 模型>
- 关键参数:<摘要>
- 付费确认:<待确认/已确认>
## 结果
<URL、资产 ID 或 Action 返回的结果>
## 备注
<内容安全、到期时间或失败恢复说明>
Attribution
See and the preserved .