跳转到主要内容
MiniMax 支持文本对话、图像理解、图像生成与语音合成,一份 minimax_api_key 即可启用全部能力。
通过 Web 控制台的「模型管理」页面可一站式配置以下全部能力,无需手动改配置文件。

文本对话

图像理解

MiniMax 的 M2.x 系列 chat 模型本身不支持视觉,视觉调用统一路由到 MiniMax-Text-01。配置 minimax_api_key 后 Agent 的 Vision 工具会自动使用该模型,无需在配置文件中显式指定。

图像生成

可选模型:image-01

语音合成

常用音色示例: 完整音色(中文 / 粤语 / 英 / 日 / 韩共 70+ 种)可参考 系统音色列表,也可在 Web 控制台的「模型管理 → 语音合成」下拉框中可视化选择。