每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

MiniMax: MiniMax-M2.1-highspeed

MiniMax M2.1 Highspeed 注重编程与工具任务中的响应速度,适合在生成指令、工具结果和下一轮回复之间反复切换的交互式智能体流程。
对比模型
minimax-m2.1-highspeed
可用MiniMax聊天
输入 / 输出
$0.60 / $2.40
上下文
205K
最大输出
128K
模态
聊天
能力
工具调用提示词缓存

MiniMax-M2.1-highspeed 简介

MiniMax-M2.1-highspeed 是 MiniMax 的 M2.1 模型面向速度的版本,用于编程和工具辅助的任务。它适合交互式智能体循环:应用在生成的指令、工具结果和下一次回复之间来回切换。它保留了 M2.1 的推理、工具调用、JSON 模式和 schema 输出,功能上没有取舍,只是每一轮更快。

擅长的任务

  • 为“模型回答、工具运行、模型再回答”的循环设计,每一轮的延迟都会累加。
  • 保留 M2.1 的 JSON 模式和 schema 约束输出。
  • 某一步需要时可以使用推理。
  • 同时支持工具调用和提示词缓存。

什么情况换别的模型

  • 仅支持文本,不能发送截图或其他图片。
  • M2.5-highspeed 和 M2.7-highspeed 是后来的快速版本,可能更适合新建的项目。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    文本生成Responses API
    POST/v1/responses
    API 格式:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "minimax-m2.1-highspeed",
        "input": "Hello!"
      }'

价格

Verified 价格用于 Verified,多数模型更便宜;Official 价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。

默认规格

每 1M token
Official 价格
输入 $0.60 / 输出 $2.40 / 缓存读取 $0.03 / 缓存写入 $0.375
Verified 价格
—
折扣
—
提示词缓存价格

缓存读取

Official 价格
$0.03
Verified 价格
—
折扣
—

缓存写入

Official 价格
$0.375
Verified 价格
—
折扣
—

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
达到隐私和数据量阈值后,指标才会显示。

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

MiniMax-M2.1-highspeed 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 minimax-m2.1-highspeed 发一条简短消息,接口是 /v1/responses。返回回复,附上延迟和费用。

使用场景

  • 交互式编程助手

    驱动编辑器内的助手,它在读取和修改文件时,要对每条指令快速作出回应。

  • 步骤很多很短的智能体循环

    运行“规划、调用工具、读取结果”的循环,模型延迟占任务总耗时的大头。

  • 在线应用中的结构化回复

    向正在等待回复的前端返回符合 schema 的 JSON。

提示词示例

打开 utils/date.ts,找到时区缺陷并修复。然后运行测试,只汇报失败项。

根据这些工具结果,决定下一步唯一的动作,以 JSON 输出,字段为 action 和 args。

在列出的这些文件中重命名这个函数,并给出每个文件的 diff。

此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。

FAQ

MiniMax-M2.1 的 highspeed 版本是什么?

同一个 M2.1 世代,作为面向速度的选项,用于编程和工具辅助的任务。交互式智能体各步骤之间的延迟很重要时,选它。

与 M2.1 相比,它会损失功能吗?

不会。它保留了 M2.1 的推理、工具调用、提示词缓存、JSON 模式和响应 schema 功能集,变化只在每一轮的速度。在你自己的任务上,质量仍然值得测试。

可以用它做结构化输出吗?

可以。JSON 模式和响应 schema 都标明支持,所以你可以要求固定格式的输出,并在应用中解析。

有更新的 MiniMax 快速模型吗?

有。MiniMax 后来推出了 M2.5-highspeed 和 M2.7-highspeed 作为更快的选项。如果是新项目而不是保留已有集成,请在自己的任务上对比它们。

它支持图片吗?

不支持。它没有图片输入,只读写文本。提示词需要理解图片或视频时,请选 MiniMax M3。只需输入文本提示词和工具结果。

MiniMax-M2.1-highspeed 的费用是多少?

在 TokenLab 上,MiniMax-M2.1-highspeed 的价格为 输入 $0.60 / 输出 $2.40 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

MiniMax-M2.1-highspeed 的上下文窗口和输出上限是多少?

MiniMax-M2.1-highspeed 最多接收 204,800 token 的上下文,单次最多返回 131,072 token。

MiniMax-M2.1-highspeed 应该使用哪个端点?

MiniMax-M2.1-highspeed 使用 https://api.tokenlab.sh/v1/responses。代码写法见下方的请求示例。

MiniMax-M2.1-highspeed 支持哪些操作?

MiniMax-M2.1-highspeed 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。

MiniMax-M2.1-highspeed 对比

资料来源

审阅于 2026年10月2日

更多 MiniMax 模型

相关模型