Claude Sonnet 5.5 已上架。Anthropic 于 9 月 28 日发布的新一代 Sonnet,接替 Claude Sonnet 5,官方定位为速度与智能的最佳平衡,支持 adaptive thinking、100 万 token 上下文与图像输入。查看价格
Minimax

MiniMax M3.1 Flash Preview

Official

minimax/minimax-m3.1-flash-preview

MiniMax M3.1 Flash Preview —— MiniMax 最新编码模型,100 万上下文,思考常开,五档 effort 可调。

上下文窗口
1M
最大输出
524K
输入模态
text · image
输出模态
text
能力
视觉理解 · 推理 · 工具调用 · 编码 · 提示词缓存
上游发布
2026-09-27
RouteMux 名
minimax/minimax-m3.1-flash-preview
官方 ID
MiniMax-M3.1-Flash-Preview
在线模型 Playground

直接试用 MiniMax M3.1 Flash Preview

调整请求参数、查看当前费用上限,并在模型介绍页内直接看到真实结果。

streamchat
1配置输入
0 / 20,000
添加图片

请先登录,再向这个视觉模型上传图片。

最高预估费用—
2实时结果

结果会显示在这里

在左侧填写输入。这里与 RouteMux 完整 Playground 共用同一条执行与计费链路。

conversation

MiniMax M3.1 Flash Preview 是什么

MiniMax M3.1 Flash Preview 是 MiniMax M3.1 系列的首个模型,2026 年 9 月 27 日发布。官方把它调校在日常开发中的速度与稳定性上 —— 修 bug、写功能、Agent 编码 —— 而不是攻最难的一次性难题。

规格沿用 M3:100 万 token 上下文,文本与图像输入,工具调用与提示缓存,OpenAI Chat Completions、OpenAI Responses、Anthropic Messages 三种协议都能打。变化在思考:它始终开启、不能关闭,深浅用 reasoning effort 调,可选 low、medium、high、xhigh、max。不传时 MiniMax 默认 max。

MiniMax 只通过订阅套餐提供这个模型,按量价目表里没有它,所以没有可对照的官方单价。它也是预览版:MiniMax 可能调整或下线。

MiniMax M3.1 Flash Preview API 定价

来源: minimax_m3_parity · 核验于 2026-09-29

输入展示价
$0.03/ 百万 tokens
≈¥0.204 / 百万 tokens
输出展示价
$0.12/ 百万 tokens
≈¥0.816 / 百万 tokens

缓存读 $0.006/M · 缓存写 —/M

档位输入缓存读缓存写输出
Standard ≤512K$0.03$0.006—$0.12
Standard >512K$0.06$0.012—$0.24

本币价按固定汇率折算(1 美元 = 6.8 CNY),汇率更新于 2026-08-02,仅供参考;计费始终以美元结算。

成本估算

预估费用$0.00042

限时首充加送 20%,最高送 200 Credits

注册后 72 小时内完成第一笔充值即可享受。满 $20 起,仅限第一笔。

注册并领取无需订阅,按用量结算。

能力亮点

五档推理强度

low / medium / high / xhigh / max。默认 max —— 对延迟敏感的场景请显式调低。

100 万 token 上下文

支持文本与图像输入。

工具调用与缓存

原生工具调用,提示缓存自动生效。

三种协议

OpenAI Chat、OpenAI Responses、Anthropic Messages。

接口与协议

OpenAI Chat Completions支持流式OpenAI Responses支持流式Anthropic Messages支持流式

API 调用时用任一 ID 都可以。

RouteMux 名minimax/minimax-m3.1-flash-preview
官方 IDMiniMax-M3.1-Flash-Preview

把 ROUTEMUX_KEY 占位符替换为你的 API Key。 创建 →

from openai import OpenAI

client = OpenAI(
    base_url="https://api.routemux.com/v1",
    api_key="<ROUTEMUX_KEY>",
)

completion = client.chat.completions.create(
    model="minimax/minimax-m3.1-flash-preview",
    messages=[{"role": "user", "content": "What is the meaning of life?"}],
)
print(completion.choices[0].message.content)
base_url: https://api.routemux.com/v1

性能数据 (近 30 天)

MiniMax M3.1 Flash Preview 常见问题

›MiniMax M3.1 Flash Preview 是什么?

MiniMax M3.1 Flash Preview —— MiniMax 最新编码模型,100 万上下文,思考常开,五档 effort 可调。

›MiniMax M3.1 Flash Preview 的上下文窗口有多大?

MiniMax M3.1 Flash Preview 支持最多 1M tokens 的上下文窗口,单次最多输出 524K tokens。

›MiniMax M3.1 Flash Preview 的 API 价格是多少?

通过 RouteMux 调用 MiniMax M3.1 Flash Preview:输入 $0.03、输出 $0.12(USD / 1M tokens),低于官方定价。

›如何通过 API 调用 MiniMax M3.1 Flash Preview?

MiniMax M3.1 Flash Preview 兼容 OpenAI 接口:把 base URL 换成 RouteMux、model 填 minimax/minimax-m3.1-flash-preview 即可,无需改代码。

›MiniMax M3.1 Flash Preview 支持哪些输入输出模态?

MiniMax M3.1 Flash Preview 的输入模态:text, image;输出模态:text。

›MiniMax M3.1 Flash Preview 是什么时候发布的?

MiniMax M3.1 Flash Preview 发布于 2026年9月27日。

›能关掉思考吗?

不能。对这个模型传 thinking disabled 或 effort 为 "none",MiniMax 会直接返回 400。想让思考最轻,用 effort "low"。

›各协议怎么设推理强度?

OpenAI Chat Completions 用 reasoning_effort;OpenAI Responses 用 reasoning.effort;Anthropic Messages 用 output_config.effort。思考 token 按输出 token 计费。

›和 MiniMax M3 有什么区别?

上下文与协议相同。M3.1 Flash Preview 思考常开,多了 xhigh 与 max 两档;M3 可以关闭思考,最高到 high。M3 是正式版,这个是预览版。

参考来源

正文由 Jerry Fan 核对于 2026-09-29

查看 Markdown 纯文本