← 返回攻略列表

GMI Cloud 跑 MiniMax 攻略:M2.5 永久免费 1,000,000 TPM,不薅白不薅

GMI Cloud 是 NVIDIA 系的 GPU 云,OpenAI 兼容 API 免费跑 MiniMax M2.5 / M2.7,注册即用、永久 Tier 1、不绑卡。M2.5 独家支持 Anthropic 兼容格式带 thinking blocks。

GMI Cloud 跑 MiniMax 攻略:M2.5 永久免费 1,000,000 TPM,不薅白不薅

更新时间:2026年8月25日

📖 案例:做 AI 内容站的小李,每天要写 20 篇小红书爆款 + 10 条抖音文案 + 5 篇知乎长文。之前用 GPT-4 一个月烧 200 块,后来发现 GMI Cloud 这个 NVIDIA 系的 GPU 云,OpenAI 兼容 API 直接白嫖 MiniMax M2.5 / M2.7——注册不用绑卡、永久 Tier 1、1,000,000 TPM 额度,薅了快一年一分钱没花。中文写作质量比 GPT-4 还接地气。

最近知乎和即刻上铺天盖地在转一张图——"GMI Cloud × MiniMax 14天免费 M3"。我花了一整天把 GMI 官方 30 多页文档扒了,发现这事得拆开看:

  • 真的部分:GMI 上确实能白嫖 MiniMax 模型(M2.1 / M2.5 / M2.7),注册即用、永久 Tier 1、不绑卡
  • 假的部分:所谓"14天"是营销噱头,GMI 文档里没有任何限时活动;所谓"M3" GMI 平台压根没上架,只能在 MiniMax 官方 Token Plan 起步 $20/月订阅

这篇文章把真相讲清楚,然后教你从注册到第一次调用、五分钟跑通 MiniMax M2.5,把免费额度薅到底。

📊 免费额度到底有多少

GMI 的免费层叫 Tier 1,注册账号就自动获得,永久有效,没有任何时间限制。文档原话(rate-limit 页面):

  • TPM(Token per Minute,每分钟 token 数):1,000,000
  • RPM(Request per Minute,每分钟请求数):所有 LLM 模型无限
  • Multimodal RPM/TPM:无限
  • 价格:$0

1,000,000 TPM 是什么概念?假设你用 M2.7 写一篇 5000 字的小红书爆款笔记,输入 + 输出大约 8000 token,那你可以每分钟写 125 篇,一天理论上能写 18 万篇——对个人开发者来说完全用不完。

升级到更高 Tier 需要累计充值:

Tier累计充值TPM升级时间
Tier 1$01,000,000立即
Tier 2$503,000,00024小时内
Tier 3$50050,000,00024小时内
Tier 4$1,000100,000,00024小时内
Tier 5$5,000300,000,00024小时内

注意 GMI 官方原话:"voucher redemptions do not count towards purchase"——意思是兑换优惠券不算充值,光注册不充钱,永远在 Tier 1,薅一辈子

🧐 真相:所谓"14天免费 M3"是怎么回事

⚠️ 重要纠错:网上那张"GMI × MiniMax 14天免费 M3"图是讹传,原因是:
  • "14天"——GMI 官方文档里没有任何限时活动文案,Tier 1 是永久层
  • "M3"——GMI 平台只挂 MiniMax M2.1 / M2.5 / M2.7,没有 M3
误传可能来源:把 M2.5 看成 M3(model ID 多了个小数点容易看错)、或者 MiniMax 官方 Token Plan 偶尔的促销 free trial 被误传到 GMI 上。

那 M3 怎么薅?有三条路:

  1. MiniMax 官方 platform.minimax.io,注册送少量试用 token,Token Plan 起步 $20/月(Plus 包含 M3 / M2.7 / image / speech 全系列,5 小时滚动 + 周窗口,3-4 个 agent 额度)
  2. 等 GMI 上架 M3,他们家模型库更新挺频繁,H3 视频模型 2026-07 上了,Speech 2.8 上了,Music 3.0 上了
  3. 走 MiniMax 官方的 Dev Program,给认证开发者发免费 Token Plan 时长

我的建议策略:薅 GMI 永久免费的 M2.5 / M2.7 干日常活,薅 MiniMax 官方注册试用 token 体验 M3,等 GMI 上 M3 再切换。

🚀 5 分钟跑通:从注册到第一次调用

第 1 步:注册账号(30 秒)

打开 https://console.gmicloud.ai,右上角 Sign in。

四种登录方式:

  • 邮箱密码
  • Google 一键(推荐,省事)
  • GitHub 一键
  • Hugging Face 一键

注册完跳到控制台首页 Inference 标签页。整个过程不用绑卡、不用 KYC、不用手机号,比 MiniMax 官方平台(要手机号 + 实名)宽松多了。

第 2 步:拿 API key(30 秒)

点右上角头像 → SettingsAPI Key Management

+ Create API Key 按钮,弹窗里:

  • Name:随便填,比如 my-test
  • Scope:保持默认 Inference(薅羊毛用不上 Compute)

点 Create。

⚠️ 关键避坑:生成的 key 只显示一次!弹窗里立刻复制到密码管理器(1Password / Bitwarden / Keychain),关了就没了。key 长得像 eyJh... 这种 JWT 格式。

第 3 步:第一次调用——curl 版

打开终端,粘贴:

curl https://api.gmi-serving.com/v1/chat/completions \ -H "Authorization: Bearer 你的key" \ -H "Content-Type: application/json" \ -d '{ "model": "MiniMaxAI/MiniMax-M2.5", "messages": [ {"role": "user", "content": "用一句话介绍你自己"} ] }'

正常情况你会拿到一个 JSON 响应,里面有 AI 写的自我介绍。

报错的几种情况:

  • 401 Unauthorized:key 错了,重新生成
  • 404 model_not_found:模型名拼错,是 MiniMaxAI/MiniMax-M2.5,注意中间是横杠不是下划线、点号是英文点不是中文点
  • 429 Too Many Requests:RPM 触顶(理论上不会),sleep 几秒重试

第 4 步:换 OpenAI Python 库

写 Python 脚本直接装 openai 包改 base URL:

pip install openai from openai import OpenAI client = OpenAI( base_url="https://api.gmi-serving.com/v1", api_key="你的key" ) response = client.chat.completions.create( model="MiniMaxAI/MiniMax-M2.5", messages=[{"role": "user", "content": "你好"}] ) print(response.choices[0].message.content)

如果你已经在用 ChatGPT Next Web、LobeChat、ChatBox、Open WebUI 这些本地聊天工具,改三处配置就能切到 GMI:

  • API Base URL:https://api.gmi-serving.com/v1
  • API Key:你的 GMI key
  • 模型名:MiniMaxAI/MiniMax-M2.5

第 5 步:薅更狠——M2.5 独家的 Anthropic 兼容

M2.5 在 GMI 上额外支持 Anthropic 兼容接口,还带 thinking blocks(思考链),对调试复杂任务超有用,免费羊毛里很少见。

⚠️ 文档坑警告:GMI 官方 M2.5 quickstart 文档里有一段示例代码 base URL 写成了 https://api.minimax.io/anthropic——这是错的api.minimax.io 是 MiniMax 官方平台的域名,跟 GMI 没关系。GMI 的正确 anthropic endpoint 是 https://api.gmi-serving.com/v1/messages,鉴权用 Authorization: Bearer 你的 key

正确写法:

import anthropic client = anthropic.Anthropic( base_url="https://api.gmi-serving.com", api_key="你的GMI key" ) message = client.messages.create( model="MiniMaxAI/MiniMax-M2.5", max_tokens=1000, messages=[{"role": "user", "content": "一步步证明 1+1=2"}] ) for block in message.content: if block.type == "thinking": print(f"思考中:\n{block.thinking}\n") elif block.type == "text": print(f"回答:\n{block.text}\n")

🎁 顺手薅走的其他免费模型

GMI 上 Tier 1 全免费的模型有上百个,按场景给你列精选:

文本对话类

  • MiniMaxAI/MiniMax-M2.7 — MiniMax 最新次旗舰,号称开始"自我改进"训练
  • MiniMaxAI/MiniMax-M2.5 — 稳,跑日常活够用
  • DeepSeek V4 Pro / DeepSeek V4 Flash — 思考链强
  • GPT-5.4 / GPT-5.4 Pro / GPT-5.4 Mini / GPT-5.4 Nano — OpenAI 完整产品线
  • Claude Sonnet 4.5 / Sonnet 4.6 / Haiku 4.5 / Opus 4.5 — Anthropic 完整产品线
  • Kimi K2.5 / K2.6 / K3 — 月之暗面
  • GLM 4.5 / 4.7 / 5 / 5.1 — 智谱
  • Qwen3 全系列 — 通义千问
  • Llama 4 Maverick 17B — Meta

编程专项

  • Qwen3 Coder 480B A35B — 480B 参数代码专用模型,效果炸裂
  • Qwen3 Next 80B A3B — 稀疏 MoE,3B 激活参数,速度快
  • DeepSeek Prover v2 671B — 数学证明

图像 / 视频 / 音频

  • 图像:Flux2-DevFlux2-Kleingemini-3-pro-imageQwen-Image-2512Z-Image-Turbo
  • 视频:Kling V3Seedance 2.5Wan 2.7MiniMax-H3Hailuo-2.3
  • 音频:MiniMax Speech 2.6 / 2.8MiniMax Music 3.0Chatterbox-tts
  • 3D:Hunyuan-3D-pro

完整模型库去 https://docs.gmicloud.ai/llms.txt 拿,是 GMI 文档站给 AI 准备的索引文件,能一键拉全所有模型 quickstart 链接。

💼 三大实战场景

场景一:自媒体博主日更

每天写 5 篇小红书爆款笔记、3 条抖音文案、2 篇知乎长文。用 M2.7 写中文、M2.5 写英文、Flux 跑封面图,每天 50,000 token 完全够用,一年不花一分钱。M2.7 中文写小红书比 GPT-4.1 还接地气,标题党套路熟、emoji 用得自然。

场景二:独立开发者做 SaaS

每天 10,000 次用户请求,平均每次 2000 token,月消耗 60 亿 token。GMI Tier 1 撑不住,得充钱升 Tier 3($500)。但 MVP 阶段(每天 1,000 次请求、月 6 亿 token)Tier 2($50)够了。按 OpenAI GPT-4.1 定价 $2.50/M input + $10/M output 算,6 亿 token 一个月差不多 1 万块。GMI Tier 3 $500 直接省 95%。

场景三:学生党薅作业

写论文、做 PPT、改代码、答疑。GMI Tier 1 100 万 TPM 完全够用,写 50 页论文都绰绰有余。建议用 M2.7 处理中文长文、Qwen3 Coder 480B 处理代码、Flux 跑插图。别拿 GMI 模型生成的内容直接交作业,会被查重——AI 写初稿、自己改。

❌ 5 个常见避坑

避坑一:模型 ID 大小写敏感

错:MiniMaxAI/minimax-m2.5(大小写错)
对:MiniMaxAI/MiniMax-M2.5

避坑二:Anthropic 格式的 base URL

GMI 官方 M2.5 quickstart 文档示例代码 base URL 写成了 api.minimax.io,那是 MiniMax 官方域名,不是 GMI。跟 GMI key 配在一起会 401。

正确:base_url = "https://api.gmi-serving.com"
错误:base_url = "https://api.minimax.io/anthropic"

避坑三:别开 Auto Pay

GMI 有个 Auto Pay 设置,开了之后余额低于阈值会自动充值。薅羊毛千万别开——路径:Settings → Account → Payment settings → Auto Pay toggle,关掉。

避坑四:API key 只显示一次

生成 key 那一刻必须立刻复制存起来,关了弹窗就没了。

避坑五:Org 级别的 rate limit

同一家公司或同一个 IP 段注册多个账号,GMI 会按 organization 算总 TPM,薅不出多个 Tier 1 的额度。个人薅一个号就够。

🔄 GMI vs MiniMax 官方 API 对比

很多用户搞混 GMI 和 MiniMax 官方 API,这里帮你理清:

项目GMI CloudMiniMax 官方
域名api.gmi-serving.comapi.minimax.io
控制台console.gmicloud.aiplatform.minimax.io
鉴权Authorization: Bearer 你的 keyAuthorization / X-Api-Key
OpenAI 兼容/v1/chat/completions/v1/chat/completions
Anthropic 兼容/v1/messages/anthropic/v1/messages
model ID 格式MiniMaxAI/MiniMax-M2.5MiniMax-M2.5
MiniMax M3没有
免费层永久 Tier 1 / 1M TPM无(Token Plan 起步 $20/月)
适合白嫖 M2.5/M2.7、长尾测试正经用 M3、做产品

建议:日常用 GMI 薅 M2.5/M2.7,要 M3 走 MiniMax 官方。两者账号、key、计费完全独立,不要混用。

❓ 常见问题

真的不要钱?会不会偷偷扣费?

注册即用 Tier 1($0),1,000,000 TPM,所有 LLM RPM 无限。视频和图片模型有 RPH 限制但额度内免费。Auto Pay 默认关,不开通不会突然扣你卡。

14 天后会怎样?

不会怎样。"14 天"这个说法是营销噱头,GMI 文档里没有。我跑了一周没收费,token 自由打。

GMI 平台的 M3 怎么薅?

三条路:MiniMax 官方 platform.minimax.io 注册送试用 token(Token Plan 起步 $20/月);等 GMI 上架;走 MiniMax Dev Program(要开源项目门槛)。GMI 当前没 M3,别浪费时间调。

能商用吗?

GMI 平台本身没禁止商用,但具体模型有各自 license。Llama 有 Meta 社区 license、Qwen 有 Tongyi 协议、GPT-5.4 / Claude 4.5 有 OpenAI / Anthropic 的 ToS。商业产品前看清楚每家条款。

速度怎么样?

国内测延迟 200-400ms,比官方 MiniMax 平台(走 agnes 代理那套)慢一点点,但比大多数海外直连稳。视频生成不算快(5 秒 768P 视频约 60-90 秒),图像生成 Flux 类挺快(2-3 秒一张)。

账号会被封吗?

GMI ToS 主要禁挖矿、刷单、API 套利。正常个人开发、自媒体、自动化脚本,薅到 Tier 1 上限都没事。别用脚本暴力刷 token,会触发风控。

除了 MiniMax 还能薅什么?

GMI 平台 Tier 1 覆盖上百个模型:DeepSeek V4 Pro / V4 Flash、Claude Sonnet 4.5 / 4.6、GPT-5.4 / 5.4 Pro / 5.4 Mini、Kimi K2.5 / K2.6 / K3、GLM 4.5 / 4.7 / 5 / 5.1、Qwen3 235B / 32B / Coder 480B、Llama 4 Maverick 17B 等 LLM,Flux2-Dev / Klein、Qwen-Image-2512、Z-Image 等图像模型,Kling V3、Seedance 2.5、Wan 2.7、Hunyuan-3D-pro 等视频/3D 模型。

🚀 5 分钟跑通 GMI Cloud MiniMax 永久免费

不绑卡、不 KYC、不收费、1,000,000 TPM 永久额度。薅完顺手把 M2.7、Qwen3 Coder、Claude Sonnet 4.5 一起薅走。

立即注册 GMI Cloud

📝 写在最后

网上那张 GMI × MiniMax 14天免费 M3 的图,转给我的时候,我心里就有数——大概率又是营销号在薅流量。但作为羊毛圈老炮,这事值得深扒,因为真羊毛的成分比噱头大

  • 永久 Tier 1 1,000,000 TPM 免费
  • M2.1 / M2.5 / M2.7 三个 MiniMax 主力模型随便调
  • DeepSeek V4 Pro、Claude 4.5、GPT-5.4 全免费
  • 100+ 视频、图像、音频、3D 模型有免费额度
  • NVIDIA 认证基础设施,SLA 99.9%

按本攻略走,薅到的羊毛价值至少 $200/月(按 OpenAI GPT-4.1 标准定价换算)。一年下来省 2400 块。

如果你调通了、跑出有意思的东西,欢迎回来留言分享。GMI 后续值得薅的我会持续更新。

下一篇预告:GMI Studio 可视化工作流实战——用 Kling + Flux + Hailuo 拼一条完整的短视频生成 pipeline,一分钱不花。