2026年大模型API白嫖与CodingPlan性价比指南

调研日期:2026-08-04;2026-09-04 增补第九节「Coding Plan 订阅性价比」(整合原 openclaw 笔记的 coding plan 对比收藏 + Command Code 订阅调研)
数据来源:GitHub (cheahjs/free-llm-api-resources, mnfst/awesome-free-llm-apis, wmpeng/codingplan)、OpenRouter Blog、官方文档


一、前言

用户已耗尽百炼(阿里云)和中国移动的免费额度,目前在用火山方舟(Agent Plan Medium)和 NVIDIA NIM。本文汇总所有可用的免费模型 API 平台,区分国内直连和国际平台,供后续薅羊毛参考。

注意:免费政策随时变动,以下数据截至 2026年8月,使用前建议核实官网最新信息。


二、国内平台(直连,无需额外网络配置)

平台 免费额度 代表模型 亮点 限制
智谱AI 新用户 2000万 Token GLM-4-Flash(永久免费) 额度最大,GLM-4-Flash 不限Token总量 ⚠️ 用户已过期(忘记用)
硅基流动 (SiliconFlow) 注册实名送 16元代金券 ✅ 已薅过(2026-08-10确认) DeepSeek-V3/R1、Qwen 等开源模型 新模型上架快,部分小模型永久免费 已用完
月之暗面 Kimi 每分钟3次请求,不限总量 kimi-k2.6 等 256K超长上下文 频率极低
火山方舟 50万 Tokens 永久免费 豆包系模型 按天重置(200万/天) 已在用
美团 (LongCat) 实名认证送 1000万 Tokens ❌ 活动已下架(2026-08核实) 自研模型 曾缓存命中免消耗 已失效
联通云 Coding Plan 0元订阅:Lite 每月1.8万次 / Pro 每月9万次,每日1200次 ❌ 名额已满(2026-08-10确认) GLM-5.1/5、Qwen3.5、MiniMax-M2.7 曾官方免费,实名不绑卡 已失效
白山智算 450元赠金 ❌ 已过时(2026-08-10确认);现为50–150元体验金 + R1-0528-Qwen3-8B/bge-m3/KAT-Coder-72B 永久免费 GLM-5、R1-0528-Qwen3-8B、KAT-Coder-72B 部分模型永久免费 10 RPM 限速
Modal 平台 GLM-5 免费端点,不限 token GLM-5 不限量 1-2路并发
欧派算力云 DeepSeek-R1/V3 各 100万 Tokens DeepSeek-R1/V3 注册即送,6个月有效 模型少
摩尔线程 30天完全免费试用 GLM-4.7 国产GPU生态,零成本试水 限时
商汤·日日新 公测 1500次/5h SenseNova 6.7 Flash-Lite 多模态编程 限时公测
讯飞星辰 MaaS 免费包:个人 200万 / 企业 500万 Tokens(1年) ❌ 已没有(2026-08-10确认) 星火 X2、Qwen3.6 等 曾语音+大模型生态强 已失效
腾讯云混元 10款模型共享100万 Tokens 混元大模型系列 1年有效期,最长 Lite版永久免费
百度千帆 每模型独立100万 Tokens ERNIE 4.5 系列 并发极高(50QPS) 通常3个月有效
零一万物 (01.AI) 注册赠送体验金 万策、万智系列 兼容 OpenAI 格式 通常1个月有效
360智脑 新人赠送体验包 360智脑4.0 安全领域特色 限时活动

2.1 GLM-4-Flash 详解

智谱 GLM-4-Flash(最新版 GLM-4-Flash-250414)是性价比最高的免费模型:

  • 费用:完全免费,不限 Token 总量
  • 上下文:128K(约300页书)
  • 并发:新用户30,付费用户可达3000
  • 速度:~200 tokens/s
  • 支持:Function Calling、联网搜索、流式输出、26种语言
  • 能力定位:入门级——日常对话、翻译、摘要、RAG 检索够用,复杂推理/Agent 多步规划较弱
  • 适用场景:批量简单任务、兜底 fallback、替代 doubao-seed-2.0-mini 节省 AFP

2.2 智谱 API 接入信息

  • 接口地址:https://open.bigmodel.cn/api/paas/v4
  • 兼容 OpenAI SDK:✅ 是
  • 注册:bigmodel.cn

三、国际平台(可能需要魔法/代理)

平台 免费额度 代表模型 亮点 限制
NVIDIA NIM 🟢 无限次调用 GLM-5.2、DeepSeek V4 Pro/Flash、Kimi K2.6 100+模型,GPU加速 40 req/min,已在用
Groq 🟢 因模型而异,最高 14400 req/天 Llama 3.3 70B、Qwen3 极快(320 tok/s),LPU硬件 2026年缩减过
Cerebras 🟢 100万 tokens/天 gpt-oss-120b、zai-glm-4.7 超快(~2600 tok/s) 8K上下文限制
Cloudflare Workers AI 🟢 10,000 neurons/天 Llama、Gemma、Qwen、GLM 50+模型,全球边缘节点 按模型算量
OpenRouter 🟢 充值$10后 1000 req/天 上百个聚合模型 模型最丰富 需充值后才有
Google AI Studio Gemini Flash ~1500 req/天 Gemini 2.5 Flash 系列 多模态强 免费层缩减过
Mistral AI Experiment tier ~10亿 tokens/月 Mistral Large、Small 量最大 需同意数据训练
SambaNova $5 credits/3个月 DeepSeek V3/V4、Gemma 4 含前沿模型 限期
Cohere 有永久免费 tier Command R 系列 企业级 RAG 能力 模型选择少
HuggingFace Inference 有免费额度 海量社区模型 模型最多 限速严

🟢 = 不需要魔法,国内可直接访问

3.1 Groq 详细限制

模型 每日限制 Token/分钟
Llama 3.1 8B 14,400 req/天 6,000
Llama 3.3 70B 1,000 req/天 12,000
Whisper Large v3 2,000 req/天 —
groq/compound 250 req/天 70,000

3.2 Cerebras 详细限制

模型 上下文 每日限制
gpt-oss-120b 128K(免费8K) 1M TPD
zai-glm-4.7 128K(免费8K) 1M TPD

3.3 NVIDIA NIM 接入信息

  • 接口地址:https://integrate.api.nvidia.com/v1
  • 认证:Authorization: Bearer nvapi-...
  • 兼容 OpenAI SDK:✅ 是
  • 热门模型:z-ai/glm-5.2、deepseek-ai/deepseek-v4-pro、deepseek-ai/deepseek-v4-flash、moonshotai/kimi-k2.6、minimaxai/minimax-m3
  • 限制:40 req/min,部分模型首次调用有冷启动延迟(1-2分钟)

四、模型能力梯队参考

旗舰级(复杂推理/Agent/代码)
├── glm-5.2 / deepseek-v4-pro / kimi-k3
├── doubao-seed-evolving / doubao-seed-2.1-turbo
└── minimax-m3

中坚级(接近旗舰80-90%性能,成本低)
├── deepseek-v4-flash(系数0.5,1M上下文)
├── doubao-seed-2.0-pro(系数2.5,即将下线)
└── doubao-seed-2.0-lite(系数0.5,有视觉)

入门级(简单任务够用,胜在免费/低成本)
├── GLM-4-Flash(完全免费,不限量)
├── doubao-seed-2.0-mini(系数0.25)
└── 各平台永久免费小模型

五、推荐薅羊毛策略(基于用户现状)

已在用

  • 火山方舟 Agent Plan Medium(主战)
  • NVIDIA NIM(备用)

优先补充(国内直连)

  1. 智谱AI → 2000万 Token,GLM-4-Flash 永久免费 → 最适合做兜底方案
  2. 硅基流动 → 16元代金券,开源模型更新快
  3. 白山智算 → 450元赠金 已过时;现为 50–150元体验金 + R1-0528-Qwen3-8B/KAT-Coder-72B 永久免费
  4. 联通云 Coding Plan → ❌ 已失效(2026-08-10 确认名额已满,详见第二节表格)
  5. 美团 LongCat → ❌ 2026-08 已确认活动下架,不再考虑

可补充(国际,无需魔法)

  1. Cerebras → 每天100万 tokens,速度极快
  2. Groq → 速度快,低延迟任务
  3. Mistral AI → 每月10亿 tokens(需同意数据训练)

配置建议

  • 主力对话:火山方舟 glm-5.2(享2.5折至2026-08-08)
  • 纯文本辅助任务:deepseek-v4-flash(系数0.5,1M上下文)
  • 视觉任务:doubao-seed-2.0-lite(系数0.5)或 kimi-k3
  • 兜底 fallback:GLM-4-Flash(免费,不限量)
  • 批量简单任务:doubao-seed-2.0-mini(系数0.25)或 GLM-4-Flash

六、接入方式参考

各平台 OpenAI 兼容 API 接入信息汇总:

平台 Base URL 认证方式
智谱AI https://open.bigmodel.cn/api/paas/v4 Authorization: Bearer <key>
硅基流动 https://api.siliconflow.cn/v1 Authorization: Bearer <key>
月之暗面 https://api.moonshot.cn/v1 Authorization: Bearer <key>
NVIDIA NIM https://integrate.api.nvidia.com/v1 Authorization: Bearer nvapi-<key>
Groq https://api.groq.com/openai/v1 Authorization: Bearer <key>
Cerebras https://api.cerebras.ai/v1 Authorization: Bearer <key>
Cloudflare https://api.cloudflare.com/client/v4/accounts/<id>/ai/v1 Authorization: Bearer <key>
OpenRouter https://openrouter.ai/api/v1 Authorization: Bearer <key>
Mistral AI https://api.mistral.ai/v1 Authorization: Bearer <key>

七、三款免费模型对比(2026-08-10 更新)

这三款定位完全不同,不能直接横向比”谁更强”,按场景分:

1. DeepSeek-R1-0528-Qwen3-8B(白山智算,永久免费)— 综合最强

  • 用 R1-0528 的思维链蒸馏 Qwen3-8B 的推理模型,8B 参数
  • AIME 2024 达 86.0(8B 开源 SOTA,超原版 Qwen3-8B 10 个点,追平 Qwen3-235B);AIME 2025 76.3、LiveCodeBench 60.5
  • 数学、逻辑、代码推理能力断崖式领先另外两款;缺点是只具”思考”模式、无工具调用

2. Hy-MT2-7B(讯飞星辰,0 元)— 翻译专精

  • 腾讯混元的多语言翻译专用模型(33 种语言),不是通用模型
  • 翻译评测 XCOMET-XXL 86.89,官方称在翻译任务上超过 DeepSeek-V4-Pro、Kimi K2.6,甚至打平 Gemini 3.1 Pro
  • 只适合翻译/多语言场景,拿来聊天写代码完全不行

3. Qwen3.5-2B(讯飞星辰,免费)— 轻量通用

  • 2B 通用小模型,约 32K 上下文,带视觉多模态
  • 常规对话、摘要、轻量任务够用;参数最小,复杂推理最弱

结论:通用 + 推理/数学/代码选 DeepSeek-R1-0528-Qwen3-8B;纯翻译选 Hy-MT2-7B;资源极紧张或要快速响应才用 Qwen3.5-2B。

八、免费模型平台推荐(2026-08-10 更新)

平台 免费内容
白山智算 ai.baishan.com R1-0528-Qwen3-8B、bge-m3、KAT-Coder-72B 永久免费;注册实名送 50–150 元体验金
讯飞星辰 MaaS maas.xfyun.cn Hy-MT2-7B 0 元;免费模型轮换(此前 Qwen3.6/3.5-35B 限时免费已到期)
智谱 bigmodel.cn GLM-4-Flash 永久免费、无限调用,128K 上下文
硅基流动 api.siliconflow.cn 14+ 开源模型全免费(含 Qwen2.5-72B、DeepSeek-V3、GLM-4-9B),按月送数百万 token 额度
阿里云百炼 新用户送 7000 万 tokens
DeepSeek 官方 新用户送 $5 额度(价格极低)
Groq / Cloudflare Workers AI / NVIDIA NIM 海外免费层:Groq 免费且极速、Cloudflare 每天 1 万神经元、NVIDIA NIM 无限制
Google AI Studio Gemini 免费 API 层(需海外网络)

注意:平台的”限时免费”经常变动,注册前先看模型集市当前标注;永久免费 + 额度兜底,个人用智谱 GLM-Flash 和硅基流动最稳。


九、Coding Plan 订阅性价比(2026-09-04 增补)

本节整合原 AI&agent/openclaw/openclaw初级-常规知识.md 的「coding plan 对比」收藏小节,并新增 Command Code(commandcode.ai)订阅调研。订阅套餐(Coding Plan)与按量 API(上文各节)互补:订阅适合固定高强度编码,按量适合挂 Agent 跑批。

9.1 一手评测来源(持续更新,查最新数据先看这里)

  • wmpeng/codingplan — 国内主流平台 Coding Plan 套餐对比,覆盖智谱、Kimi、MiniMax、阿里云百炼、字节火山方舟、百度千帆、腾讯混元等 31 个平台,含平台对比表 + 套餐对比表(价格、5h/周/月请求数、实测 Token、支持模型、权益),更新频繁(2026-08-16 版已覆盖 GLM-5.3、DeepSeek-V4-Flash-0731 正式版)
  • AI Coding Plan 对比工具站(Coze) — 可视化对比查询

9.2 国内 Coding Plan 平台性价比速览

摘自 wmpeng/codingplan 2026-08-16 版平台对比表(星级为该仓库评分):

平台 综合 性价比要点 购买状态
MiniMax ⭐5 所有平台额度最慷慨,性价比全场最高;MiniMax-M3 支持多模态 开放购买
OpenCode ⭐5 Go 套餐 $10/月(首月 $5)可用 $15~$60 额度,DeepSeek-V4-Flash 月约 15.8 万次请求;支付宝可付、无需抢购,模型最全(Kimi-K3/GLM-5.3/Qwen-3.7-Max/DeepSeek-V4) 开放购买
字节·方舟 ⭐5 已解除限购无需抢购;GLM-5.3/DeepSeek-V4/MiniMax-M3/Kimi-K3 全家桶,国内模型覆盖最全 开放购买
智谱AI ⭐5 GLM-5.3 代码能力 T0、Opus 平替;新 Token Plan 涨价后性价比下降,但无需抢购 开放购买
DeepSeek ⭐5 V4-Flash-0731 官方按量,第一梯队最便宜之一;高峰翻倍后优势收窄 开放购买
共绩算力 ⭐5 DeepSeek 官方约 8 折按量,用户少稳定性高 开放购买
小米·MiMo ⭐4 TokenPlan 比 DeepSeek 直调还便宜,Coding 能力与 DeepSeek 基本相当 开放购买
阿里·百炼 ⭐4 Coding Plan 性价比比肩 MiniMax 但不放量;Qwen3.8-Max 限时 1 折、夜间 2 折 开放购买
智谱国际版 ⭐5 无需抢购的 GLM 替代,用量同国内版、价约 2 倍 开放购买
Codex ⭐5 Pro x20 额度大、取消 5h 限制仅周限制;需外币卡/PayPal 开放购买
Claude ⭐4 官方会员性价比高;需外币卡 + 境外手机号 + 境外网络 开放购买
Kimi ⭐4 Kimi-K3 最强但会员停售,需抢购或等新套餐 暂停销售
不推荐 — GitHub(改按量后无性价比)、讯飞星火(仅剩 199/699 元档)、联通云/腾讯云(Coding Plan 已下线)、华为云/京东云(性价比低/久不更新) —

入手结论(原仓库综合推荐):MiniMax(性价比最高)> 智谱国际版(免抢购 GLM)> OpenCode(首月 $5、支付宝)> 字节·方舟(免抢购全家桶);智谱国内版与 Kimi 官方暂不开放新购。

9.3 Command Code(commandcode.ai)订阅调研

产品定位:终端 AI coding agent(npm i -g command-code,bin:cmd/cmdc/command-code),核心卖点是 taste-1——自述”元神经符号模型”,从用户每次接受/拒绝/修改中学习并自动沉淀项目级 skills(taste 仅存本地,承诺不用用户代码训练)。支持 1M 上下文、交互式 / headless -p / --yolo / 后台沙箱三种运行模式,内置 /agents /skills /commands /mcp /plugins /share,npx taste push/pull 团队共享。

项目活跃度(npm,2026-09-04 查):412 个版本,最新 1.45.0 更新于 2026-09-03(前一天),维护者 asharirfan(npm keywords 含 langbase),UNLICENSED 闭源。

定价(官网 pricing 页 2026-09-04 抓取;所有档位标注 “+ processing fee” 但未写明金额;新用户送 $10–40 credits,可随时取消):

档位 月费 月送 credits 约请求量/月 模型范围 备注
Go $1 $10 ~15K 开放模型 + 精选闭源(GPT-5.6 Luna、Grok 4.5、Qwen Max & Plus 各档通用) 白嫖级入门
GOAT $10 $70 ~75K 按模型分设限额:GPT-5.6 Sol / GLM-5.2 / 腾讯 Hy3 / Qwen 3.8 27B 各 $70、DeepSeek V4 Flash $60,另有 28+ 模型 官方自称 “Best value subscription in market”
Pro $20 $80 ~100K 开源 + premium(Claude/GPT/Gemini)
Max 10× $100 $150 ~219K premium 全开 + Claude Opus 4.8,更高限速 优先支持
Max 20× $200 $300 ~437K 同上,最高限速
Provider $15 按量付费 — OpenAI/Anthropic 兼容 API 端点,零加价,充值永不过期 API 接入方案,适合挂 Agent
Teams $40 共享池 ~35K 团队协作、统一账单、优先支持

Deals 加成(credits 在指定模型上放大,官方对比表数字):

  • MiniMax M3:credits 2× 生效(Go ~$20 / GOAT $47 / Pro $57 / Max10 ~$300 / Max20 ~$600)
  • MiMo V2.5:最高 5× 生效(Go ~$50 / GOAT ~$100 / Pro ~$150 / Max10 ~$750 / Max20 ~$1,500)
  • Laguna S 2.1、LongCat 2.0:免费不计 credits(容量期内)——$1 档也能白嫖

性价比点评:

  • Go $1 档(约 7 元/月):送 $10 credits 折算 $10~50 有效额度 + 两个免费模型,”负成本试水”,适合先验货
  • GOAT $10 档:7 倍额度杠杆 + 33 款模型(覆盖 GLM-5.2/DeepSeek/Kimi/MiniMax 国产主力),是对标国内 Coding Plan 的主力档;单位月费额度比 OpenCode Go($10 用 $15~60)略保守,胜在模型选择面和 taste 生态
  • Provider $15:零加价 API + 充值永不过期,适合已有 OpenAI/Anthropic 客户端工作流(如 Hermes/dsh 的 custom endpoint)转接,避免订阅浪费
  • Max 档($100/$200)对标 Codex/Claude 同价位订阅,含 Claude Opus 4.8,重 Agent 用户再考虑

注意事项 / 风险:

  1. processing fee 金额未公开,实际成本 > 标价,订阅前先走一遍结算页确认
  2. ~请求量为官方估算(取决于所选模型)
  3. deals 有效额度依赖促销持续性,随时可能缩水
  4. 第三方口碑 2026-09-04 检索暂缺,活跃度目前仅 npm 可佐证;页面模型名以官网实际为准
  5. 官网未标注支付宝/微信支付,大概率需国际卡;国内直连情况未实测

9.4 选购建议(结合本库使用场景)

  • 国内直连 + 支付宝:OpenCode Go / MiniMax / 字节·方舟
  • GLM 生态:智谱新 Token Plan(涨价版)或字节·方舟 / 共绩算力按量
  • 按量 API 挂 Agent(Hermes/dsh custom endpoint):DeepSeek 官方、共绩算力、小米 MiMo;或 Command Code Provider
  • 订阅 Agent 一体:Command Code Go/GOAT 试水 → 重度再上 Codex Pro 或 Claude

参考资料