2026年大模型API白嫖与CodingPlan性价比指南
2026年大模型API白嫖与CodingPlan性价比指南
调研日期:2026-08-04;2026-09-04 增补第九节「Coding Plan 订阅性价比」(整合原 openclaw 笔记的 coding plan 对比收藏 + Command Code 订阅调研)
数据来源:GitHub (cheahjs/free-llm-api-resources, mnfst/awesome-free-llm-apis, wmpeng/codingplan)、OpenRouter Blog、官方文档
一、前言
用户已耗尽百炼(阿里云)和中国移动的免费额度,目前在用火山方舟(Agent Plan Medium)和 NVIDIA NIM。本文汇总所有可用的免费模型 API 平台,区分国内直连和国际平台,供后续薅羊毛参考。
注意:免费政策随时变动,以下数据截至 2026年8月,使用前建议核实官网最新信息。
二、国内平台(直连,无需额外网络配置)
| 平台 | 免费额度 | 代表模型 | 亮点 | 限制 |
|---|---|---|---|---|
| 智谱AI | 新用户 2000万 Token | GLM-4-Flash(永久免费) | 额度最大,GLM-4-Flash 不限Token总量 | ⚠️ 用户已过期(忘记用) |
| 硅基流动 (SiliconFlow) | DeepSeek-V3/R1、Qwen 等开源模型 | 新模型上架快,部分小模型永久免费 | 已用完 | |
| 月之暗面 Kimi | 每分钟3次请求,不限总量 | kimi-k2.6 等 | 256K超长上下文 | 频率极低 |
| 火山方舟 | 50万 Tokens 永久免费 | 豆包系模型 | 按天重置(200万/天) | 已在用 |
| 美团 (LongCat) | 自研模型 | 曾缓存命中免消耗 | 已失效 | |
| 联通云 Coding Plan | GLM-5.1/5、Qwen3.5、MiniMax-M2.7 | 曾官方免费,实名不绑卡 | 已失效 | |
| 白山智算 | GLM-5、R1-0528-Qwen3-8B、KAT-Coder-72B | 部分模型永久免费 | 10 RPM 限速 | |
| Modal 平台 | GLM-5 免费端点,不限 token | GLM-5 | 不限量 | 1-2路并发 |
| 欧派算力云 | DeepSeek-R1/V3 各 100万 Tokens | DeepSeek-R1/V3 | 注册即送,6个月有效 | 模型少 |
| 摩尔线程 | 30天完全免费试用 | GLM-4.7 | 国产GPU生态,零成本试水 | 限时 |
| 商汤·日日新 | 公测 1500次/5h | SenseNova 6.7 Flash-Lite | 多模态编程 | 限时公测 |
| 讯飞星辰 MaaS | 星火 X2、Qwen3.6 等 | 曾语音+大模型生态强 | 已失效 | |
| 腾讯云混元 | 10款模型共享100万 Tokens | 混元大模型系列 | 1年有效期,最长 | Lite版永久免费 |
| 百度千帆 | 每模型独立100万 Tokens | ERNIE 4.5 系列 | 并发极高(50QPS) | 通常3个月有效 |
| 零一万物 (01.AI) | 注册赠送体验金 | 万策、万智系列 | 兼容 OpenAI 格式 | 通常1个月有效 |
| 360智脑 | 新人赠送体验包 | 360智脑4.0 | 安全领域特色 | 限时活动 |
2.1 GLM-4-Flash 详解
智谱 GLM-4-Flash(最新版 GLM-4-Flash-250414)是性价比最高的免费模型:
- 费用:完全免费,不限 Token 总量
- 上下文:128K(约300页书)
- 并发:新用户30,付费用户可达3000
- 速度:~200 tokens/s
- 支持:Function Calling、联网搜索、流式输出、26种语言
- 能力定位:入门级——日常对话、翻译、摘要、RAG 检索够用,复杂推理/Agent 多步规划较弱
- 适用场景:批量简单任务、兜底 fallback、替代 doubao-seed-2.0-mini 节省 AFP
2.2 智谱 API 接入信息
- 接口地址:
https://open.bigmodel.cn/api/paas/v4 - 兼容 OpenAI SDK:✅ 是
- 注册:
bigmodel.cn
三、国际平台(可能需要魔法/代理)
| 平台 | 免费额度 | 代表模型 | 亮点 | 限制 |
|---|---|---|---|---|
| NVIDIA NIM 🟢 | 无限次调用 | GLM-5.2、DeepSeek V4 Pro/Flash、Kimi K2.6 | 100+模型,GPU加速 | 40 req/min,已在用 |
| Groq 🟢 | 因模型而异,最高 14400 req/天 | Llama 3.3 70B、Qwen3 | 极快(320 tok/s),LPU硬件 | 2026年缩减过 |
| Cerebras 🟢 | 100万 tokens/天 | gpt-oss-120b、zai-glm-4.7 | 超快(~2600 tok/s) | 8K上下文限制 |
| Cloudflare Workers AI 🟢 | 10,000 neurons/天 | Llama、Gemma、Qwen、GLM | 50+模型,全球边缘节点 | 按模型算量 |
| OpenRouter 🟢 | 充值$10后 1000 req/天 | 上百个聚合模型 | 模型最丰富 | 需充值后才有 |
| Google AI Studio | Gemini Flash ~1500 req/天 | Gemini 2.5 Flash 系列 | 多模态强 | 免费层缩减过 |
| Mistral AI | Experiment tier ~10亿 tokens/月 | Mistral Large、Small | 量最大 | 需同意数据训练 |
| SambaNova | $5 credits/3个月 | DeepSeek V3/V4、Gemma 4 | 含前沿模型 | 限期 |
| Cohere | 有永久免费 tier | Command R 系列 | 企业级 RAG 能力 | 模型选择少 |
| HuggingFace Inference | 有免费额度 | 海量社区模型 | 模型最多 | 限速严 |
🟢 = 不需要魔法,国内可直接访问
3.1 Groq 详细限制
| 模型 | 每日限制 | Token/分钟 |
|---|---|---|
| Llama 3.1 8B | 14,400 req/天 | 6,000 |
| Llama 3.3 70B | 1,000 req/天 | 12,000 |
| Whisper Large v3 | 2,000 req/天 | — |
| groq/compound | 250 req/天 | 70,000 |
3.2 Cerebras 详细限制
| 模型 | 上下文 | 每日限制 |
|---|---|---|
| gpt-oss-120b | 128K(免费8K) | 1M TPD |
| zai-glm-4.7 | 128K(免费8K) | 1M TPD |
3.3 NVIDIA NIM 接入信息
- 接口地址:
https://integrate.api.nvidia.com/v1 - 认证:
Authorization: Bearer nvapi-... - 兼容 OpenAI SDK:✅ 是
- 热门模型:
z-ai/glm-5.2、deepseek-ai/deepseek-v4-pro、deepseek-ai/deepseek-v4-flash、moonshotai/kimi-k2.6、minimaxai/minimax-m3 - 限制:40 req/min,部分模型首次调用有冷启动延迟(1-2分钟)
四、模型能力梯队参考
旗舰级(复杂推理/Agent/代码) |
五、推荐薅羊毛策略(基于用户现状)
已在用
- 火山方舟 Agent Plan Medium(主战)
- NVIDIA NIM(备用)
优先补充(国内直连)
- 智谱AI → 2000万 Token,GLM-4-Flash 永久免费 → 最适合做兜底方案
- 硅基流动 → 16元代金券,开源模型更新快
- 白山智算 →
450元赠金已过时;现为 50–150元体验金 + R1-0528-Qwen3-8B/KAT-Coder-72B 永久免费 - 联通云 Coding Plan → ❌ 已失效(2026-08-10 确认名额已满,详见第二节表格)
- 美团 LongCat → ❌ 2026-08 已确认活动下架,不再考虑
可补充(国际,无需魔法)
- Cerebras → 每天100万 tokens,速度极快
- Groq → 速度快,低延迟任务
- Mistral AI → 每月10亿 tokens(需同意数据训练)
配置建议
- 主力对话:火山方舟 glm-5.2(享2.5折至2026-08-08)
- 纯文本辅助任务:deepseek-v4-flash(系数0.5,1M上下文)
- 视觉任务:doubao-seed-2.0-lite(系数0.5)或 kimi-k3
- 兜底 fallback:GLM-4-Flash(免费,不限量)
- 批量简单任务:doubao-seed-2.0-mini(系数0.25)或 GLM-4-Flash
六、接入方式参考
各平台 OpenAI 兼容 API 接入信息汇总:
| 平台 | Base URL | 认证方式 |
|---|---|---|
| 智谱AI | https://open.bigmodel.cn/api/paas/v4 |
Authorization: Bearer <key> |
| 硅基流动 | https://api.siliconflow.cn/v1 |
Authorization: Bearer <key> |
| 月之暗面 | https://api.moonshot.cn/v1 |
Authorization: Bearer <key> |
| NVIDIA NIM | https://integrate.api.nvidia.com/v1 |
Authorization: Bearer nvapi-<key> |
| Groq | https://api.groq.com/openai/v1 |
Authorization: Bearer <key> |
| Cerebras | https://api.cerebras.ai/v1 |
Authorization: Bearer <key> |
| Cloudflare | https://api.cloudflare.com/client/v4/accounts/<id>/ai/v1 |
Authorization: Bearer <key> |
| OpenRouter | https://openrouter.ai/api/v1 |
Authorization: Bearer <key> |
| Mistral AI | https://api.mistral.ai/v1 |
Authorization: Bearer <key> |
七、三款免费模型对比(2026-08-10 更新)
这三款定位完全不同,不能直接横向比”谁更强”,按场景分:
1. DeepSeek-R1-0528-Qwen3-8B(白山智算,永久免费)— 综合最强
- 用 R1-0528 的思维链蒸馏 Qwen3-8B 的推理模型,8B 参数
- AIME 2024 达 86.0(8B 开源 SOTA,超原版 Qwen3-8B 10 个点,追平 Qwen3-235B);AIME 2025 76.3、LiveCodeBench 60.5
- 数学、逻辑、代码推理能力断崖式领先另外两款;缺点是只具”思考”模式、无工具调用
2. Hy-MT2-7B(讯飞星辰,0 元)— 翻译专精
- 腾讯混元的多语言翻译专用模型(33 种语言),不是通用模型
- 翻译评测 XCOMET-XXL 86.89,官方称在翻译任务上超过 DeepSeek-V4-Pro、Kimi K2.6,甚至打平 Gemini 3.1 Pro
- 只适合翻译/多语言场景,拿来聊天写代码完全不行
3. Qwen3.5-2B(讯飞星辰,免费)— 轻量通用
- 2B 通用小模型,约 32K 上下文,带视觉多模态
- 常规对话、摘要、轻量任务够用;参数最小,复杂推理最弱
结论:通用 + 推理/数学/代码选 DeepSeek-R1-0528-Qwen3-8B;纯翻译选 Hy-MT2-7B;资源极紧张或要快速响应才用 Qwen3.5-2B。
八、免费模型平台推荐(2026-08-10 更新)
| 平台 | 免费内容 |
|---|---|
| 白山智算 ai.baishan.com | R1-0528-Qwen3-8B、bge-m3、KAT-Coder-72B 永久免费;注册实名送 50–150 元体验金 |
| 讯飞星辰 MaaS maas.xfyun.cn | Hy-MT2-7B 0 元;免费模型轮换(此前 Qwen3.6/3.5-35B 限时免费已到期) |
| 智谱 bigmodel.cn | GLM-4-Flash 永久免费、无限调用,128K 上下文 |
| 硅基流动 api.siliconflow.cn | 14+ 开源模型全免费(含 Qwen2.5-72B、DeepSeek-V3、GLM-4-9B),按月送数百万 token 额度 |
| 阿里云百炼 | 新用户送 7000 万 tokens |
| DeepSeek 官方 | 新用户送 $5 额度(价格极低) |
| Groq / Cloudflare Workers AI / NVIDIA NIM | 海外免费层:Groq 免费且极速、Cloudflare 每天 1 万神经元、NVIDIA NIM 无限制 |
| Google AI Studio | Gemini 免费 API 层(需海外网络) |
注意:平台的”限时免费”经常变动,注册前先看模型集市当前标注;永久免费 + 额度兜底,个人用智谱 GLM-Flash 和硅基流动最稳。
九、Coding Plan 订阅性价比(2026-09-04 增补)
本节整合原
AI&agent/openclaw/openclaw初级-常规知识.md的「coding plan 对比」收藏小节,并新增 Command Code(commandcode.ai)订阅调研。订阅套餐(Coding Plan)与按量 API(上文各节)互补:订阅适合固定高强度编码,按量适合挂 Agent 跑批。
9.1 一手评测来源(持续更新,查最新数据先看这里)
- wmpeng/codingplan — 国内主流平台 Coding Plan 套餐对比,覆盖智谱、Kimi、MiniMax、阿里云百炼、字节火山方舟、百度千帆、腾讯混元等 31 个平台,含平台对比表 + 套餐对比表(价格、5h/周/月请求数、实测 Token、支持模型、权益),更新频繁(2026-08-16 版已覆盖 GLM-5.3、DeepSeek-V4-Flash-0731 正式版)
- AI Coding Plan 对比工具站(Coze) — 可视化对比查询
9.2 国内 Coding Plan 平台性价比速览
摘自 wmpeng/codingplan 2026-08-16 版平台对比表(星级为该仓库评分):
| 平台 | 综合 | 性价比要点 | 购买状态 |
|---|---|---|---|
| MiniMax | ⭐5 | 所有平台额度最慷慨,性价比全场最高;MiniMax-M3 支持多模态 | 开放购买 |
| OpenCode | ⭐5 | Go 套餐 $10/月(首月 $5)可用 $15~$60 额度,DeepSeek-V4-Flash 月约 15.8 万次请求;支付宝可付、无需抢购,模型最全(Kimi-K3/GLM-5.3/Qwen-3.7-Max/DeepSeek-V4) | 开放购买 |
| 字节·方舟 | ⭐5 | 已解除限购无需抢购;GLM-5.3/DeepSeek-V4/MiniMax-M3/Kimi-K3 全家桶,国内模型覆盖最全 | 开放购买 |
| 智谱AI | ⭐5 | GLM-5.3 代码能力 T0、Opus 平替;新 Token Plan 涨价后性价比下降,但无需抢购 | 开放购买 |
| DeepSeek | ⭐5 | V4-Flash-0731 官方按量,第一梯队最便宜之一;高峰翻倍后优势收窄 | 开放购买 |
| 共绩算力 | ⭐5 | DeepSeek 官方约 8 折按量,用户少稳定性高 | 开放购买 |
| 小米·MiMo | ⭐4 | TokenPlan 比 DeepSeek 直调还便宜,Coding 能力与 DeepSeek 基本相当 | 开放购买 |
| 阿里·百炼 | ⭐4 | Coding Plan 性价比比肩 MiniMax 但不放量;Qwen3.8-Max 限时 1 折、夜间 2 折 | 开放购买 |
| 智谱国际版 | ⭐5 | 无需抢购的 GLM 替代,用量同国内版、价约 2 倍 | 开放购买 |
| Codex | ⭐5 | Pro x20 额度大、取消 5h 限制仅周限制;需外币卡/PayPal | 开放购买 |
| Claude | ⭐4 | 官方会员性价比高;需外币卡 + 境外手机号 + 境外网络 | 开放购买 |
| Kimi | ⭐4 | Kimi-K3 最强但会员停售,需抢购或等新套餐 | 暂停销售 |
| 不推荐 | — | GitHub(改按量后无性价比)、讯飞星火(仅剩 199/699 元档)、联通云/腾讯云(Coding Plan 已下线)、华为云/京东云(性价比低/久不更新) | — |
入手结论(原仓库综合推荐):MiniMax(性价比最高)> 智谱国际版(免抢购 GLM)> OpenCode(首月 $5、支付宝)> 字节·方舟(免抢购全家桶);智谱国内版与 Kimi 官方暂不开放新购。
9.3 Command Code(commandcode.ai)订阅调研
产品定位:终端 AI coding agent(npm i -g command-code,bin:cmd/cmdc/command-code),核心卖点是 taste-1——自述”元神经符号模型”,从用户每次接受/拒绝/修改中学习并自动沉淀项目级 skills(taste 仅存本地,承诺不用用户代码训练)。支持 1M 上下文、交互式 / headless -p / --yolo / 后台沙箱三种运行模式,内置 /agents /skills /commands /mcp /plugins /share,npx taste push/pull 团队共享。
项目活跃度(npm,2026-09-04 查):412 个版本,最新 1.45.0 更新于 2026-09-03(前一天),维护者 asharirfan(npm keywords 含 langbase),UNLICENSED 闭源。
定价(官网 pricing 页 2026-09-04 抓取;所有档位标注 “+ processing fee” 但未写明金额;新用户送 $10–40 credits,可随时取消):
| 档位 | 月费 | 月送 credits | 约请求量/月 | 模型范围 | 备注 |
|---|---|---|---|---|---|
| Go | $1 | $10 | ~15K | 开放模型 + 精选闭源(GPT-5.6 Luna、Grok 4.5、Qwen Max & Plus 各档通用) | 白嫖级入门 |
| GOAT | $10 | $70 | ~75K | 按模型分设限额:GPT-5.6 Sol / GLM-5.2 / 腾讯 Hy3 / Qwen 3.8 27B 各 $70、DeepSeek V4 Flash $60,另有 28+ 模型 | 官方自称 “Best value subscription in market” |
| Pro | $20 | $80 | ~100K | 开源 + premium(Claude/GPT/Gemini) | |
| Max 10× | $100 | $150 | ~219K | premium 全开 + Claude Opus 4.8,更高限速 | 优先支持 |
| Max 20× | $200 | $300 | ~437K | 同上,最高限速 | |
| Provider | $15 | 按量付费 | — | OpenAI/Anthropic 兼容 API 端点,零加价,充值永不过期 | API 接入方案,适合挂 Agent |
| Teams | $40 | 共享池 | ~35K | 团队协作、统一账单、优先支持 |
Deals 加成(credits 在指定模型上放大,官方对比表数字):
- MiniMax M3:credits 2× 生效(Go ~$20 / GOAT $47 / Pro $57 / Max10 ~$300 / Max20 ~$600)
- MiMo V2.5:最高 5× 生效(Go ~$50 / GOAT ~$100 / Pro ~$150 / Max10 ~$750 / Max20 ~$1,500)
- Laguna S 2.1、LongCat 2.0:免费不计 credits(容量期内)——$1 档也能白嫖
性价比点评:
- Go $1 档(约 7 元/月):送 $10 credits 折算 $10~50 有效额度 + 两个免费模型,”负成本试水”,适合先验货
- GOAT $10 档:7 倍额度杠杆 + 33 款模型(覆盖 GLM-5.2/DeepSeek/Kimi/MiniMax 国产主力),是对标国内 Coding Plan 的主力档;单位月费额度比 OpenCode Go($10 用 $15~60)略保守,胜在模型选择面和 taste 生态
- Provider $15:零加价 API + 充值永不过期,适合已有 OpenAI/Anthropic 客户端工作流(如 Hermes/dsh 的 custom endpoint)转接,避免订阅浪费
- Max 档($100/$200)对标 Codex/Claude 同价位订阅,含 Claude Opus 4.8,重 Agent 用户再考虑
注意事项 / 风险:
- processing fee 金额未公开,实际成本 > 标价,订阅前先走一遍结算页确认
- ~请求量为官方估算(取决于所选模型)
- deals 有效额度依赖促销持续性,随时可能缩水
- 第三方口碑 2026-09-04 检索暂缺,活跃度目前仅 npm 可佐证;页面模型名以官网实际为准
- 官网未标注支付宝/微信支付,大概率需国际卡;国内直连情况未实测
9.4 选购建议(结合本库使用场景)
- 国内直连 + 支付宝:OpenCode Go / MiniMax / 字节·方舟
- GLM 生态:智谱新 Token Plan(涨价版)或字节·方舟 / 共绩算力按量
- 按量 API 挂 Agent(Hermes/dsh custom endpoint):DeepSeek 官方、共绩算力、小米 MiMo;或 Command Code Provider
- 订阅 Agent 一体:Command Code Go/GOAT 试水 → 重度再上 Codex Pro 或 Claude
参考资料
- cheahjs/free-llm-api-resources — 持续更新的免费 LLM API 资源列表
- mnfst/awesome-free-llm-apis — 免费 LLM API 汇总
- 智谱AI开放文档
- NVIDIA NIM 文档
- 2026大模型API免费额度汇总
- Free LLM API in 2026: 13 Options Ranked
- wmpeng/codingplan — 国内 Coding Plan 平台性价比对比(持续更新)
- AI Coding Plan 对比工具站
- Command Code 官网 / 定价页
- command-code (npm)
- OpenCode Go 套餐文档









