为什么我用 1 美元的阿里百炼订阅探索 Claude 和 GPT 之外的模型
阿里百炼 Coding Plan 以每月 7.9 元打包 Qwen 3.5 Plus、Kimi K2.5、GLM-5、MiniMax M2.5 等八个模型。这里记录价格、配置、取舍,以及把这些模型和 Claude、Codex 一起用于代码评审的体验。
AI 驱动 · 每小时限 20 次请求
一年前要是有人跟我说,每月花不到一块钱美元就能用上八个 AI 模型写代码,我肯定觉得他在扯淡。但阿里云百炼最近推出的 Coding Plan,定价确实离谱——是那种好的离谱。
百炼 Coding Plan 是什么?
阿里云的 Model Studio(百炼)推出了一个专门给 AI 辅助编码用的包月订阅。跟大多数平台按 token 计费不同,它是固定月费,给你一定的请求额度,而且能跨模型通用。
两档可选:
- Lite:首月 ¥7.9(约 1 美元),每月 18,000 次请求
- Pro:首月 ¥39.9(约 5.50 美元),每月 90,000 次请求
首月优惠价面向新订阅用户,活动截止到 2026 年 4 月 1 日。之后逐步恢复原价:第二个月五折(Lite ¥20,Pro ¥100),第三个月起全价(Lite ¥40,Pro ¥200)。说实话,就算全价也不算贵,但首月基本等于白送。新注册的阿里云账号还会送 ¥30 代金券,Lite 首月直接覆盖。所以如果你是新用户,相当于免费体验。
一个订阅,八个模型
这才是真正让我觉得值的地方。两个档位都能用这些模型:
- Qwen 3.5 Plus(支持图像理解)
- Kimi K2.5(支持图像理解)
- GLM-5
- MiniMax M2.5
- Qwen3-Max(2026-01-23 快照)
- Qwen3-Coder-Next
- Qwen3-Coder-Plus
- GLM-4.7
不是只能用一个模型,而是根据任务随便切。这也是我目前的用法。
我实际怎么用的
我买了 Lite 档,主要在 MiniMax M2.5、Qwen 3.5 Plus、Kimi K2.5 和 GLM-5 之间轮换。场景比较单一——拿来做方案和代码评审,不是当主力编码助手。
说句实话:Claude Opus 写代码依然很强,GPT-5.3-Codex 依然是我见过最抠细节的 code reviewer。作为一个写了多年代码的人,真要干正事我还是会用 Claude 和 Codex。这点没变。
但这个订阅的意义本来就不是替代它们。
重点是横向对比。同一个问题丢给不同模型,看 Qwen 擅长什么,Kimi 审代码的思路跟别人有什么不一样,GLM-5 哪里行哪里不行。AI 模型迭代太快了,只待在一个生态里很容易变成井底之蛙。一个月 ¥7.9,几乎零成本就能把各家都摸一遍。
工具链无缝对接
Coding Plan 支持这些工具:
- Claude Code(终端)
- Cursor
- Cline(VS Code 插件)
- OpenClaw / NanoClaw
- Qwen Code
接 Claude Code 很简单。你会拿到一把 Coding Plan 专属的 API Key(格式是 sk-sp-xxxxx),然后把 endpoint 指向百炼的 Anthropic 兼容地址就行:
{
"env": {
"ANTHROPIC_AUTH_TOKEN": "sk-sp-your-key-here",
"ANTHROPIC_BASE_URL": "https://coding.dashscope.aliyuncs.com/apps/anthropic",
"ANTHROPIC_MODEL": "qwen3.5-plus"
}
}扔进 ~/.claude/settings.json,Claude Code 里就跑起 Qwen 了。聊天中途想换模型也行,直接 /model model_name。
如果你的工具走 OpenAI 兼容协议,也有对应的 endpoint:https://coding.dashscope.aliyuncs.com/v1。
几个要注意的点
订阅之前,有几件事得清楚。
请求限额是分层的。Lite 档每 5 小时 1,200 次、每周 9,000 次、每月 18,000 次。我拿来做代码评审绰绰有余。但如果你打算当主力编码工具频繁对话,Lite 可能会不够用,Pro 的 90,000 次/月会宽裕很多。
不能用于自动化或批处理。这个 Plan 明确只允许交互式编码辅助,拿来做后端自动化、批量处理之类的会违规。
只支持主账号。必须是阿里云主账号,RAM 子用户不行。
适合什么人?
它不会替代你的主力 AI 编码工具。如果你 Claude Code 或者 Cursor + Anthropic/OpenAI 已经用得很顺手了,继续用就好。
但如果你是这种开发者:
- 想看看 2026 年国产 AI 模型编码能力到底什么水平
- 在跑 OpenClaw 或 NanoClaw,需要一个便宜的模型后端
- 想体验不同模型的编码风格,但不想每个都单独注册、单独绑支付方式
- 对 AI 编码工具感兴趣,但不想上来就掏每月 20 美元
那首月 ¥7.9 真的可以直接冲。就算恢复原价 ¥40/月,一个订阅包八个模型这种事也不多见。大部分平台要么按模型收费,要么按 token 计费,想试各家模型得挨个注册开户,光这个摩擦就劝退不少人。
总结
百炼 Coding Plan 最大的亮点是打包模式——Qwen、Kimi、GLM、MiniMax 等八家模型,一个订阅、一把 API Key 搞定。定价很激进,特别是首月优惠。这种价格长期能不能持续,还是纯粹在烧钱拉新,目前还看不清楚。但至少当下,性价比是实打实的。
我打算接下来继续深挖这些模型。目前光是看它们用不同思路审同一段代码,就已经挺有启发了。模型之间的差异本身,就能让你感受到这个领域正在往哪个方向走。
许可
Article text © 2026 Mark Huang. Licensed under Creative Commons Attribution-NonCommercial 4.0 International (CC BY-NC 4.0) unless otherwise noted. 文章文本可在非商业场景下分享或翻译,但需标注原文 URL。商业使用需事先取得书面许可,并清楚引用原始来源。
代码片段、截图、第三方素材和网站源码可能适用单独条款。
建议署名: Based on "为什么我用 1 美元的阿里百炼订阅探索 Claude 和 GPT 之外的模型" by Mark Huang, originally published at https://markhuang.ai/zh/blog/why-im-using-alibaba-bailian-to-explore-ai-models.
相关文章

多 AI 论
LLM 会在超过 90% 的情况下确认自己的答案,对自身错误还有 64.5% 的盲区率。跨模型家族的多 AI 流水线,让 Claude 评审 GPT、GPT 评审 Qwen,能打破自我评审的天花板。本文讨论研究、成本和真正有效的做法。
阅读文章
不,中文对 LLM 并不比英文更省 token
一位中文母语者测试“中文字符更省 token”这个流行说法。跨六种 tokenizer,包括 Qwen、GLM、DeepSeek 等中文优先模型,英文每次都使用更少 token。本文讨论数据、BPE 机制,以及为什么字符数和 token 数不是一回事。
阅读文章
没有意图的自动化,只是更快的混乱
三套失败的流水线架构,一次关于反压的教训,以及最终让多 AI 氛围编程跑起来的 UAT 门。本文复盘什么坏了、什么留下来,以及为什么知道自己想要什么比工具本身更重要。
阅读文章