整理时间:2026-09-03 | 信息来源:AMD 开发者官网(developer.amd.com.cn)、BAI 平台、Cloudflare Workers 文档、多份第三方实测教程 ⚠️ 两平台均为活动性质,模型池、额度与接口规则持续变动,下文以 2026 年 9 月初的最新快照为准,关键处已标注历史变化。
0. 核心思路:两条路线,同一个问题
最近一段时间,不少算力与 AI 服务商在境内推出活动,放出了可以免费调用的大模型 API。把当下能稳定用的两个境内免费通道——AMD 开发者平台与 BAI 平台——并排摆开,其实落在同一条主线上:去哪白嫖免费大模型,又怎么把它接进自己顺手的工具链。
答案不是唯一的,取决于平台「开没开好入口」:
- 路线 A · 原生直连:平台直接开放一套通用标准接口(也就是业内通用的 OpenAI 那套接口规范,Base URL + Key 直接给你),市面上绝大多数 AI 客户端和开发工具不用做任何改造,填进去就能调用。代表就是 AMD 开发者平台。
- 路线 B · 反代桥接:平台有免费模型,但官方入口不适合直接塞进第三方客户端(协议不对、路径不对、鉴权不对),需要一个「听得懂两边协议」的中间层。代表就是 BAI 平台 + Cloudflare Worker 反代。
一句话:平台入口「开得好」就直连,开得别扭就套一层反代。反代的价值是协议转换 + 域名自有,不是绕开鉴权。
下面把两条路线并排拆开,最后给一张选型对照表,照着对号入座即可。
路线 A · AMD 开发者平台(原生 OpenAI 兼容直连)
A1. 平台定位与入口
Radeon Cloud 是 AMD 官方的云端 AI 算力平台(类似 Colab,但跑的是 AMD 显卡)。国内站为 developer.amd.com.cn。
其中 Public Free Model APIs(公共免费模型 API) 是平台专门给开发者开的免费窗口:模型直接跑在 AMD 自己的服务器上,不需要你自己开实例,也不消耗 GPU 算力额度。它提供的是业内通用的 OpenAI 接口规范,所以 curl、Python SDK、Cherry Studio、Cursor、LangChain 等常见工具不用做任何改造,接上就能用。
| 入口 | 地址 | 用途 |
|---|---|---|
| Token Factory(密钥工厂) | https://developer.amd.com.cn/radeon/tokenfactory | 领取/管理 API Key、查看额度 |
| Model APIs(模型接口) | https://developer.amd.com.cn/radeon/modelapis | 查看免费模型、Base URL、复制 curl 示例 |
补充:加入 AMD AI Developer Program 还能额外领 $100 的 AMD Developer Cloud 算力额度(开实例、微调、训练),与本文的「公共免费模型 API」是两条不同的免费通道。
A2. 注册与拿 Key(约 10 分钟)
整个流程不绑卡、不充值。
⚠️ 实测踩坑(重要):常规邮箱 / 手机号注册有几率失败——个人亲测两次均 100% 注册失败(卡在验证/激活环节,收不到验证码或激活无效)。强烈建议直接走第三方授权登录:GitHub、CSDN、魔搭社区,点一下授权即过。 另外该站点已在国内完成 ICP 备案,属合规境内服务;要正常调用 API,账号的邮箱和手机号必须都通过验证——即便用第三方授权登录,也建议随后在账号设置里补齐并验证国内手机号,否则部分接口可能因账号未完全验证而被拒。
- 打开 Model APIs 页面 → 右上角点
Login。登录方式:GitHub、CSDN、魔搭社区 快捷登录(推荐)/ 手机号(支持国内号码)/ 邮箱。 - 完成账号验证:邮箱注册会收到验证邮件点链接激活;用第三方授权登录时若第三方邮箱已验证通常自动跳过,但请务必在账号设置里补齐并验证国内手机号。
- 进入 Token Factory:激活后页面跳到模型列表。
Public Free Model APIs区域下各免费模型卡片,点开任意卡片弹窗展示:- Base URL:
https://developer.amd.com.cn/radeon/api/v1 - Model 名:如
DeepSeek-V4-Flash、Qwen3.8-Flash-Next、MiniCPM5-1B - 你的 API Key(每位用户独立生成),现成的 curl 测试代码(OpenAI 格式)
- 把 Key 复制下来存好,所有免费模型共用同一个 Key。
- Base URL:
- 了解积分规则:卡片显示「输入 0.14 / 输出 0.28 / 缓存读 0.0028 pts 每 1M tokens」——这是相对用量统计,不是人民币,页面写明
Free to use. Points show relative usage, not a charge。
A3. 免费模型怎么选(2026-09 最新快照)
9 月初 Public Free Model APIs 板块挂着 4 个模型,定位完全不同:
| 模型 | 类型 | 状态 | 关键能力 | 适合场景 |
|---|---|---|---|---|
| DeepSeek-V4-Flash-Vision-Exp | 多模态 VLM(看图) | LIMITED FREE | 305B 总参 / MoE 激活 13B,1M 上下文,8/31 开源(MIT) | 图片问答、OCR、视觉理解、截图分析 |
| DeepSeek-V4-Flash-0731 | 纯文本 LLM | FREE | DeepSeek V4 Flash 的 0731 快照 | 写代码、写文章、问答、翻译、Agent、长文档 |
| Qwen3.8-Flash-Next | 多模态 MoE | FREE | 262144 token 上下文(可扩至 1M),125B 总/激活 6B,8/26 开源(Qwen4 架构先导版) | 智能体编程、长文档、代码任务 |
| MiniCPM5-1B | 纯文本 LLM | FREE | 1B 参数,AA 榜单小模型组第一,INT4 仅 0.5GB | 本地部署、端侧、轻量 Agent、IoT |
一句话选型:不知道用哪个 → DeepSeek-V4-Flash-0731(免费全能);要看图 → DeepSeek-V4-Flash-Vision-Exp(限时免费先用);要提前体验 Qwen4 底子 / 长上下文 → Qwen3.8-Flash-Next;要塞进自己产品 / 端侧 → MiniCPM5-1B。
📌 历史变化:8 月实测模型池曾为
DeepSeek-V4-Flash-0731、Qwen3.6-35B-A3B、MiniCPM5-1B、MiniCPM-V46。另有一个 Fireworks Credits 区(如DeepSeek-V4-Pro、GLM 5.2、Kimi K2.5),需 Fireworks 额度,不属于免费池。
A4. 客户端接入:两种协议,两类客户端
AMD 的免费 API 原生同时支持 OpenAI Completions 与 Anthropic Messages 两条协议,同一个 Base URL、同一个 Key 就能喂进两类客户端,无需再套反代。关键是协议对上,不是域名对上就行:
| 客户端 | 接入 URL | API 协议 | 说明 |
|---|---|---|---|
| DSH | https://developer.amd.com.cn/radeon/api/v1 |
OpenAI Completions | 标准 OpenAI 兼容入口 |
| CCswitch + Claude Code | https://developer.amd.com.cn/radeon/api/v1 |
Anthropic Messages | 让 Claude Code 走 AMD 的模型 |
两处
API Key统一填 AMD 平台的 key——AMD 原生同时支持 OpenAI Completions 与 Anthropic Messages 两条协议,鉴权身份始终来自 AMD,不要在客户端里填其他平台的 key。协议选错(如把 DSH 指到 Anthropic 路径)是最常见的接不通原因。
A5. 注意事项
- 限速是真的有限:积分做软限流,并发超 5 个开始排队,RPM 上限约 30 次/分钟。定位开发调试,别当生产级高并发 API 用。
- 每日额度会重置/变化:早期曾 $10/天,后下调至 $1/天(账号间可能有差异),每天早上 8 点重置。
- LIMITED FREE 随时可能撤:Vision 版标 LIMITED FREE,遇到先薅,撤了换纯文本版。
- Key 不要公开:等同密码,别发公开仓库;泄露了去 Token Factory 重新生成。
- 数据是否留存:云端推理会上传请求内容到 AMD 服务器,敏感数据建议走本地
MiniCPM5-1B。 - 连接偶尔不稳:实测出现过网络错误,把请求 retry 次数调大即可。
路线 B · BAI 平台 + Cloudflare 反代(桥接)
B1. 为什么需要反代
BAI 平台有免费模型,但官方入口不适合直接塞进第三方客户端(DSH、Claude Code 等)——它的协议、路径、鉴权跟通用客户端对不上。所以要在「平台」和「你的工具链」之间架一座桥:一个部署在 Cloudflare 上的 Worker,对外把平台协议翻译成客户端听得懂的 OpenAI / Anthropic 协议,鉴权身份仍然来自 BAI。
一个能跑的反代,离「能用的反代」之间,差的是平台适配——而不是又写几百行代码。
B2. 改造:让脚本听懂 BAI 的协议
起点是 dogchild 的 api-cf 仓库里一份现成的 _worker.js(通用 AI API 反向代理)。直接部署它并不工作,因为字段、鉴权、路由都按原作者平台来。把原脚本连同 BAI 接口约定一起交给 GPT 做适配:补全 BAI 需要的请求头、改写路径映射、把鉴权换成 BAI 的 key 体系。
迭代后的成品放在 Andrew-li777/API 仓库的 bai.js:
改脚本 ≠ 写脚本:让 GPT 做平台适配,比从零手写快得多。
B3. 部署:Worker + 自定义域名
把 bai.js 内容贴进 Cloudflare Workers 的新建脚本,保存部署,再把自定义域名绑定到这个 Worker。完成后对外暴露两条基础路径:
/bai/v1—— 走 OpenAI 风格的 completions 协议/bai—— 走 Anthropic Messages 协议
B4. 接线:两种协议,两类客户端
关键是协议对上,不是域名对上就行。同一份部署,对外两条路:
| 客户端 | 接入 URL | API 协议 | 说明 |
|---|---|---|---|
| DSH | https://你的域名/bai/v1 |
OpenAI Completions | 标准 OpenAI 兼容入口 |
| CCswitch + Claude Code | https://你的域名/bai |
Anthropic Messages | 让 Claude Code 走 BAI 的模型 |
两处
API Key统一填 BAI 平台的 key——反代只负责转发,鉴权身份始终来自 BAI,不要在客户端里填 Cloudflare 或其他平台的 key。把你的域名换成真实域名;协议选错(如把 DSH 指到/bai)是最常见的接不通原因。
B5. 现在能白嫖哪些模型
目前 BAI 平台这批模型免费,接入后直接在客户端里点选:
deepseekv4lash/deepseekv4lash-visionglm5.3flashqwen.8flashhy3mimov2.5
免费清单随平台变动,下单前以 BAI 控制台实际显示为准;反代层不缓存模型列表。
路线对照与选型
两张表把 A、B 两条路线摆在一起,照着选:
| 维度 | 路线 A · AMD 直连 | 路线 B · BAI 反代 |
|---|---|---|
| 接入形态 | 平台原生 OpenAI 兼容 API | 自建 Cloudflare Worker 桥接 |
| 注册难度 | 中(邮箱/手机注册易失败,建议第三方授权) | 低(BAI 账号 + Cloudflare 账号,无注册坑) |
| 客户端覆盖 | OpenAI 兼容系全覆盖(curl/Python/Cherry Studio/Cursor/opencode) | OpenAI 系(/bai/v1)+ Anthropic 系(/bai,可喂 Claude Code) |
| 免费模型 | DeepSeek-V4-Flash 系列、Qwen3.8-Flash-Next、MiniCPM5-1B | deepseekv4lash、glm5.3flash、qwen.8flash、hy3、mimov2.5 |
| 维护成本 | 零(平台维护) | 中(要自己部署、绑域名、跟平台协议变动作适配) |
| 适合谁 | 想最快用上免费模型、工具本身支持 OpenAI 协议 | 想用 Claude Code 等 Anthropic 系客户端、或要自有域名统一入口 |
怎么选:
- 工具支持 OpenAI 协议、只想最快用上 → 路线 A 直连,十分钟搞定。
- 用 Claude Code / 想要 Anthropic 协议、或想统一一个自有域名入口 → 路线 B 反代。
- 都不排斥 → 两条路线不冲突,AMD 当主力免费池,BAI 反代补 Anthropic 系客户端,互为备份。
收尾小结
- 免费模型从哪来:AMD 与 BAI 是当下两个可白嫖的境内平台,模型池都在滚动更新,能领就领、领到先用。
- 怎么进工具链:平台入口开得好就直连(AMD),开得别扭就套反代(BAI)。反代的核心是协议转换,鉴权始终来自原平台。
- 共同提醒:两者都属活动性质,额度有限速(AMD 约 $1/天、RPM 30)、LIMITED FREE 随时撤;Key 等同密码别公开;敏感数据走本地小模型。
参考链接
- AMD 开发者中心(国内):https://developer.amd.com.cn/
- Token Factory:https://developer.amd.com.cn/radeon/tokenfactory
- Model APIs:https://developer.amd.com.cn/radeon/modelapis
- AMD AI Developer Program(领 $100 算力):https://developer.amd/?page_id=5185
- BAI 反代源脚本:dogchild/api-cf
- BAI 反代适配版:Andrew-li777/API · bai.js
本文讲解 AMD 直连与 BAI 反代两条免费大模型 API 通道,所有模型、额度与接口以各平台官方页面实时显示为准。