跳到主要内容
生长的档案
← 返回期刊架
NO.2026-0022026.09.0312 MIN READ

免费大模型 API 实战地图:AMD 直连与 BAI 反代两条路线

免费API大模型技术实战

整理时间:2026-09-03 | 信息来源:AMD 开发者官网(developer.amd.com.cn)、BAI 平台、Cloudflare Workers 文档、多份第三方实测教程 ⚠️ 两平台均为活动性质,模型池、额度与接口规则持续变动,下文以 2026 年 9 月初的最新快照为准,关键处已标注历史变化。

0. 核心思路:两条路线,同一个问题

最近一段时间,不少算力与 AI 服务商在境内推出活动,放出了可以免费调用的大模型 API。把当下能稳定用的两个境内免费通道——AMD 开发者平台与 BAI 平台——并排摆开,其实落在同一条主线上:去哪白嫖免费大模型,又怎么把它接进自己顺手的工具链。

答案不是唯一的,取决于平台「开没开好入口」:

  • 路线 A · 原生直连:平台直接开放一套通用标准接口(也就是业内通用的 OpenAI 那套接口规范,Base URL + Key 直接给你),市面上绝大多数 AI 客户端和开发工具不用做任何改造,填进去就能调用。代表就是 AMD 开发者平台
  • 路线 B · 反代桥接:平台有免费模型,但官方入口不适合直接塞进第三方客户端(协议不对、路径不对、鉴权不对),需要一个「听得懂两边协议」的中间层。代表就是 BAI 平台 + Cloudflare Worker 反代

一句话:平台入口「开得好」就直连,开得别扭就套一层反代。反代的价值是协议转换 + 域名自有,不是绕开鉴权。

下面把两条路线并排拆开,最后给一张选型对照表,照着对号入座即可。


路线 A · AMD 开发者平台(原生 OpenAI 兼容直连)

A1. 平台定位与入口

Radeon Cloud 是 AMD 官方的云端 AI 算力平台(类似 Colab,但跑的是 AMD 显卡)。国内站为 developer.amd.com.cn

其中 Public Free Model APIs(公共免费模型 API) 是平台专门给开发者开的免费窗口:模型直接跑在 AMD 自己的服务器上,不需要你自己开实例,也不消耗 GPU 算力额度。它提供的是业内通用的 OpenAI 接口规范,所以 curl、Python SDK、Cherry Studio、Cursor、LangChain 等常见工具不用做任何改造,接上就能用。

入口 地址 用途
Token Factory(密钥工厂) https://developer.amd.com.cn/radeon/tokenfactory 领取/管理 API Key、查看额度
Model APIs(模型接口) https://developer.amd.com.cn/radeon/modelapis 查看免费模型、Base URL、复制 curl 示例

补充:加入 AMD AI Developer Program 还能额外领 $100 的 AMD Developer Cloud 算力额度(开实例、微调、训练),与本文的「公共免费模型 API」是两条不同的免费通道。

A2. 注册与拿 Key(约 10 分钟)

整个流程不绑卡、不充值。

⚠️ 实测踩坑(重要):常规邮箱 / 手机号注册有几率失败——个人亲测两次均 100% 注册失败(卡在验证/激活环节,收不到验证码或激活无效)。强烈建议直接走第三方授权登录:GitHub、CSDN、魔搭社区,点一下授权即过。 另外该站点已在国内完成 ICP 备案,属合规境内服务;要正常调用 API,账号的邮箱和手机号必须都通过验证——即便用第三方授权登录,也建议随后在账号设置里补齐并验证国内手机号,否则部分接口可能因账号未完全验证而被拒。

  1. 打开 Model APIs 页面 → 右上角点 Login。登录方式:GitHub、CSDN、魔搭社区 快捷登录(推荐)/ 手机号(支持国内号码)/ 邮箱。
  2. 完成账号验证:邮箱注册会收到验证邮件点链接激活;用第三方授权登录时若第三方邮箱已验证通常自动跳过,但请务必在账号设置里补齐并验证国内手机号
  3. 进入 Token Factory:激活后页面跳到模型列表。Public Free Model APIs 区域下各免费模型卡片,点开任意卡片弹窗展示:
    • Base URLhttps://developer.amd.com.cn/radeon/api/v1
    • Model 名:如 DeepSeek-V4-FlashQwen3.8-Flash-NextMiniCPM5-1B
    • 你的 API Key(每位用户独立生成),现成的 curl 测试代码(OpenAI 格式)
    • 把 Key 复制下来存好,所有免费模型共用同一个 Key
  4. 了解积分规则:卡片显示「输入 0.14 / 输出 0.28 / 缓存读 0.0028 pts 每 1M tokens」——这是相对用量统计,不是人民币,页面写明 Free to use. Points show relative usage, not a charge

A3. 免费模型怎么选(2026-09 最新快照)

9 月初 Public Free Model APIs 板块挂着 4 个模型,定位完全不同:

模型 类型 状态 关键能力 适合场景
DeepSeek-V4-Flash-Vision-Exp 多模态 VLM(看图) LIMITED FREE 305B 总参 / MoE 激活 13B,1M 上下文,8/31 开源(MIT) 图片问答、OCR、视觉理解、截图分析
DeepSeek-V4-Flash-0731 纯文本 LLM FREE DeepSeek V4 Flash 的 0731 快照 写代码、写文章、问答、翻译、Agent、长文档
Qwen3.8-Flash-Next 多模态 MoE FREE 262144 token 上下文(可扩至 1M),125B 总/激活 6B,8/26 开源(Qwen4 架构先导版) 智能体编程、长文档、代码任务
MiniCPM5-1B 纯文本 LLM FREE 1B 参数,AA 榜单小模型组第一,INT4 仅 0.5GB 本地部署、端侧、轻量 Agent、IoT

一句话选型:不知道用哪个 → DeepSeek-V4-Flash-0731(免费全能);要看图 → DeepSeek-V4-Flash-Vision-Exp(限时免费先用);要提前体验 Qwen4 底子 / 长上下文 → Qwen3.8-Flash-Next;要塞进自己产品 / 端侧 → MiniCPM5-1B

📌 历史变化:8 月实测模型池曾为 DeepSeek-V4-Flash-0731Qwen3.6-35B-A3BMiniCPM5-1BMiniCPM-V46。另有一个 Fireworks Credits 区(如 DeepSeek-V4-ProGLM 5.2Kimi K2.5),需 Fireworks 额度,不属于免费池

A4. 客户端接入:两种协议,两类客户端

AMD 的免费 API 原生同时支持 OpenAI CompletionsAnthropic Messages 两条协议,同一个 Base URL、同一个 Key 就能喂进两类客户端,无需再套反代。关键是协议对上,不是域名对上就行:

客户端 接入 URL API 协议 说明
DSH https://developer.amd.com.cn/radeon/api/v1 OpenAI Completions 标准 OpenAI 兼容入口
CCswitch + Claude Code https://developer.amd.com.cn/radeon/api/v1 Anthropic Messages 让 Claude Code 走 AMD 的模型

两处 API Key 统一填 AMD 平台的 key——AMD 原生同时支持 OpenAI Completions 与 Anthropic Messages 两条协议,鉴权身份始终来自 AMD,不要在客户端里填其他平台的 key。协议选错(如把 DSH 指到 Anthropic 路径)是最常见的接不通原因。

A5. 注意事项

  • 限速是真的有限:积分做软限流,并发超 5 个开始排队,RPM 上限约 30 次/分钟。定位开发调试,别当生产级高并发 API 用
  • 每日额度会重置/变化:早期曾 $10/天,后下调至 $1/天(账号间可能有差异),每天早上 8 点重置。
  • LIMITED FREE 随时可能撤:Vision 版标 LIMITED FREE,遇到先薅,撤了换纯文本版。
  • Key 不要公开:等同密码,别发公开仓库;泄露了去 Token Factory 重新生成。
  • 数据是否留存:云端推理会上传请求内容到 AMD 服务器,敏感数据建议走本地 MiniCPM5-1B
  • 连接偶尔不稳:实测出现过网络错误,把请求 retry 次数调大即可。

路线 B · BAI 平台 + Cloudflare 反代(桥接)

B1. 为什么需要反代

BAI 平台有免费模型,但官方入口不适合直接塞进第三方客户端(DSH、Claude Code 等)——它的协议、路径、鉴权跟通用客户端对不上。所以要在「平台」和「你的工具链」之间架一座桥:一个部署在 Cloudflare 上的 Worker,对外把平台协议翻译成客户端听得懂的 OpenAI / Anthropic 协议,鉴权身份仍然来自 BAI。

一个能跑的反代,离「能用的反代」之间,差的是平台适配——而不是又写几百行代码。

B2. 改造:让脚本听懂 BAI 的协议

起点是 dogchild 的 api-cf 仓库里一份现成的 _worker.js(通用 AI API 反向代理)。直接部署它并不工作,因为字段、鉴权、路由都按原作者平台来。把原脚本连同 BAI 接口约定一起交给 GPT 做适配:补全 BAI 需要的请求头、改写路径映射、把鉴权换成 BAI 的 key 体系。

迭代后的成品放在 Andrew-li777/API 仓库的 bai.js

改脚本 ≠ 写脚本:让 GPT 做平台适配,比从零手写快得多。

B3. 部署:Worker + 自定义域名

bai.js 内容贴进 Cloudflare Workers 的新建脚本,保存部署,再把自定义域名绑定到这个 Worker。完成后对外暴露两条基础路径:

  • /bai/v1 —— 走 OpenAI 风格的 completions 协议
  • /bai —— 走 Anthropic Messages 协议

B4. 接线:两种协议,两类客户端

关键是协议对上,不是域名对上就行。同一份部署,对外两条路:

客户端 接入 URL API 协议 说明
DSH https://你的域名/bai/v1 OpenAI Completions 标准 OpenAI 兼容入口
CCswitch + Claude Code https://你的域名/bai Anthropic Messages 让 Claude Code 走 BAI 的模型

两处 API Key 统一填 BAI 平台的 key——反代只负责转发,鉴权身份始终来自 BAI,不要在客户端里填 Cloudflare 或其他平台的 key。把 你的域名 换成真实域名;协议选错(如把 DSH 指到 /bai)是最常见的接不通原因。

B5. 现在能白嫖哪些模型

目前 BAI 平台这批模型免费,接入后直接在客户端里点选:

  • deepseekv4lash / deepseekv4lash-vision
  • glm5.3flash
  • qwen.8flash
  • hy3
  • mimov2.5

免费清单随平台变动,下单前以 BAI 控制台实际显示为准;反代层不缓存模型列表。


路线对照与选型

两张表把 A、B 两条路线摆在一起,照着选:

维度 路线 A · AMD 直连 路线 B · BAI 反代
接入形态 平台原生 OpenAI 兼容 API 自建 Cloudflare Worker 桥接
注册难度 中(邮箱/手机注册易失败,建议第三方授权) 低(BAI 账号 + Cloudflare 账号,无注册坑)
客户端覆盖 OpenAI 兼容系全覆盖(curl/Python/Cherry Studio/Cursor/opencode) OpenAI 系(/bai/v1)+ Anthropic 系(/bai,可喂 Claude Code)
免费模型 DeepSeek-V4-Flash 系列、Qwen3.8-Flash-Next、MiniCPM5-1B deepseekv4lash、glm5.3flash、qwen.8flash、hy3、mimov2.5
维护成本 零(平台维护) 中(要自己部署、绑域名、跟平台协议变动作适配)
适合谁 想最快用上免费模型、工具本身支持 OpenAI 协议 想用 Claude Code 等 Anthropic 系客户端、或要自有域名统一入口

怎么选

  • 工具支持 OpenAI 协议、只想最快用上 → 路线 A 直连,十分钟搞定。
  • 用 Claude Code / 想要 Anthropic 协议、或想统一一个自有域名入口 → 路线 B 反代
  • 都不排斥 → 两条路线不冲突,AMD 当主力免费池,BAI 反代补 Anthropic 系客户端,互为备份。

收尾小结

  • 免费模型从哪来:AMD 与 BAI 是当下两个可白嫖的境内平台,模型池都在滚动更新,能领就领、领到先用。
  • 怎么进工具链:平台入口开得好就直连(AMD),开得别扭就套反代(BAI)。反代的核心是协议转换,鉴权始终来自原平台。
  • 共同提醒:两者都属活动性质,额度有限速(AMD 约 $1/天、RPM 30)、LIMITED FREE 随时撤;Key 等同密码别公开;敏感数据走本地小模型。

参考链接


本文讲解 AMD 直连与 BAI 反代两条免费大模型 API 通道,所有模型、额度与接口以各平台官方页面实时显示为准。

COMMENTS / 评论

评论系统尚未开放。你可以通过 来访登记 直接与我联系。