写在前面:赛博菩萨 Cloudflare 的 Workers AI,免费档每天送 10,000 Neurons(神经元)。不用自己买token,注册个账号就能调模型,不用白不用。
免费额度先看清楚
Workers AI 按 Neurons 计费,不是按次包月。
| 计划 | 每天免费 | 超出之后 |
|---|---|---|
| Workers 免费档 | 10,000 Neurons | 当天直接停,不会自动扣钱 |
| Workers 付费档 | 同样 10,000 Neurons | 超出部分约 $0.011 / 1,000 Neurons |
个人试模型、写个小接口,一天一万够用。别拿它跑批量长文,也别一上来就点那些要付费计划的大模型。官方写明免费档用不了的包括 Kimi K2.6、Kimi K2.7 Code、GLM 5.2 / 5.3,以及部分 DeepSeek V4。下面示例用的是 @cf/meta/llama-3.1-8b-instruct,免费档可以跑。
模型目录在 Workers AI Models。每个模型页面里有输入字段,换模型时对着那个页面改 JSON,
不需要信用卡,也不需要自己的域名(白嫖真爽)。
1. 注册并登录
打开 https://dash.cloudflare.com/sign-up,邮箱注册,验证后登录。
注册 / 登录后的 Cloudflare 控制台。

2. 打开 Workers AI
左侧找 Workers AI。新版控制台多半在 AI 下面;找不到就用控制台顶部搜索 Workers AI。
这一页能看到模型、用量,还有 Use REST API。后面创建 Token、看 Neurons 都从这里进。
Workers AI 概览页。

3. 先在 Playground 里试一句
不想写代码的话,打开 AI Playground,用同一个 Cloudflare 账号登录。选一个免费档能用的对话模型,打一句话,能出字就算账号和额度是通的。
Playground 同样扣每天那 1 万 Neurons。
4. 创建 API Token
要用接口调用,需要两样东西:Account ID 和 API Token。
还是在 Workers AI 页面:
- 点 REST API
- 点 创建 Workers Al API 令牌
- 权限不用改,确认后 创建API令牌
- 立刻复制 Token。关掉弹窗就看不到原文了
- 同一页复制 Account ID
Workers AI 页上的 REST API。



创建Token

自己另建 Token 时,权限要同时有 Workers AI - Read 和 Workers AI - Edit,缺一个会 403。Token 只放在自己电脑上。
5. 打一次模型
下面用 curl。把 Account ID 和 Token 换成你自己的:
curl --location --request POST 'https://api.cloudflare.com/client/v4/accounts/${AccountID}/ai/run/@cf/meta/llama-3.1-8b-instruct' \
--header 'Authorization: Bearer ${Token}' \
--header 'Content-Type: application/json' \
--data-raw '{"prompt":"用一句话解释什么是 Workers AI"}'通了的话,success 是 True,result.response 里是模型回复。
换模型只改网址最后那段模型名,以及 Body。例如翻译模型 @cf/meta/m2m100-1.2b 要的是文本和语言,不是 prompt:
curl --location --request POST 'https://api.cloudflare.com/client/v4/accounts/${AccountID}/ai/run/@cf/meta/m2m100-1.2b' \
--header 'Authorization: Bearer ${Token}' \
--header "application/json; charset=utf-8" \
--data-raw'{"text":"你好,世界","source_lang":"zh","target_lang":"en"}'返回里看 result.translated_text。语言一般用两位代码,如 zh、en、ja。具体以该模型文档为准。
常见报错:
| 现象 | 原因 |
|---|---|
| 401 / Authentication error | Token 抄错、过期,或请求头不是 Bearer |
| 403 | Token 没有 Workers AI 的 Read + Edit |
| 400,提示缺字段 | 这个模型的入参不是 prompt,打开模型页对着改 |
| 提示需要付费计划 | 选成了 Kimi、GLM 5.x 这类免费档不能用的模型 |
| 当天突然全部失败 | 1 万 Neurons 用完了,等第二天 |
6. 写成自己的 Worker(可选)
REST 适合自己脚本里调用。如果想要一个打开就能用的地址,把模型绑到 Worker 上。Worker 里调用不用 API Token,靠的是绑定。
- 左侧打开 Workers & Pages
- 创建应用程序,模板选 Hello World,起个小写名字,例如
my-ai,然后部署 - 第一次会让你选
workers.dev子域名,选完地址就是https://my-ai.<子域名>.workers.dev - 进入这个 Worker 的 设置 → Runtime variables and secrets → 添加变量
- 类型选 Workers AI(有的列表里就叫 AI),变量名填
AI,再 Deploy
变量名必须是 AI,和下面代码里的 env.AI 一致。
创建 Worker。



绑定类型是 Workers AI,变量名是
AI。

然后 编辑代码,把默认脚本换成下面这段,再部署:
export default {
async fetch(request, env) {
const result = await env.AI.run("@cf/meta/llama-3.1-8b-instruct", {
prompt: "用一句话解释什么是 Workers AI",
});
return Response.json(result);
},
};浏览器打开那个 workers.dev 地址,能看到 JSON 回复就成了。这段没有做鉴权,地址泄露出去,别人也能消耗你的免费额度。只是自己试的话够用;要给别人用,再加一层校验。
想在 Worker 里做翻译,把 env.AI.run 换成:
const result = await env.AI.run("@cf/meta/m2m100-1.2b", {
text: "你好,世界",
source_lang: "zh",
target_lang: "en",
});小结
用起来就三条路,额度是同一份:
- Playground:浏览器里试模型
- REST API:Token + Account ID,自己的脚本里
POST .../ai/run/<模型名> - Worker 绑定:变量名
AI,代码里env.AI.run(...)
模型名和入参以模型目录为准。免费档每天 1 万 Neurons,个人够玩,别拿去跑批量任务。
