写在前面:赛博菩萨 Cloudflare 的 Workers AI,免费档每天送 10,000 Neurons(神经元)。不用自己买token,注册个账号就能调模型,不用白不用。

免费额度先看清楚

Workers AI 按 Neurons 计费,不是按次包月。

计划每天免费超出之后
Workers 免费档10,000 Neurons当天直接停,不会自动扣钱
Workers 付费档同样 10,000 Neurons超出部分约 $0.011 / 1,000 Neurons

个人试模型、写个小接口,一天一万够用。别拿它跑批量长文,也别一上来就点那些要付费计划的大模型。官方写明免费档用不了的包括 Kimi K2.6、Kimi K2.7 Code、GLM 5.2 / 5.3,以及部分 DeepSeek V4。下面示例用的是 @cf/meta/llama-3.1-8b-instruct,免费档可以跑。

模型目录在 Workers AI Models。每个模型页面里有输入字段,换模型时对着那个页面改 JSON,
不需要信用卡,也不需要自己的域名(白嫖真爽)。

1. 注册并登录

打开 https://dash.cloudflare.com/sign-up,邮箱注册,验证后登录。

注册 / 登录后的 Cloudflare 控制台。

2. 打开 Workers AI

左侧找 Workers AI。新版控制台多半在 AI 下面;找不到就用控制台顶部搜索 Workers AI

这一页能看到模型、用量,还有 Use REST API。后面创建 Token、看 Neurons 都从这里进。

Workers AI 概览页。

3. 先在 Playground 里试一句

不想写代码的话,打开 AI Playground,用同一个 Cloudflare 账号登录。选一个免费档能用的对话模型,打一句话,能出字就算账号和额度是通的。

Playground 同样扣每天那 1 万 Neurons。

4. 创建 API Token

要用接口调用,需要两样东西:Account IDAPI Token

还是在 Workers AI 页面:

  1. REST API
  2. 创建 Workers Al API 令牌
  3. 权限不用改,确认后 创建API令牌
  4. 立刻复制 Token。关掉弹窗就看不到原文了
  5. 同一页复制 Account ID

Workers AI 页上的 REST API。

创建Token

自己另建 Token 时,权限要同时有 Workers AI - ReadWorkers AI - Edit,缺一个会 403。Token 只放在自己电脑上。

5. 打一次模型

下面用 curl。把 Account ID 和 Token 换成你自己的:

curl --location --request POST 'https://api.cloudflare.com/client/v4/accounts/${AccountID}/ai/run/@cf/meta/llama-3.1-8b-instruct' \
--header 'Authorization: Bearer ${Token}' \
--header 'Content-Type: application/json' \
--data-raw '{"prompt":"用一句话解释什么是 Workers AI"}'

通了的话,successTrueresult.response 里是模型回复。

换模型只改网址最后那段模型名,以及 Body。例如翻译模型 @cf/meta/m2m100-1.2b 要的是文本和语言,不是 prompt


curl --location --request POST 'https://api.cloudflare.com/client/v4/accounts/${AccountID}/ai/run/@cf/meta/m2m100-1.2b' \
  --header 'Authorization: Bearer ${Token}' \
  --header "application/json; charset=utf-8" \
  --data-raw'{"text":"你好,世界","source_lang":"zh","target_lang":"en"}'

返回里看 result.translated_text。语言一般用两位代码,如 zhenja。具体以该模型文档为准。

常见报错:

现象原因
401 / Authentication errorToken 抄错、过期,或请求头不是 Bearer
403Token 没有 Workers AI 的 Read + Edit
400,提示缺字段这个模型的入参不是 prompt,打开模型页对着改
提示需要付费计划选成了 Kimi、GLM 5.x 这类免费档不能用的模型
当天突然全部失败1 万 Neurons 用完了,等第二天

6. 写成自己的 Worker(可选)

REST 适合自己脚本里调用。如果想要一个打开就能用的地址,把模型绑到 Worker 上。Worker 里调用不用 API Token,靠的是绑定。

  1. 左侧打开 Workers & Pages
  2. 创建应用程序,模板选 Hello World,起个小写名字,例如 my-ai,然后部署
  3. 第一次会让你选 workers.dev 子域名,选完地址就是 https://my-ai.<子域名>.workers.dev
  4. 进入这个 Worker 的 设置Runtime variables and secrets添加变量
  5. 类型选 Workers AI(有的列表里就叫 AI),变量名填 AI,再 Deploy

变量名必须是 AI,和下面代码里的 env.AI 一致。

创建 Worker。

绑定类型是 Workers AI,变量名是 AI

然后 编辑代码,把默认脚本换成下面这段,再部署:

export default {
  async fetch(request, env) {
    const result = await env.AI.run("@cf/meta/llama-3.1-8b-instruct", {
      prompt: "用一句话解释什么是 Workers AI",
    });
    return Response.json(result);
  },
};

浏览器打开那个 workers.dev 地址,能看到 JSON 回复就成了。这段没有做鉴权,地址泄露出去,别人也能消耗你的免费额度。只是自己试的话够用;要给别人用,再加一层校验。

想在 Worker 里做翻译,把 env.AI.run 换成:

const result = await env.AI.run("@cf/meta/m2m100-1.2b", {
  text: "你好,世界",
  source_lang: "zh",
  target_lang: "en",
});

小结

用起来就三条路,额度是同一份:

  • Playground:浏览器里试模型
  • REST API:Token + Account ID,自己的脚本里 POST .../ai/run/<模型名>
  • Worker 绑定:变量名 AI,代码里 env.AI.run(...)

模型名和入参以模型目录为准。免费档每天 1 万 Neurons,个人够玩,别拿去跑批量任务。


  目录