目录宽,不深

AnyRouter 的目录覆盖 170+ 个模型、28+ 家供应商,用一条 provider/model 字符串寻址——anthropic/claude-opus-4-8、z-ai/glm-5.2、google/gemini-2.5-pro。模型按拥有组织分组,不按哪家上游在伺候,而且所有权是偏的:少数实验室占了目录的大部分,长尾小实验室各贡献一两个模型。
| Owner | Models in catalog |
|---|---|
| openai | 32 |
| qwen | 16 |
| meta | 16 |
| 14 | |
| anthropic | 12 |
| x-ai | 11 |
| venice | 8 |
| wafer | 7 |
| deepseek | 7 |
| nvidia | 6 |
这层拆分要紧,因为同一模型在 Cloudflare 一侧还可以有两种 SKU——第一方托管(@cf/owner/model)或合作方托管(owner/model,没有 @cf 前缀)——还没算 DeepInfra 这类第三方上游或直连供应商 API。目录宽,不代表被调用的也宽。
人们免费时真正打的是什么
调任何模型都是对同一个 OpenAI 兼容端点的一次请求:
curl https://anyrouter.dev/api/v1/chat/completions \
-H "Authorization: Bearer sk-ar-v1-..." \
-H "Content-Type: application/json" \
-d '{"model": "z-ai/glm-5.2", "messages": [{"role": "user", "content": "Hello"}]}'但免费路由上的流量——不扣额度、也不是 BYOK——不会在目录上均匀铺开。截至 2026 年 7 月 11 日的全时段,两个模型吃掉了绝大多数免费请求:
Free-served requests by model
All-time through July 11, 2026
两种用法,不是一种
只看请求数会盖住真正在发生的事。GLM-5.2 请求领先,免费 token 更是碾压——超过 2 亿免费 token——这是在跑持续、真活,不是随手试一下。gpt-4o-mini 请求也多,但每次 token 少得多:它是分类和胶水模型,便宜到可以塞进循环,每次就一两句。
这是两份不同的工作,却共用「免费模型」标签。单看请求数分不清某个模型在干哪份活——每次请求的 token 比能分清。
Coding agent 以归因出现,不是模型名
相当一部分生产流量不是开发者亲手打提示——是 coding agent 代打。Claude Code、Codex 和 Cursor 对着同一份目录说不同方言:
| Dialect | Endpoint | Used by |
|---|---|---|
| OpenAI chat | /api/v1/chat/completions | Codex, Cursor, any OpenAI-compatible client |
| Anthropic messages | /api/v1/messages | Claude Code and other Claude-native clients |
| OpenAI Responses | /api/v1/responses | Newer OpenAI-compatible agent tooling |
因为所有方言都落到同一份目录,Claude Code 的请求和手打的请求可以解析到同一个模型——用量分析里能看见的差别只是客户端发来的 app 归因头,不是另一条代码路径。
免费档靠捐赠撑,不是一张资产负债表补贴
这些请求数背后的免费容量不是批量买来的——是共享 key 池。成员把供应商免费档里闲着的额度捐进来,额度合成一池,捐赠者拿回一份分成,并拿到免费档。捐进来的容量越多,上面的免费档数字就能涨,而不必在后面加付费墙。

怎么读这张形状
- 目录宽和流量集中并不矛盾——覆盖面和热度是两回事
- 请求数和 token 数合在一起,才能看出模型在干什么活,而不只是被叫了几次
- 目录所有权偏向少数实验室,但小条目仍会被调用——只是更少
- 免费档体量随捐赠容量涨,不是固定预算
在自己的账号里看实时目录、流量和按模型用量。
打开控制台