先给结论:OmniRoute 软件本身免费,但「免费用 AI」取决于你能合法连接并消耗多少上游免费档——仪表盘上的约 14 亿 Token/月是 pool-dedupe 汇总,不是个人无限额度。 下文按软件成本、额度类型、模型支持与生产限制四层拆解,并附场景选型表与五条落地步骤。
如果你刚接触 OmniRoute,最容易混淆两件事:网关要不要钱,以及 AI 调用要不要钱。前者答案是「MIT 开源、自托管零授权费」;后者则完全取决于你接入了哪些上游——Pollinations 可以免 Key 起步,Claude/GPT 往往走 OAuth 或试用额度,各自有 RPM、日限额和条款约束。本文与站内已有的 OmniRoute OAuth 合规指南、云端部署成本估算 形成互补:本篇聚焦「免费到底免费在哪」。
最后更新于 2026 年 8 月 3 日,额度与模型列表依据 OmniRoute 官方仓库 与 omniroute.online 公开文档整理;上游条款可能随时调整,接入前请以各厂商官网为准。
为什么「OmniRoute 免费吗」这个问题本身就容易算错
很多人把三个「免费」混为一谈:
- OmniRoute 软件授权——MIT 许可,可本地或云端自托管,无订阅费。
- 上游模型免费档——各厂商独立政策:有的永久免费(如部分 Pollinations、Cloudflare AI),有的按月重置(如 Kiro 50 credits),有的需注册试用金(OpenAI $5、Google 每日请求额)。
- 你的隐性成本——云主机、公网带宽、维护时间,以及触顶后接入的付费 API Key。
真正差异在于:OmniRoute 不负责「发明」免费额度,而是把分散在各家的免费档聚合成一个可路由的池,并在配额耗尽时自动 fallback。 问题不在「能不能免费用」,而在「你的使用模式能否在限额内稳定跑完」。
三层「免费」怎么分类
| 层级 | 含义 | 典型费用 | 谁承担限额 |
|---|---|---|---|
| L0 网关软件 | OmniRoute 本体 | $0(MIT) | 自托管者负责机器 |
| L1 免 Key / 免卡永久档 | Pollinations、部分 OpenCode | $0 | 上游 RPM/公平使用 |
| L2 OAuth / 试用额度 | Claude Code、Gemini CLI、Kiro | $0 起,有上限 | 各订阅或 credits 规则 |
| L3 自备 API Key | OpenAI、Anthropic、Groq 等 | 按量或预付 | 你的账单与速率限制 |
非对称结论: 模型能力不是分水岭,额度形态与条款才是——同一款 Claude 模型,经 OAuth 与经官方 API 的合规边界完全不同。
额度全景:仪表盘数字怎么读
OmniRoute 在 /dashboard/free-tiers 展示约 1.4–1.53B Token/月(pool-dedupe 后),覆盖 43 个 provider pool / 516 个模型 文档化免费档。关键规则:
- Pool dedupe:共享账号或同一上游池只计一次,避免重复夸大。
- 未连接 = 不可用:数字是「潜在池」,你必须在仪表盘完成 OAuth 或填入 API Key。
- 按月重置 vs 一次性:LongCat 等有 one-time 额度;Cerebras 约 1M tokens/天;Cloudflare 约 10K neurons/天。
- 压缩延长寿命:RTK+Caveman 宣称可省 15–95% Token,等效放大免费档(尤其适合长上下文 Agent)。
代表性免费上游(2026 初)
| 上游 | 代表模型 | 额度形态 | 接入方式 |
|---|---|---|---|
| Pollinations | GPT、Llama、Claude 等 | 免 Key,公平使用 | 无需认证 |
| Cloudflare AI | 50+ 开源模型 | ~10K neurons/天 | Workers AI |
| Cerebras | GLM 4.7、GPT-OSS | ~1M tokens/天 | API Key |
| NVIDIA NIM | GLM、MiniMax | ~40 RPM 免费 | 注册 NIM |
| Qoder | Kimi-K2、Qwen3-coder | 文档称 Unlimited FREE | OAuth |
| Kiro AI | Claude Sonnet/Haiku/Opus | 50 credits/月 | OAuth |
| OpenCode Free | GPT-4o、Claude、Gemini | 文档称 Unlimited | 无需认证 |
| OpenRouter :free | 多开源模型 | 免费档 + 充值提 RPM | API Key |
完整机器可读目录见官方 docs/reference/PROVIDER_REFERENCE.md 与 FREE_TIERS.md。
模型支持:500+ 背后实际能用什么
OmniRoute 宣称支持 290 个 provider、500+ 模型,其中 90+ 带免费档、11+ free forever。但「目录里有」≠「你已连接且当前有配额」。
| 路由模式 | 行为 | 适合场景 |
|---|---|---|
auto |
平衡质量、延迟与剩余配额 | 日常开发默认 |
auto/coding |
偏重代码质量 | IDE / Claude Code / Cursor |
auto/fast |
最低延迟优先 | 交互式补全 |
auto/cheap |
最低单价(含免费档) | 批处理、草稿 |
auto/offline |
优先消耗剩余配额多的上游 | 免费档榨干 |
显式 provider/model |
固定路由,可配 Tier1/2/3 fallback | 生产需可预测性时 |
与 Claude Code 成本文 对照:把 OmniRoute 指到 http://localhost:20128/v1 时,你省的是「多厂商统一入口」,不是「Anthropic 订阅变免费」。
核心限制:免费档的五条红线
| 限制类型 | 具体表现 | 应对 |
|---|---|---|
| 无 SLA | 免费上游随时降速、改限额 | 生产备付费 Key |
| 条款风险 | OAuth 个人订阅可能禁止代理/团队共享 | 见 OAuth 合规文 |
| 质量波动 | fallback 可能换到较弱模型 | 固定 Tier 或显式 model |
| 自托管成本 | 24/7 网关需机器与公网 | 云端 Mac / VPS 预算 |
| 隐私与日志 | 请求经第三方上游 | 敏感数据走官方 API + 企业协议 |
场景怎么选
| 如果你是… | 推荐组合 | 月费预期 |
|---|---|---|
| 个人尝鲜、日调用 <2h | 本机 OmniRoute + Pollinations/OpenCode + auto/cheap |
$0 + 电费 |
| 日常编码 Agent | 叠 Kiro + Qoder + Cerebras + 压缩开启 | $0–$20(触顶后 API) |
| 团队共享网关 | 自托管 + 每人独立上游账号 + API Key 分流 | 主机 $5–30 + API |
| 生产 SaaS | OmniRoute 作开发代理;线上只用付费 API | API 为主 |
需要稳定远程环境跑网关与 OAuth 回调时,可参考 Mac mini 租用 做隔离节点,避免与个人桌面账号混用。
推荐组合(可叠加)
- 零成本探索栈:Pollinations + Cloudflare AI +
auto/offline——适合写脚本、测 prompt,不适合长 Agent。 - 编码主力栈:Kiro(Claude)+ Qoder(Kimi/Qwen coder)+ Cerebras 日限额兜底 + RTK 压缩——适合个人开发者日更。
- 可审计团队栈:自托管 OmniRoute + 成员各自 OAuth/API + 网关访问令牌分离 + 日志脱敏——配合 帮助中心 做密钥规范。
- 生产过渡栈:开发环境走免费 fallback;预发/生产固定 OpenAI 或 Anthropic API Key,OmniRoute 仅作本地统一端点。
常见误区
- 把 14 亿 Token 当成个人月度配额——那是全池理论值,且需连接全部上游。
- 认为「free forever」等于「无限 RPM」——公平使用与速率限制仍在。
- 团队共用一个 OAuth 刷新令牌——合规与封号风险极高。
- 忽略压缩开关——长上下文 Agent 不压缩会快速烧完日限额。
- 生产零付费备份——上游维护窗口会导致全链路失败。
落地步骤(5 步)
- 安装并打开仪表盘:本地默认
http://localhost:20128,确认/dashboard/free-tiers可见已连接池。 - 按优先级连接上游:先免 Key(Pollinations、OpenCode),再 OAuth(Kiro、Gemini CLI),最后填 Groq/OpenRouter 等 API Key。
- 设路由策略:日常
auto/coding;批任务auto/cheap;在 UI 配置 Tier1/2/3 fallback 链。 - 开启 RTK+Caveman 压缩:在设置中启用,观察仪表盘 token 节省比例。
- 客户端改 base URL:Cursor / Claude Code / Cline 指向
http://<host>:20128/v1,用auto或显式模型名;触顶后切换付费 Key 或等待重置。
总结
OmniRoute 免费的是网关软件与聚合免费档的能力,不是无限制使用顶级闭源模型。 个人开发者可以把多上游免费档叠成「够用的开发环境」;团队与生产则必须把条款、配额、付费备份和托管成本一并入账。下一步建议对照 OAuth 合规文 检查账号边界,并用 部署成本文 估算 24/7 网关的真实账单。
FAQ
OmniRoute 本身收费吗?
OmniRoute 是 MIT 开源项目,软件本身免费,可自托管。你付的钱通常来自云主机、电费、域名,以及超出免费档后接入的付费 API Key。
「约 14 亿 Token/月」是个人都能用的吗?
不是。这是 OmniRoute 仪表盘对 90+ 上游免费档做 pool-dedupe 后的汇总估算,前提是你已连接对应账号且各上游条款允许。共享池账号只计一次,不代表单人无限额度。
哪些模型可以免费用?
取决于你连接的上游。常见包括 Pollinations(免 Key)、Cloudflare AI、Cerebras、NVIDIA NIM、Qoder、OpenCode Free 等;Claude/GPT 等多通过 OAuth 或试用额度接入,有独立限额。
和 OpenRouter、LiteLLM 比有什么不同?
OmniRoute 侧重聚合上游免费档、配额感知路由与 RTK+Caveman 压缩;OpenRouter 偏商业模型市场;LiteLLM 偏企业统一代理。免费额度「能叠多少」是 OmniRoute 的核心卖点。
生产环境可以直接全靠免费档吗?
不建议。免费档无 SLA、限额易变、模型质量参差。适合个人实验、原型和低成本开发;面向客户的生产流量应准备付费 API 或企业方案。
为 OmniRoute 准备独立、可控的远程 Mac
在隔离的 Cloud Mac 上运行 OmniRoute,避免个人 OAuth 与生产凭据混在同一台机器。
按需租用 Mac mini,适合 OAuth 回调验证、团队网关试点与 Agent 长会话。 立即订购