转载请注明出处小锋学长生活大爆炸[xfxuezhagn.cn]如果本文帮助到了你欢迎[点赞、收藏、关注]哦~用AI Agent的童鞋大概都经历过用 Claude Code 或 Cursor 写得正顺突然弹出一条配额超限的报错或者某个免费 API 提供商刚好在你要赶工的下午挂了。你只能停下来翻出另一个 key改配置重启工具把刚才的上下文重新喂一遍。这不是个例而是结构性的问题。根因你的编码链路绑在了一根管子上绝大多数人用 AI 编码工具时背后只连着一个提供商。一个提供商意味着一个配额上限、一个故障域、一个计费入口。免费额度通常很小付费额度又让人肉疼而提供商的稳定性你完全无法控制。问题不在于模型不够好而在于你把整条链路搭在了一个单点上。单点的特征就是它一定会断只是时间问题。解法也不复杂 只需要一层路由把多个提供商变成一个池子。哪个能用就用哪个哪个断了就自动切下一个。OmniRoute做的就是这件事。OmniRoute 是什么项目地址https://github.com/diegosouzapw/OmniRouteOmniRoute 是一个开源的 AI 网关核心定位就Never stop coding永不停编码。它把290 个 AI 提供商、500 个模型聚合到一个本地端点后面。因此不用挨个去对接 Kimi、Claude、GPT、Gemini、DeepSeek、GLM……它们全部变成你这个端点背后的资源池。其中90 个提供商提供免费层级40 个永久免费据作者描述聚合后每月约有 15.3 亿免费Token可用。和 cc-switch、sub2api 比强在哪OmniRoute 不是这个赛道里唯一的玩家。另外两个常被提到的开源项目cc-switch和sub2api也是为了少折腾而生但解决的问题和 OmniRoute 很不一样。先说清它们三个的共同标准都坐在编码工具和 AI 提供商之间把多路访问统一成一个入口。维度OmniRoutecc-switchsub2api定位聚合 290 提供商的 AI 网关Claude Code / Codex 配置切换 轻量代理订阅额度分发 / 拼车中转平台接入规模290 提供商、500 模型、90 免费你自带的几个订阅 key你自带的订阅账号Claude/OpenAI/Gemini 等路由能力19 种策略 Combo 自动降级 三层韧性代理模式按优先级顺序故障切换粘性会话 按账号智能调度令牌压缩12 引擎流水线省 15-95%无无免费层聚焦是聚合 90 免费提供商否key 由你提供否订阅由你提供计费 / 拼车不做不做核心能力按 token 计费、支付、拼车运行形态100% 本地、零遥测本地桌面 App 本地代理自托管服务需 PostgreSQL Redis三个关键差异1. 规模不是一个量级。cc-switch 和 sub2api 都是你带 key / 订阅进来我帮你接好你有多少账号就能用多少账号。OmniRoute 反过来它自己聚合了 290 提供商其中 90 带免费层装上就有约 15.3 亿免费令牌/月的池子可用。前者解决的是我有多账号怎么切换后者解决的是我根本没有那么多账号但想用上。2. 令牌压缩是独门能力。cc-switch 是配置切换器sub2api 是额度分发器两者在已公开的功能清单里都没有令牌压缩。OmniRoute 的 12 引擎压缩尤其 RTK 对工具输出压 60-90%是同类里少见的——它直接降低每一次请求的令牌消耗让免费层更经用。3. 路由深度不同。cc-switch 代理模式支持按优先级自动故障切换sub2api 按账号做粘性调度都算够用但 OmniRoute 的 19 种策略成本优化、延迟优先、fusion 多模型合成等加三层韧性架构熔断 / 冷却 / 锁定在复杂场景下的可控性和自愈能力明显更高。那什么情况下选哪个•想用免费额度认真编码、不想自己攒账号→ OmniRoute。聚合免费层 压缩是它最不可替代的组合。•已经在用多个 Claude Code / Codex 订阅只想一键切换、轻量不折腾→ cc-switch。它更轻、更聚焦桌面端点点就完事。•要把订阅额度分给团队或对外卖额度、需要计费对账→ sub2api。它的拼车 支付 按 token 计费是核心卖点OmniRoute 没有这些。总的来说OmniRoute 的对手不是更简单的切换器而是要不要一个能自愈、能压缩、自带免费池的网关。如果你的问题正好是后一种它的优势就很清楚了。OmniRoute 作者还把自己和 9router、OpenRouter、CLIProxyAPI、LiteLLM 这几款更成熟的同类方案放在一起比过并强调它是其中唯一同时具备 290 提供商、90 免费内置、19 路由策略、12 引擎令牌压缩、内置 MCP 服务器、A2A 协议、持久化内存、防护栏、云代理、TLS 指纹隐身、Desktop/Termux/PWA 全平台、43 种语言界面和 100% MIT 自托管的项目。部署OmniRoute常规命令行安装方式# 1. 安装并启动端口默认 20128 npm install -g omniroute omniroute # 2. 在 Dashboard 里连接免费提供商 # OpenCode Free 和 Felo 已预置在 auto combo 中零配置即可工作 # 3. 把编码工具指向本地端点 # Base URL: http://localhost:20128/v1 # API Key: 从 Dashboard → Endpoints 复制 # Model: auto验证一下是否通了curl http://localhost:20128/v1/models -H Authorization: Bearer YOUR_KEY除了 npm 全局安装还支持 Docker、Electron 桌面端、AndroidTermux、PWA、Arch LinuxAUR和 Nix。 Docker方式 (推荐)Docker方式适合想尝鲜一下的童鞋比如学长我。docker run -d --name omniroute --restart unless-stopped --stop-timeout 40 \ -p 127.0.0.1:20128:20128 \ -v omniroute-data:/app/data \ diegosouzapw/omniroute:latest1、执行完成后浏览器输入127.0.0.1:20128即可进入配置界面。2、有挺多免费的供应商甚至还有一些免鉴权的供应商或者如果你有购买API可以添加对应的供应商。3、整体功能非常全面学长有点玩不过来了大家可以探索一下。学长在NAS上面也部署了一个大家可以尝试玩玩Base URL: https://omniroute.xfxuezhang.cn/api/v1API Key: sk-8f1d1c968461702e-929f7c-5fee43f9️ 从源码运行cp .env.example .env npm install PORT20128 npm run dev pnpm 安装pnpm add -g omniroutelatest \ --allow-buildbetter-sqlite3 \ --allow-buildswc/core \ omniroute Arch LinuxAURyay -S omniroute-bin systemctl --user enable --now omniroute.service NixFlake使用 Nix Flakesnix develop npm run dev或使用 Devboxdevbox run npm run dev Podman1. 构建镜像podman build --target runner-base -t omniroute:base .2. 修复 Rootless Podman 数据目录权限mkdir -p data podman unshare chown 1000:1000 ./data3. 设置运行环境并启动echo CONTAINER_HOSTpodman .env podman compose --profile base up -dOmniRoute的核心能力核心能力一19 种路由策略 自动降级OmniRoute 提供了 19 种路由策略不需要全记住理解几个关键的就够用•priority按你排的优先级逐个耗尽用完一个自动切下一个。•cost-optimized每次请求都选最便宜的那个。•auto12 因子实时评分自动平衡质量、延迟、成本和配额余量。还有auto/coding质量优先、auto/fast延迟优先、auto/cheap每令牌最便宜等变体。•fusion把请求扇出到多个模型再用一个判官模型合成最终答案。真正让编码永不停的是它的Combo 系统和三层韧性架构1.提供商熔断器——某个提供商连续失败达到阈值OAuth 3 次 / API-key 5 次自动熔断60 秒后进入半开状态探测恢复。2.连接冷却——单个密钥级别的基础冷却5 秒起指数退避防止所有请求同时涌向同一个恢复中的提供商。3.模型锁定——某个模型返回 429限流或 404 时只锁定这个模型不影响同提供商的其他模型。这三层叠加的效果是当你的首选提供商配额用尽或服务波动时网关在毫秒级把请求路由到池子里的下一个可用目标你的编码工具那边感知不到中断。核心能力二12 引擎令牌压缩把免费额度撑到可用免费额度小是另一个现实问题。OmniRoute 的思路不是去要更多免费额度而是把每次请求消耗的令牌压下去。它内置了一条 12 引擎的压缩流水线针对不同场景有不同的压缩策略•Lite修剪空白和图片 URL节省约 15%常开安全默认。•Caveman基于规则的文本压缩节省约 30%适合日常编码。•RTK专门压缩 Shell、测试、构建、Git 输出——这类工具输出通常冗长且重复RTK 能压掉 60-90%。•Aggressive摘要 旧轮次渐进老化节省约 50%适合长工具密集会话。•Ultra启发式令牌剪枝最高节省 75%。•堆叠模式RTK → Caveman 串联最高节省 78-95%。对编码场景来说工具输出编译日志、测试结果、文件内容往往占上下文的大头。把这些压缩掉 60-90%等于同样的免费额度能撑更久。这是免费编码从噱头变成日常的关键一环。核心能力三兼容你的工具数据不出本地OmniRoute 兼容33 编码工具包括 Claude Code、Codex CLI、Cursor CLI、GitHub Copilot CLI、Cline、Aider、Roo Code、Continue 等。接入方式是标准的 OpenAI 兼容 REST API因此可以无缝切换到 OmniRoute。对无法发送自定义 Header 的客户端它还提供了** URL 路径内嵌 key 的兼容别名**。隐私方面OmniRoute100% 本地运行零遥测密钥用 AES-256-GCM 加密存储不需要注册或登录。请求经过本地网关再转发给提供商中间不留第三方中间层。核心能力四多端可部署是的你没看错甚至能部署到 Android (Termux) 手机上。使用边界OmniRoute 不是万能的OmniRoute 有自己的适用条件选之前先看清•不适合需要严格 SLA 的企业生产环境——它是社区开源项目没有独立可用性保证提供商池的稳定性取决于各个免费层级的实际状态。•不适合完全离线环境——它只是路由层本身不提供模型仍需联网访问上游提供商。•对延迟极度敏感的场景要谨慎——多一层本地网关会增加少量开销通常可忽略。• 已经在用 LiteLLM、OpenRouter 等成熟代理时可对照上文 README 的能力清单判断是否需要迁移差异主要在令牌压缩与免费层聚合而不是功能的简单叠加。总结如果你的 AI 编码频繁因为配额和单点故障被打断又愿意在本地跑一个网关进程OmniRoute 值得试一试——尤其是它的令牌压缩和自动降级组合把用免费额度认真编码这件事变得现实了很多。
【工具】每月免费1.4B的Token!这个开源网关把 290+ 模型聚成一个端点 | OmniRoute
转载请注明出处小锋学长生活大爆炸[xfxuezhagn.cn]如果本文帮助到了你欢迎[点赞、收藏、关注]哦~用AI Agent的童鞋大概都经历过用 Claude Code 或 Cursor 写得正顺突然弹出一条配额超限的报错或者某个免费 API 提供商刚好在你要赶工的下午挂了。你只能停下来翻出另一个 key改配置重启工具把刚才的上下文重新喂一遍。这不是个例而是结构性的问题。根因你的编码链路绑在了一根管子上绝大多数人用 AI 编码工具时背后只连着一个提供商。一个提供商意味着一个配额上限、一个故障域、一个计费入口。免费额度通常很小付费额度又让人肉疼而提供商的稳定性你完全无法控制。问题不在于模型不够好而在于你把整条链路搭在了一个单点上。单点的特征就是它一定会断只是时间问题。解法也不复杂 只需要一层路由把多个提供商变成一个池子。哪个能用就用哪个哪个断了就自动切下一个。OmniRoute做的就是这件事。OmniRoute 是什么项目地址https://github.com/diegosouzapw/OmniRouteOmniRoute 是一个开源的 AI 网关核心定位就Never stop coding永不停编码。它把290 个 AI 提供商、500 个模型聚合到一个本地端点后面。因此不用挨个去对接 Kimi、Claude、GPT、Gemini、DeepSeek、GLM……它们全部变成你这个端点背后的资源池。其中90 个提供商提供免费层级40 个永久免费据作者描述聚合后每月约有 15.3 亿免费Token可用。和 cc-switch、sub2api 比强在哪OmniRoute 不是这个赛道里唯一的玩家。另外两个常被提到的开源项目cc-switch和sub2api也是为了少折腾而生但解决的问题和 OmniRoute 很不一样。先说清它们三个的共同标准都坐在编码工具和 AI 提供商之间把多路访问统一成一个入口。维度OmniRoutecc-switchsub2api定位聚合 290 提供商的 AI 网关Claude Code / Codex 配置切换 轻量代理订阅额度分发 / 拼车中转平台接入规模290 提供商、500 模型、90 免费你自带的几个订阅 key你自带的订阅账号Claude/OpenAI/Gemini 等路由能力19 种策略 Combo 自动降级 三层韧性代理模式按优先级顺序故障切换粘性会话 按账号智能调度令牌压缩12 引擎流水线省 15-95%无无免费层聚焦是聚合 90 免费提供商否key 由你提供否订阅由你提供计费 / 拼车不做不做核心能力按 token 计费、支付、拼车运行形态100% 本地、零遥测本地桌面 App 本地代理自托管服务需 PostgreSQL Redis三个关键差异1. 规模不是一个量级。cc-switch 和 sub2api 都是你带 key / 订阅进来我帮你接好你有多少账号就能用多少账号。OmniRoute 反过来它自己聚合了 290 提供商其中 90 带免费层装上就有约 15.3 亿免费令牌/月的池子可用。前者解决的是我有多账号怎么切换后者解决的是我根本没有那么多账号但想用上。2. 令牌压缩是独门能力。cc-switch 是配置切换器sub2api 是额度分发器两者在已公开的功能清单里都没有令牌压缩。OmniRoute 的 12 引擎压缩尤其 RTK 对工具输出压 60-90%是同类里少见的——它直接降低每一次请求的令牌消耗让免费层更经用。3. 路由深度不同。cc-switch 代理模式支持按优先级自动故障切换sub2api 按账号做粘性调度都算够用但 OmniRoute 的 19 种策略成本优化、延迟优先、fusion 多模型合成等加三层韧性架构熔断 / 冷却 / 锁定在复杂场景下的可控性和自愈能力明显更高。那什么情况下选哪个•想用免费额度认真编码、不想自己攒账号→ OmniRoute。聚合免费层 压缩是它最不可替代的组合。•已经在用多个 Claude Code / Codex 订阅只想一键切换、轻量不折腾→ cc-switch。它更轻、更聚焦桌面端点点就完事。•要把订阅额度分给团队或对外卖额度、需要计费对账→ sub2api。它的拼车 支付 按 token 计费是核心卖点OmniRoute 没有这些。总的来说OmniRoute 的对手不是更简单的切换器而是要不要一个能自愈、能压缩、自带免费池的网关。如果你的问题正好是后一种它的优势就很清楚了。OmniRoute 作者还把自己和 9router、OpenRouter、CLIProxyAPI、LiteLLM 这几款更成熟的同类方案放在一起比过并强调它是其中唯一同时具备 290 提供商、90 免费内置、19 路由策略、12 引擎令牌压缩、内置 MCP 服务器、A2A 协议、持久化内存、防护栏、云代理、TLS 指纹隐身、Desktop/Termux/PWA 全平台、43 种语言界面和 100% MIT 自托管的项目。部署OmniRoute常规命令行安装方式# 1. 安装并启动端口默认 20128 npm install -g omniroute omniroute # 2. 在 Dashboard 里连接免费提供商 # OpenCode Free 和 Felo 已预置在 auto combo 中零配置即可工作 # 3. 把编码工具指向本地端点 # Base URL: http://localhost:20128/v1 # API Key: 从 Dashboard → Endpoints 复制 # Model: auto验证一下是否通了curl http://localhost:20128/v1/models -H Authorization: Bearer YOUR_KEY除了 npm 全局安装还支持 Docker、Electron 桌面端、AndroidTermux、PWA、Arch LinuxAUR和 Nix。 Docker方式 (推荐)Docker方式适合想尝鲜一下的童鞋比如学长我。docker run -d --name omniroute --restart unless-stopped --stop-timeout 40 \ -p 127.0.0.1:20128:20128 \ -v omniroute-data:/app/data \ diegosouzapw/omniroute:latest1、执行完成后浏览器输入127.0.0.1:20128即可进入配置界面。2、有挺多免费的供应商甚至还有一些免鉴权的供应商或者如果你有购买API可以添加对应的供应商。3、整体功能非常全面学长有点玩不过来了大家可以探索一下。学长在NAS上面也部署了一个大家可以尝试玩玩Base URL: https://omniroute.xfxuezhang.cn/api/v1API Key: sk-8f1d1c968461702e-929f7c-5fee43f9️ 从源码运行cp .env.example .env npm install PORT20128 npm run dev pnpm 安装pnpm add -g omniroutelatest \ --allow-buildbetter-sqlite3 \ --allow-buildswc/core \ omniroute Arch LinuxAURyay -S omniroute-bin systemctl --user enable --now omniroute.service NixFlake使用 Nix Flakesnix develop npm run dev或使用 Devboxdevbox run npm run dev Podman1. 构建镜像podman build --target runner-base -t omniroute:base .2. 修复 Rootless Podman 数据目录权限mkdir -p data podman unshare chown 1000:1000 ./data3. 设置运行环境并启动echo CONTAINER_HOSTpodman .env podman compose --profile base up -dOmniRoute的核心能力核心能力一19 种路由策略 自动降级OmniRoute 提供了 19 种路由策略不需要全记住理解几个关键的就够用•priority按你排的优先级逐个耗尽用完一个自动切下一个。•cost-optimized每次请求都选最便宜的那个。•auto12 因子实时评分自动平衡质量、延迟、成本和配额余量。还有auto/coding质量优先、auto/fast延迟优先、auto/cheap每令牌最便宜等变体。•fusion把请求扇出到多个模型再用一个判官模型合成最终答案。真正让编码永不停的是它的Combo 系统和三层韧性架构1.提供商熔断器——某个提供商连续失败达到阈值OAuth 3 次 / API-key 5 次自动熔断60 秒后进入半开状态探测恢复。2.连接冷却——单个密钥级别的基础冷却5 秒起指数退避防止所有请求同时涌向同一个恢复中的提供商。3.模型锁定——某个模型返回 429限流或 404 时只锁定这个模型不影响同提供商的其他模型。这三层叠加的效果是当你的首选提供商配额用尽或服务波动时网关在毫秒级把请求路由到池子里的下一个可用目标你的编码工具那边感知不到中断。核心能力二12 引擎令牌压缩把免费额度撑到可用免费额度小是另一个现实问题。OmniRoute 的思路不是去要更多免费额度而是把每次请求消耗的令牌压下去。它内置了一条 12 引擎的压缩流水线针对不同场景有不同的压缩策略•Lite修剪空白和图片 URL节省约 15%常开安全默认。•Caveman基于规则的文本压缩节省约 30%适合日常编码。•RTK专门压缩 Shell、测试、构建、Git 输出——这类工具输出通常冗长且重复RTK 能压掉 60-90%。•Aggressive摘要 旧轮次渐进老化节省约 50%适合长工具密集会话。•Ultra启发式令牌剪枝最高节省 75%。•堆叠模式RTK → Caveman 串联最高节省 78-95%。对编码场景来说工具输出编译日志、测试结果、文件内容往往占上下文的大头。把这些压缩掉 60-90%等于同样的免费额度能撑更久。这是免费编码从噱头变成日常的关键一环。核心能力三兼容你的工具数据不出本地OmniRoute 兼容33 编码工具包括 Claude Code、Codex CLI、Cursor CLI、GitHub Copilot CLI、Cline、Aider、Roo Code、Continue 等。接入方式是标准的 OpenAI 兼容 REST API因此可以无缝切换到 OmniRoute。对无法发送自定义 Header 的客户端它还提供了** URL 路径内嵌 key 的兼容别名**。隐私方面OmniRoute100% 本地运行零遥测密钥用 AES-256-GCM 加密存储不需要注册或登录。请求经过本地网关再转发给提供商中间不留第三方中间层。核心能力四多端可部署是的你没看错甚至能部署到 Android (Termux) 手机上。使用边界OmniRoute 不是万能的OmniRoute 有自己的适用条件选之前先看清•不适合需要严格 SLA 的企业生产环境——它是社区开源项目没有独立可用性保证提供商池的稳定性取决于各个免费层级的实际状态。•不适合完全离线环境——它只是路由层本身不提供模型仍需联网访问上游提供商。•对延迟极度敏感的场景要谨慎——多一层本地网关会增加少量开销通常可忽略。• 已经在用 LiteLLM、OpenRouter 等成熟代理时可对照上文 README 的能力清单判断是否需要迁移差异主要在令牌压缩与免费层聚合而不是功能的简单叠加。总结如果你的 AI 编码频繁因为配额和单点故障被打断又愿意在本地跑一个网关进程OmniRoute 值得试一试——尤其是它的令牌压缩和自动降级组合把用免费额度认真编码这件事变得现实了很多。