OmniRoute零配置智能路由完全指南:auto、auto/coding、auto/fast、auto/cheap 四大模式差异全解

发布时间:2026/8/30 12:55:55
OmniRoute零配置智能路由完全指南:auto、auto/coding、auto/fast、auto/cheap 四大模式差异全解 OmniRoute零配置智能路由完全指南auto、auto/coding、auto/fast、auto/cheap 四大模式差异全解【免费下载链接】OmniRouteNever stop coding. Free MIT AI gateway: one endpoint, 350 providers (90 free), 1200 models Kimi, Claude, GPT, Gemini, GLM, DeepSeek, MiniMax. Works with Claude Code, Codex, Cursor, OpenCode, Cline Copilot. Quota-aware auto-fallback, RTKCaveman compression saves 15-95% tokens, MCP/A2A, Desktop/PWA. Built by 450 contributors项目地址: https://gitcode.com/GitHub_Trending/om/OmniRouteOmniRoute是一款免费的 MIT 协议 AI 网关AI Gateway一个端点接入 350 供应商、1200 模型支持 Claude Code、Codex、Cursor、OpenCode、Cline 与 Copilot 等主流 AI 编程工具。其中最省心的能力是零配置智能路由——你只需把模型名设为auto它就会自动为你挑选当下最优的供应商。那么auto、auto/coding、auto/fast、auto/cheap到底有何区别本文一次讲清楚。什么是 OmniRoute 零配置智能路由传统用法里你需要手动指定某个具体模型如 GPT、Gemini一旦该供应商限流、宕机或额度耗尽请求就会失败。OmniRoute 的auto/前缀彻底改变了这一点无需创建任何路由组合Combo无需任何配置只要请求里写你写的 model 值OmniRoute 的行为auto从所有已连接供应商中实时打分选综合最优者auto/coding按代码质量优先的权重打分auto/fast按最低延迟优先的权重打分auto/cheap按单 token 成本最低的权重打分它的工作原理是每次收到带auto/前缀的请求时OmniRoute 会即时构建一个虚拟路由组合——把当前所有健康、有额度、凭据有效的供应商连接拉进候选池用 15 因子评分引擎逐一打分选出得分最高者。虚拟组合只存在于内存中不写数据库因此新增供应商后立即进入候选池零维护成本。auto 与 auto/coding、auto/fast、auto/cheap 的核心差异四个模式的本质区别只有一件事评分权重模式包不同。同一个候选池、同一套 15 因子评分引擎只是哪些因子更重要被调成了不同比例模式核心目标关键权重分配适用场景auto 综合均衡健康 20% 额度 15% 成本 15%日常聊天、通用问答auto/coding‍ 代码质量优先任务匹配度 37% 稳定性 15%写代码、调试、重构auto/fast⚡ 低延迟优先延迟 32% 健康 28%自动补全、实时交互auto/cheap 成本优先成本 37%批量任务、省钱场景几个容易踩坑的细节auto并不总选最贵的模型成本默认只占 15% 权重一个便宜、快速且健康的供应商完全可以击败昂贵的大模型auto/coding不是指定编程模型而是把该模型擅长此类任务吗taskFit的权重拉到最高同时看重稳定性减少代码生成中途出错auto/fast优先低 p95 延迟但健康度仍占 28%不会为了快而把请求发给即将挂掉的供应商。进阶还能这样组合使用1. 别忘了另外三个变体除了本文主角auto/前缀还内置auto/offline—— 额度余量最大优先quota 权重 37%适合供应商普遍繁忙时auto/smart—— 质量优先 10% 探索率默认 5%愿意尝鲜新模型时用它auto/lkgp—— 显式最近成功路径策略与auto默认行为一致。2. 类别 × 档位自由组合借鉴 OpenRouter 的设计你还可以写auto/类别:档位例如写法含义auto/coding:fast编程类候选池 低延迟权重auto/coding:cheap编程类候选池 成本优化别名:floorauto/reasoning:pro仅推理模型且限定高级档auto/multimodal:free仅多模态模型且只用免费档类别coding / reasoning / vision / chat / multimodal负责按能力筛选候选池档位fast / cheap / reliable / free / pro负责决定权重与池过滤两者自由搭配按需解析、即时生效。3. 按请求微调三个隐藏请求头不改配置只给单次请求加 Header就能临时切换模式甚至锁预算X-OmniRoute-Mode: fast—— 本次请求强制低延迟权重可选 fast / balanced / quality / cheap / reliable / offlineX-OmniRoute-Budget: 0.05—— 本次请求成本上限美元X-OmniRoute-Budget-Fallback: strict—— 所有候选都超预算时直接返回 402 拒绝而非悄悄超支。路由失败后会发生什么三层保护机制auto系列路由自带完整的自愈体系你几乎不用管自动回退得分最高的供应商失败了自动顺延到下一名请求不中断自我修复得分低于 0.2 的供应商被临时剔除5 分钟起步渐进退避最长 30 分钟熔断器开启的供应商自动排除紧急兜底全部失败时路由到稳定的免费供应商如 Kiro、Qoder保底。此外还有两个聪明机制会话粘性LKGP多轮对话会优先粘住上一次成功的供应商保证上下文连续、提示缓存命中Bandit 探索默认 5% 的请求会随机探索新供应商让评分系统持续学习你场景下的真实表现故障大面积发生时自动关闭探索稳住基本盘。快速上手两步完成接入第一步启动 OmniRoute 并连接至少一个供应商OAuth 或 API Key 均可参考 docs/getting-started/AUTO-COMBO-GUIDE.md。第二步在任意 OpenAI 格式客户端中把 Base URL 指向 OmniRoute 的http://localhost:20128/v1然后把模型名改为auto或任意变体curl http://localhost:20128/v1/chat/completions \ -H Content-Type: application/json \ -d {model:auto/coding,messages:[{role:user,content:写一个 Python 排序函数}]}响应头中会标注实际使用的供应商与模型方便你确认路由结果。多账号场景下同一供应商的每个 Key 都会作为独立候选参与打分——A 账号有额度就用 AB 账号限流就跳过 B。延伸阅读用户向完整指南docs/getting-started/AUTO-COMBO-GUIDE.md技术参考15 因子评分表、模式包权重矩阵docs/routing/AUTO-COMBO.md评分引擎源码open-sse/services/autoCombo/scoring.ts模式包定义open-sse/services/autoCombo/modePacks.tsauto/前缀解析器open-sse/services/autoCombo/autoPrefix.ts虚拟组合工厂open-sse/services/autoCombo/virtualFactory.ts一句话总结日常用auto写代码切auto/coding追求响应速度用auto/fast批量省钱任务用auto/cheap——一个前缀之差OmniRoute 就换了一套评分逻辑为你服务。【免费下载链接】OmniRouteNever stop coding. Free MIT AI gateway: one endpoint, 350 providers (90 free), 1200 models Kimi, Claude, GPT, Gemini, GLM, DeepSeek, MiniMax. Works with Claude Code, Codex, Cursor, OpenCode, Cline Copilot. Quota-aware auto-fallback, RTKCaveman compression saves 15-95% tokens, MCP/A2A, Desktop/PWA. Built by 450 contributors项目地址: https://gitcode.com/GitHub_Trending/om/OmniRoute创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考