OpenRouter
一个 API 访问几百个模型,统一计费,支持按效果自动路由。
原型期还没想好押哪家模型的人。接一次就能在 GPT、Claude、Gemini、Qwen、DeepSeek 之间横跳,不用每家都申请一遍密钥、各写一套调用代码。
OpenRouter 把自己摆在所有模型厂商的上游:你只用它的一个 base_url 和一个密钥,就能调用几百个模型。它把各家原本不兼容的接口统一成 OpenAI 那套 /v1/chat/completions,请求体和返回结构基本一致,切换模型通常只改一个字符串。
这一层抽象对一人公司最大的价值不是省钱,是「不锁死」。模型迭代的速度远超任何人的规划——这个月最划算的模型下个月可能就被超越了。如果代码里硬编码了某家的 SDK,换模型就是一次重构;走 OpenRouter 的话,改配置就行,甚至可以同时跑两个模型做 A/B,看谁在你自己的样本上表现更好。
计费上它是转售模式:按各家的 token 单价结算,另收一点服务费,余额以 credits 形式预充值。它还有一个实用功能是可以给单个 key 设消费上限——给外包、给客户做 demo、给自动化脚本单独发一个限额 key,不用担心哪天失控烧掉一笔钱。
路由能力值得单独说。除了手动指定模型,它可以按价格、按延迟、按「某个任务上表现最好的模型」自动选。做批量任务时开自动路由,往往比自己挑一个模型划算。
免费额度与计费
带 `:free` 后缀的模型完全免费,但有每日请求量和速率限制,适合试功能、跑测试。付费模型按 token 计费,需要先充值 credits,可以在后台给每个 key 单独设消费上限。
能拿它做什么
- 原型期横向对比:同一批样本跑五六个模型,挑最合适的再谈成本
- 避免锁死:代码只认 OpenAI 兼容接口,随时换供应商
- 限额分发:给客户/外包发一个设了上限的 key,账单可控
- 兜底切换:主用模型限流时自动落到备选,不用改代码
怎么接进去
- 注册后在 Keys 页面生成一个 API key,建议当场设一个消费上限
- 把应用的 base_url 改成 https://openrouter.ai/api/v1,api_key 换成刚生成的
- 模型名填厂商全名,比如 anthropic/claude-3.5-sonnet、qwen/qwen-2.5-72b-instruct
- 想白嫖测试就先用带 :free 后缀的模型,跑通了再换付费的
坑在哪
它是中间商,多一层就意味着多一个故障点和一点加价;对延迟敏感、量又大的线上业务,稳定之后通常会切回厂商直连。另外不同模型的上下文长度、工具调用支持程度并不完全一致,「一次接入到处可用」这个承诺在边缘功能上会打折扣——涉及 function calling、结构化输出时,一定要拿自己真实的请求压一遍。
有免费额度模型。做原型期用它换模型最省事,不用每家都接一遍。