一个人想同时用 GPT 做对话、Claude 处理长文档、Gemini 做多模态,听起来只是"多调几个 API",实际却是:OpenAI 要海外手机号注册、绑卡被拒;Anthropic 的 Key 等了三天才下来,区域限制一堆;Gemini 的鉴权和前两家完全不同;DeepSeek、Qwen、Kimi 各自一套 SDK,光适配层就写上千行。Cursor 在国内连 OpenAI 时断时续,Claude Code 想直连 Anthropic 又得自己搭代理。每换一个模型,就是从注册、鉴权、网络到计费的完整重来。
痛点不是"没有好模型",而是接入的摩擦力太大——账号、密钥、协议、网络、计费,每一层都在消耗开发者的时间。我们手上正好有全球网络节点和网关技术,于是决定把这些摩擦一次性打包解决:在所有模型前面加一层"智能代理层 + 统一网关",开发者只拿一个 Key,调 GPT 和调 Claude 只差一个 model 名称。这就是 Ofox。
Ofox 目前已聚合 100+ 主流大模型,包括 GPT、Claude、Gemini、DeepSeek、Qwen、GLM、Kimi、豆包、Mistral、xAI Grok 等,原生支持 OpenAI、Anthropic、Gemini 三套接入协议,开发者用现有 SDK 只改 base_url 即可接入,无需重写代码。
当前的用户画像比较集中:国内的后端工程师、AI Agent 开发者、独立开发者及小型创业团队。他们大多在做一个具体产品——AI 客服、代码助手、数据分析管线——需要在多个模型间灵活切换,但不想为每个供应商单独维护账号、密钥和适配代码。典型用法是把 Cursor、Claude Code、Cline、LangChain 等工具的 endpoint 指向 Ofox,一个 Key 打通所有模型,一份账单统一结算。
计费上我们坚持 0% 平台手续费,直接按各模型官方定价扣费,余额不过期,无订阅或月度最低消费。支付支持微信、支付宝,可开企业发票。网络层国内直连、无需科学上网,首 token 实测平均约 299ms,SLA 99.9%。数据上,prompts 和响应不落盘、不用于训练,只保留计费元数据。