新增 Claude 3.5 Sonnet & GPT-4o
通过统一端点全面支持 Anthropic Claude 3.5 Sonnet 和 OpenAI GPT-4o。使用同一个 API Key 即可访问——只需修改 model 参数。价格与上游供应商保持一致。
我们交付了什么,何时交付的。
追踪自 2026 年 3 月以来的更新。最新动态请关注 Telegram @ctimlucas。
通过统一端点全面支持 Anthropic Claude 3.5 Sonnet 和 OpenAI GPT-4o。使用同一个 API Key 即可访问——只需修改 model 参数。价格与上游供应商保持一致。
通过连接池和请求批处理减少代理开销。平均网关延迟从 85ms 降至 p50 < 30ms,p99 从 200ms 降至 65ms。上游模型响应时间不变。
将 Google Gemini 2.0 Pro 和阿里巴巴 Qwen 3 加入支持模型列表。Gemini 可通过同一 OpenAI 兼容端点访问。Qwen 3 提供强大的中文语言能力,价格具有竞争力。
修复了 API Key 速率限制全局执行而非按 Key 独立执行的问题。现在每个 Key 拥有独立的 Token 配额和请求速率计数器。防止单一用户耗尽其他用户的额度。
上线自助用量仪表盘。查看实时 Token 消耗、按模型成本分解、日/周/月趋势图,以及用量明细。支持导出 CSV 用于会计用途。
当上游模型供应商发生故障时,网关现在自动使用配置的备用模型重试。用户可以为每个 API Key 设置备用偏好,控制故障时使用哪个备用模型。
为代理添加了流式支持(Server-Sent Events)。客户端现在可以逐 Token 接收模型响应,而不是等待完整响应。显著降低了长输出的感知延迟。
修正了多字节字符集(中文、日文、韩文、emoji、特殊 Unicode)报告的与实际用量之间的 Token 计数差异。现在使用与上游供应商相同的分词器。计费精度提升至 0.1% 以内。
用户现在可以从仪表盘创建、管理和轮换多个 API Key。每个 Key 拥有独立的速率限制、模型访问权限和用量配额。适用于团队环境和服务隔离。
扩展模型目录,新增 DeepSeek V3(GPT-4 的高性价比替代方案)和智谱 GLM-4(强大的多语言支持)。两个模型均可通过标准 OpenAI 兼容端点访问。
网关升级为支持 HTTP/2 多路复用和与上游供应商的持久连接。对于突发请求模式,连接建立开销减少了 60%。
所有错误响应现在一致遵循 OpenAI 错误格式,无论上游供应商是谁。使用官方 OpenAI SDK 的客户端不再需要为非 OpenAI 模型编写特殊错误处理。
CTIM AI 网关以 Early Access 形式上线。初始支持 OpenAI(GPT-4、GPT-3.5)和 Anthropic(Claude 3 Opus/Sonnet/Haiku)模型,通过单一统一端点访问。OpenAI 兼容 API,零代码修改即可使用。
使用 Go 实现核心代理层。功能包括请求路由、响应流式处理、Token 计数和基本速率限制。与种子用户进行内部测试。
想体验最新功能?
申请 Early Access →