更新日志

我们交付了什么,何时交付的。

追踪自 2026 年 3 月以来的更新。最新动态请关注 Telegram @ctimlucas

v0.3.0 Feature

新增 Claude 3.5 Sonnet & GPT-4o

通过统一端点全面支持 Anthropic Claude 3.5 Sonnet 和 OpenAI GPT-4o。使用同一个 API Key 即可访问——只需修改 model 参数。价格与上游供应商保持一致。

v0.2.8 Performance

网关延迟优化至 < 30ms

通过连接池和请求批处理减少代理开销。平均网关延迟从 85ms 降至 p50 < 30ms,p99 从 200ms 降至 65ms。上游模型响应时间不变。

v0.2.7 Feature

新增 Gemini 2.0 Pro & Qwen 3

将 Google Gemini 2.0 Pro 和阿里巴巴 Qwen 3 加入支持模型列表。Gemini 可通过同一 OpenAI 兼容端点访问。Qwen 3 提供强大的中文语言能力,价格具有竞争力。

v0.2.6 Fix

速率限制 — 按 Key 配额执行

修复了 API Key 速率限制全局执行而非按 Key 独立执行的问题。现在每个 Key 拥有独立的 Token 配额和请求速率计数器。防止单一用户耗尽其他用户的额度。

v0.2.5 Feature

用量仪表盘与 Token 分析

上线自助用量仪表盘。查看实时 Token 消耗、按模型成本分解、日/周/月趋势图,以及用量明细。支持导出 CSV 用于会计用途。

v0.2.4 Feature

上游故障自动容灾

当上游模型供应商发生故障时,网关现在自动使用配置的备用模型重试。用户可以为每个 API Key 设置备用偏好,控制故障时使用哪个备用模型。

v0.2.3 Performance

流式响应支持

为代理添加了流式支持(Server-Sent Events)。客户端现在可以逐 Token 接收模型响应,而不是等待完整响应。显著降低了长输出的感知延迟。

v0.2.2 Fix

Token 计数精度提升

修正了多字节字符集(中文、日文、韩文、emoji、特殊 Unicode)报告的与实际用量之间的 Token 计数差异。现在使用与上游供应商相同的分词器。计费精度提升至 0.1% 以内。

v0.2.0 Feature

多 Key 管理与轮换

用户现在可以从仪表盘创建、管理和轮换多个 API Key。每个 Key 拥有独立的速率限制、模型访问权限和用量配额。适用于团队环境和服务隔离。

v0.1.9 Feature

新增 DeepSeek V3 & GLM-4

扩展模型目录,新增 DeepSeek V3(GPT-4 的高性价比替代方案)和智谱 GLM-4(强大的多语言支持)。两个模型均可通过标准 OpenAI 兼容端点访问。

v0.1.8 Performance

连接保活与 HTTP/2 支持

网关升级为支持 HTTP/2 多路复用和与上游供应商的持久连接。对于突发请求模式,连接建立开销减少了 60%。

v0.1.6 Fix

错误响应标准化

所有错误响应现在一致遵循 OpenAI 错误格式,无论上游供应商是谁。使用官方 OpenAI SDK 的客户端不再需要为非 OpenAI 模型编写特殊错误处理。

v0.1.4 Feature

Early Access 上线 — OpenAI & Claude 模型

CTIM AI 网关以 Early Access 形式上线。初始支持 OpenAI(GPT-4、GPT-3.5)和 Anthropic(Claude 3 Opus/Sonnet/Haiku)模型,通过单一统一端点访问。OpenAI 兼容 API,零代码修改即可使用。

v0.1.0 Internal

网关核心基础设施构建完成

使用 Go 实现核心代理层。功能包括请求路由、响应流式处理、Token 计数和基本速率限制。与种子用户进行内部测试。

想体验最新功能?

申请 Early Access →