One endpoint. All models. Pay per token.
from openai import OpenAI # One line, access all models client = OpenAI( api_key="YOUR_API_KEY", base_url="https://api.ctimsoft.net/ai" ) # Call any model response = client.chat.completions.create( model="gpt-4o", messages=[{"role": "user", "content": "Hello"}] ) print(response.choices[0].message.content)
curl -X POST https://api.ctimsoft.net/ai/chat/completions \ -H "Authorization: Bearer YOUR_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "gpt-4o", "messages": [{"role": "user", "content": "你好"}] }'
import OpenAI from 'openai'; // Same OpenAI SDK, just change the base URL const client = new OpenAI({ apiKey: "YOUR_API_KEY", baseURL: "https://api.ctimsoft.net/ai" }); const response = await client.chat.completions.create({ model: "gpt-4o", messages: [{ role: "user", content: "你好" }] }); console.log(response.choices[0].message.content);
import anthropic # Same base_url, different SDK client = anthropic.Anthropic( api_key="YOUR_API_KEY", base_url="https://api.ctimsoft.net/ai" ) # Call Claude through the gateway message = client.messages.create( model="claude-sonnet-4-20250514", max_tokens=1024, messages=[{"role": "user", "content": "你好"}] ) print(message.content[0].text)
curl -X POST https://api.ctimsoft.net/ai/messages \ -H "x-api-key: YOUR_API_KEY" \ -H "anthropic-version: 2023-06-01" \ -H "Content-Type: application/json" \ -d '{ "model": "claude-sonnet-4-20250514", "max_tokens": 1024, "messages": [{"role": "user", "content": "你好"}] }'
import Anthropic from '@anthropic-ai/sdk'; // Same Anthropic SDK, just change the base URL const client = new Anthropic({ apiKey: "YOUR_API_KEY", baseURL: "https://api.ctimsoft.net/ai" }); const msg = await client.messages.create({ model: "claude-sonnet-4-20250514", max_tokens: 1024, messages: [{ role: "user", content: "你好" }] }); console.log(msg.content[0].text);
Supported AI Providers
Everything you need to integrate AI at scale.
OpenAI-compatible interface, all vendors plug-and-play. Change one parameter, switch any model.
No monthly fees, no subscriptions. Input/output tokens priced separately, fully transparent.
Gateway latency under 20ms. Automatic failover when models are unavailable.
Per-key rate limiting, model-level access control, usage alerts and balance management.
Real-time dashboard for token consumption, cost trends, and call logs. Filter by model, date, or user.
Website and docs in 12 languages, for developers worldwide.