LLM • AI 推理

零改動接入 OpenAI 生態

單一 API 覆蓋 /v1/chat/completions、/v1/completions、/v1/embeddings,支援 gpt-4o / o 系列與輕量模型,並提供多 Region Key、限速與審計。

  • 200K RPM預設吞吐
  • 30+ 模型可用模型
  • < 600ms全球延遲
  • 100%協定相容

核心能力

從接入、路由、限速到審計一次搞定,完全相容既有 OpenAI SDK。

🔌

API 無縫遷移

完全相容 OpenAI SDK / API,涵蓋 gpt-4o / gpt-4.1 / o1 系列與輕量模型。

  • Chat/Completions/Embeddings
  • 函式呼叫 / JSON 輸出
  • 串流回應 + SSE
🌐

多 Region Key 與路由

可為不同應用發放海外 / 本地雙線 API Key,並對 Key 細緻限速與審計。

  • Region 智能路由
  • 限速 / 審計 / 帳單報表
  • Webhook 告警與自動化
🧠

模型快速跟進

第一時間提供 gpt-4o / o1 / o3 等新模型,可配置 Fallback 與多模型策略。

  • gpt-4o / gpt-4.1 系列
  • o1 / o3 reasoning
  • 音訊、文字與嵌入

幾分鐘啟動 LLM 服務

沿用既有 SDK,配置多區域 Key、限速與審計,即刻服務全球用戶。

立即建立帳號