Einheitliche Preise

Vergleichen Sie aktuelle regionale Ein- und Ausgabepreise im Live-Katalog. Rabatte hängen von Modell und Region ab. OpenAI-kompatibles Gateway — 767+ Modelle (DeepSeek, Qwen, Hunyuan, GLM, Kimi, GPT, Claude, Gemini, Grok). Live-Preise, Smart Routing, 10-Sprachen-Compliance.

Mitgliederrabatt gilt nur für chinesische/inländische Modelle. GPT & Claude werden zum Listenpreis +5 % berechnet.

Architektur-Leitfaden & FAQ

  • Wie löst das Unified Token Gateway die Fragmentierung von LLM-Anbietern? — Eine OpenAI-kompatible API leitet zu den kostengünstigsten oder latenzärmsten Upstream-Clustern über Qwen, DeepSeek, Hunyuan und mehr.
  • Was ist die Base-URL für die Integration? — Nutzen Sie ein beliebiges OpenAI-SDK mit base_url auf unser Gateway und Ihrem Dashboard-Geheimschlüssel. Abrechnung pro 1M Tokens zum Listenpreis.
  • Reduzieren Caching und Geo-Routing die Kosten? — Bei berechtigten wiederholten Anfragen kann Caching die Kosten senken. Route, gemessene Nutzung und tatsächliche Gebühr stehen im Live-Katalog und im Anfragebeleg.
  • Können Admins automatisierte Preispipelines überschreiben? — Ja — die Admin-Konsole unterstützt manuelle Preisobergrenzen und Modell-Overrides für Enterprise-Kontingente.