Einheitliche Preise
Vergleichen Sie aktuelle regionale Ein- und Ausgabepreise im Live-Katalog. Rabatte hängen von Modell und Region ab. OpenAI-kompatibles Gateway — 767+ Modelle (DeepSeek, Qwen, Hunyuan, GLM, Kimi, GPT, Claude, Gemini, Grok). Live-Preise, Smart Routing, 10-Sprachen-Compliance.
Mitgliederrabatt gilt nur für chinesische/inländische Modelle. GPT & Claude werden zum Listenpreis +5 % berechnet.
Architektur-Leitfaden & FAQ
- Wie löst das Unified Token Gateway die Fragmentierung von LLM-Anbietern? — Eine OpenAI-kompatible API leitet zu den kostengünstigsten oder latenzärmsten Upstream-Clustern über Qwen, DeepSeek, Hunyuan und mehr.
- Was ist die Base-URL für die Integration? — Nutzen Sie ein beliebiges OpenAI-SDK mit base_url auf unser Gateway und Ihrem Dashboard-Geheimschlüssel. Abrechnung pro 1M Tokens zum Listenpreis.
- Reduzieren Caching und Geo-Routing die Kosten? — Bei berechtigten wiederholten Anfragen kann Caching die Kosten senken. Route, gemessene Nutzung und tatsächliche Gebühr stehen im Live-Katalog und im Anfragebeleg.
- Können Admins automatisierte Preispipelines überschreiben? — Ja — die Admin-Konsole unterstützt manuelle Preisobergrenzen und Modell-Overrides für Enterprise-Kontingente.