Tarification unifiée
Comparez les prix régionaux actuels d’entrée et de sortie dans le catalogue en direct. Les remises dépendent du modèle et de la région. Passerelle compatible OpenAI — 767+ modèles (DeepSeek, Qwen, Hunyuan, GLM, Kimi, GPT, Claude, Gemini, Grok). Tarifs en direct, routage intelligent, conformité 10 langues.
La remise membre s'applique uniquement aux modèles chinois/domestiques. GPT et Claude facturés au tarif catalogue +5 %.
Guide d'architecture & FAQ
- Comment la passerelle unifiée résout-elle la fragmentation des fournisseurs LLM ? — Une API compatible OpenAI route vers les clusters amont les moins chers ou les plus rapides — Qwen, DeepSeek, Hunyuan et plus.
- Quelle est l'URL de base pour l'intégration ? — Utilisez un SDK OpenAI avec base_url pointant vers notre passerelle et votre clé secrète du tableau de bord. Facturation au million de tokens au prix catalogue.
- Le cache et le routage géo réduisent-ils les coûts ? — Le cache peut réduire le coût des requêtes répétées éligibles. Le catalogue en direct et le reçu de requête indiquent la route, l’usage mesuré et le montant réellement facturé.
- Les admins peuvent-ils outrepasser les pipelines de prix automatisés ? — Oui — la console Admin prend en charge les plafonds manuels et les overrides par modèle pour les quotas entreprise.