Tarification unifiée

Comparez les prix régionaux actuels d’entrée et de sortie dans le catalogue en direct. Les remises dépendent du modèle et de la région. Passerelle compatible OpenAI — 767+ modèles (DeepSeek, Qwen, Hunyuan, GLM, Kimi, GPT, Claude, Gemini, Grok). Tarifs en direct, routage intelligent, conformité 10 langues.

La remise membre s'applique uniquement aux modèles chinois/domestiques. GPT et Claude facturés au tarif catalogue +5 %.

Guide d'architecture & FAQ

  • Comment la passerelle unifiée résout-elle la fragmentation des fournisseurs LLM ? — Une API compatible OpenAI route vers les clusters amont les moins chers ou les plus rapides — Qwen, DeepSeek, Hunyuan et plus.
  • Quelle est l'URL de base pour l'intégration ? — Utilisez un SDK OpenAI avec base_url pointant vers notre passerelle et votre clé secrète du tableau de bord. Facturation au million de tokens au prix catalogue.
  • Le cache et le routage géo réduisent-ils les coûts ? — Le cache peut réduire le coût des requêtes répétées éligibles. Le catalogue en direct et le reçu de requête indiquent la route, l’usage mesuré et le montant réellement facturé.
  • Les admins peuvent-ils outrepasser les pipelines de prix automatisés ? — Oui — la console Admin prend en charge les plafonds manuels et les overrides par modèle pour les quotas entreprise.