DémarrerVue d'ensemble

Gateway IA souveraine 3GK

API compatible OpenAI pour exécuter des inférences LLM sur infrastructure hébergée en France. Routage prioritaire vers nos instances vLLM locales avec fallback Scaleway (Paris) en cas d'indisponibilité — aucune donnée ne quitte le territoire français.

stablev1compatible OpenAI

Présentation#pitch

La gateway expose une API REST minimale qui réplique le contrat openai.chat.completions. Les SDK officiels OpenAI (Python, Node.js) fonctionnent sans modification — il suffit de pointer base_url vers notre domaine et d'utiliser une clé sk-3gk-….

Souveraineté de bout en bout. Inférence sur GPU localisés en France (vLLM) et basculement automatique vers Scaleway Generative APIs (Paris, FR) si nécessaire. Les prompts ne transitent jamais par des fournisseurs hors UE.

Base URL#base-url

Toutes les routes publiques sont préfixées par /v1.

GEThttps://ai.3gks.cloud/v1routes : /chat/completions, /models

Prérequis#prerequis

  • Un compte client actif sur la plateforme.
  • Une clé API générée depuis votre dashboard — format sk-3gk- suivi de 48 caractères alphanumériques.
  • Un client HTTP capable de gérer les Server-Sent Events si vous utilisez le streaming.

Modèles disponibles#modeles

La plateforme expose des alias stables3gk-llm (chat), 3gk-embed (embeddings) et 3gk-rerank (reranking) — découplés des modèles sous-jacents : une montée de version ne change jamais votre intégration. La liste à jour est accessible via GET /v1/models.

Aller plus loin#aller-plus-loin