🇫🇷 Hébergé 100 % en France

L'API d'inférence IA 100 % souveraine, compatible OpenAI

Vos données ne quittent jamais la France. Migrez depuis OpenAI en changeant une seule ligne de code. LLM, embeddings et reranking sur infrastructure française — vos prompts ne servent jamais à entraîner de modèles.

Sans carte bancaire
# une ligne. C'est tout.
from openai import OpenAI

client = OpenAI(
    base_url="https://ai.3gks.cloud/v1",
    api_key="sk-3gk-..."
)

response = client.chat.completions.create(
    model="3gk-llm",
    messages=[{"role": "user", "content": "Bonjour !"}]
)
🇫🇷
Hébergé en FranceInférence sur notre propre infrastructure GPU, en datacenter français
🔒
Confidentialité par défautVos prompts ne sont jamais réutilisés pour entraîner des modèles ni cédés à des tiers
🔁
Compatible OpenAISDK officiels, LangChain, LlamaIndex : tout fonctionne tel quel
🧾
Facturation françaiseFactures conformes, TVA française, support en français

Compatible OpenAI : migrez en une ligne, littéralement

Notre API implémente le standard OpenAI (/v1/chat/completions, /v1/embeddings). Votre code existant, vos SDK, vos frameworks fonctionnent sans modification : seule l'URL de base change.

Avant
client = OpenAI(
    api_key="sk-..."
)
Après
client = OpenAI(
    base_url="https://ai.3gks.cloud/v1",
    api_key="sk-3gk-..."
)
Aucun SDK propriétaire à installer. Aucun format à apprendre. Si votre code parle à OpenAI, il parle déjà à 3GK Cloud.

Trois modèles, une seule API

3gk-llm

Génération de texte

Modèle de langage multimodal dernière génération : rédaction, extraction de données structurées, raisonnement, agents. Fenêtre de contexte de 128k tokens, plus de 200 langues supportées.

3gk-embed

Embeddings

Vectorisation de vos documents pour la recherche sémantique et le RAG. Qualité état de l'art, dimensionnement adapté aux bases vectorielles courantes (pgvector, Qdrant, Milvus…).

3gk-rerank

Reranking

Réordonnancement des résultats de recherche pour maximiser la pertinence de vos pipelines RAG. Le chaînon manquant entre votre base vectorielle et votre LLM.

Sous le capot

Actuellement servi : Qwen3.6-27B (génération, quantifié FP8), accompagné de modèles d'embedding et de reranking de la même famille — open weights, licence Apache 2.0, déployés exclusivement sur notre infrastructure.

Les alias 3gk-llm, 3gk-embed et 3gk-rerank sont stables dans le temps : lorsque nous mettons à niveau un modèle, votre intégration continue de fonctionner sans changer une ligne de code. Chaque mise à jour est annoncée dans le changelog.

Pourquoi une API d'IA souveraine ?

Utiliser une API d'IA américaine, c'est envoyer les données de vos clients hors de l'Union européenne, sous juridiction du Cloud Act. Pour beaucoup d'entreprises françaises — santé, juridique, finance, secteur public — c'est simplement impossible. 3GK Cloud a été conçu pour répondre à cette contrainte, sans compromis sur la qualité.

01Infrastructure française

L'inférence tourne sur nos propres serveurs GPU, hébergés en colocation dans un datacenter situé en France. Pas de revente d'API tierce, pas d'intermédiaire opaque.

02Continuité souveraine

En cas d'incident sur notre infrastructure principale, un repli automatique s'effectue vers Scaleway, cloud français. Même en mode dégradé, vos données ne quittent jamais le sol français.

03Vos contenus vous appartiennent

Vos prompts et réponses ne sont jamais réutilisés pour entraîner des modèles ni cédés à des tiers. En traitement synchrone, aucun contenu n'est journalisé ; les traitements asynchrones sont purgés automatiquement sous quelques jours. Seules les métadonnées de facturation (horodatage, volumes de tokens, latence) sont conservées.

04RGPD by design

Société française, DPA disponible, aucun sous-traitant hors Union européenne pour l'inférence. Vos obligations de conformité deviennent simples à documenter.

Conçu pour vos workloads de production

RAG souverain de bout en bout

Embeddings, reranking et génération sur la même API : votre pipeline de recherche augmentée reste intégralement en France, du chunk à la réponse.

Extraction de données structurées

Transformez documents, HTML ou PDF en JSON fiable à grande échelle, avec des volumes d'entrée massifs facturés au juste prix.

Assistants & agents métiers

Chatbots internes, copilotes et agents manipulant des données sensibles, sans exposition à des juridictions tierces.

De l'inscription au premier token en quelques minutes

01Renseignez votre email

Pas de carte bancaire, pas de validation manuelle. Vous recevez aussitôt un lien pour définir votre mot de passe.

02Activez votre compte

Un clic sur le lien, vous choisissez votre mot de passe : votre million de tokens d'essai est déjà crédité.

03Générez votre premier token

Créez votre clé sk-3gk- en un clic, puis testez dans le playground intégré ou copiez le snippet dans votre terminal.

Des tarifs transparents, sans surprise

Facturation au token, prix publics identiques pour tous, affichés en € HT. Pas de grille opaque, pas de négociation obligatoire, pas de coûts cachés.

ModèleInputOutput
3gk-embed0,12 € / M tokens
3gk-rerank0,15 € / M tokens
Essentiel
100 € HT / mois
  • 130 millions de tokens LLM inclus
  • Embeddings et reranking inclus sans limite de forfait
  • Alertes email à 80 % et 100 % de consommation
Volume
450 € HT / mois
  • 650 millions de tokens LLM inclus
  • Embeddings et reranking inclus
  • Alertes de consommation

Forfait épuisé avant la fin du mois ? Passez au palier supérieur en un clic, avec prorata immédiat. Qualité de service garantie par une régulation automatique et équitable de la charge.

Questions fréquentes

Qu'est-ce qu'une API d'IA souveraine ?

Une API d'IA souveraine est un service d'inférence dont l'infrastructure, l'hébergement et l'exploitation sont intégralement situés en France (ou dans l'UE), sous juridiction européenne exclusive. Chez 3GK Cloud, les modèles tournent sur nos propres GPU en datacenter français.

Mes données quittent-elles la France ?

Non, jamais. L'inférence s'exécute sur notre infrastructure française, et le mécanisme de continuité bascule vers Scaleway, cloud français.

Êtes-vous vraiment compatibles avec le SDK OpenAI ?

Oui. Nous implémentons les endpoints standard /v1/chat/completions et /v1/embeddings. Les SDK officiels OpenAI, LangChain, LlamaIndex fonctionnent en changeant uniquement le base_url et la clé API.

Enregistrez-vous mes prompts ou les réponses générées ?

Vos prompts et réponses ne sont jamais réutilisés pour entraîner des modèles ni cédés à des tiers. En traitement synchrone, aucun contenu n'est journalisé ; les traitements asynchrones (jobs) conservent temporairement la requête et son résultat le temps de la restituer, puis sont purgés automatiquement sous quelques jours. Au-delà, seules les métadonnées de facturation sont conservées : horodatage, modèle appelé, volumes de tokens, latence.

Que se passe-t-il en cas de panne de votre infrastructure ?

Un repli automatique et transparent s'active vers une infrastructure souveraine de secours (Scaleway, France), au même tarif.

Puis-je essayer gratuitement ?

Oui : chaque nouveau compte reçoit automatiquement 1 million de tokens, sans carte bancaire.

Comment fonctionne la facturation ?

Au token consommé, avec des prix publics identiques pour tous. Les prix applicables sont figés au moment de chaque appel. Les factures sont émises par notre outil de facturation français, TVA comprise.

Proposez-vous un DPA ?

Oui, un DPA standard est disponible pour tous les clients. 3GK SOFTWARE est une société de droit français ; la chaîne de sous-traitance pour l'inférence est intégralement française.

Quel modèle d'IA servez-vous exactement ?

Le modèle actuellement servi derrière l'alias 3gk-llm est Qwen3.6-27B (open weights, licence Apache 2.0), quantifié FP8. Les alias étant stables, les mises à niveau futures ne nécessitent aucun changement de code.

Suis-je enfermé chez vous ?

Non. L'API étant compatible OpenAI et les modèles issus de familles open weights, votre code reste portable.

Votre premier token en moins de 3 minutes

1 million de tokens offerts. Pas de carte bancaire. Pas d'engagement. Juste une clé API et une infrastructure française qui répond.