🇫🇷 API d'inférence · compatible OpenAI

L'IA souveraine, hébergée en France.

La puissance d'un grand modèle de langage, d'un moteur d'embeddings et d'un reranker — au même endroit, sous droit français, sans que vos données ne quittent jamais le territoire.

Sans carte bancaire
# votre client OpenAI, pointé vers 3GK : deux paramètres
from openai import OpenAI

client = OpenAI(
    base_url="https://ai.3gks.cloud/v1",
    api_key="sk-3gk-..."
)

response = client.chat.completions.create(
    model="3gk-llm",
    messages=[{"role": "user", "content": "Bonjour !"}]
)
🇫🇷
Hébergé en FranceInférence sur notre propre infrastructure GPU, en datacenter français
🔒
Confidentialité par défautVos prompts ne sont jamais réutilisés pour entraîner des modèles ni cédés à des tiers
🔁
Compatible OpenAISDK officiels, LangChain, LlamaIndex : tout fonctionne tel quel
🧾
Facturation françaiseFactures conformes, TVA française, support en français

Un grand modèle souverain à poids ouverts

Un choix simple et assumé : servir un seul modèle de langage, le meilleur de sa catégorie, plutôt qu'un catalogue dispersé. Un modèle souverain à poids ouverts, retenu pour trois raisons.

2.0Licence Apache · ouvert
201Langues
256kTokens de contexte
Texte · image · vidéo

De tout premier plan

Sur les grands benchmarks de code, il dépasse des modèles open-source bien plus lourds de la génération précédente. Il excelle en production : compréhension de documents, extraction structurée, recherche, raisonnement multilingue.

Accessible et pérenne

Modèle à poids ouverts (licence Apache 2.0). 3GK détient et opère le modèle sur sa propre infrastructure : personne ne peut le désactiver à distance, le restreindre, ni le retirer du marché.

Il évolue

L'écosystème des modèles ouverts progresse rapidement. 3GK évaluera les versions plus performantes publiées en poids ouverts et fera évoluer le service — sans rupture pour vous, l'API restant stable.

Pourquoi c'est décisif

En juin 2026, deux modèles propriétaires de premier plan ont été rendus indisponibles en quelques heures, pour l'ensemble de leurs utilisateurs dans le monde, sur directive d'une autorité étatique étrangère. Des clients en production se sont retrouvés sans service, sans préavis ni recours. Un modèle à poids ouverts servi sur une infrastructure souveraine vous met structurellement à l'abri de ce risque.

Spécifications techniques — modèle actuellement servi : Qwen3.6-27B quantifié FP8 (famille Qwen), poids ouverts sous licence Apache 2.0. Les alias 3gk-llm, 3gk-embed et 3gk-rerank sont stables : une mise à niveau du modèle ne demande aucun changement de code.

Une chaîne RAG souveraine, complète

3GK ne fournit pas seulement un « chat ». L'offre couvre toute la chaîne technique pour interroger vos propres documents en langage naturel — un pipeline RAG (Retrieval-Augmented Generation) — chez un seul fournisseur français.

01

Embeddings 3gk-embed

Chaque document devient une représentation vectorielle qui capture son sens. Vos contenus deviennent « cherchables » par similarité, au-delà du mot-clé.

02

Reranking 3gk-rerank

Parmi les documents candidats, le reranker replace les plus pertinents en tête. L'étape qui fait passer un résultat « correct » à « précis ».

03

LLM 3gk-llm

À partir des documents pertinents, le modèle rédige la réponse, en extrait l'information structurée, ou produit une synthèse.

Exemple concret

Une société dispose de milliers de documents internes — contrats, comptes-rendus, fiches techniques. Ses équipes posent une question en langage naturel : les embeddings identifient les documents proches, le reranking sélectionne les plus pertinents, le LLM rédige une réponse sourcée — ou en extrait les données utiles (JSON, tableau…). Sans qu'aucun document ne quitte l'infrastructure souveraine.

Vous n'avez pas à assembler trois prestataires aux régimes juridiques différents : tout au même endroit, sous le même cadre de conformité, une seule facture.

La souveraineté, vraiment

La plupart des API d'IA reposent sur des infrastructures soumises à un droit extra-européen. Vos prompts, vos documents, vos données clients y transitent — et y sont parfois conservés. L'approche 3GK est l'inverse, par construction.

01Hébergement intégralement français

Les modèles tournent sur du matériel GPU que 3GK possède et opère, colocalisé dans un datacenter français. Vos requêtes ne sortent pas du territoire.

02Aucun entraînement sur vos données

Vos données ne servent ni à entraîner ni à affiner aucun modèle, et ne sont jamais cédées à des tiers. Elles vous appartiennent.

03Droit français

Contrat et traitement sous droit français, sans exposition à une législation extraterritoriale.

04Intégration native à l'écosystème 3GK

Pour les clients déjà hébergés et infogérés chez 3GK, l'IA s'ajoute à une infrastructure que vous maîtrisez déjà, avec un interlocuteur unique.

Secteurs sensibles

Une réponse directe aux exigences RGPD et aux contraintes de souveraineté — finance, immobilier, santé, secteur public.

Continuité de service

Une bascule automatique, sans quitter la France

Aucune infrastructure n'est à l'abri d'une maintenance ou d'un incident matériel. Si l'infrastructure principale devient indisponible, les requêtes de génération basculent automatiquement sur une infrastructure de repli, elle aussi française. Vos appels continuent de répondre, sans rien changer de votre côté.

NominalInfrastructure GPU 3GKDatacenter français
RepliPartenaire français (Scaleway)Sol français, même conformité

Une migration sans friction

L'API 3GK est compatible avec le standard OpenAI (/v1/chat/completions, /v1/embeddings). Si vous utilisez déjà une bibliothèque cliente OpenAI (ou tout outil qui s'y conforme), la bascule se résume à deux changements.

  1. Changer l'URL de base (base_url) pour pointer vers https://ai.3gks.cloud/v1.
  2. Remplacer votre clé d'API par une clé 3GK (préfixe sk-3gk-).
Avant
client = OpenAI(
    api_key="sk-..."
)
Après
client = OpenAI(
    base_url="https://ai.3gks.cloud/v1",
    api_key="sk-3gk-..."
)
Aucune réécriture de code applicatif : SDK officiels, LangChain, LlamaIndex et vos frameworks fonctionnent tels quels. Si votre code parle à OpenAI, il parle déjà à 3GK Cloud.

La conformité, intégrée

RGPD by design

Pas d'entraînement sur vos données, hébergement et traitement en France, DPA disponible pour tous les clients.

Rétention maîtrisée

Aucun contenu n'est journalisé en traitement synchrone. Les traitements asynchrones sont conservés le temps de leur restitution, puis purgés automatiquement sous 7 jours.

Authentification renforcée

Authentification à deux facteurs (TOTP) disponible et activable sur votre compte.

Clés d'API dédiées

Préfixe sk-3gk-, révocables à tout moment.

Conçu pour vos workloads de production

Compréhension de documents

Pages numérisées, schémas, captures d'écran : le modèle multimodal lit le texte et les images pour résumer, classer ou répondre à des questions sur vos documents.

Extraction de données structurées

Transformez documents, HTML ou PDF en JSON fiable à grande échelle, avec des volumes d'entrée massifs facturés au juste prix.

Assistants & agents métiers

Chatbots internes, copilotes et agents manipulant des données sensibles, sans exposition à des juridictions tierces.

De l'inscription au premier token en quelques minutes

01Renseignez votre email

Pas de carte bancaire, pas de validation manuelle. Vous recevez aussitôt un lien pour définir votre mot de passe.

02Activez votre compte

Un clic sur le lien, vous choisissez votre mot de passe : votre million de tokens d'essai est déjà crédité.

03Générez votre premier token

Créez votre clé sk-3gk- en un clic, puis testez dans le playground intégré ou copiez le snippet dans votre terminal.

Une tarification transparente, au plus juste

Deux approches selon votre usage — à l'usage, au token, ou un forfait mensuel en trois formules pour les volumes réguliers. Prix publics identiques pour tous, en € HT.

A

À l'usage

Au token · prépayé · sans abonnement
Démarrage & volumes variables
ServiceModèleTarif
Génération (LLM)3gk-llmQwen3.6-27B-FP8 — modèle actuellement servi0,80 € / M entrée · 1,80 € / M sortie
Embeddings3gk-embed0,12 € / M entrée
Reranking3gk-rerank0,15 € / M (requête + documents)

Ces tarifs s'appliquent au paiement à l'usage, hors forfait. Crédit prépayé, valable 6 mois ; prix figé à l'appel : le prix appliqué est celui en vigueur au moment exact de l'appel, sans révision rétroactive. Reranking facturé sur requête + documents, sans tokens de sortie.

ou
B

Forfaits mensuels

Trois formules · usage régulier
Sans engagement
Essentiel
+30 %
100 € / mois HT
  • 130 € de crédit d'usage mensuel
  • Embeddings et reranking inclus, sans décompte du crédit
  • Alertes email à 80 % et 100 % de consommation
  • Crédit valable sur le mois en cours, non reportable

Soit environ 130 millions de tokens sur une base de 4 tokens d'entrée pour 1 de sortie.

Volume
+44 %
450 € / mois HT
  • 650 € de crédit d'usage mensuel
  • Embeddings et reranking inclus, sans décompte du crédit
  • Alertes email à 80 % et 100 % de consommation
  • Crédit valable sur le mois en cours, non reportable

Soit environ 650 millions de tokens sur une base de 4 tokens d'entrée pour 1 de sortie.

Le crédit d'usage est décompté aux tarifs €/M tokens affichés ci-dessus, seule référence de prix. Au-delà du crédit inclus, la consommation se poursuit sans coupure au tarif public, facturée en fin de mois, dans la limite d'un plafond de sécurité relevable sur demande ; le passage à un palier supérieur reste possible à tout moment, au prorata. Le crédit non consommé en fin de mois est perdu : il est valable sur le mois en cours et n'est pas reportable. Sans engagement, forfait nominatif non revendable. Tarifs HT.

3GK SOFTWARE, votre partenaire unique

3GK n'est pas qu'un fournisseur d'API. C'est un hébergeur et un infogérant français, éditeur de logiciels métier. Pour vous, cela signifie :

01Un interlocuteur unique

Pour l'hébergement, l'infogérance et l'IA.

02Un support humain francophone

Sans barrière de fuseau ni de langue.

03Une IA qui s'intègre nativement

À l'infrastructure que 3GK opère déjà pour vous.

Là où les API extra-européennes vous laissent seul face à un portail en libre-service, 3GK vous accompagne.

Questions fréquentes

Qu'est-ce qu'une API d'IA souveraine ?

Une API d'IA souveraine est un service d'inférence dont l'infrastructure, l'hébergement et l'exploitation sont intégralement situés en France (ou dans l'UE), sous juridiction européenne exclusive. Chez 3GK Cloud, les modèles tournent sur du matériel GPU que 3GK possède et opère, en datacenter français, sous droit français.

À quels secteurs s'adresse 3GK Cloud ?

À toutes les organisations soumises aux exigences du RGPD ou à des contraintes de souveraineté, en particulier la finance, l'immobilier, la santé et le secteur public : hébergement, traitement et contrat restent en France, sous droit français.

Mes données quittent-elles la France ?

Non, jamais. L'inférence s'exécute sur notre infrastructure française, et le mécanisme de continuité bascule vers Scaleway, cloud français.

Êtes-vous vraiment compatibles avec le SDK OpenAI ?

Oui. Nous implémentons les endpoints standard /v1/chat/completions et /v1/embeddings. Les SDK officiels OpenAI, LangChain, LlamaIndex fonctionnent en changeant uniquement le base_url et la clé API.

Enregistrez-vous mes prompts ou les réponses générées ?

Vos prompts et réponses ne sont jamais réutilisés pour entraîner des modèles ni cédés à des tiers. En traitement synchrone, aucun contenu n'est journalisé ; les traitements asynchrones (jobs) conservent temporairement la requête et son résultat le temps de la restituer, puis sont purgés automatiquement sous 7 jours. Seules les métadonnées techniques sont conservées (horodatage, modèle appelé, volumes de tokens, latence), 6 mois au plus, puis supprimées automatiquement.

Que se passe-t-il en cas de panne de votre infrastructure ?

Pour la génération (3gk-llm), un repli automatique et transparent s'active vers une infrastructure souveraine de secours (Scaleway, partenaire français) : vos appels continuent de répondre, sans que vos données quittent le territoire.

Puis-je essayer gratuitement ?

Oui : chaque nouveau compte reçoit automatiquement 1 million de tokens, sans carte bancaire.

Comment fonctionne la facturation ?

Deux formules. À l'usage : crédits prépayés valables 6 mois, décomptés au token aux prix publics figés au moment de chaque appel. Au forfait : 100, 250 ou 450 € HT par mois incluent un crédit d'usage de 130, 350 ou 650 €, décompté aux mêmes tarifs (embeddings et reranking inclus sans décompte). Au-delà du crédit, la consommation continue au tarif public et le dépassement est facturé en fin de mois, dans la limite d'un plafond de sécurité relevable sur demande. Les factures sont émises par notre outil de facturation français.

Proposez-vous un DPA ?

Oui, un DPA standard est disponible pour tous les clients. 3GK SOFTWARE est une société de droit français ; la chaîne de sous-traitance pour l'inférence est intégralement française.

Quel modèle d'IA servez-vous exactement ?

Le modèle actuellement servi derrière l'alias 3gk-llm est Qwen3.6-27B (famille Qwen, poids ouverts sous licence Apache 2.0), quantifié FP8. Multimodal (texte, image, vidéo), il offre une fenêtre de contexte de 256k tokens et couvre 201 langues. Les alias étant stables, les mises à niveau futures ne nécessitent aucun changement de code.

Que se passe-t-il si le modèle est retiré du marché ?

Rien ne change pour vous. Le modèle est à poids ouverts (licence Apache 2.0) et 3GK l'opère sur sa propre infrastructure : personne ne peut le désactiver à distance ni le restreindre. Si 3GK fait évoluer le modèle, l'alias 3gk-llm et l'API restent stables.

Suis-je enfermé chez vous ?

Non. L'API étant compatible OpenAI et les modèles issus de familles open weights, votre code reste portable.

Reprenez le contrôle de votre IA.

Parlons de votre cas d'usage et obtenez une clé d'API souveraine. Migration accompagnée, sans réécriture de code. Envie de tester d'abord ? 1 million de tokens offerts, sans carte bancaire.