La puissance d'un grand modèle de langage, d'un moteur d'embeddings et d'un reranker — au même endroit, sous droit français, sans que vos données ne quittent jamais le territoire.
# votre client OpenAI, pointé vers 3GK : deux paramètres from openai import OpenAI client = OpenAI( base_url="https://ai.3gks.cloud/v1", api_key="sk-3gk-..." ) response = client.chat.completions.create( model="3gk-llm", messages=[{"role": "user", "content": "Bonjour !"}] )
Un choix simple et assumé : servir un seul modèle de langage, le meilleur de sa catégorie, plutôt qu'un catalogue dispersé. Un modèle souverain à poids ouverts, retenu pour trois raisons.
Sur les grands benchmarks de code, il dépasse des modèles open-source bien plus lourds de la génération précédente. Il excelle en production : compréhension de documents, extraction structurée, recherche, raisonnement multilingue.
Modèle à poids ouverts (licence Apache 2.0). 3GK détient et opère le modèle sur sa propre infrastructure : personne ne peut le désactiver à distance, le restreindre, ni le retirer du marché.
L'écosystème des modèles ouverts progresse rapidement. 3GK évaluera les versions plus performantes publiées en poids ouverts et fera évoluer le service — sans rupture pour vous, l'API restant stable.
En juin 2026, deux modèles propriétaires de premier plan ont été rendus indisponibles en quelques heures, pour l'ensemble de leurs utilisateurs dans le monde, sur directive d'une autorité étatique étrangère. Des clients en production se sont retrouvés sans service, sans préavis ni recours. Un modèle à poids ouverts servi sur une infrastructure souveraine vous met structurellement à l'abri de ce risque.
Spécifications techniques — modèle actuellement servi : Qwen3.6-27B quantifié FP8 (famille Qwen), poids ouverts sous licence Apache 2.0. Les alias 3gk-llm, 3gk-embed et 3gk-rerank sont stables : une mise à niveau du modèle ne demande aucun changement de code.
3GK ne fournit pas seulement un « chat ». L'offre couvre toute la chaîne technique pour interroger vos propres documents en langage naturel — un pipeline RAG (Retrieval-Augmented Generation) — chez un seul fournisseur français.
Chaque document devient une représentation vectorielle qui capture son sens. Vos contenus deviennent « cherchables » par similarité, au-delà du mot-clé.
Parmi les documents candidats, le reranker replace les plus pertinents en tête. L'étape qui fait passer un résultat « correct » à « précis ».
À partir des documents pertinents, le modèle rédige la réponse, en extrait l'information structurée, ou produit une synthèse.
Une société dispose de milliers de documents internes — contrats, comptes-rendus, fiches techniques. Ses équipes posent une question en langage naturel : les embeddings identifient les documents proches, le reranking sélectionne les plus pertinents, le LLM rédige une réponse sourcée — ou en extrait les données utiles (JSON, tableau…). Sans qu'aucun document ne quitte l'infrastructure souveraine.
Vous n'avez pas à assembler trois prestataires aux régimes juridiques différents : tout au même endroit, sous le même cadre de conformité, une seule facture.
La plupart des API d'IA reposent sur des infrastructures soumises à un droit extra-européen. Vos prompts, vos documents, vos données clients y transitent — et y sont parfois conservés. L'approche 3GK est l'inverse, par construction.
Les modèles tournent sur du matériel GPU que 3GK possède et opère, colocalisé dans un datacenter français. Vos requêtes ne sortent pas du territoire.
Vos données ne servent ni à entraîner ni à affiner aucun modèle, et ne sont jamais cédées à des tiers. Elles vous appartiennent.
Contrat et traitement sous droit français, sans exposition à une législation extraterritoriale.
Pour les clients déjà hébergés et infogérés chez 3GK, l'IA s'ajoute à une infrastructure que vous maîtrisez déjà, avec un interlocuteur unique.
Une réponse directe aux exigences RGPD et aux contraintes de souveraineté — finance, immobilier, santé, secteur public.
Aucune infrastructure n'est à l'abri d'une maintenance ou d'un incident matériel. Si l'infrastructure principale devient indisponible, les requêtes de génération basculent automatiquement sur une infrastructure de repli, elle aussi française. Vos appels continuent de répondre, sans rien changer de votre côté.
L'API 3GK est compatible avec le standard OpenAI (/v1/chat/completions, /v1/embeddings). Si vous utilisez déjà une bibliothèque cliente OpenAI (ou tout outil qui s'y conforme), la bascule se résume à deux changements.
base_url) pour pointer vers https://ai.3gks.cloud/v1.sk-3gk-).client = OpenAI(
api_key="sk-..."
)client = OpenAI(
base_url="https://ai.3gks.cloud/v1",
api_key="sk-3gk-..."
)Pas d'entraînement sur vos données, hébergement et traitement en France, DPA disponible pour tous les clients.
Aucun contenu n'est journalisé en traitement synchrone. Les traitements asynchrones sont conservés le temps de leur restitution, puis purgés automatiquement sous 7 jours.
Authentification à deux facteurs (TOTP) disponible et activable sur votre compte.
Préfixe sk-3gk-, révocables à tout moment.
Pages numérisées, schémas, captures d'écran : le modèle multimodal lit le texte et les images pour résumer, classer ou répondre à des questions sur vos documents.
Transformez documents, HTML ou PDF en JSON fiable à grande échelle, avec des volumes d'entrée massifs facturés au juste prix.
Chatbots internes, copilotes et agents manipulant des données sensibles, sans exposition à des juridictions tierces.
Pas de carte bancaire, pas de validation manuelle. Vous recevez aussitôt un lien pour définir votre mot de passe.
Un clic sur le lien, vous choisissez votre mot de passe : votre million de tokens d'essai est déjà crédité.
Créez votre clé sk-3gk- en un clic, puis testez dans le playground intégré ou copiez le snippet dans votre terminal.
Deux approches selon votre usage — à l'usage, au token, ou un forfait mensuel en trois formules pour les volumes réguliers. Prix publics identiques pour tous, en € HT.
| Service | Modèle | Tarif |
|---|---|---|
| Génération (LLM) | 3gk-llmQwen3.6-27B-FP8 — modèle actuellement servi | 0,80 € / M entrée · 1,80 € / M sortie |
| Embeddings | 3gk-embed | 0,12 € / M entrée |
| Reranking | 3gk-rerank | 0,15 € / M (requête + documents) |
Ces tarifs s'appliquent au paiement à l'usage, hors forfait. Crédit prépayé, valable 6 mois ; prix figé à l'appel : le prix appliqué est celui en vigueur au moment exact de l'appel, sans révision rétroactive. Reranking facturé sur requête + documents, sans tokens de sortie.
Soit environ 130 millions de tokens sur une base de 4 tokens d'entrée pour 1 de sortie.
Soit environ 350 millions de tokens sur une base de 4 tokens d'entrée pour 1 de sortie.
Soit environ 650 millions de tokens sur une base de 4 tokens d'entrée pour 1 de sortie.
Le crédit d'usage est décompté aux tarifs €/M tokens affichés ci-dessus, seule référence de prix. Au-delà du crédit inclus, la consommation se poursuit sans coupure au tarif public, facturée en fin de mois, dans la limite d'un plafond de sécurité relevable sur demande ; le passage à un palier supérieur reste possible à tout moment, au prorata. Le crédit non consommé en fin de mois est perdu : il est valable sur le mois en cours et n'est pas reportable. Sans engagement, forfait nominatif non revendable. Tarifs HT.
3GK n'est pas qu'un fournisseur d'API. C'est un hébergeur et un infogérant français, éditeur de logiciels métier. Pour vous, cela signifie :
Pour l'hébergement, l'infogérance et l'IA.
Sans barrière de fuseau ni de langue.
À l'infrastructure que 3GK opère déjà pour vous.
Là où les API extra-européennes vous laissent seul face à un portail en libre-service, 3GK vous accompagne.
Une API d'IA souveraine est un service d'inférence dont l'infrastructure, l'hébergement et l'exploitation sont intégralement situés en France (ou dans l'UE), sous juridiction européenne exclusive. Chez 3GK Cloud, les modèles tournent sur du matériel GPU que 3GK possède et opère, en datacenter français, sous droit français.
À toutes les organisations soumises aux exigences du RGPD ou à des contraintes de souveraineté, en particulier la finance, l'immobilier, la santé et le secteur public : hébergement, traitement et contrat restent en France, sous droit français.
Non, jamais. L'inférence s'exécute sur notre infrastructure française, et le mécanisme de continuité bascule vers Scaleway, cloud français.
Oui. Nous implémentons les endpoints standard /v1/chat/completions et /v1/embeddings. Les SDK officiels OpenAI, LangChain, LlamaIndex fonctionnent en changeant uniquement le base_url et la clé API.
Vos prompts et réponses ne sont jamais réutilisés pour entraîner des modèles ni cédés à des tiers. En traitement synchrone, aucun contenu n'est journalisé ; les traitements asynchrones (jobs) conservent temporairement la requête et son résultat le temps de la restituer, puis sont purgés automatiquement sous 7 jours. Seules les métadonnées techniques sont conservées (horodatage, modèle appelé, volumes de tokens, latence), 6 mois au plus, puis supprimées automatiquement.
Pour la génération (3gk-llm), un repli automatique et transparent s'active vers une infrastructure souveraine de secours (Scaleway, partenaire français) : vos appels continuent de répondre, sans que vos données quittent le territoire.
Oui : chaque nouveau compte reçoit automatiquement 1 million de tokens, sans carte bancaire.
Deux formules. À l'usage : crédits prépayés valables 6 mois, décomptés au token aux prix publics figés au moment de chaque appel. Au forfait : 100, 250 ou 450 € HT par mois incluent un crédit d'usage de 130, 350 ou 650 €, décompté aux mêmes tarifs (embeddings et reranking inclus sans décompte). Au-delà du crédit, la consommation continue au tarif public et le dépassement est facturé en fin de mois, dans la limite d'un plafond de sécurité relevable sur demande. Les factures sont émises par notre outil de facturation français.
Oui, un DPA standard est disponible pour tous les clients. 3GK SOFTWARE est une société de droit français ; la chaîne de sous-traitance pour l'inférence est intégralement française.
Le modèle actuellement servi derrière l'alias 3gk-llm est Qwen3.6-27B (famille Qwen, poids ouverts sous licence Apache 2.0), quantifié FP8. Multimodal (texte, image, vidéo), il offre une fenêtre de contexte de 256k tokens et couvre 201 langues. Les alias étant stables, les mises à niveau futures ne nécessitent aucun changement de code.
Rien ne change pour vous. Le modèle est à poids ouverts (licence Apache 2.0) et 3GK l'opère sur sa propre infrastructure : personne ne peut le désactiver à distance ni le restreindre. Si 3GK fait évoluer le modèle, l'alias 3gk-llm et l'API restent stables.
Non. L'API étant compatible OpenAI et les modèles issus de familles open weights, votre code reste portable.
Parlons de votre cas d'usage et obtenez une clé d'API souveraine. Migration accompagnée, sans réécriture de code. Envie de tester d'abord ? 1 million de tokens offerts, sans carte bancaire.