Vos données ne quittent jamais la France. Migrez depuis OpenAI en changeant une seule ligne de code. LLM, embeddings et reranking sur infrastructure française — vos prompts ne servent jamais à entraîner de modèles.
# une ligne. C'est tout. from openai import OpenAI client = OpenAI( base_url="https://ai.3gks.cloud/v1", api_key="sk-3gk-..." ) response = client.chat.completions.create( model="3gk-llm", messages=[{"role": "user", "content": "Bonjour !"}] )
Notre API implémente le standard OpenAI (/v1/chat/completions, /v1/embeddings). Votre code existant, vos SDK, vos frameworks fonctionnent sans modification : seule l'URL de base change.
client = OpenAI(
api_key="sk-..."
)client = OpenAI(
base_url="https://ai.3gks.cloud/v1",
api_key="sk-3gk-..."
)Modèle de langage multimodal dernière génération : rédaction, extraction de données structurées, raisonnement, agents. Fenêtre de contexte de 128k tokens, plus de 200 langues supportées.
Vectorisation de vos documents pour la recherche sémantique et le RAG. Qualité état de l'art, dimensionnement adapté aux bases vectorielles courantes (pgvector, Qdrant, Milvus…).
Réordonnancement des résultats de recherche pour maximiser la pertinence de vos pipelines RAG. Le chaînon manquant entre votre base vectorielle et votre LLM.
Actuellement servi : Qwen3.6-27B (génération, quantifié FP8), accompagné de modèles d'embedding et de reranking de la même famille — open weights, licence Apache 2.0, déployés exclusivement sur notre infrastructure.
Les alias 3gk-llm, 3gk-embed et 3gk-rerank sont stables dans le temps : lorsque nous mettons à niveau un modèle, votre intégration continue de fonctionner sans changer une ligne de code. Chaque mise à jour est annoncée dans le changelog.
Utiliser une API d'IA américaine, c'est envoyer les données de vos clients hors de l'Union européenne, sous juridiction du Cloud Act. Pour beaucoup d'entreprises françaises — santé, juridique, finance, secteur public — c'est simplement impossible. 3GK Cloud a été conçu pour répondre à cette contrainte, sans compromis sur la qualité.
L'inférence tourne sur nos propres serveurs GPU, hébergés en colocation dans un datacenter situé en France. Pas de revente d'API tierce, pas d'intermédiaire opaque.
En cas d'incident sur notre infrastructure principale, un repli automatique s'effectue vers Scaleway, cloud français. Même en mode dégradé, vos données ne quittent jamais le sol français.
Vos prompts et réponses ne sont jamais réutilisés pour entraîner des modèles ni cédés à des tiers. En traitement synchrone, aucun contenu n'est journalisé ; les traitements asynchrones sont purgés automatiquement sous quelques jours. Seules les métadonnées de facturation (horodatage, volumes de tokens, latence) sont conservées.
Société française, DPA disponible, aucun sous-traitant hors Union européenne pour l'inférence. Vos obligations de conformité deviennent simples à documenter.
Embeddings, reranking et génération sur la même API : votre pipeline de recherche augmentée reste intégralement en France, du chunk à la réponse.
Transformez documents, HTML ou PDF en JSON fiable à grande échelle, avec des volumes d'entrée massifs facturés au juste prix.
Chatbots internes, copilotes et agents manipulant des données sensibles, sans exposition à des juridictions tierces.
Pas de carte bancaire, pas de validation manuelle. Vous recevez aussitôt un lien pour définir votre mot de passe.
Un clic sur le lien, vous choisissez votre mot de passe : votre million de tokens d'essai est déjà crédité.
Créez votre clé sk-3gk- en un clic, puis testez dans le playground intégré ou copiez le snippet dans votre terminal.
Facturation au token, prix publics identiques pour tous, affichés en € HT. Pas de grille opaque, pas de négociation obligatoire, pas de coûts cachés.
| Modèle | Input | Output |
|---|---|---|
3gk-embed | 0,12 € / M tokens | — |
3gk-rerank | 0,15 € / M tokens | — |
Forfait épuisé avant la fin du mois ? Passez au palier supérieur en un clic, avec prorata immédiat. Qualité de service garantie par une régulation automatique et équitable de la charge.
Une API d'IA souveraine est un service d'inférence dont l'infrastructure, l'hébergement et l'exploitation sont intégralement situés en France (ou dans l'UE), sous juridiction européenne exclusive. Chez 3GK Cloud, les modèles tournent sur nos propres GPU en datacenter français.
Non, jamais. L'inférence s'exécute sur notre infrastructure française, et le mécanisme de continuité bascule vers Scaleway, cloud français.
Oui. Nous implémentons les endpoints standard /v1/chat/completions et /v1/embeddings. Les SDK officiels OpenAI, LangChain, LlamaIndex fonctionnent en changeant uniquement le base_url et la clé API.
Vos prompts et réponses ne sont jamais réutilisés pour entraîner des modèles ni cédés à des tiers. En traitement synchrone, aucun contenu n'est journalisé ; les traitements asynchrones (jobs) conservent temporairement la requête et son résultat le temps de la restituer, puis sont purgés automatiquement sous quelques jours. Au-delà, seules les métadonnées de facturation sont conservées : horodatage, modèle appelé, volumes de tokens, latence.
Un repli automatique et transparent s'active vers une infrastructure souveraine de secours (Scaleway, France), au même tarif.
Oui : chaque nouveau compte reçoit automatiquement 1 million de tokens, sans carte bancaire.
Au token consommé, avec des prix publics identiques pour tous. Les prix applicables sont figés au moment de chaque appel. Les factures sont émises par notre outil de facturation français, TVA comprise.
Oui, un DPA standard est disponible pour tous les clients. 3GK SOFTWARE est une société de droit français ; la chaîne de sous-traitance pour l'inférence est intégralement française.
Le modèle actuellement servi derrière l'alias 3gk-llm est Qwen3.6-27B (open weights, licence Apache 2.0), quantifié FP8. Les alias étant stables, les mises à niveau futures ne nécessitent aucun changement de code.
Non. L'API étant compatible OpenAI et les modèles issus de familles open weights, votre code reste portable.
1 million de tokens offerts. Pas de carte bancaire. Pas d'engagement. Juste une clé API et une infrastructure française qui répond.