Votre IA. Vos clés.
Fonctionne hors ligne.
L’administrateur choisit le moteur. Des modèles locaux natifs par défaut, qui tournent même Internet débranché. Votre propre clé cloud quand vous voulez plus de puissance, avec bascule automatique vers le natif dès que le cloud lâche. L’intelligence vit dans vos murs, à vos conditions.
Natif par défaut · votre clé en option · bascule toujours active
Le problème de la location
Une intelligence louée peut être coupée.
Presque toutes les fonctions d’IA que vous avez vues sont un contrat de locataire : elles tournent sur les serveurs d’un autre, selon les tarifs d’un autre, accessibles seulement tant que la ligne tient. Une hausse de prix, une clé révoquée, une panne ou une frontière, il n’en faut pas plus. Possédez le moteur et rien de tout cela ne peut vous atteindre.
- Leurs tarifs, qui changent sans vous
- Leur clé, révocable à tout moment
- Leurs serveurs, vos données là-bas
- La ligne tombe ? Tout s’arrête
- Pas de compteur, les appels natifs sont gratuits
- Vos clés, chiffrées, plafonnées, à vous
- Vos serveurs, les données ne partent jamais
- La ligne tombe ? Elle continue de penser
Pourquoi la posséder
L’intelligence vit dans vos murs, à vos conditions.
Sûre en air-gap
Derrière une DMZ ou totalement coupée du réseau, l’IA fonctionne toujours. Vos données ne quittent jamais la pièce où elles se trouvent.
Zéro facture de tokens
Les modèles natifs ne coûtent rien par appel. Utilisez l’IA autant que vous voulez sans surveiller un compteur.
Un réglage, partout
Choisissez le moteur une seule fois dans les réglages globaux. Chaque fonction qui utilise l’IA en hérite. Aucun câblage, aucune répétition.
Un réglage, partout
Un seul interrupteur. Natif par défaut, votre clé quand vous le voulez.
Choisissez le moteur une fois dans les réglages globaux et chaque fonction en hérite, aucun câblage, aucune répétition. Pointez-le vers un fournisseur cloud avec votre propre clé pour plus de puissance, et dès que cette clé atteint son plafond ou que la ligne tombe, il bascule vers le natif. Personne n’est réveillé en pleine nuit.
Chaque fonction d’IA hérite du réglage :
Le réglage réel
En aval
Tout, en aval, ne fait que l’appeler.
Réécriture, traduction, chatbot, parcours, textes de campagne, RAG : aucun d’eux ne sait ni ne se soucie du moteur qui se cache derrière l’interface unique. Changez de moteur et tous suivent, ensemble, instantanément.
La garde qui ne téléphone jamais dehors
Chaque message contrôlé. Le spam signalé, pas bloqué.
Le contrôle anti-spam est le seul travail trop important pour être sous-traité. Il tourne en natif, sur le chemin critique des messages : fastText et des règles vérifient chaque message en un dixième de milliseconde environ, signalant ce qui ressemble à du spam sans jamais bloquer un envoi ni faire d’appel réseau.
Signaler, pas bloquer : vous gardez le dernier mot, et le contrôle ne quitte jamais la machine.
Sous le capot
Pour l’ingénieur dans la salle.
Présent, pas central : les détails qu’un évaluateur technique voudra vérifier.
Une interface interne unique, compatible OpenAI
Bâtie sur le format /v1/chat-completions, si bien que le natif, OpenAI et la plupart des fournisseurs passent par le même contrat. Un adaptateur en plus couvre Anthropic.
Les embeddings sont un réglage à part
Le modèle d’embeddings se choisit indépendamment du modèle de chat : changez l’un sans toucher à l’autre.
Le spam est natif, toujours
fastText et des règles, sur le chemin critique, signaler sans bloquer. Jamais de LLM, jamais de saut réseau.
Les clés sont chiffrées au repos
Les clés tierces sont chiffrées, masquées dans les journaux et plafonnées. Fixez un plafond de coût strict par moteur : une fois atteint, il bascule vers le natif.
Assistive, pas autonome
Les campagnes restent validées par un humain. Les réponses RAG portent un garde-fou « pas dans la documentation » plutôt que d’inventer.
Tourne sur du matériel standard
Le natif est servi via llama.cpp / Ollama (par ex. Phi-4-mini) sur simple CPU : conçu pour l’hors ligne, l’edge et les machines à faible concurrence.
Avant de demander
Quel matériel faut-il pour l’IA native ?
Le natif tourne sur du matériel serveur standard : aucune ferme de GPU requise pour les tâches assistives (réécriture, traduction, chatbot, spam). Les repères de dimensionnement sont dans la documentation de la plateforme.
Quels fournisseurs cloud puis-je utiliser ?
Tout fournisseur compatible OpenAI via l’interface standard, plus Anthropic via son adaptateur. Vous apportez la clé ; vous gardez le contrôle du compte et de la dépense.
Que se passe-t-il quand une clé atteint son plafond de coût ?
Le moteur bascule vers le natif automatiquement. La fonction continue de marcher. Vous obtenez vos données, jamais un écran cassé.
L’IA peut-elle divulguer mes données à un fournisseur ?
En natif, rien ne quitte vos serveurs. En cloud, seul ce que vous choisissez d’envoyer sort, sous votre propre compte, et vous pouvez tout faire en natif si vous ne voulez jamais de cela.
Possédez l’intelligence.
Votre IA, vos clés, sur des serveurs qui vous appartiennent, qui continue de penser le monde éteint.