Fiore all’occhiello · la punta di diamante IA

La Sua IA. Le Sue chiavi.
Funziona offline.

L’amministratore sceglie il motore. Modelli locali nativi di default, che girano anche con Internet staccato. La Sua chiave cloud quando vuole più potenza, con ripiego automatico sul nativo nell’istante in cui il cloud cade. L’intelligenza vive nel Suo edificio, alle Sue condizioni.

Nativo di default · la Sua chiave opzionale · ripiego sempre attivo

Il problema dell’affitto

L’intelligenza in affitto può essere spenta.

Quasi ogni funzione IA che ha visto è un contratto da inquilino: gira sui server di qualcun altro, ai prezzi di qualcun altro, raggiungibile solo finché la linea regge. Un rincaro, una chiave revocata, un’interruzione o un confine: basta questo. Possieda il motore e niente di tutto ciò può raggiungerLa.

IA in affitto
  • I loro prezzi, cambiano senza di Lei
  • La loro chiave, revocabile in ogni momento
  • I loro server, i Suoi dati laggiù
  • Cade la linea? Tutto si ferma
IA di proprietà
  • Nessun contatore, le chiamate native sono gratis
  • Le Sue chiavi, cifrate, con tetto, Sue
  • I Suoi server, i dati non escono mai
  • Cade la linea? Continua a pensare

Perché possederla

L’intelligenza vive nel Suo edificio, alle Sue condizioni.

Sicura in air-gap

Dietro una DMZ o del tutto isolata dalla rete, l’IA funziona lo stesso. I Suoi dati non lasciano mai la stanza in cui si trovano.

Zero bollette di token

I modelli nativi non costano nulla per chiamata. Usi l’IA quanto vuole senza tenere d’occhio un contatore.

Un’impostazione, ovunque

Scelga il motore una volta sola nelle impostazioni globali. Ogni funzione che usa l’IA lo eredita. Nessun cablaggio, nessuna ripetizione.

Un’impostazione, ovunque

Un interruttore. Nativo di default, la Sua chiave quando vuole.

Scelga il motore una volta nelle impostazioni globali e ogni funzione lo eredita, nessun cablaggio, nessuna ripetizione. Lo punti su un provider cloud con la Sua chiave per più potenza, e nell’istante in cui quella chiave tocca il tetto o la linea cade, ripiega sul nativo. Nessuno viene svegliato di notte.

Impostazioni globali · motore IA

Ogni funzione IA eredita l’impostazione:

Riscrittura nativo Chatbot nativo Percorsi nativo RAG nativo Controllo spam nativo · bloccato
Il nativo è l’impostazione di default, sempre disponibile, sempre gratis.

L’impostazione reale

A valle

Tutto ciò che sta a valle si limita a chiamarlo.

Riscrittura, traduzione, chatbot, percorsi, testi di campagna, RAG: nessuno sa né si cura di quale motore ci sia dietro l’unica interfaccia. Cambia il motore e tutti seguono, insieme, all’istante.

un’interfaccia

La guardia che non telefona mai a casa

Ogni messaggio controllato. Lo spam segnalato, non bloccato.

Controllare lo spam è l’unico compito troppo importante per esternalizzarlo. Gira in nativo, sul percorso critico dei messaggi: fastText e regole controllano ogni messaggio in circa un decimo di millisecondo, segnalando ciò che sembra spam senza mai bloccare un invio né fare una chiamata di rete.

in arrivo «Il tuo OTP è 4821» «VINCI un premio GRATIS $$$, clicca subito!!» «Ordine n. 1024 spedito 🎉»
controllo spam nativo ~0,1 ms · nessun salto di rete
passa OTP · consegnato Ordine · consegnato segnalato come spam «VINCI un premio GRATIS…» · segnalato, non bloccato

Segnalare, non bloccare: l’ultima parola resta a Lei, e il controllo non lascia mai la macchina.

Sotto il cofano

Per l’ingegnere presente.

Presente, non protagonista: i dettagli che un valutatore tecnico vorrà confermare.

Un’unica interfaccia interna, compatibile con OpenAI

Costruita sul formato /v1/chat-completions, così nativo, OpenAI e la maggior parte dei provider passano dallo stesso contratto. Un adattatore in più copre Anthropic.

Gli embedding sono un’impostazione a parte

Il modello di embedding si sceglie indipendentemente dal modello di chat: cambia l’uno senza toccare l’altro.

Lo spam è nativo, sempre

fastText e regole, sul percorso critico, segnalare non bloccare. Mai un LLM, mai un salto di rete.

Le chiavi sono cifrate a riposo

Le chiavi di terze parti sono cifrate, oscurate nei log e limitate. Imposta un tetto di costo rigido per motore: raggiunto, ripiega sul nativo.

Di supporto, non autonoma

Le campagne restano approvate da una persona. Le risposte RAG portano una barriera «non è nella documentazione» invece di inventare.

Gira su hardware comune

Il nativo è servito tramite llama.cpp / Ollama (per es. Phi-4-mini) su semplice CPU: pensato per offline, edge e macchine a bassa concorrenza.

Prima che lo chieda

Che hardware serve all’IA nativa?

Il nativo gira su hardware server comune: nessuna farm di GPU per i compiti di supporto (riscrittura, traduzione, chatbot, spam). Le indicazioni di dimensionamento sono nella documentazione della piattaforma.

Quali provider cloud posso usare?

Qualsiasi provider compatibile con OpenAI tramite l’interfaccia standard, più Anthropic tramite il suo adattatore. La chiave la porta Lei; mantiene il controllo dell’account e della spesa.

Cosa succede quando una chiave raggiunge il tetto di costo?

Il motore ripiega sul nativo automaticamente. La funzione continua a lavorare. Ottiene i Suoi dati, mai una schermata rotta.

L’IA può far trapelare i miei dati a un fornitore?

In nativo, nulla lascia i Suoi server. In cloud, esce solo ciò che sceglie di inviare, sotto il Suo account, e può lavorare del tutto in nativo se non lo vuole mai.

Possiedi l’intelligenza.

La Sua IA, le Sue chiavi, su server che sono Suoi, che continua a pensare a mondo spento.