← Torna al blog

12 maggio 2026 · Équipe betool

BYOK — perché è irrinunciabile nei settori regolamentati

Bring Your Own Key non è un'opzione di comodità. È l'unico modo serio per usare un LLM di terze parti in un ambiente sottoposto ad audit.

securityllmbyok

BYOK — perché è irrinunciabile nei settori regolamentati

I fornitori di AI offrono in genere due modelli di fatturazione: un pool condiviso, in cui si paga una tariffa forfettaria che copre i token, oppure una modalità BYOK, in cui fornisci la tua chiave API e paghi direttamente il tuo provider.

Nel SaaS standard, il pool condiviso è comodo. Negli ambienti regolamentati, è insostenibile.

Il problema del pool condiviso

Quando il tuo fornitore rende disponibile la tua chiave OpenAI / Anthropic / Mistral a tutti i suoi clienti tramite un'unica master key:

  1. Perdi il dettaglio contabile. Diventa impossibile dimostrare al tuo revisore esattamente quanti token hai consumato presso il provider — ricevi una fattura aggregata.
  2. Perdi la catena contrattuale. I tuoi dati transitano attraverso l'account del fornitore. Il contratto per il trattamento dei dati (DPA) con OpenAI non ti copre più direttamente.
  3. Perdi il controllo del modello. Il fornitore può passare silenziosamente dal modello A al modello B per motivi di costo. I tuoi benchmark regrediscono e non sai perché.
  4. Perdi la revoca immediata. In caso di incidente, non puoi revocare la chiave senza prima chiederlo al fornitore.

Cosa garantisce il BYOK

Con il BYOK:

  • I tuoi prompt e le tue completion transitano direttamente tra il tuo account provider e betool — non attraverso un account di terze parti condiviso.
  • Il tuo DPA con il provider resta l'unica catena contrattuale. Nessun sub-trattamento opaco.
  • La tua fatturazione è trasparente: il provider ti fattura, tu vedi ogni singola voce. betool ti fattura soltanto l'orchestrazione.
  • La tua revoca è istantanea: rigenera la chiave presso il provider e il modello diventa inaccessibile nel giro di pochi secondi.

L'opzione del modello privato (self-hosted)

Per le organizzazioni con i requisiti più stringenti (banche, difesa, sanità), persino il BYOK non basta: inviare i tuoi prompt a OpenAI o Anthropic costituisce comunque un trasferimento verso gli Stati Uniti.

La soluzione è un modello privato:

  • Ollama sulla tua GPU, per i modelli open source (Llama, Qwen, Mistral, DeepSeek).
  • vLLM su un cluster di GPU per la produzione ad alto throughput.
  • Azure OpenAI / AWS Bedrock quando disponi di un contratto di cloud privato.

I tuoi prompt non lasciano mai il tuo perimetro. La latenza è sotto il tuo controllo. La conformità è totale.

Quanto costa

Il mito è che ospitare un LLM in self-hosting costi una fortuna. In realtà, per i moderni modelli open source della classe Llama 3 / Qwen 2:

  • Un server con due GPU A100 80 GB può servire un Llama-3 70B in produzione.
  • Con un utilizzo moderato (qualche migliaio di scambi al giorno), una singola GPU A6000 è sufficiente per servire un modello da 32B con latenza inferiore al secondo.
  • Costo di ammortamento mensile: da ~2.000 a ~5.000 $ a seconda della strategia di approvvigionamento (noleggio vs. acquisto).

Rispetto a una spesa OpenAI equivalente su 12 mesi, l'investimento si ripaga in pochi mesi a volumi seri — e il ROI si ribalta del tutto se hai vincoli di sovranità che rendono OpenAI inaccettabile.

La nostra scelta

betool è BYOK-native fin dal primo giorno. Non puoi usare la piattaforma senza collegare le tue chiavi. Questo è intenzionale:

  • Il pool condiviso genera un debito di conformità che ci rifiutiamo di assumere per i nostri clienti regolamentati.
  • L'asimmetria tra "piccoli clienti" e "grandi clienti" sul tema della sovranità non è accettabile.
  • L'esperienza che vogliamo costruire — "posso vedere esattamente cosa consumo, dove e con chi" — è possibile solo con il BYOK.

Aggiunge un passaggio all'onboarding (15 minuti per recuperare una chiave dal tuo provider). È un investimento che ripaga nel tempo.