Sari la conținut
Toate articolele
Private AI

„Datele rămân în interior.” Desenează săgețile înainte să crezi asta.

„În interior” nu este o proprietate a unui produs. Este o proprietate a unei diagrame. Se desenează traseul complet al unei cereri, se marchează fiecare săgeată care trece perimetrul, iar propoziția de marketing devine o afirmație verificabilă.

De Bastion, Cluj-NapocaPublicat 6 min de citit

„Datele rămân în interior” este cea mai ușor de scris propoziție din această piață și cea mai greu de verificat. Nu este necinstită. Este neterminată, pentru că nu spune care date, care parte a sistemului și în interiorul a ce.

Testul de zece minute

Se desenează traseul complet al unei singure cereri, de la un capăt la altul, fără a sări peste vreo etapă pentru că pare evidentă.

Utilizator, aplicație, serviciu AI, model, jurnale, stocare, backup, canal de actualizare, acces pentru suport. Apoi se marchează fiecare săgeată care iese din clădire. Numărul lor este răspunsul și este de obicei mai mare decât se aștepta cineva.

Cele șase săgeți care trec fără o decizie

  • Telemetria și raportarea erorilor, pornite dintr-o valoare implicită a unei componente pe care nu a ales-o nimeni
  • Canalul de actualizare automată, care este o conexiune outbound cu drept de scriere în sistem
  • Backup-urile, care ajung frecvent într-un loc cu alt nivel de securitate decât sistemul principal
  • Un instrument de suport remote, inactiv până în ziua în care cineva are nevoie de el și atunci complet privilegiat
  • Un serviciu de retrieval sau de embeddings găzduit în exterior, deși modelul este local
  • Jurnalele, care conțin prompturi, iar prompturile conțin documentul

O implementare poate respecta afirmația „modelul rulează local” în timp ce cinci din aceste șase săgeți arată în afară.

Cum arată, pentru comparație, un serviciu din cloud documentat

Un furnizor din cloud care își documentează corect fluxurile face acest exercițiu mai ușor, nu mai greu. Documentația Microsoft pentru modelele vândute de Azure afirmă clar că „The models are stateless: no prompts or completions are stored in the model”, iar separat că prompturile și răspunsurile pot fi stocate pentru monitorizarea abuzurilor, unde „Human reviewers assessing potential abuse can access prompts and completions data only when that data has already been flagged by the abuse monitoring system”.

Două săgeți, ambele documentate, ambele condiționate. Așa arată o afirmație precisă. O implementare locală trebuie judecată după același standard, nu după unul mai indulgent.

Cere furnizorului diagrama. Dacă răspunsul este o propoziție și nu o diagramă, propoziția nu a fost verificată.

Ce nu protejează faptul că datele rămân înăuntru

Chiar și cu toate săgețile îndreptate spre interior, informația poate ieși pe ușa din față. Lista OWASP Top 10 pentru aplicații LLM, ediția 2025, plasează dezvăluirea informațiilor sensibile pe poziția LLM02, prompt injection pe LLM01 și adaugă slăbiciunile vectorilor și ale embeddings pe LLM08.

Fiecare dintre acestea este un drum de la un document intern la cititorul greșit și niciuna nu ține cont de locul unde este găzduit modelul. Permisiunile excesive, un laptop compromis, un PDF malițios și un jurnal neprotejat supraviețuiesc mutării în interior.

Varianta afirmației care merită făcută

Formularea utilă este mai îngustă decât sloganul și poate fi verificată: traficul de inferență și procesarea modelului rămân în limita de rețea controlată de organizație, fără să fie nevoie de o conexiune outbound pentru a răspunde la o cerere.

Aceasta spune ce este controlat și lasă să se înțeleagă ce nu este. Pentru un responsabil de securitate valorează mai mult decât o promisiune absolută, pentru că este una pe care o poate verifica.

Cu Bastion

Ce schimbă Bastion

Bastion este un sistem AI privat, livrat ca un singur echipament sigilat care funcționează în clădirea ta. Un singur abonament lunar acoperă echipamentul, modelul, sistemul de operare securizat și suportul, iar nimic din ce scrie echipa ta nu părăsește clădirea.

Bastion răspunde fără să aibă nevoie de conexiune outbound la internet, deci săgeata inferenței nu trece perimetrul. Actualizările sunt semnate și instalate deliberat, nu descărcate automat, ceea ce menține canalul de actualizare o decizie, nu o valoare implicită.

Săgețile rămase aparțin clientului: cine poate folosi sistemul, ce documente poate citi, unde ajung jurnalele și cine deține backup-urile. Articolul acesta există pentru ca ele să fie decise, nu presupuse.

Întrebări la care răspunde articolul

Ce înseamnă că datele rămân în firmă?
Doar ceea ce spune arhitectura. Varianta verificabilă este mai îngustă: traficul de inferență și prelucrarea modelului rămân în limita de rețea controlată de organizație, fără conexiune outbound necesară pentru a răspunde la o cerere.
Ce componente ale unui sistem AI local pot trimite date în afară?
De obicei șase: telemetria, canalul de actualizare automată, backup-urile, un instrument de suport remote, un serviciu de retrieval sau embeddings găzduit extern și jurnalele, care conțin prompturi, iar prompturile conțin documentul.
Un model AI local elimină riscul de scurgere a datelor?
Nu. Lista OWASP 2025 plasează dezvăluirea informațiilor sensibile la LLM02 și slăbiciunile embeddings la LLM08. Permisiunile excesive, un laptop compromis, un document malițios și un jurnal neprotejat rămân valabile și în interior.

Sursele

  1. 1
  2. 2