Model de inteligență artificială chinezesc, investigat pentru posibile vulnerabilități de securitate
Un model de inteligență artificială dezvoltat de compania chineză Moonshot AI se află în centrul unei investigații interne, după ce un cercetător a susținut că sistemul poate fi manipulat pentru a furniza informații despre arme biologice, asasinate și atacuri teroriste. Modelul în cauză este Kimi-K3, iar testele efectuate de cercetătorul Peter Garrigan au evidențiat, potrivit acestuia, vulnerabilități importante ale sistemului.
Garrigan afirmă că modelul ar fi putut fi determinat să ofere informații despre dezvoltarea unor arme biologice, producerea gazului sarin și planificarea unor asasinate. De asemenea, testele ar fi indicat posibilitatea obținerii unor informații despre atacuri teroriste folosind date în timp real, dezvoltarea de malware și atacuri asupra aeronavelor.
„Ceea ce am descoperit este foarte îngrijorător”, a declarat Garrigan.
Compania a demarat o anchetă internă
Moonshot AI a lansat o investigație internă după apariția acestor rezultate și comunică direct cu cercetătorul. Compania nu a anunțat public că rezultatele cercetătorului au fost confirmate în totalitate.
Deocamdată, informațiile disponibile descriu rezultatele unor teste asupra comportamentului modelului și nu demonstrează că Kimi-K3 a fost folosit efectiv pentru producerea unei arme biologice, organizarea unui asasinat sau comiterea unui atac terorist.
Vulnerabilitatea nu ar fi specifică doar modelelor chineze
Garrigan susține că vulnerabilitatea identificată nu este neapărat specifică modelelor dezvoltate în China. Potrivit acestuia, și modelele AI americane prezintă probleme similare.
„Este un defect fundamental al tehnologiei”, a afirmat cercetătorul.
Observația este importantă deoarece discuția nu se limitează la performanțele unui singur model. Pe măsură ce sistemele AI devin mai capabile și primesc acces la instrumente, date și servicii externe, cercetătorii analizează tot mai atent modul în care acestea pot fi manipulate pentru a produce rezultate pe care dezvoltatorii încearcă să le blocheze.