Anthropic anunță că a blocat cercetări care ar fi putut ajuta la dezvoltarea de arme biologice
Anthropic anunță că a blocat cercetări care ar fi putut ajuta la dezvoltarea de arme biologiceCompania americană de inteligență artificială susține că a adăugat măsuri de protecție mai puternice în ultimele sale modele, pentru a restricționa cercetările biologice ce ar putea fi folosite și la fabricarea de arme.
Compania din spatele Claude califică utilizarea abuzivă în scopuri biologice drept unul dintre „cele mai grave riscuri” provocate de tehnologia IA. / Reuters Archive

Compania americană Anthropic a anunțat că a blocat tentativele unor actori rău-intenționați de a-i folosi modelele de inteligență artificială în scopuri ostile, cum ar fi atacuri cibernetice, acțiuni de supraveghere și cercetări ce ar fi putut duce la crearea de arme biologice.

Pe măsură ce modelele IA devin tot mai performante, atacurile cibernetice elaborate nu mai necesită competențe tehnice avansate, iar persoane izolate pot genera amenințări imposibil de conceput cu doar un an în urmă, a avertizat joi compania.

Din acest motiv, Anthropic a adăugat filtre de protecție mai riguroase în cele mai recente modele ale sale, pentru a restricționa cercetările biologice ce ar putea fi folosite și la fabricarea de armament.

„Cazurile prezentate aici nu reprezintă utilizări necorespunzătoare obișnuite, ci exemple ale celor mai remarcabile și inedite amenințări identificate până în prezent”, a precizat Anthropic în cel de-al treilea raport al său dedicat utilizării abuzive a IA, publicat din martie 2025 încoace.

Raportul include fragmente de cod dăunător și secvențe de instrucțiuni (prompturi) descoperite de companie și îndeamnă guvernele și competitorii din industrie să identifice și să prevină abuzuri similare.

„Publicăm aceste concluzii deoarece considerăm că avem responsabilitatea de a dezvălui utilizarea abuzivă a serviciilor noastre. Pe măsură ce modelele devin tot mai capabile, riscurile vor crește, cu excepția cazului în care dezvoltatorii IA și apărătorii societății acționează pentru a le face mai sigure”, a transmis compania.

Te-ar putea interesa șiTRT Română - Anthropic raportează al patrulea incident cibernetic care implică o versiune timpurie a Claude

Utilizarea abuzivă de către actori din străinătate

Raportul amănunțit al startup-ului de IA — care își pregătește listarea la bursă în această toamnă — a fost publicat la o zi după ce unul dintre cercetătorii săi și-a anunțat demisia, invocând temeri că Anthropic și rivalii săi nu acționează responsabil în dezvoltarea tehnologiei. Acesta a reluat avertismentele lansate în industrie privind riscul ca inteligența artificială să scape de sub controlul uman.

Între decembrie 2025 și august 2026, cercetătorii de la Anthropic au identificat abuzuri comise de actori diverși, de la furnizori de programe spion (spyware) și persoane motivate politic, până la grupuri susținute de state care răspândeau propagandă.

Printre constatările raportului se numără încercările unor actori neidentificați de a utiliza modelele companiei pentru cercetări ce ar fi putut conducă la arme biologice. Într-unul dintre cazuri, sistemele Anthropic au blocat o solicitare prin care se cerea asistența modelului Claude la redactarea unei cereri de finanțare științifică.

Proiectul descris în cerere implică cercetări de tip „gain-of-function” (modificări genetice ale unui organism pentru a-i crea sau spori anumite proprietăți biologice) pe virusul Chikungunya. Această cercetare vizase creșterea transmisibilității virusului și a capacității acestuia de a fenta sistemul imunitar.

Chikungunya este un virus transmis de țânțari, care provoacă simptome debilitante, cum ar fi dureri severe și febră.

Solicitarea implica o propunere de finanțare pentru cercetări care urmăreau intensificare mutațiilor, astfel încât virusul să devină tot mai periculos.

Deși astfel de cercetări ar putea fi folosite la dezvoltarea unor vaccinuri și tratamente mai bune, Anthropic a subliniat că „ar putea fi utilizate și pentru a face agentul patogen mai periculos”.

Niciunul dintre cazurile incluse în raportul Anthropic nu a implicat utilizarea modelelor sale mai noi și mai puternice din clasa Claude Fable sau Mythos, cu excepția unui singur caz de distilare ilicită — descris de companie drept „o campanie clandestină, la scară industrială, de extragere neautorizată a capacităților unui model și de replicare a acestora în altul”.

Anthropic a precizat că modelele sale mai vechi din 2025, cum ar fi Claude Opus 4 și Claude Sonnet 4.5, se aflau „mult sub pragul de la care ar fi putut ajuta în mod semnificativ un utilizator avansat să deruleze cercetări biologice periculoase”.

„Prin urmare, măsurile de protecție pentru aceste modele erau mai puțin severe, fiind concepute în principal pentru a împiedica începătorii să recreeze arme biologice cunoscute”, se arată în raport. „Însă pentru modelele de astăzi — capabile să asiste într-o serie de sarcini complexe de cercetare științifică — dovezile nu mai sunt sigure și nu mai putem oferi aceeași garanție.”

Din acest motiv, Anthropic a aplicat „filtre de protecție mai stricte, care restricționează accesul la o gamă largă de interogări privind cercetările biologice cu dublă utilizare” pe modelele mai recente, precum Claude Fable 5.

Operațiuni de influență și avertismentul privind extincția umanității

De asemenea, Anthropic a descoperit grupuri care au creat sute de conturi pe rețelele de socializare ce simulau identitatea unor persoane obișnuite, distribuind timp de o săptămână materiale care amplificau aceleași viziuni politice. Compania a detaliat nouă astfel de cazuri, provenite din zona Golfului, Asia de Sud, Africa și Europa.

Dacă rețelele de socializare pot detecta operațiunile de influență abia după ce postările încep să circule, „noi le putem identifica pe Claude încă din faza în care operațiunea este în curs de construire”, a explicat compania.

Raportul Anthropic vine la scurt timp după ce cercetătorul Jacob Coxon și-a anunțat demisia, invocând că Anthropic și rivalul său principal, OpenAI, „se întrec într-o cursă orbitoare spre o superinteligență care se auto-perfecționează, jucându-se cu viețile noastre”. În mesajul său, Coxon a avertizat că unii dintre colegii săi cred că inteligența artificială ar putea amenința existența umană până la sfârșitul acestui deceniu.

Cu toate acestea, Anthropic susține că a blocat fiecare dintre activitățile dăunătoare identificate, a folosit aceste experiențe pentru a-și întări mecanismele de siguranță și a transmis informațiile autorităților guvernamentale și partenerilor din industrie.

„Sperăm că concluziile din acest raport vor ajuta alți dezvoltatori să recunoască tipare similare pe propriile platforme, vor oferi guvernelor și societății civile o imagine mai clară asupra modului în care se conturează noile amenințări și vor consolida apărarea colectivă”, a concluzionat Anthropic.