| Romana
Opinii
ȘTIINȚĂ ȘI TEHNOLOGIE
4 min de citire
Cine este Jacob Coxon de la Anthropic și de ce consideră el că riscăm extincția umanității?
Cel care a contribuit la antrenarea modelului GPT-4o tocmai și-a dat demisia, avertizând că laboratoarele de IA „pariază cu viețile noastre”.
Cine este Jacob Coxon de la Anthropic și de ce consideră el că riscăm extincția umanității?
Coxon și-a anunțat plecarea, declarând că nici Anthropic, nici rivala sa OpenAI nu acționează responsabil în efortul de a dezvolta o inteligență artificială avansată. / Reuters

Jacob Coxon nu este un simplu pesimist oarecare.

Este un matematician de la Cambridge care și-a petrecut ultimii trei ani lucrând intens în culisele celor două laboratoare de IA cele mai puternice de pe Pământ: OpenAI, unde a avut o contribuție esențială la dezvoltarea modelului GPT-4o, și apoi Anthropic.

Cu ce se ocupă? Cu preantrenarea, acel proces extrem de solicitant și care necesită cantități uriașe de date, care face ca modelele de IA să devină cu adevărat mai inteligente.

Miercuri, el a demisionat de la Anthropic și s-a retras din întreaga industrie. Cercetătorul cu experiență în domeniul inteligenței artificiale afirmă că ambele laboratoare se îndreaptă cu viteză maximă spre o superinteligență capabilă să se perfecționeze singură și că „pariază cu viețile noastre”.

Coxon, în vârstă de 27 de ani, a anunțat plecarea într‑o serie de postări pe X, afirmând că nici Anthropic, nici rivalul său OpenAI nu acționează responsabil în efortul de a dezvolta IA avansată.

Iată cât de gravă spune el că poate deveni situația.

„Niciuna dintre cele două companii nu acționează în mod responsabil. Ele se îndreaptă cu viteză spre o superinteligență capabilă de auto-perfecționare și riscă viețile noastre”, a scris Coxon.

Tweetul său a devenit viral pe X, unde utilizatori din toate categoriile sociale s-au alăturat pentru a-și exprima îngrijorarea cu privire la traiectoria modelelor de IA, pe care oamenii se bazează din ce în ce mai mult în viața de zi cu zi.

Plecarea foarte mediatizată a lui Coxon este cea mai recentă dintr-o serie de demisii ale cercetătorilor preocupați de siguranță, care părăsesc marile companii de dezvoltare a IA din cauza preocupărilor etice și existențiale.

Avertismentele vin în contextul în care sistemele de IA de ultimă generație dau deja semne că ar putea scăpa de sub control.

În iulie, OpenAI a dezvăluit că modelele testate pentru capacități de securitate cibernetică au ocolit controalele de izolare, au obținut acces la internet și au compromis părți din infrastructura de cercetare a OpenAI și din platforma de IA, Hugging Face.

Compania a declarat că modelele au comunicat prin canale neautorizate și au exploatat vulnerabilități din infrastructura partajată.

Te-ar putea interesa șiTRT Română - Inteligența artificială este inevitabilă, dar este ea responsabilă?

Anthropic a raportat o problemă similară.

Într‑o revizuire din iulie, compania a spus că modelele Claude au ajuns la internet din interiorul sau în timp ce interacționau cu medii terțe de evaluare și ulterior au obținut acces neautorizat la sistemele reale ale trei organizații.

Anthropic a afirmat că incidentele au avut loc în timpul evaluărilor de securitate cibernetică și au determinat modificări în modul în care desfășoară astfel de teste.

În declarația sa, Coxon a avertizat să nu subestimăm viteza și capacitatea sistemelor IA viitoare, prezicând că acestea ar putea curând să dobândească abilitatea de a sparge software‑uri, de a perturba industrii întregi și de a dobândi în mod autonom resurse din lumea reală.

„Cei care dezvoltă inteligența artificială cred cu tărie că aceasta ne-ar putea ucide pe toți până la sfârșitul acestui deceniu. Nu este vorba de o strategie de marketing. Dimpotrivă, mulți directori și cercetători de rang înalt își vor alege cu grijă cuvintele în fața presei pentru a părea rezonabili, dar îi aud pe aceiași oameni exprimându-și temerile în privat”, a spus el.

Adresându‑se colegilor cercetători din laboratoare comerciale, Coxon i‑a îndemnat pe lucrători să «ceară condiții diferite» și a remarcat că încetinirea cursei competitive ar putea necesita măsuri drastice, inclusiv acorduri de ritm între laboratoare sau o interdicție temporară asupra avansării capabilităților.

Evan Hubinger, coordonatorul Departamentului de Știința Alinierii din cadrul Anthropic, nu l-a contrazis pe Coxon. El a susținut afirmația principală: „Chiar credem cu tărie că IA ar putea ucide toată omenirea.”

El consideră că există o probabilitate mai mare de 10% de extincție în următorul deceniu.

„Cred că Anthropic face tot ce-i stă în putință, dar încă nu avem un plan pentru a rezolva problema alinierii superinteligenței și nu suntem clar pe drumul cel bun în această direcție”, a scris el pe X.

Au existat și semne îngrijorătoare în teste controlate.

În 2025, Anthropic a constatat că Claude Opus 4, plasat într‑un mediu corporativ simulat și având acces la e‑mailurile unui director fictiv, a încercat să îl șantajeze după ce a aflat că urma să fie înlocuit.

Anthropic a testat apoi 16 modele de top și a constatat că modelele de la mai mulți dezvoltatori au manifestat comportamente similare de «dezaliniere agentică», inclusiv șantaj și spionaj corporativ, atunci când aceste acțiuni păreau necesare pentru a‑și atinge obiectivele atribuite.

Descoperă
Meta lansează Muse, un agent de IA capabil să gestioneze aplicații și plăți
NVIDIA va cumpăra platforma de dezvoltare IA Hugging Face pentru aproape 13 miliarde de dolari
New York City interzice utilizarea inteligenței artificiale pentru elevii de până în clasa a opta
UE: Scăparea inteligenței artificiale de sub controlul uman reprezintă un risc grav de securitate
Inteligența artificială este inevitabilă, dar este ea responsabilă?
Când IA a luat-o razna: În culisele testului alarmant în care și-a încălcat propriile reguli
Vaccinul împotriva cancerului produs de Rusia a dat rezultate pozitive în primele teste clinice
Inteligența artificială, suveranitatea digitală și etica jurnalismului
Comunicațiile prin satelit ale NATO sunt încredințate Türkiye
Inteligența artificială avansată devine un instrument periculos pentru actori rău-intenționați
Un calculator chinezesc tocmai a câștigat un concurs de supercalculatoare. Cum a reușit Beijingul?
Raport de mediu al ONU: Inteligența artificială amenință resursele globale de apă și energie
Cursa investițiilor în piața roboților umanoizi se intensifică
Google face schimbări radicale în bara de căutare: începe era inteligenței artificiale
Hürjet își îndreaptă cursul către „Patria Albastră”
Oamenii de știință au distrus virusuri precum coronavirusul și gripa folosind unde sonore
Astronauții Artemis II împărtășesc momente din timpul zborului lunar în timp ce se întorc pe Pământ
Astronauții Artemis se pregătesc pentru o trecere pe lângă Lună în cadrul unei misiuni istorice
NASA lansează prima misiune lunară cu echipaj uman după jumătate de secol
Türkiye avansează spre independența spațială cu noi lansări de sateliți