Anthropic afirmă că a identificat și oprit tentative de folosire a modelului său de inteligență artificială pentru „activități rău intenționate” care ar putea sprijini dezvoltarea armelor biologice și convenționale.
Modelul de inteligență artificială Claude al companiei ar fi fost, de asemenea, utilizat într-o campanie de spionaj cibernetic asociată Rusiei și de o instituție iraniană de propagandă, potrivit celui mai recent raport de informații privind amenințările publicat de Anthropic.
Cazurile problematice detectate în ultimele 8 luni au variat de la aplicații false de întâlniri și fraude prin rețele Wi-Fi ale hotelurilor până la sisteme de supraveghere concepute pentru identificarea disidenților.
Dezvăluirile vin după avertismentele formulate de un important cercetător în domeniul siguranței de la Anthropic cu privire la potențialele riscuri ale inteligenței artificiale pentru omenire, notează radioromania.ro.
Anthropic a acuzat, de asemenea, companii chineze de inteligență artificială că încearcă să reproducă performanțele Claude.
Compania a publicat, joi, cel mai recent raport despre amenințări, afirmând că face acest lucru deoarece consideră că are „responsabilitatea de a dezvălui utilizările rău intenționate ale serviciilor noastre”.
Raportul amplu enumeră cazuri în care grupuri suspectate că ar fi susținute de state, infractori, furnizori de programe de spionaj, instituții de propagandă de stat și persoane motivate politic ar fi folosit abuziv tehnologia companiei.
Anthropic spune că a întrerupt astfel de utilizări ale modelelor Claude Haiku, Sonnet și Opus în perioada decembrie 2025 – august 2026.
Niciunul dintre cazurile de utilizare abuzivă nu a implicat Claude Fable sau modelele puternice din clasa Mythos, cu excepția unui singur caz de „distilare” – proces prin care modele de inteligență artificială mai mici sunt antrenate cu ajutorul unor modele mai mari și mai costisitoare.
Pe lângă detectarea utilizării modelelor sale pentru operațiuni cibernetice și de influență, supraveghere, escrocherii, fraude și dezvoltarea de arme, Anthropic afirmă că a blocat cercetători care foloseau inteligența artificială în moduri ce ar fi putut contribui la dezvoltarea armelor biologice.
Raportul evidențiază „cinci studii de caz privind actori care au folosit modelele noastre în moduri ce ar putea sprijini dezvoltarea armelor biologice”.
Utilizarea abuzivă în domeniul biologic este, potrivit companiei, „unul dintre cele mai grave riscuri ale modelelor AI de frontieră”. În lipsa unor măsuri de protecție adecvate, asemenea capabilități „ar putea avea consecințe catastrofale”, afirmă Anthropic.
„Aceleași informații care pot fi folosite pentru dezvoltarea unei arme biologice ar putea fi utilizate și pentru a dezvolta, de exemplu, un vaccin sau un tratament pentru o boală”, a precizat compania.
Jacob Klein, șeful diviziei de informații privind amenințările de la Anthropic, a declarat pentru New York Times că este vorba despre „o situație incredibil de nuanțată”.
„Nu vezi pe cineva care, ca într-o bandă desenată, să spună: «Hei, vreau să construiesc o armă biologică pentru a-i ucide pe toți»”, a spus el.
Raportul menționează, de asemenea, 6 cazuri în care Claude a fost folosit „pentru dezvoltarea de software destinat armelor convenționale, inclusiv arme de foc, rachete, drone înarmate, bombe și alte tipuri de muniție, precum și sistemelor de țintire și control care le operează”.
Raportul arată că infractorii cibernetici și hackerii susținuți de state folosesc tot mai frecvent această tehnologie pentru a-și sprijini operațiunile.
Gruparea de hackeri ShinyHunters și laboratoare din China se numără printre entitățile menționate.
Documentul mai afirmă că o grupare de hackeri ale cărei activități sunt compatibile cu cele ale Midnight Blizzard, grup asociat Rusiei, ar fi utilizat inteligența artificială pentru a construi un sistem capabil să detecteze automat momentul în care programele sale malware erau identificate de soluțiile de securitate și să rescrie codul până când reușea să evite detectarea.
Compania cu sediul în California afirmă că a integrat concluziile raportului în propriile proceduri, „pentru a preveni, detecta și întrerupe mai eficient astfel de activități pe viitor”.
Anthropic a precizat că, acolo unde a fost cazul, a transmis informații autorităților și partenerilor din industrie.
Raportul, primul publicat de companie în acest an, apare după ce un important cercetător al Anthropic în domeniul siguranței a avertizat că inteligența artificială avansează atât de rapid, încât consideră că există o probabilitate de peste 10% ca aceasta „să poată ucide toți oamenii” în următorul deceniu.
Anthropic a blocat utilizări „rău intenționate” ale inteligenței artificiale care ar putea sprijini dezvoltarea armelor biologice