Claude de la Anthropic a atacat companii reale după o eroare în testare
EUR/MDL - 20.11 0.1668
USD/MDL - 17.53 0.1685
VMS_91 - 3.03%
VMS_364 - 9.54%
BONDS_2Y - 7.40%
GOLD - 4,081.70 1.5%
EURUSD - 1.15 0%
BRENT - 85.40 20.29%
SP500 - 741.69 1.68%
SILVER - 58.08 1.54%
GAS - 3.15 7.14%

Claude a confundat testul cu realitatea și a atacat companii reale

Trei modele de inteligență artificială Claude ale companiei Anthropic au obținut, în timpul unor teste interne, acces neprevăzut la internet și au pătruns în sistemele a trei organizații. Potrivit dezvoltatorului, cauza incidentelor a fost o eroare în configurarea mediului de testare. Acesta este deja al doilea caz de acest gen din industrie în ultimele săptămâni, după o anunț similar din partea OpenAI.
Natașa Kim Timp de citire: 2 minute
Dimensiunea textului
Link copiat
Claude

Conform datelor furnizate de Anthropic, modelele au participat la teste de securitate cibernetică în formatul „capture-the-flag” (CTF), care este utilizat pentru a evalua capacitatea IA de a identifica și exploata vulnerabilitățile. Conform scenariului testului, modelele trebuiau să descopere un „steag secret”, presupus a fi plasat pe un alt computer din interiorul unei rețele izolate.

Se presupunea că accesul la internetul extern va fi complet blocat. Cu toate acestea, din cauza unei neconcordanțe între Anthropic și partenerul Irregular, care a efectuat evaluarea, restricțiile nu au funcționat. Drept urmare, Claude a obținut acces la resurse reale de pe internet și le-a perceput ca făcând parte din mediul de învățare.

Compania a subliniat că modelele au acționat în cadrul sarcinii stabilite. Într-un caz, Claude a înțeles că interacționează cu o organizație reală, iar în altul a considerat în mod eronat că respectiva companie face parte din scenariul de testare.

Numele organizațiilor ale căror sisteme au fost atacate nu sunt dezvăluite. Potrivit datelor furnizate de Anthropic, cele două companii au aflat despre incidente abia după ce au fost notificate de către dezvoltator. Compania continuă să încerce să ia legătura cu reprezentanții celei de-a treia organizații.

Comunicatul Anthropic a apărut la două săptămâni după o declarație similară a OpenAI. Atunci, compania a anunțat că, în timpul testării interne, două dintre modelele sale experimentale au obținut acces neprevăzut la infrastructura externă și au atacat platforma Hugging Face. La OpenAI, incidentul a fost calificat drept unul fără precedent și s-a declarat că acesta a constituit un motiv pentru revizuirea procedurilor de testare a IA.

Noile cazuri arată că, pe măsură ce modelele de inteligență artificială devin tot mai complexe, dezvoltatorii acordă o atenție din ce în ce mai mare securității testelor. Erorile de configurare a mediului de testare pot duce la situația în care modelele încep să interacționeze nu cu o simulare, ci cu infrastructura digitală reală.


Abonați-vă la actualizările noastre


Реклама недоступна
Pe aceeași temă*
Mai mult de la autor*

Întotdeauna apreciem feedback-ul dumneavoastră!

Ultimele știri
Popular acum*
De citit neapărat*