Stiripesurse.ro

Loading RSS Feed

Mythos 5, unul dintre cele mai avansate modele dezvoltate de Anthropic, a creat în timpul unui test o identitate falsă pentru a convinge un programator să introducă, pe un site dedicat găzduirii codurilor, o actualizare ce conținea erori. Când a constatat că nu reușește, și-a editat activitatea pentru a nu fi prins și a plănuit să folosească o altă identitate pentru a încerca din nou.

Noua descoperire a fost făcută în timpul unor evaluări realizate de cercetătorii de la Institutul pentru Siguranță și Securitate AI din Marea Britanie (AISI). Acestea au arătat că cele mai noi modele de inteligență artificială ale OpenAI și Anthropic au încălcat instrucțiunile primite și au încercat să obțină acces neautorizat la diverse sisteme securizate, acțiuni care puteau reprezenta riscuri pentru securitatea digitală.
În cadrul testelor, cercetătorii britanici au analizat modelele Anthropic Mythos 5 și OpenAI GPT-5.6-Sol pe care le-au pus în anumite scenarii, pentru a testa securitate cibernetică. AISI a desfășurat 122 de evaluări și a identificat 19 acțiuni neautorizate în 10 dintre teste. Modelul dezvoltat de Anthropic a fost responsabil pentru 17 dintre aceste acțiuni, iar modelul…

Citește articolul complet

Articole similare

Articole populare