Modelul AI Fable Anthropic impune restricții stricte de securitate cibernetică care limitează chiar și solicitările inofensive. Lansat recent, acesta a stârnit critici din partea cercetătorilor în securitate cibernetică din mai multe țări. Aceste măsuri afectează utilizarea practică a modelului în domeniul securității informatice.
Pe scurt:
- Modelul AI Fable de la Anthropic impune restricții stricte care blochează orice solicitare legată de securitatea cibernetică, inclusiv cereri inofensive.
- Restricțiile au fost implementate pentru a preveni utilizarea modelului în activități periculoase, cum ar fi dezvoltarea de malware sau atacuri cibernetice.
- Aceste limitări afectează negativ utilizarea modelului pentru codare și bune practici în ingineria software, generând nemulțumiri în rândul experților.
- Anthropic intenționează să ajusteze restricțiile colaborând cu companii specializate, pentru a echilibra accesul larg și securitatea cibernetică.
Critici privind restricțiile de securitate cibernetică ale modelului AI Fable Anthropic
Modelul AI Fable Anthropic, lansat recent, include restricții stricte de securitate cibernetică care au stârnit nemulțumiri în rândul cercetătorilor din domeniu. Aceste limitări afectează chiar și solicitările inofensive, cum ar fi citirea unui text legat de securitate.
Fable respinge orice cerere ce poate fi asociată cu securitatea cibernetică, întrerupând conversația și afișând un mesaj care indică măsuri de siguranță pentru subiecte sensibile, inclusiv biologie. Aceste bariere au fost implementate pentru a preveni utilizarea modelului în dezvoltarea de malware sau alte activități periculoase.
Restricții și impact asupra utilizării modelului AI securitate
Anthropic a lansat anterior Mythos, un model AI destinat securității cibernetice, cu acces limitat pentru organizații selectate. Recent, accesul a fost extins la sute de entități din 15 țări. Cu toate acestea, natura restrictivă a Fable generează dificultăți în utilizarea sa pentru sarcini legate de codare și bune practici în ingineria software.
Matt Suiche, expert în securitate cibernetică, a explicat că modelul interpretează orice referire la securitate cibernetică ca o potențială amenințare, ceea ce duce la răspunsuri limitate sau degradate. Fable revine automat la o versiune anterioară, Claude Opus 4.8, când întâlnește astfel de bariere.
Perspective asupra evoluției restricțiilor în modelul Fable Anthropic
Deși restricțiile sunt criticate, specialiștii recunosc necesitatea lor în această etapă de dezvoltare. Se așteaptă ca barierele să fie ajustate pe măsură ce Anthropic colaborează cu companii specializate în securitate cibernetică. Această abordare urmărește să echilibreze accesul larg cu prevenirea riscurilor de securitate.
Nemulțumirile utilizatorilor includ blocarea chiar și a cererilor simple, cum ar fi revizuirea de cod, ceea ce limitează potențialul modelului în domeniul securității informatice. Anthropic nu a oferit încă un răspuns oficial privind aceste critici.
Noa Insight
Anthropic a lansat modelul AI Fable, care include restricții stricte de securitate cibernetică ce limitează chiar și solicitările inofensive legate de acest domeniu. Aceste măsuri sunt menite să prevină utilizarea modelului în activități periculoase, afectând însă funcționalitatea pentru cercetători și dezvoltatori.
Implicații
Restricțiile impuse de Fable afectează utilizarea modelului în sarcini legate de codare și bune practici în securitatea cibernetică, generând dificultăți pentru utilizatori și limitând potențialul tehnologic al acestuia.
Elemente-cheie
- Restricțiile modelului Fable blochează orice cerere asociată securității cibernetice pentru a preveni riscuri de securitate.
- Accesul la modelul Mythos a fost extins recent la sute de entități din 15 țări, conform articolului.
- Fable revine automat la versiunea anterioară Claude Opus 4.8 când întâlnește bariere legate de securitate cibernetică.
Sursa originală a acestui articol este https://techcrunch.com/2026/06/10/cybersecurity-researchers-arent-happy-about-the-guardrails-on-anthropics-fable/ (link)







