Anthropic activează modul automat în Claude Code pentru a crește siguranța AI și a reduce dependența de supravegherea umană. Din 14 august, această funcție devine implicită pentru conturile Pro, Max și Team, marcând un pas important în protecția utilizatorilor. Implementarea are loc după teste care au demonstrat o eficiență superioară în detectarea acțiunilor dăunătoare.
Pe scurt:
- Anthropic a activat modul automat în Claude Code pentru siguranța AI, devenind implicit pentru conturile Pro, Max și Team din 14 august.
- Modul automat permite acțiuni fără aprobarea umană la fiecare pas, exceptând cazurile ireversibile sau distructive, reducând astfel supravegherea manuală.
- Un studiu cu 1.053 testeri a arătat că modul automat detectează 89% din acțiunile dăunătoare, față de 13,6% în cazul revizuirii umane.
- Anthropic a introdus și filtrarea injecțiilor de prompturi și reguli personalizabile pentru a preveni riscuri precum exfiltrarea de date.
Anthropic activează modul automat pentru siguranța AI cu Claude Code
Anthropic a implementat modul automat în Claude Code pentru a spori siguranța AI și a reduce necesitatea supravegherii umane. Această funcție devine implicită pentru conturile Pro, Max și Team începând cu 14 august.
Performanța modulului automat în Claude Code
Modul automat, lansat inițial în martie, permite continuarea acțiunilor fără aprobarea umană la fiecare pas, cu excepția celor considerate ireversibile, distructive sau care ies din mediul utilizatorului. Testele au arătat că acest mod este mai sigur decât revizuirea manuală.
Un studiu realizat pe 1.053 de testeri plătiți a indicat că modul automat a detectat 89% din acțiunile dăunătoare, comparativ cu doar 13,6% în cazul revizuirii umane. Aceasta poate fi explicată prin tendința utilizatorilor de a aproba 97% din solicitările de permisiune în Claude Code.
Siguranță AI îmbunătățită prin funcții noi
Boris Cherny, șeful Claude Code, a declarat că echipa sa folosește exclusiv modul automat de luni de zile și nu intenționează să revină la solicitările de permisiune. În plus, Anthropic a introdus funcții suplimentare de siguranță, cum ar fi filtrarea injecțiilor de prompturi și reguli personalizabile de refuz ferm.
Aceste măsuri previn riscuri precum exfiltrarea de date, consolidând astfel protecția utilizatorilor în mediul Claude Code.
Noa Insight
Anthropic a activat modul automat în platforma Claude Code pentru a îmbunătăți siguranța inteligenței artificiale, reducând astfel necesitatea supravegherii umane. Această funcție devine implicită pentru conturile Pro, Max și Team începând cu 14 august, marcând o schimbare operațională importantă în gestionarea riscurilor AI.
Implicații
Implementarea modulului automat afectează modul de operare al utilizatorilor Claude Code, reducând intervenția manuală și sporind eficiența detectării acțiunilor dăunătoare. Aceasta consolidează protecția datelor și siguranța în utilizarea AI în cadrul platformei.
Elemente-cheie
- Modul automat permite continuarea acțiunilor fără aprobarea umană, exceptând cazurile considerate ireversibile sau distructive.
- Studiul pe 1.053 de testeri a arătat o detectare de 89% a acțiunilor dăunătoare prin modul automat, față de 13,6% cu revizuirea umană.
- Funcțiile suplimentare includ filtrarea injecțiilor de prompturi și reguli personalizabile de refuz ferm pentru prevenirea riscurilor.
Sursa originală a acestui articol este https://techcrunch.com/2026/08/09/anthropic-is-turning-claude-codes-auto-mode-on-by-default/ (link)







