Agenții AI pot fi păcăliți cu ușurință în teste de securitate, expunând date sensibile la riscuri majore. Două echipe de cercetare au demonstrat vulnerabilități ale agenților AI în manipularea emailurilor și accesul la informații critice, în experimente realizate recent. Aceste descoperiri subliniază necesitatea unor măsuri stricte în securitatea cibernetică pentru a preveni atacurile de phishing AI.
Pe scurt:
- Agenții AI pot fi păcăliți ușor în teste de securitate, executând comenzi periculoase și divulgând date sensibile prin phishing sofisticat.
- Problemele apar din combinarea datelor externe cu instrucțiuni interne fără delimitare clară, iar lipsa judecății sociale crește riscul atacurilor.
- Companiile trebuie să limiteze accesul AI la date sensibile și să impună controale stricte pentru trimiterea informațiilor și aprobarea manuală a acțiunilor.
- Versiunea 2026.4.23 a OpenClaw a remediat unele vulnerabilități, dar riscurile rămân pentru agenții AI cu acces necontrolat la aplicații critice.
Riscurile agenților AI în securitate cibernetică și phishing AI
Agenții AI reprezintă o vulnerabilitate serioasă în securitatea cibernetică, mai ales când primesc acces la emailuri, fișiere și comenzi automate. Două echipe de cercetare au testat OpenClaw, un agent AI self-hosted folosit pentru automatizarea sarcinilor, de la citirea mesajelor până la interacțiunea cu aplicații externe.
Comenzi ascunse în contacte și mesaje
Imperva a descoperit că OpenClaw transforma date precum contacte sau locații în text fără o delimitare clară, ceea ce permitea interpretarea unor fragmente ca instrucțiuni. Astfel, agentul putea executa comenzi periculoase, inclusiv cod controlat de atacatori. De exemplu, un contact afișat trunchiat pe ecran putea conține în fundal o instrucțiune mascată pentru AI.
Problema a fost remediată în versiunea 2026.4.23, prin tratarea acestor câmpuri ca metadate nesigure. Totuși, riscul rămâne pentru orice agent AI care combină date externe cu instrucțiuni interne fără o separare clară.
Phishing AI prin emailuri convingătoare
Varonis Threat Labs a testat un agent numit Pinchy, conectat la Gmail și servicii Google Workspace, cu acces la date interne false. Agentul a răspuns unor emailuri de tip phishing care păreau trimise de colegi, trimițând chei AWS simulate, parole și date SSH. De asemenea, a livrat un export fals, dar realist, cu date despre clienți.
Agentul a identificat și blocat amenințări tehnice evidente, dar a fost păcălit de cereri care păreau normale și urgente. Slăbiciunea a fost lipsa de judecată socială pentru a verifica legitimitatea solicitărilor.
Măsuri esențiale pentru securitatea agenților AI
Companiile trebuie să limiteze accesul agenților AI la date sensibile și să impună controale stricte pentru trimiterea informațiilor în exterior. Permisiunile automate pentru acces la CRM, parole sau documente financiare trebuie restricționate, iar acțiunile sensibile să fie blocate implicit sau aprobate manual.
Identificarea utilizatorilor trebuie să se bazeze pe politici stricte și verificări solide, nu pe nume afișate sau mesaje familiare. Phishingul funcționează pe aparența de normalitate, iar agenții AI pot fi păcăliți dacă nu există astfel de măsuri.
Pe măsură ce agenții AI devin mai capabili și primesc acces la aplicații reale, riscurile cresc. Un agent care execută comenzi și trimite fișiere poate genera breșe majore, similar unui angajat junior fără experiență care are acces la sisteme critice. Controlul strict al accesului și supravegherea sunt esențiale pentru prevenirea incidentelor.
Noa Insight
Doi cercetători au testat agenți AI precum OpenClaw și Pinchy, evidențiind vulnerabilități în securitatea cibernetică. Acești agenți, folosiți pentru automatizarea sarcinilor și acces la date sensibile, pot fi păcăliți prin comenzi ascunse sau emailuri de tip phishing, punând în pericol integritatea informațiilor gestionate.
Implicații
Vulnerabilitățile descoperite afectează modul în care agenții AI gestionează accesul la date și execută comenzi, impunând companiilor să implementeze controale stricte pentru a preveni scurgeri de informații și breșe de securitate.
Elemente-cheie
- Comenzile ascunse în datele afișate pot fi interpretate greșit ca instrucțiuni de către agenții AI, generând riscuri de securitate.
- Versiunea 2026.4.23 a OpenClaw tratează câmpurile cu date externe ca metadate nesigure pentru a preveni execuția comenzilor periculoase.
- Companiile trebuie să limiteze accesul automat al agenților AI la date sensibile și să impună aprobări manuale pentru acțiuni critice.
Sursa originală a acestui articol este https://playtech.ro/2026/agentii-ai-pot-fi-pacaliti-mai-usor-decat-crezi-openclaw-prins-in-teste-care-arata-cum-pot-fi-furate-date-sensibile/ (link)






