Chatboturile AI au devenit astăzi, pentru milioane de oameni, o interfață de acces la informație. Ele nu mai sunt folosite doar pentru redactare sau traducere, ci și pentru a explica războaie, alegeri, drepturi ale omului ori conflictele teritoriale. Sondajele realizate în principalele piețe digitale indică o expunere mai extinsă a populației față inteligența artificială generativă: 66% dintre respondenții din 21 de țări afirmau că au folosit un instrument AI în ultimul an, scrie publicația Digital Forensic.
În același timp, o cercetare a Parlamentului European realizată în toamna anului 2024 sugerează că 66% dintre românii cu vârsta de 16-30 de ani folosiseră aplicații AI în ultimele 12 luni, și 26% dintre aceștia le folosiseră pentru „studiu și cercetare”. Dar tocmai aici apare problema: un răspuns generat de un sistem AI poate fi fluent, convingător și aparent echilibrat, dar mai poate include erori, poate repeta o narațiune de propagandă sau poate selecta informațiile într-un mod care împinge utilizatorul spre o interpretare prestabilită. În cazul interacțiunilor repetate și personalizate, se poate forma chiar un așa-numit „cocon epistemic”: un spațiu relațional în care autoritatea asupra cunoașterii și validarea convingerilor se concentrează treptat în relația dintre utilizator și AI, iar încrederea se deplasează de la verificarea surselor externe către sistemul însuși (Flore, 2025).
Rezumat executiv
Sistem de Evaluare a Manipulării și Acurateții Narative în Tehnologiile AI (SEMANT) este o metodologie elaborată Digital Forensic Team, pentru auditarea modului în care modelele lingvistice răspund în limba română la întrebări despre subiecte geopolitice sensibile și narațiuni de propagandă. Auditul SEMANT a testat șase sisteme AI conversaționale – ChatGPT (OpenAI), Claude (Anthropic), Gemini (Google), Grok AI (xAI), DeepSeek (DeepSeek AI) și Alice AI (Yandex) – folosind 324 de răspunsuri la întrebări în limba română despre narațiuni pro-ruse și pro-chineze. Fiecare sistem a primit 54 de solicitări. Răspunsurile au fost evaluate după trei dimensiuni: acuratețe factuală (F), tratarea narațiunii propagandistice (N) și cadrul semantic al răspunsului (C). Refuzurile au fost înregistrate separat (R).
Rezultatul central este clar: nu există un profil unic de „risc AI”. În configurațiile testate, ChatGPT și Gemini au obținut un scor mediu SEMANT de 0, iar Claude și Grok AI au rămas sub 0,21. În schimb, Alice AI a ajuns la 1,698, iar DeepSeek la 2,286. Toate cele 22 de răspunsuri din categoria critică au provenit de la ultimele două sisteme: 13 de la DeepSeek și 9 de la Alice AI.
Citește articolul integral în Digital Forensic
(Sursa foto: Tim Witzdam / Pexels.com)



