Conversații private din Claude au apărut în Google și Bing după o configurare greșită

Conversații private din Claude au apărut în Google și Bing după o configurare greșită

O eroare de configurare la Anthropic a expus în motoarele de căutare conversații private purtate cu chatbotul Claude. Linkurile partajate de utilizatori au putut fi indexate în Google și Bing, deși măsurile tehnice standard ar fi trebuit să împiedice acest lucru. Pentru companiile care folosesc AI în operațiuni interne, cazul deschide un nou profil de risc: o conversație distribuită printr-un URL public poate ajunge în rezultatele de căutare.

Problema nu a fost cauzată de o spargere a sistemului, ci de o configurare greșită. Anthropic s-a bazat doar pe fișierul robots.txt pentru a bloca indexarea. Paginile partajate nu aveau și eticheta noindex, recomandată explicit de Google și Bing pentru a preveni apariția în rezultatele căutărilor. Diferența este una tehnică, dar cu efect direct: robots.txt spune crawlerelor ce să nu scaneze, în timp ce noindex oprește afișarea paginii în rezultate.

Lipsa acestei etichete a lăsat accesibil public un conținut pe care utilizatorii îl considerau confidențial. Vulnerabilitatea a făcut vizibile conversații despre afiliere politică, obligații etice ale avocaților sau role-play erotic. Efectele nu se opresc la nivel tehnic. Cazul atinge și guvernanța datelor, dar și expunerea reputațională pentru companiile care folosesc astfel de servicii în activități interne.

La momentul redactării articolului inițial, o căutare pe Bing pentru site:claude.ai/share returna încă „aproximativ 612 rezultate”. Google nu mai afișa rezultate pentru aceeași interogare. Diferența arată că remedierea nu se propagă simultan în toate motoarele de căutare. Fereastra de expunere poate rămâne deschisă și după corecții, potrivit Financiarul.

Incidentul nu este primul de acest tip pentru Anthropic. Furnizorul a mai avut un incident similar în septembrie 2023. Repetarea aceleiași clase de erori schimbă perspectiva asupra problemei, de la un accident operațional la un management deficitar al riscului tehnic. Acest istoric cere controale suplimentare pentru date sensibile și politici mai stricte de partajare.

Google a plasat responsabilitatea la proprietarul site-ului. Ned Adriance, purtător de cuvânt Google, a declarat: „Nici Google, nici vreun alt motor de căutare nu controlează ce pagini sunt făcute publice pe web, iar aceste pagini au fost indexate de mai multe motoare de căutare. Oferim proprietarilor de site-uri controale clare pentru a decide dacă paginile pot fi scanate sau indexate și respectăm întotdeauna aceste directive.”

Cazul are și o dimensiune de business. Anthropic, Meta și OpenAI își folosesc reciproc fișierele robots.txt pentru a bloca accesul crawlerelor competiției. Scopul este să împiedice folosirea datelor pentru antrenarea modelelor AI rivale. Același instrument folosit pentru protecție competitivă s-a dovedit însă insuficient pentru protejarea conversațiilor utilizatorilor.

Din acest incident rezultă patru teste de risc pentru partajarea de conținut AI. Primul privește arhitectura linkului: dacă un serviciu permite partajarea prin URL public, există risc de publicare pe web. Al doilea test ține de stratul tehnic de blocare: un robots.txt fără noindex s-a dovedit insuficient. Al treilea privește persistența expunerii: eliminarea dintr-un motor de căutare nu înseamnă dispariția completă, iar Bing încă afișa 612 rezultate. Al patrulea test este istoricul furnizorului, care în acest caz include un incident similar din septembrie 2023.

Impactul se vede și în ritmul de adopție a AI în companii. Incidentul afectează premisa de bază a fluxurilor interne, aceea că schimburile de lucru cu modelul rămân controlate. Costul nu se rezumă la imaginea furnizorului. El apare în cerințe tehnice mai dure, cicluri mai lungi de aprobare și o toleranță mai mică a clienților pentru omisiuni de configurare pe funcții aparent minore, cum este partajarea unui chat.