Cercetători au folosit Claude într-un atac demonstrativ asupra OpenAI. Au ajuns până la un repository intern
Trei cercetători Hacktron au folosit Claude într-un lanț de vulnerabilități care a compromis conturi OpenAI și a demonstrat acces la un repository intern.
O echipă de trei cercetători de securitate de la Hacktron AI spune că a folosit Claude, modelul Anthropic, pentru a dezvolta un exploit care a contribuit la compromiterea unor conturi OpenAI. Lanțul de vulnerabilități a pornit de la forumul companiei și a ajuns, potrivit cercetătorilor, până la un repository intern conectat prin Codex.
Pe scurt
- Atacul demonstrativ a pornit de la
community.openai.com, forum bazat pe Discourse. - O vulnerabilitate din biblioteca
libheifpermitea executarea de cod printr-un fișier HEIF special construit. Discourse a publicat un advisory pentru CVE-2026-32882 și i-a acordat un scor CVSS de 8,8 din 10. - Hacktron spune că a combinat acest acces cu o problemă separată de autentificare OpenAI, ceea ce a permis preluarea unor conturi ChatGPT și Codex, inclusiv ale unor angajați.
- Pentru a demonstra accesul fără să inspecteze codul intern, cercetătorii spun că au folosit Codex-ul unui angajat pentru a crea un pull request în repository-ul privat
openai/openai.
Atacul a pornit de la o imagine încărcată pe forum
Discourse procesa imaginile HEIF și HEIC încărcate de utilizatori printr-un lanț de componente care includea ImageMagick și biblioteca libheif. O eroare de memorie din libheif putea fi exploatată pentru executarea de cod de la distanță.
Existența vulnerabilității este confirmată independent de advisory-ul publicat de Discourse pe 28 iulie 2026. Documentul identifică problema drept CVE-2026-32882, o clasifică „High”, cu scor 8,8, și creditează hacktronai-research pentru raportare.
Rolul Claude în dezvoltarea exploitului
Potrivit Hacktron, cercetătorii au încercat inițial să transforme vulnerabilitatea într-un exploit funcțional folosind o versiune specială Claude Opus 4.8 disponibilă pentru cercetare de securitate. Modelul nu ar fi reușit să producă un exploit fiabil în condițiile reale ale țintei.
Echipa afirmă că situația s-a schimbat după lansarea Claude Opus 5. Același tip de sarcină ar fi fost rezolvat în câteva ore, iar exploitul a fost ulterior adaptat mediului folosit de Discourse. TechCrunch relatează aceeași succesiune pe baza discuțiilor cu cercetătorii.
De la contul unui angajat la GitHub
După compromiterea serverului Discourse, Hacktron spune că a descoperit o a doua problemă, în fluxul de autentificare OpenAI. Aceasta le-ar fi permis cercetătorilor să preia mai multe conturi ChatGPT și Codex, inclusiv un cont de angajat al cărui Codex era conectat la organizația GitHub a OpenAI.
Cercetătorii spun că nu au deschis și analizat codul intern. În schimb, au cerut Codex-ului asociat contului compromis să creeze un pull request inofensiv, PR #1186742, în repository-ul privat openai/openai. Repository-ul nu este public, deci această parte a demonstrației nu poate fi verificată direct din exterior.
OpenAI a transmis pentru TechCrunch că problemele identificate de Hacktron au fost remediate. Publicația relatează și că echipa a primit o recompensă de 6.500 de dolari prin programul de bug bounty al companiei.
De ce contează
Hacktron prezintă cazul ca exemplu al modului în care modelele AI reduc timpul și cantitatea de expertiză rară necesare pentru dezvoltarea unor exploituri complexe. Cercetătorii precizează însă că procesul nu a fost complet autonom: intervenția umană a rămas necesară pentru alegerea țintelor, validarea rezultatelor și adaptarea atacului.
În proiectul mai larg „HEIF Heist”, echipa spune că trei cercetători au lucrat aproximativ două luni și au cheltuit sub 3.000 de dolari pe tokeni AI. Cifra se referă la proiectul de cercetare în ansamblu, nu exclusiv la incidentul OpenAI.
Surse verificate
- Hacktron AI, „Hacking OpenAI”, sursa primară a cercetătorilor, accesată la 21 septembrie 2026: https://www.hacktron.ai/blog/hacking-openai
- Discourse / GitHub Security Advisory, „RCE via malformed HEIF file”, 28 iulie 2026: https://github.com/discourse/discourse/security/advisories/GHSA-vhm9-85gw-x335
- TechCrunch, „Researchers used Anthropic’s Claude to hack into OpenAI”, 18 septembrie 2026: https://techcrunch.com/2026/09/18/researchers-used-anthropics-claude-to-hack-into-openai/
Imagine: Adi Goldstein / Unsplash.