AI model ng kalabang kumpanya pa ang tumulong sa pag-hack ng OpenAI! Gumamit ang mga researcher sa Hacktron AI ng Claude — AI model ng Anthropic — para gumawa ng working na exploit code.
Natapos nila ang buong pag-atake sa loob lang ng halos 72 oras. Nagbigay ang OpenAI ng $6,500 bounty matapos mapatunayang umabot nga sila sa private source code ng kumpanya.
Paano naging malaking breach ang simpleng image upload
Nagsimula ang attack chain sa isang simple at nakasanayan na bagay: ang image upload feature sa community help forum ng OpenAI na gumagamit ng Discourse, isang third-party software.
Dapat sana may safety filter na nagche-check sa mga in-upload na files, pero nalusutan nito ‘yung ibang photo formats na hindi niya kilala. Dahil dito, nakalusot ang mga files at umabot sa isang hiwalay na image-processing library na may kilalang memory-corruption bug.
Sinimulan ng Hacktron team — sina Harsh Jaiswal, Mohan Pedhapati, at Rahul Maini — na i-weaponize ang bug na ito noong huling bahagi ng July.
Medyo nahirapan ‘yung mas lumang version ng Claude AI labanan ang isang security feature na random ang memory locations.
Pero ilang oras lang ang lumipas, nagawa ng latest model na gumawa ng gumaganang attack code at na-adapt pa ito para eksakto sa setup ng forum.
I-follow kami sa X para una ka sa mga pinakabagong balita.
Pero ang access na nakuha nila ay para lang sa forum servers, hindi pa mismong OpenAI. May isa pang bug — ibang issue naman — sa single sign-on ng OpenAI na nagpabago ng takbo ng kwento.
Dahil ginagamit din yung forum login para mag-authenticate sa ChatGPT at Codex accounts, nang ma-hijack nila ang session ng isang empleyado, direkta silang naka-access sa private code repository ng OpenAI.
Na-patch ng Discourse yung image bug ilang araw ang nakalipas, at binigyan nila ito ng severity rating na 8.8 out of 10. Nagawan din agad ng solusyon ng OpenAI yung authentication bug — mga 14 oras lang mula nung nai-report ito sa kanilang bug bounty program.
Bakit pabalik-balik ang AI labs sa sarili nilang mga gawa
Hindi lang ito nag-iisang insidente. Nauna nang naglabas ang OpenAI ng hiwalay na kaso nitong July — mismo ang internal models nila nakatakas sa testing sandbox at nakaabot sa external system.
Sa panig naman ng Anthropic, kinilala nila na si Claude nakapag-compromise din ng totoong organizations habang sinusubok ang cybersecurity nila, kasi hindi sinasadyang naka-live internet pa during testing.
Bilang dagdag pa, ni-reference ni Mustafa Suleyman, AI chief ng Microsoft, ang parehong dami ng unauthorized AI agents ngayong linggo, at nagbabala siya na habang tumatalino at nagiging automatic ang mga AI model, mas mahirap na silang i-control.
“Warning shot na ’to… Malinaw na, panahon na para magkaisa ang mga AI labs para ma-sigurado nating kontrolado pa rin natin ang teknolohiyang ito,” saad ni Suleyman sa panayam ng Reuters.
Ang pinaka-kapansin-pansin sa Hacktron case, hindi na kakaiba ‘yung mismong hack. Matagal nang ginagawa ng mga security researcher ang pag-cocombo ng iba’t ibang software bugs.
Ang nagbago — ang bilis! Dati, kailangan pa ng matinding eksperyensya at oras. Ngayon, dahil sa AI tulad ni Claude, puwede nang mapabilis sa isang gabi lang basta may sapat kang model.
Mag-subscribe sa YouTube channel namin para mapanood ang insights ng mga leader at journalist.









