OpenAI Magre-release ng Unang Model na Pasa sa ‘Matinding’ Cybersecurity Standard Nila

  • OpenAI Inangat ang Astra Bilang Unang Model na Pumasa sa Critical Cybersecurity Threshold
  • Astra Nakakuha ng Perfect Score sa ExploitBench, Tumanggi sa 91.5% ng Cyber Jailbreak Attempt
  • Alpha testers unang makakagamit, susunod mga defender via Daybreak Blue program ng OpenAI.

Kumpirmado ng OpenAI na pumasa na ang upcoming model nila na Astra sa Critical cybersecurity level base sa sarili nilang Preparedness Framework. Plano ng kumpanya na i-release ang model na ‘to na may mga safeguard at may restrictions para sa mga advanced cyber features nito.

Unang beses ng OpenAI na mag-place ng isang model sa ganitong tier, at ang ibig sabihin nito, kaya ng Astra na maghanap ng mga bago o ‘di kilalang butas sa sobrang secured na systems at gumawa ng working exploits — kahit walang step-by-step na guidance mula sa tao.

Ano ang Sakop ng Critical Rating

Dalawang condition ang kailangan para masabing Critical level ang isang AI sa Preparedness Framework. Qualified ang isang model kung kaya nitong maghanap at gumawa ng gumaganang zero-day exploits sa maraming hardened na real-world systems—kahit walang tulong ng tao.

Papasok din sa Critical rating kung kaya ng model na magplano at mag-execute ng bagong end-to-end na cyber attack sa mga matitibay na target, kahit high-level na goal lang ang ibigay dito.

Umabot ng 100% ang score ng Astra sa ExploitBench, ayon sa assessment ng OpenAI. Sa isang internal set ng 20 high-severity V8 vulnerabilities, mas mataas pa ang code-execution rates nito kaysa GPT-5.6 Sol at mas konti pa ang tokens na ginamit.

Habang tumatakbo ang test, dalawang bago at ‘di pa natutukoy na vulnerabilities ang natagpuan at nagamit ng Astra. Sabi ng OpenAI, irereport nila ang findings na ‘to sa mga maintainers na naapektuhan.

Nakita rin ng mga expert tester na kaya ng model gumawa ng browser compromise chain—nakalabas siya sa sandbox at nakapagpatakbo ng commands sa mismong host machine.

“Malaki ang nadagdag na cybersecurity capability ng Astra kumpara sa GPT-5.6 Sol: mas efficient ito sa tokens at mas magaling sa paghahanap ng vulnerabilities at paggawa ng exploit,” ayon sa OpenAI sa kanilang statement.

 I-follow kami sa X para updated ka agad sa mga latest news

Nilagyan ng OpenAI ng Mga Guardrail Bago I-release

Pansamantalang hininto ng kumpanya ang ilang parte ng development ng Astra habang pinapalakas pa ang safety features nito. Sinimulan uli nila ang malaking frontier reinforcement learning run noong August 28 nang maipatupad na ang mga bagong safety requirements.

Sabi ng OpenAI, 91.5% ng requests sa cyber jailbreak tests ay ni-reject ng Astra. Sa comparison, 59% lang ang ni-reject ng GPT-5.6 Sol sa parehong tests. Mas mahigpit din ang pag-reject ng requests mula sa accounts na mas mataas ang risk level.

May chain-of-thought monitoring din ang OpenAI para i-detect at pigilan ang mga possible na delikadong action ng model. Sa honeypot tests, 56% ng samples ng GPT-5.6 Sol (na walang production safeguards) ay nagtangkang i-compromise ang surrounding infrastructure. Si Astra, walang ganitong attempt.

Plano ng OpenAI na gawing available na si Astra sa lalong madaling panahon. Mas limitado muna ang access sa mga pinaka-advanced na cybersecurity feature nito—uunahin ang iilang tester bago ito maging available para sa mas marami through Daybreak Blue para sa defense use cases.

Aminado naman ang kumpanya na dahil sa mga safeguard, magiging mas mahirap at may friction muna ang simula ng Astra.

Mag-subscribe din sa YouTube channel namin para mapanood ang mga expert insights mula sa mga industry leader at journalists


Upang mabasa ang pinakabagong pagsusuri sa merkado ng cryptocurrency mula sa BeInCrypto, i-click dito.

Disclaimer

Ang opinion article na ito ay nagpapahayag ng opinyon ng may-akda at maaaring hindi kumakatawan sa mga pananaw ng BeInCrypto. Nananatiling committed ang BeInCrypto sa transparent na pag-uulat at pagpapanatili ng pinakamataas na pamantayan ng journalism. Pinapayuhan ang mga mambabasa na i-verify ang impormasyon sa kanilang sariling kakayahan at kumonsulta sa isang propesyonal bago gumawa ng anumang desisyon base sa nilalamang ito. Paalala rin na ang aming Terms and Conditions, Privacy Policy, at Disclaimers ay na-update na.