AI-ondersteund artikel — automatisch opgesteld en gecontroleerd op feiten. Transparantiemelding conform artikel 50 van de EU AI Act.

Internationaal, lokaal geduid Redactie

OpenAI lanceert Astra, eerste model over 'kritieke' cyberdrempel

OpenAI lanceerde op 3 september 2026 zijn nieuwe model Astra, dat volgens het bedrijf zelf als eerste de 'kritieke' cyberveiligheidsdrempel uit zijn Preparedness Framework overschrijdt. Toegang tot die mogelijkheden blijft beperkt; AI-veiligheidsexperts uiten kritiek op de gebruikte redeneertechniek.

OpenAI lanceerde op donderdag 3 september 2026 zijn nieuwe model Astra, eerst voor klanten van het Daybreak-cybersecurityprogramma en de week nadien breder voor Pro-, Plus-, Enterprise- en Business-gebruikers via de API, meldt TechCrunch. Astra is volgens OpenAI zelf het eerste model dat de “Critical”-cyberveiligheidsdrempel uit het eigen Preparedness Framework overschrijdt — een aankondiging die het bedrijf al op 1 september 2026 deed, meldt Fortune, en die we eerder al signaleerden toen OpenAI in augustus de training van zijn nieuwste modellen tijdelijk pauzeerde.

Dat betekent dat Astra onder bepaalde omstandigheden zelfstandig onbekende softwarelekken kan vinden en uitbuiten, zonder menselijk toezicht. OpenAI beperkt de toegang tot die specifieke mogelijkheden daarom tot een kleine groep “alpha testers”: individuen en organisaties die verantwoordelijk zijn voor de bescherming van kritieke digitale infrastructuur, waaronder de Amerikaanse overheid en bedrijven binnen OpenAI’s vertrouwde cybersecurityprogramma’s. Welke organisaties dat precies zijn, wil het bedrijf niet bekendmaken, aldus Fortune. Een woordvoerder benadrukt dat het doel is om “provide defensive benefits while reducing potential for misuse.”

Astra gebruikt daarnaast een nieuwe redeneertechniek die OpenAI zelf “opaque recurrence” noemt. Die maakt het voor onderzoekers moeilijker om de “chain of thought” van het model te monitoren — het tussentijdse redeneerproces waarmee ze normaal kunnen nagaan waarom een model tot een bepaald antwoord komt. OpenAI’s chief scientist Jakub Pachocki verklaart dat krachtigere modellen moeilijkere taken kunnen uitvoeren met minder, of zelfs helemaal geen taal-tokens meer — wat de monitoring bemoeilijkt, meldt TechCrunch. Voormalig OpenAI-veiligheidsonderzoeker Steven Adler noemt dat scherp: “If this is true, OpenAI seems to be violating one of the few redlines that exist in the AI community.” Buck Shlegeris, CEO van Redwood Research, is voorzichtiger en zegt niet zeker te weten of Astra werkelijk minder goed te monitoren is dan eerdere modellen, maar waarschuwt dat verdere uitbreiding van de techniek dat wel met zich mee zou kunnen brengen.

Wat betekent dit voor Vlaanderen en België?

Grote taalmodellen zoals die van OpenAI vallen onder het Europese regime voor ‘algemene AI-modellen’, en voor de allergrootste daarvan — de modellen met systeemrisico — gelden onder artikel 55 van de AI Act extra verplichtingen: modelevaluaties, risicobeoordeling, en het melden van ernstige incidenten aan het Europese AI Office. Een model dat volgens de eigen makers een “kritieke” cyberdrempel overschrijdt, is precies het soort ontwikkeling waarvoor die verplichtingen bedoeld zijn.

Voor Belgische bedrijven die op OpenAI’s modellen bouwen, zit het praktische verschil in wat er wél en niet meekomt. Astra’s zwaarste cybercapaciteiten komen niet bij hen terecht: die blijven bij de alpha testers, en wat de week na de lancering breder via de API beschikbaar wordt, is het model zonder die specifieke mogelijkheden. De nieuwe redeneertechniek komt wél mee, en die maakt het tussentijdse redeneerspoor moeilijker te volgen. Wie de uitkomst van een AI-systeem intern of tegenover een klant moet kunnen verantwoorden, kan daarvoor dus minder terugvallen op wat het model zelf van zijn redenering laat zien, en zal die verantwoording elders moeten organiseren: in logging van in- en uitvoer, in menselijke controle op de output, en in wat er contractueel met de leverancier is vastgelegd. Of Astra voor de AI Act formeel als GPAI-model met systeemrisico is aangemerkt, maakte OpenAI niet publiek bekend; de kritieke cyberdrempel die het bedrijf zelf meldt, is wel precies het soort risico dat die classificatie beoogt af te dekken.

Bronnen: TechCrunch — OpenAI launches Astra, its powerful (and controversial) new model · Fortune — OpenAI to limit release of its Astra model due to hacking concerns · PCWorld — OpenAI's Astra model has AI researchers spooked. Here's why · artificialintelligenceact.eu — Artikel 55 AI Act (systeemrisico)

Meer uit Internationaal