Markt & Trends

OpenAI: GPT-6 Astra is gelanceerd en claimt 'agi' te zijn

Tweakers

Samenvatting

GPT-6 Astra is gelanceerd voor geselecteerde bedrijven en claimt een nieuw agi-tijdperk, maar concrete benchmarkresultaten ontbreken.

GPT-6 Astra: introductie en beschikbaarheid

OpenAI heeft GPT-6 Astra geïntroduceerd als zijn krachtigste AI-model tot nu toe. Het model komt eerst beschikbaar voor geselecteerde bedrijven en direct voor OpenAI Daybreak-leden. Over enkele dagen volgt een release voor gebruikers met een betaald ChatGPT-abonnement.

OpenAI zegt dat Astra beter presteert dan het huidige frontiermodel GPT-5.6 Sol. De fabrikant noemt vooral verbeteringen bij het aansturen van AI-agents, programmeren en het maken van documenten, spreadsheets en presentaties. Astra zou computers en webbrowsers beter bedienen en zelfstandig websites kunnen bouwen.

GPT-6 Astra en de agi-claim

Tijdens een persbriefing suggereerde OpenAI dat met Astra het agi-tijdperk is begonnen. Die claim blijft moeilijk te toetsen, omdat agi geen vaste, eenduidige definitie heeft. Bovendien publiceerden de media die over de introductie schrijven geen concrete benchmarks of andere bewijsstukken.

Dat onderscheid telt voor BI-teams die AI-agents willen beoordelen. Een model dat afspraken boekt, vacatures zoekt of appartementen vindt, voert andere taken uit dan een systeem dat betrouwbare analyses, spreadsheets of rapportages oplevert. De genoemde mogelijkheden tonen vooral welke taken OpenAI benadrukt; ze bewijzen niet zelfstandig de kwaliteit in een bedrijfsomgeving.

OpenAI meldt ook betere vangrails. De release werd eerder uitgesteld om extra veiligheidsmaatregelen toe te voegen. Volgens het bedrijf weigert Astra jailbreakpogingen beter dan GPT-5.6 Sol, terwijl het model ook eenvoudiger exploits vindt en daarvoor minder tokens gebruikt. Die combinatie maakt onafhankelijke tests van veiligheid en controle noodzakelijk.

GPT-6 Astra: concrete takeaway

Test GPT-6 Astra niet alleen op taakuitvoering. Leg vóór gebruik in BI-processen vast hoe je nauwkeurigheid, broncontrole, browseracties, documentkwaliteit en weigeringen bij risicovolle opdrachten meet. Behandel de agi-claim als een uitspraak van OpenAI zolang openbare benchmarks ontbreken.

Lees het volledige artikel
Meer over Markt & Trends →