Interview with Vincent Ginis in De Morgen, by Dieter De Cleene.
Met GPT-6 Astra brengt OpenAI naar eigen zeggen ‘het intelligentste’ model tot dusver op de markt. Wat kan het zoal en is dat een goede zaak? ‘Je kunt het echt hallucinante opdrachten geven’, zegt AI-expert Vincent Ginis (VUB).
In welke mate is Astra spectaculair?
"Wat het model presteert is echt zeer indrukwekkend. Het is nog een stap vooruit in een evolutie die al langer aan de gang is en waarbij AI er steeds beter in slaagt om autonoom en steeds sneller, steeds complexere taken tot een goed einde te brengen.
"De lengte van een taak die AI zelfstandig kan afwerken - uitgedrukt in de tijd die een mens ervoor nodig zou hebben - is de laatste twee jaar elke vier maanden verdubbeld. In 2023 ging het om enkele minuten, nu spreken we over enkele werkdagen.
"Het model maakt ten opzichte van voorgangers en concurrent Claude van Anthropic vooral een verschil op het vlak van computergebruik. Het is nog beter in het uitvoeren van complexe zoekopdrachten of invullen van formulieren. Maar je kunt Astra ook vragen om op basis van een blik op de website van een softwarebedrijf een prototype van hun product van nul na te maken. Je kunt het echt hallucinante opdrachten geven."
Je zou daarbij meer op Astra's oordeel kunnen vertrouwen.
"Tot voor kort moest je een AI-model superviseren als een soort stagiair, die constant feedback nodig heeft over wat die in een volgende stap moet doen. Deze generatie modellen heeft dat soort micromanagement veel minder nodig."
OpenAI presenteert de resultaten van een reeks tests waarop Astra beter scoort dan voorgangers en de concurrentie. Mogen we die zomaar geloven?
"Die resultaten worden vaak met scepsis bekeken, omdat modellen beter scoren op die tests dan in de praktijk. Maar ik hoor van betrouwbare experts die al vervroegde toegang kregen tot Astra dat het echt doet wat het belooft."
Astra maakt een grote sprong in cyberbeveiliging. Is dat een reden tot bezorgheid?
"Het model bevindt zich in de hoogste risicoklasse omdat het erg goed in staat is om zwakheden in cyberbeveiliging bloot te leggen. Eerder dit jaar ontstond om dezelfde reden bezorgdheid over de capaciteiten van Claude Mythos, waarop Anthropic besliste om het enkel aan een beperkte groep vertrouwde bedrijven ter beschikking te stellen.
"OpenAI zegt zijn model na een eerste fase van beperkte toegang toch breed te willen uitrollen. Dat is des te vreemder na het incident van amper anderhalve maand geleden, waarbij een OpenAI-model ongewild het bedrijf Hugging Face hackte. Dan lijkt een brede uitrol mij roekeloos. Het zou goed zijn als hier internationale regelgeving en samenwerking rond komt."
OpenAI suggereert dat hiermee de stap is gezet naar artificial general intelligence (AGI), dat het definieert als ‘AI die de mens in de meest economisch waardevolle taken overtreft’. Legt het bedrijf de lat daarvoor te laag?
"Bij gebrek aan een eenduidige definitie van AGI is dat een discussie over het geslacht der engelen. In welke domeinen moet AI de mens evenaren of overtreffen? En bedoelen we dan de gemiddelde mens of de allerbesten in hun vakgebied?
"Feit is dat AI al in staat is om wiskundige problemen op te lossen die al decennia onopgelost zijn, tot de beste programmeurs ter wereld behoort en wetenschap op doctoraatsniveau beoefent. Persoonlijk denk ik dat we daarmee AGI al een tijdje hebben bereikt, maar daarover verschillen de meningen."
Waarin zit hem de grootste meerwaarde van dit soort modellen?
"We ontwikkelen AI niet in de eerste plaats om ons belastingformulier steeds sneller in te vullen, of lekken in cyberbeveiliging op te sporen.
"Maar modellen als Astra worden door hun capaciteit om meer autonoom te redeneren ook steeds beter in het vooruithelpen van wetenschappelijk onderzoek, door bijvoorbeeld nieuwe medicijnen te suggereren. Zo kan AI helpen om meer welzijn en welvaart te creëren, en dat is waar het uiteindelijk om draait." (DD)