OpenAI stemt in met vrijwillige AI-benchmarks en toezicht

OpenAI werkt vrijwillig mee aan Amerikaanse benchmarktests voor geavanceerde AI. Dat benadrukt de spanning tussen vrijwillige samenwerking en bindend toezicht en roept vragen op over veiligheid en transparantie.

.
OpenAI stemt in met vrijwillige AI-benchmarks en toezicht

2 Minuten

Volgen op Google

Wanneer een overheid vraagt om onder de motorkap van geavanceerde AI te kijken, aarzelen bedrijven meestal. OpenAI deed dat niet, althans niet volledig. George Osborne, hoofd landen van OpenAI, vertelde een Londens publiek op SXSW dat het bedrijf vrijwillig zal deelnemen aan het nieuwe Amerikaanse proces dat vroegtijdige toegang tot geavanceerde modellen vraagt.

Oorspronkelijk had het uitvoeringsbesluit van het Witte Huis een termijn van 90 dagen voor indienen vóór publicatie als doel. Dat voorstel stuitte op verzet. Het werd versoepeld, naar verluidt tot een verzoek van 30 dagen na publieke tegenreacties en zelfs enige publieke aarzeling van president Trump zelf. De uiteindelijke bewoording vraagt om toegang in plaats van het te eisen, maar geeft nog steeds aan dat er strenger toezicht komt voor de meest capabele systemen.

OpenAI heeft ermee ingestemd zijn modellen van de volgende generatie in een benchmarktest te plaatsen die is ontworpen om de 'geavanceerde cybercapaciteiten van AI-modellen' te evalueren en om mee te helpen de drempel vast te stellen voor wat toezichthouders mogelijk een 'gedekt grensmodel' zouden noemen. Wat betekent dat in de praktijk? Zie het als een stresstest voor software gericht op reële risico's: capaciteiten, misbruikpotentieel en beveiligingspositie worden allemaal gemeten aan de hand van een maatstaf voor het algemeen belang.

Osborne kaderde de stap als proactief. Hij zei dat OpenAI heeft voorgesteld hoe overheden AI-veiligheid en -beveiliging kunnen monitoren, niet alleen in de VS, maar wereldwijd. Die aanpak weerspiegelt een verschuiving in de sector: bedrijven die ooit defensief stonden tegenover regelgeving zien coördinatie nu als een manier om gehaaste, slecht ontworpen regels te vermijden.

Toch is vrijwillige samenwerking iets anders dan bindend toezicht. Bedrijven kunnen meewerken, adviseren of zich verzetten. Ze kunnen ook benchmarks en de definities die daaruit voortvloeien beïnvloeden. Voor beleidsmakers zal de uitdaging zijn ervoor te zorgen dat benchmarks rigoureus, transparant en bestand tegen belangenverstrengeling blijven. Voor bedrijven draait de afweging om reputatie, marktoegang en de praktische last van het overdragen van gevoelige modellen, zelfs aan geverifieerde beoordelaars.

Regulering op verzoek. Benchmarking bij overeenkomst. Een nieuw hoofdstuk over hoe industrie en overheid onderhandelen over de controle op krachtige AI begint, en het roept bekende maar dringende vragen op over verantwoordelijkheid, technische transparantie en wie de veiligheidsgrenzen bepaalt. Blijf dit volgen; de tests zelf kunnen ons meer vertellen dan welk uitvoeringsbesluit dan ook.

Thijs Bakker
"Data-analist en AI-expert. Ik duik diep in de cijfers om de trends achter het nieuws te onthullen."

Laat een reactie achter

Reacties

Nog geen reacties. Wees de eerste.