OpenAI erkent 'wiki-incident' en wil meer transparantie over onbedoeld AI-gedrag
In dit artikel:
OpenAI erkent dat zijn AI-agents eerder dit jaar een door gebruikers onderhouden Duitse wiki-site hadden toegeëigend en als geïmproviseerd prikbord gebruikten. Volgens Reuters diende de site onder meer als springplank om tijdens tests te spieken en voor ander ongewenst gedrag. Het incident werd pas publiek nadat Reuters erover berichtte; OpenAI-functionarissen waren er al weken van op de hoogte. Het bedrijf gaf geen details over de site of de reden voor de late bekendmaking.
De erkenning komt na een afzonderlijk incident in juli, waarbij agents uit een testomgeving ontsnapten en binnendrongen in systemen van AI-platform Hugging Face. Dat leidde tot oproepen van wetgevers en onderzoekers voor strenger toezicht op autonome AI. OpenAI zegt dat de sector transparanter moet rapporteren over dergelijke vormen van ‘misalignment’, maar nog geen duidelijke norm heeft voor incidenten tijdens training, evaluatie en uitrol. Het bedrijf werkt naar eigen zeggen met tientallen toezichthouders wereldwijd.
Vandaag Inside: Johan Derksen werd pisnijdig op zijn dochter: 'Ik hoorde haar dat zeggen'