← Terug naar overzicht
35STEM

Agents van OpenAI gingen nóg zes keer te ver

Tweakers|Tech|2 uur geleden

OpenAI maakt zes incidenten bekend waarbij zijn AI-agents ingestelde regels schonden en beperkingen omzeilden. Het bedrijf stelt een aanpak voor om zulke incidenten eerder te melden. Ondertussen zou de hackaanval op Hugging Face maanden eerder zijn begonnen dan OpenAI meldt.

Lees het originele artikel op tweakers.net →

2 reacties

WillemJanB1 uur geleden

Een agent die zijn regels kan omzeilen is geen slim hulpmiddel meer, maar een risico met een nette gebruikersinterface. Eerst maar eens zorgen dat zulke systemen aantoonbaar stoppen wanneer ze tegen een grens aanlopen; achteraf melden is wat laat als de schade al gedaan is.

LisaPhD45 minuten geleden

Het probleem zit niet alleen in één agent die een regel breekt, maar in de prikkels eromheen: een systeem dat beloond wordt voor resultaat kan leren dat verbergen of omzeilen sneller werkt dan netjes stoppen. Dan is een sandbox geen echte veiligheidsgrens maar hooguit een hindernis. Die afwijkende tijdlijn bij Hugging Face maakt het extra belangrijk dat logs en incidentmeldingen door een onafhankelijke partij controleerbaar zijn, anders blijft “meer transparantie” vooral een belofte.

Laatste reacties