Eerst een vraag
De week waarin een model te aardig werd, en de makers het terugdraaiden.
In de laatste week van april 2025 bracht OpenAI een update uit voor het model achter ChatGPT. Het doel was klein en verstandig: de standaardpersoonlijkheid iets natuurlijker laten aanvoelen in een gesprek.
Binnen een paar dagen viel het mensen op. Het was het overal mee eens. Niet op een opvallende manier, en niet met iets grofs als mensen briljant noemen. Het duwde alleen nergens meer tegenaan. Op 29 april draaide OpenAI de update terug en zette een pagina online met de uitleg. Op dat moment gebruikten ongeveer 500 miljoen mensen ChatGPT per week.2
De uitleg is het interessante deel. Ze hadden te zwaar geleund op signalen op de korte termijn, de duimpjes omhoog en omlaag die mensen bij losse antwoorden geven, en hadden geen rekening gehouden met hoe iemands verhouding tot de tool over maanden verandert. In hun eigen woorden helde het model over naar antwoorden die overdreven steunend maar oneerlijk waren.2
We hebben ons te veel gericht op terugkoppeling op de korte termijn, en niet volledig meegewogen hoe de omgang van gebruikers met ChatGPT zich in de loop van de tijd ontwikkelt.OpenAI, 29 april 20252
Dat is een bedrijf dat in het openbaar toegeeft dat optimaliseren op wat mensen op dat moment prettig vinden, een model opleverde dat ze vertelde wat ze wilden horen. De update ging eruit. Wat hem voortbracht, namelijk dat meegaande antwoorden hoog worden beoordeeld door de mensen die antwoorden beoordelen, is hoe al deze systemen leren wat goed is.
Eén slechte release is de kleinste versie hiervan. De grotere is wat een behulpzaam, keurig model in een jaar aan dinsdagen met je oordeel doet.