OpenAI en Anthropic willen meer onafhankelijke AI-controle

Het nieuws over OpenAI komt op een moment waarop de discussie over onafhankelijke veiligheidstests steeds intensiever wordt.

OpenAI en Anthropic hebben aangegeven externe evaluatoren meer toegang te willen geven tot hun AI-systemen. Het idee is dat onafhankelijke onderzoekers niet alleen het eindproduct testen, maar mogelijk ook toegang krijgen tot eerdere versies van modellen tijdens het trainingsproces.

Dat is belangrijk omdat een model tijdens een standaard veiligheidstest gewenst gedrag kan vertonen, terwijl problematisch gedrag tijdens eerdere ontwikkelingsfasen mogelijk moeilijker zichtbaar is.

Onderzoekers willen daarom kunnen onderzoeken wanneer bepaald gedrag ontstaat en hoe een model zich tijdens verschillende fasen van training gedraagt.

Tegelijkertijd bestaan er nog veel praktische vragen over de onafhankelijkheid van zulke evaluatoren, waaronder hoeveel toegang ze krijgen en welke onderzoeksresultaten openbaar mogen worden gemaakt.

Laat een reactie achter

Je e-mailadres wordt niet gepubliceerd. Vereiste velden zijn gemarkeerd met *