OpenAI foreslår sikkerhedsdokumentation før træning af de mest avancerede AI-modeller

OpenAI foreslår struktureret dokumentation for risici før træning af frontier-modeller. Selskabet kalder selv rammen et mål, ikke en færdig standard.

OpenAI foreslår sikkerhedsdokumentation før træning af de mest avancerede AI-modeller
Pressegrafik: OpenAI

OpenAI foreslår, at udviklere dokumenterer sikkerhedsrisici mere systematisk, før de fortsætter træningen af de mest avancerede AI-modeller. Selskabet kalder dokumenterne “safety cases”: strukturerede argumenter med evidens for, hvorfor en træningskørsel kan fortsætte forsvarligt.

De tidlige retningslinjer samler arbejdet i tre områder: træning, begrænsning af modellens adgang og overvågning. Hvis en model handler forkert, skal tekniske barrierer begrænse skaden, og overvågning skal gøre det muligt at opdage hændelsen.

Et forslag, ikke en færdig kontrolstandard

OpenAI skriver selv, at rammen er et langsigtet mål, og at det er svært at gøre sikkerhedsvurderinger lige så præcise som i luftfart eller atomindustri. Dokumentet handler desuden om frontier-træning, ikke alle risici ved at gøre modeller tilgængelige for brugere.

Det er ikke en ny lov eller uafhængig certificering. Det er OpenAIs bud på, hvordan selskabet og branchen kan dokumentere beslutninger bedre. Værdien afhænger af, om vurderingerne kan efterprøves af andre end dem, der træner modellen.

Læs OpenAIs tidlige retningslinjer.

Kilde: OpenAI. Selskabet beskriver rammen som under udvikling.

Aktører i artiklen

Læs videre i aktørprofilen

OpenAI OpenAI er AI-selskabet bag ChatGPT, GPT-modellerne, Codex og API-platformen - og en af de aktører, der mest konkret har flyttet AI fra demo til dagligt arbejdsredskab. AI-lab og platform

Skriv et svar

Din e-mailadresse vil ikke blive publiceret. Krævede felter er markeret med *