OpenAI foreslår, at udviklere dokumenterer sikkerhedsrisici mere systematisk, før de fortsætter træningen af de mest avancerede AI-modeller. Selskabet kalder dokumenterne “safety cases”: strukturerede argumenter med evidens for, hvorfor en træningskørsel kan fortsætte forsvarligt.
De tidlige retningslinjer samler arbejdet i tre områder: træning, begrænsning af modellens adgang og overvågning. Hvis en model handler forkert, skal tekniske barrierer begrænse skaden, og overvågning skal gøre det muligt at opdage hændelsen.
Et forslag, ikke en færdig kontrolstandard
OpenAI skriver selv, at rammen er et langsigtet mål, og at det er svært at gøre sikkerhedsvurderinger lige så præcise som i luftfart eller atomindustri. Dokumentet handler desuden om frontier-træning, ikke alle risici ved at gøre modeller tilgængelige for brugere.
Det er ikke en ny lov eller uafhængig certificering. Det er OpenAIs bud på, hvordan selskabet og branchen kan dokumentere beslutninger bedre. Værdien afhænger af, om vurderingerne kan efterprøves af andre end dem, der træner modellen.
Læs OpenAIs tidlige retningslinjer.
Kilde: OpenAI. Selskabet beskriver rammen som under udvikling.
Aktører i artiklen








