Anthropic og Accenture vil hver bruge mindst en milliard dollar over de næste fem år på at gøre evaluering af avanceret AI til en større del af det praktiske arbejde. Det er ikke en ny chatbot. Det er pengene bag dem, der skal prøve at finde fejlene, før de bliver til et problem hos kunderne.
Samarbejdet skal blandt andet lade evalueringsfolk arbejde tættere på Anthropics udvikling af modeller. De skal teste sårbarheder, afprøve sikkerhedsforanstaltninger og se på, om modeller opfører sig anderledes i den virkelighed, virksomheder faktisk bruger dem i.
Aftalen kort
- Anthropic og Accenture forventer hver at investere mindst 1 milliard dollar.
- Perioden er fem år.
- Fokus er evaluering, red teaming og sikkerhedsforanstaltninger.
- Målet er test tættere på brug i rigtige organisationer.

Det kan lyde tørt. Det er også lidt tørt. Men det er en af de mere interessante dele af AI-kapløbet, fordi alle gerne vil tale om, hvad modellerne kan. Færre taler om, hvem der opdager, når de kan noget forkert, eller når de fejler på en måde, der først bliver tydelig, når systemet er koblet på rigtige arbejdsgange.
Anthropic kalder evalueringsarbejdet uafhængigt, men det sker stadig som led i et partnerskab med virksomheden selv. Det er derfor ikke en garanti for, at alle problemer bliver fundet eller offentliggjort. Det er derimod en markant investering i at gøre testningen mere systematisk end en pæn sikkerhedssætning nederst i en pressemeddelelse.
For danske organisationer, der vil bruge AI i større arbejdsgange, er det vigtigste ikke milliarden i sig selv. Det er, at leverandører og rådgivere bliver presset til at kunne forklare, hvordan de har testet systemet, og hvad det ikke bør bruges til. Den samtale er væsentligt mere nyttig end endnu en demo med en god prompt.
Kilde: Anthropic.
Aktører i artiklen








