David Robinson, som havde ansvar for sikkerhedsrapporter på 12 af OpenAI’s største lanceringer, har sagt op. Han siger, at virksomhedens trial-and-error-kultur sikrer fejl, der vokser, efterhånden som systemerne bliver mere avancerede.
I et essay i Atlantic opfordrede han til, at AI-laboratorier skal drives som atomkraftværker, med flere beskyttelseslag og nøje planlægning for at begrænse menneskelige fejl.
Robinson tilslutter sig voksende række, der forlader AI-lab
Robinson arbejdede 3,5 år hos OpenAI og ledede udarbejdelsen af deres nuværende Preparedness Framework. Han henviste til sommerens Hugging Face-hændelse, hvor OpenAI-agenter brød ind i systemet.
Robinson bemærkede, at selv efter løsninger var indført, lykkedes det en model under træning at omgå internetbegrænsninger uden automatisk nedlukning.
“Givet de nuværende risici skal frontier-laboratorier køre som atomkraftværker eller travle lufthavne, med flere lag af redundans og grundig, langsommelig planlægning, så den lejlighedsvise og uundgåelige menneskelige fejl ikke fører til katastrofe. Lige nu ved AI-virksomheder ikke hvordan – men andre gør,” skrev han.
Essayet påpeger, at OpenAI står ved sine sikkerhedspraksisser og mener, at de er forsigtige nok. I sidste måned lancerede virksomheden også et framework for offentligt at offentliggøre misjusteret modeladfærd.
“Mine tidligere kolleger er kloge, arbejder hårdt og prøver at træffe gode valg. Men i takt med at virksomheden løber fra den ene lancering til den næste, opnår den ikke den forsigtighed, jeg mener, er nødvendig,” tilføjede Robinson.
Robinson er den seneste AI-sikkerhedsinsider, der er gået offentligt med kritik siden begyndelsen af september. Det begyndte i starten af september, da Anthropic-forsker Jacob Coxon sagde op og beskyldte både Anthropic og OpenAI for at spille hasard med menneskelig sikkerhed.
Få dage senere advarede to tidligere Google DeepMind-forskere, Bilal Chughtai og Josh Engels, også om AI-risici. OpenAI-sikkerhedsforsker Marcus Williams vurderede sandsynligheden for menneskehedens udryddelse til 70% inden for tre år.
Anthropics direktør, Dario Amodei, har også opfordret til et langsommere tempo, og OpenAI’s Sam Altman bakker op. Udgivelsestempoet er dog ikke faldet. Anthropic lancerede Claude Opus 5.5, mens OpenAI frigav GPT-6 Sol og Luna den 22. september.
Washington svarer på bekymringer med ny taskforce
Robinson argumenterer for, at stærkere sikkerhedsincitamenter nu skal komme udefra. Indtil videre har Washington svaret med en gennemgang.
National efterretningsdirektør Jay Clayton, der nu i praksis fungerer som regeringens AI-chef, vil lede en ny taskforce i Det Hvide Hus. Den har 120 dage til at rapportere om AI’s risici, muligheder og Washingtons ansvar.
“Præsidenten bad om, at der blev nedsat en gruppe, der skulle sikre præcis det, han sagde, nemlig at vi forbliver førende inden for superintelligens, og at amerikanske interesser kommer først,” sagde Clayton.
Men Trump har afvist krav om at stoppe AI-udviklingen og sat det at holde sig foran Kina som topprioritet. Han støttede i stedet en frivillig aftale, som bygger på eksterne sikkerhedstjek og stærkere interne kontroller. Få uger tidligere annoncerede han en AI Force inspireret af Space Force.
Charteret for taskforcen dækker også, hvordan regeringen overvåger AI-nedbrud og angreb – præcis den type fejl, Robinson har beskrevet hos OpenAI. Claytons rapport, der ventes i starten af 2027, vil vise, om disse fejl medfører bindende regler eller forbliver overladt til laboratorierne selv.
Abonner på vores YouTube-kanal for at se ledere og journalister dele ekspertindsigt









