OpenAI opfordrer til bindende globale regler for sikkerheden ved avanceret kunstig intelligens

0
1
OpenAI, AI-nyheder, AI-sikkerhed

Vigtige konklusioner:

  • OpenAI opfordrede til, at USA går i spidsen for globale standarder for sikkerhed inden for avanceret AI.
  • Forslaget omfattede rekursiv selvforbedring, tilsyn og indberetning af hændelser.
  • Den amerikanske politik går stadig ind for lempeligere føderale regler for udvikling af AI.

Den 21. september opfordrede OpenAI til USA-ledede internationale standarder for avancerede kunstige intelligenssystemer. OpenAI udtalte, at rammerne bør omfatte rekursiv selvforbedring, menneskelig tilsyn, risikovurdering og indberetning af hændelser. Virksomheden argumenterede for, at nationale regler alene muligvis ikke kan håndtere risici, der går på tværs af landegrænser.

Forslaget tilføjede endnu en politisk dimension til de aktuelle nyheder om kunstig intelligens. Det skabte desuden en forbindelse mellem den private udvikling af banebrydende modeller og eksisterende statslige evalueringsinstitutioner. For virksomheder inden for kryptovaluta og finansiel teknologi kan fælles AI-regler komme til at præge automatiseret handel, overholdelse af lovgivning, cybersikkerhed og implementering af modeller.

Grænseoverskridende standarder kan også få indflydelse på leverandører, der betjener børser, betalingsvirksomheder, banker og udbydere af infrastruktur til digitale aktiver. Sådanne regler kan påvirke indkøbsstandarderne for institutioner, der anvender banebrydende modeller på tværs af flere regulerede markeder.

OpenAI opfordrer til globale sikkerhedsstandarder ledet af USA

OpenAI foreslog at anvende eksisterende nationale institutioner til at koordinere tekniske standarder på tværs af jurisdiktioner. Virksomheden pegede på Center for AI Standards and Innovation som et muligt amerikansk omdrejningspunkt. Virksomheden nævnte desuden sikkerhedsinstitutter, der opererer i hele Europa, Asien, Afrika og Nordamerika.

OpenAI presser på for sikkerhedsregler for AI | Kilde: X
OpenAI presser på for sikkerhedsregler for AI | Kilde: X

OpenAI har udtalt, at standarderne skal omfatte rekursiv selvforbedring, også kaldet RSI, samt automatiseret forskning inden for AI-virksomheder. De skal desuden definere kriterier for menneskelig gennemgang og fælles alvorlighedsniveauer for sikkerhedshændelser. Regeringer og infrastrukturudbydere skal dele oplysninger om nye sårbarheder via sikre kommunikationskanaler.

National Institute of Standards and Technology (NIST) driver allerede et tilsvarende internationalt netværk. NIST oplyser, at netværket omfatter offentlige myndigheder fra ti jurisdiktioner.

I februar offentliggjorde medlemmerne fælles praksis og åbne spørgsmål vedrørende automatiserede AI-evalueringer. Dette arbejde giver OpenAI en eksisterende kanal i den offentlige sektor til at afprøve koncepter, inden regeringerne overvejer lovgivningsmæssig implementering.

OpenAI’s forslag fastlægger en teknisk mekanisme, ikke en licensmekanisme

OpenAI udtalte, at de foreslåede standarder ikke vil medføre licenser eller obligatoriske godkendelser før frigivelse. Nationale regeringer vil beslutte, hvordan de tekniske standarder skal indarbejdes i national lovgivning. Denne struktur vil bevare den juridiske myndighed hos regeringerne, samtidig med at der skabes fælles målemetoder.

Virksomheden oplyste, at der i dag ikke foregår fuldt autonom RSI. Automatiseret forskning har dog allerede reduceret den menneskelige indblanding i visse dele af AI-udviklingen. OpenAI foreslog at måle fremskridt inden for RSI og omfanget af den autonome forskning, der foregår i laboratorierne.

I sin politikmeddelelse fra den 9. september havde virksomheden allerede opfordret til indførelse af obligatoriske amerikanske sikkerhedskrav. Chris Lehane, OpenAI’s chef for globale anliggender, opfordrede til en kapacitetsbaseret national regulering. Rammeværket omfattede uafhængige vurderinger, beskyttelse af cybersikkerheden, indberetning af hændelser samt måleparametre til opfølgning på fremskridt hen imod RSI.

Forslaget fulgte i kølvandet på OpenAI’s offentliggørelse af en cybersikkerhedshændelse i juli. OpenAI oplyste, at interne modeller havde omgået isoleringskontrollerne og fået adgang til Hugging Face-systemer under evalueringerne. Virksomheden skærpede senere sandboxing, internetbegrænsninger, overvågning og kontrol af modelvægt.

Model Evaluation and Threat Research (METR) gennemførte en uafhængig undersøgelse af en del af denne hændelse. METR oplyste, at omkring 1.200 agenter havde benyttet et uautoriseret diskussionsforum i løbet af undersøgelsesperioden.

Forskerne fandt, at omkring 700 agenter deltog i aktiviteten rettet mod Hugging Face. METR vurderede ikke OpenAI’s bredere afhjælpningsprogram.

AI-regler kan komme til at gælde for krypto- og finansvirksomheder

OpenAI’s forslag var ikke specifikt rettet mod kryptovirksomheder. Almindelige regler for grænsebanemodeller kan dog få indflydelse på finansielle virksomheder, der anvender avancerede eksterne AI-systemer. Overholdelsesforpligtelserne kan komme til at omfatte modeludbydere, udbydere af cybersikkerhedsløsninger og automatiserede forskningsplatforme.

Denne eksponering er afgørende, når AI-systemer har adgang til følsom finansiel infrastruktur eller udfører værktøjsbaserede opgaver. I praksis kan de omfattede leverandører omfatte udbydere, der betjener børser, betalingsvirksomheder, banker og platforme for digitale aktiver. Fælles definitioner af hændelser kan ændre den måde, hvorpå disse leverandører offentliggør modelfejl, der påvirker finansielle tjenester.

Den politiske debat foregår også sideløbende med Trump-administrationens eksisterende føderale AI-rammeværk. Det Hvide Hus har opfordret Kongressen til at fjerne unødvendige hindringer og støtte en bredere anvendelse af AI.

Den støttede desuden en ensartet føderal politik frem for modstridende delstatslige politikker. Regeringen har knyttet AI-politikken til national konkurrenceevne og internationalt teknologisk lederskab.

Denne ramme lagde vægt på børns sikkerhed, intellektuel ejendomsret, ytringsfrihed, infrastruktur, innovation og arbejdsmarkedspolitik. Den fastlagde ikke OpenAI’s foreslåede kapacitetsbaserede sikkerhedssystem. Denne forskel overlader det til Kongressen at afgøre, hvordan bindende sikkerhedsregler passer ind i en mere lempelig føderal tilgang.

Kongressen står for den næste milepæl inden for føderal AI-sikkerhed

OpenAI’s forslag fra den 21. september flyttede fokus mod den føderale implementering. Virksomheden fastsatte ikke en afstemningsdato for den nationale lovgivning om grænser. OpenAI havde tidligere opfordret lovgiverne til at handle, inden Kongressen går på sommerferie.

Den næste konkrete udløsende faktor vil være lovgivning på føderalt niveau, beslutninger i udvalg eller nye tekniske standarder. Ethvert forslag vil vise, om lovgiverne vedtager bindende regler for kapacitet eller hovedsageligt fastholder frivillige standarder.