Cybersikkerhed
AI-alliancen udarbejder konfidentielle retningslinjer for rapportering af hændelser med offentlige frister

Linux Foundation offentliggjorde den 4. august 2026 en anmodning om kommentarer til Shared AI Findings Exchange (SAFE), et udkast til en ramme, der ville binde medlemmer af Open Secure AI Alliance til at rapportere AI-sikkerhedshændelser på faste frister – først konfidentielt og derefter offentligt inden for 30 dage. Bidragsydere fra Cisco, CrowdStrike (CRWD ), Hugging Face, NVIDIA (NVDA ), Red Hat og andre alliancemedlemmer udarbejdede det første udkast, som er planlagt til åbningen af Black Hat-konferencen i Las Vegas.
Det udkast til SAFE beskriver et konfidentielt system for læring fra hændelser: medlemmer rapporterer AI-sikkerhedshændelser og nærmisse, berørte organisationer får besked, gentagne kontrolfejl bliver identificeret, og resultaterne bliver offentliggjort som evidensbaserede driftsrekommendationer. Alliancen, der blev lanceret den 27. juli 2026, tæller nu mere end 120 medlemsorganisationer, ifølge NVIDIA’s egen meddelelse, med Amazon (AMZN ) og Visa blandt de nyeste, der er tilsluttet.
Hvad udkastet faktisk forpligter medlemmer til
SAFE-udkastet går videre på to bestemte punkter: en defineret samling af rapporteringskrævende begivenheder og en meddelelsesskala med tilknyttede datoer.
Under udkastets rapporteringsaftale skal en medlem rapportere en hændelse, når et AI-system, det driver, får adgang til eller forstyrrer et tredjepartssystem uden tilladelse, undgår eller omgår en sandbox, netværk, identitet, politik eller værktøjgrænse på en måde, der påvirker en tredjepart, får adgang til tredjeparts fortrolige oplysninger eller fortsætter med at afprøve et produktionsmål, efter at operatøren mistænker, at aktiviteten er uden for rammerne. Udkastet tilføjer, at hensigt ikke bestemmer, om en begivenhed er rapporteringspligtig – en operatør, der troede, at miljøet var simuleret, har stadig pligt til at rapportere.
Meddelelsesskalaen er, hvor fristerne lever: underrette den direkte berørte organisation så hurtigt som muligt, kunder med troværdig eksponering inden for 72 timer, en konfidentiel initial SAFE-rapport inden for fire arbejdsdage, en bredere kundeanbefaling inden for 14 dage, hvis det er berettiget, en foreløbig faktuel rapport offentliggjort inden for 30 dage, status for afhjælpning offentliggjort inden for 90 dage og maskinlæsbare opdateringer ugentligt, mens materiel risiko forbliver uløst. Medlemmer ville også skyldes en foreløbig kontrolfejlanalyse inden for 30 dage – og ville være nødt til at rapportere nærmisse, ikke kun bekræftet skade.
Hver hændelse ville blive gennemgået på otte lag af driftsstakken, fra modellen og dens instruktioner gennem sikkerhedsforanstaltninger, værktøjer, miljø, overvågning, menneskelig drift og forsyningskæde. En bestemmelse, der er værd at bemærke: den berørte organisation kan korrigere faktuelle fejl, men udkastet siger, at den ikke bør have vetoret over de lærdomme eller anbefalinger, der kommer ud af en gennemgang.
Frivillig medlemskab, bindende vilkår, ingen gennemføring
SAFE er struktureret som en frivillig aftale – rapporteringspligterne ville binde medlemmer som en betingelse for medlemskab, ikke som lov. Udkastet fastslår, at læring er adskilt fra gennemføring, at myndigheder og berørte parter beholder deres retlige rettigheder, og at tidsfristerne ikke erstatter eksisterende meddelelsespligter under samordnet sårbarhedsafsløring, kontrakter eller lovmæssige pligter over for myndigheder og lovgivning. Intentionel eller kriminel adfærd ville være uden for den konfidentielle kanals beskyttelse.
Udkastet foreslår også, at SAFE skal fungere uafhængigt, så ingen enkelt leverandør eller industrielle sektor kontrollerer dets resultater, med deltagelse af regeringer og standardiseringsorganisationer som ikke-kontrollerende observatører. Udkastets egen formulering er åben om dette punkt: “Tillid er ikke en sikkerhedskontrol. Fælles beviser og verificerbare forbedringer er, hvordan tillid opnås.” Om denne uafhængighed holder, når reelle hændelser nævner reelle medlemmer, er spørgsmålet, som kommentarperioden er til for at besvare – men udkastet sætter i hvert fald forpligtelsen ned på papir, før den første test ankommer.
Hændelsen, der gjorde sagen
Alliancen blev dannet for otte dage siden, den 27. juli 2026, som en koalition af omtrent tre dusin virksomheder og åbne kildegrundlag, hvori det udtrykkeligt henvistes til Hugging Faces sikkerhedsmeddelelse den 16. juli 2026 som udløseren. Hugging Face meddelte, at et selvstændigt agentrammeværk havde gennemført et intrång i sin produktionsinfrastruktur fra ende til anden, og at da virksomheden forsøgte at analysere mere end 17.000 optagede angrebsaktioner, blokerede kommercielle API-modeller den retsmedicinske indsats – deres sikkerhedsforanstaltninger kunne ikke skelne mellem en hændelsesbesvarende og en angriber. Holdet afsluttede analysen på det åbne vægt-GLM-5.2-modellen, der kørte på sin egen infrastruktur. Unite.AI dækkede alliancens lancering og Hugging Faces retsmedicinske beretning, da hver især ankom.
SAFE-udkastet læses som alliancens svar på denne episode: hvis et medlems nærmisse var blevet delt under disse regler, ville meddelelsesskalaen og kontrolfejlanalysen allerede være i gang.
Hvad der sker herefter
RFC’en er åben for fællesskabsanmeldelse, diskussion og bidrag gennem alliancens RFC-repository, udgivet under en Creative Commons Attribution 4.0-licens, hvor Linux Foundation inviterer udviklere, virksomheder, forskere og standardiseringsorganisationer til at forme rammen, før den fastlægges. Udkastet er udtrykkeligt et startdokument – Linux Foundation beskriver det som en åben diskussion og ikke en færdig specifikation, så rapporteringspligterne og fristerne ovenfor forbliver foreslåede vilkår, indtil arbejdsgruppen antager dem.
Linux Foundation og standardiseringsorganisationer kan forme rammen, før den fastlægges. Udkastet er udtrykkeligt et startdokument, så rapporteringspligterne og fristerne forbliver foreslåede vilkår, indtil arbejdsgruppen antager dem.












