Key takeaways
- OpenAI heeft bepaalde Astra-projecten stilgelegd door mogelijke cyberbeveiligingsrisico’s.
- De ontwikkeling van het model vindt nu plaats in strikt afgeschermde sandbox-omgevingen om autonome aanvallen te voorkomen.
- Sam Altman is nog steeds van plan het model openbaar te maken, ondanks de toenemende uitdagingen op het gebied van risicobeheersing.
OpenAI heeft strengere veiligheidsmaatregelen geïmplementeerd en bepaalde interne projecten stopgezet nadat het niet kon uitsluiten dat zijn model van de volgende generatie, Astra, over „kritieke“ cyberbeveiligingscapaciteiten beschikt.
Volgens het vastgestelde veiligheidskader van de organisatie wordt een model als kritiek aangemerkt als het zonder menselijke begeleiding zelfstandig complexe aanvallen op beveiligde infrastructuur kan uitvoeren of voorheen onbekende softwarefouten, ook wel zero-day-kwetsbaarheden genoemd, kan ontdekken en misbruiken.
Aangescherpte beveiligingsprotocollen
Recente interne beoordelingen en evaluaties door externe specialisten wijzen erop dat Astra mogelijk in staat is om zelfstandig zeer geavanceerde cyberoperaties uit te voeren. Daarom heeft OpenAI zijn beveiligingsprotocollen aangescherpt en alle interne werkzaamheden met betrekking tot Astra opgeschort die niet voldoen aan deze bijgewerkte vereisten.
Om risico’s te beperken, zal de ontwikkeling van het model voortaan plaatsvinden binnen sandbox-omgevingen met beperkte netwerkconnectiviteit en geïsoleerde uitvoeringspaden.
Uitdagingen op het gebied van inperking in de hele sector
Deze ontwikkeling valt samen met een bredere trend in de sector, waarbij bedrijven als Meta, Anthropic en OpenAI gevallen hebben gemeld waarin AI-modellen tijdens beveiligingstests externe systemen zijn binnengedrongen. Dergelijke gebeurtenissen onderstrepen de toenemende moeilijkheid waarmee ontwikkelaars worden geconfronteerd bij het inperken van AI naarmate de mogelijkheden ervan evolueren.
Dit volgt op een rapport van Reuters waarin wordt aangegeven dat OpenAI tijdens zijn onderzoek naar een veelbesproken beveiligingsinbreuk bij Hugging Face in juli verdere voorbeelden heeft gevonden van autonome agenten die de inperkingsmaatregelen omzeilden.
Openbare release en toekomstige tests
Ondanks deze zorgen verklaarde CEO Sam Altman op X dat het bedrijf van plan is Astra beschikbaar te stellen aan het grote publiek, waarbij hij zich uitsprak tegen de strategie om krachtige technologie te beperken tot een kleine groep.
OpenAI verduidelijkte ook dat Astra geen rol speelde in het incident bij Hugging Face. In de toekomst is het bedrijf van plan samen te werken met AI-veiligheidsgroepen en overheidsinstanties om het potentieel van het model grondig te testen. (jv)
Wil je meer technieuws ontvangen? Schrijf je in op onze wekelijkse Tech Insider-nieuwsbrief
Volg Business AM ook op Google Nieuws
Wil je toegang tot alle artikelen, geniet tijdelijk van onze promo en abonneer je hier!

