Dossier

CAISI en pre-release frontier AI testing

Amerikaanse overheidstesten van frontiermodellen vóór publieke release.

Nieuwsitems

Gekoppelde artikelen

41 artikelen

DeepMind-CEO Demis Hassabis heeft een plan gepubliceerd voor een Amerikaanse toezichthouder die geavanceerde AI-modellen moet screenen op gevaren zoals misleiding en biowapens. Het model, gebaseerd op FINRA, vereist dat labs hun modellen 30 dagen voor release ter review aanbieden. Hassabis wil de onafhankelijke instantie nog dit jaar operationeel hebben.

Demis Hassabis, CEO van Google DeepMind, heeft voorgesteld een standaardenorgaan op te richten voor het reguleren van frontier AI-modellen. Hij pleit ervoor dat de VS de leiding neemt en heeft hierover gesproken met het Witte Huis en Europese functionarissen. Het orgaan zou benchmarks moeten ontwikkelen om risico's van AI te meten, onder andere op het gebied van cybersecurity en biologisch onderzoek. Hassabis wil het orgaan nog dit jaar lanceren.

DeepMind CEO Demis Hassabis stelt voor een onafhankelijk standaardenorgaan op te richten, gemodelleerd naar FINRA, om frontier AI-modellen te testen en best practices te ontwikkelen. Het orgaan zou vrijwillig modellen kunnen beoordelen voor release en later verplichte goedkeuring kunnen eisen. Het voorstel bouwt voort op eerdere ad-hoc beoordelingen door de Amerikaanse overheid.

Google DeepMind CEO Demis Hassabis stelt dat kunstmatige algemene intelligentie (AGI) nog maar een paar jaar verwijderd is en vergelijkt de impact ervan met die van elektriciteit of vuur. In een blogpost pleit hij voor de oprichting van een Amerikaanse Frontier AI Standards Body om de risico's van de meest geavanceerde AI-modellen te beoordelen voordat ze worden ingezet. Hassabis waarschuwt voor nucleaire, biologische en cybersecurity-risico's en benadrukt dat de technologische vooruitgang ons huidige begrip overtreft.

Google DeepMind CEO Demis Hassabis heeft een gedetailleerd voorstel gepubliceerd voor het reguleren van geavanceerde AI. Hij pleit voor een nieuwe Amerikaanse standaardenorganisatie naar het model van financiële toezichthouder FINRA, die evaluatieprotocollen voor frontier-modellen moet ontwikkelen en indien nodig een vertraging van de AI-ontwikkeling kan coördineren. Startups en onderzoeksmodellen worden uitgezonderd. Het voorstel komt te midden van waarschuwingen van economen en AI-onderzoekers over grootschalige banenverlies door AI.

De release van GPT-5.6 toont de macht die de Amerikaanse overheid heeft in het AI-model landschap. ChatGPT Work benadrukt hoe OpenAI zich verder ontwikkelt tot een enterprise leverancier.

Ondanks een gebrek aan transparantie over het goedkeuringsproces heeft OpenAI zijn geavanceerde taalmodel Sol voor het publiek uitgebracht. Experts zoals Mina Narayanan en Andy Konwinski uiten hun onzekerheid over de criteria en wie de beslissingen neemt. De regering-Trump heeft nog geen duidelijke procedure vastgesteld, wat leidt tot kritiek op de ad-hoc aanpak en mogelijke beïnvloeding via persoonlijke connecties.

OpenAI heeft GPT-Live geïntroduceerd, een reeks AI-modellen geoptimaliseerd voor gesproken instructies. De modellen zullen ChatGPT's spraakmodus aandrijven en worden via een API beschikbaar gesteld. GPT-Live-1 gebruikt een full-duplex architectuur voor real-time interactie. Complexe prompts worden doorgestuurd naar GPT-5.5. Daarnaast wordt GPT-5.6 na goedkeuring door de Amerikaanse overheid breed uitgerold.

Anthropic heeft de toegang tot Fable 5 hervat nadat het Amerikaanse ministerie van Handel de exportbeperkingen ophefte. Het model keert terug met strengere filters en afspraken die de VS pre-release toegang geven tot toekomstige modellen. Betaalde gebruikers krijgen tot 7 juli de helft van hun wekelijkse limiet toegewezen, daarna via credits. Het veiligheidsfilter blokkeert het beveiligingslek nu in meer dan 99% van de gevallen, maar kan ook onschuldige codeervragen markeren.

Anthropic's AI-model Fable 5, dat op 12 juni werd stilgelegd vanwege veiligheidszorgen, kan binnen enkele dagen weer beschikbaar komen. De Trump-administratie staat op het punt de beperkingen op te heffen, meldt Axios. Het Pentagon en de NSA moeten nog akkoord geven. Ondertussen is de variant zonder extra veiligheidsbeperkingen, Mythos 5, alweer beschikbaar voor geselecteerde partners.

OpenAI heeft de GPT-5.6-modelfamilie gelanceerd, bestaande uit Sol, Terra en Luna. De modellen worden eerst beperkt uitgerold voor geselecteerde partners na overleg met de Amerikaanse overheid. Tegelijkertijd heeft Anthropic toestemming gekregen om zijn cybersecuritymodel Claude Mythos 5 weer beschikbaar te stellen voor een groep Amerikaanse organisaties.

OpenAI heeft op verzoek van het Witte Huis de publieke release van zijn GPT-5.6 AI-modellen uitgesteld. Het bedrijf zal de modellen eerst delen met een kleine set door de Amerikaanse overheid goedgekeurde klanten, en daarna de toegang stapsgewijs uitbreiden. OpenAI hoopt de modellen binnen enkele weken voor iedereen beschikbaar te stellen. Dit gebeurt twee weken nadat Anthropic zijn meest geavanceerde AI-modellen offline moest halen.

De Amerikaanse overheid neemt steeds meer controle over welke AI-modellen worden uitgebracht, zoals blijkt uit de beperkte preview van OpenAI's GPT 5.6 en de aanhoudende beperkingen op Anthropic's Mythos. Het artikel benadrukt dat de AI-industrie collectieve actie nodig heeft om de politieke gevolgen van geavanceerde AI-capaciteiten aan te pakken. De focus moet liggen op samenwerking in plaats van concurrentie tussen bedrijven.

OpenAI heeft de release van zijn nieuwste AI-model GPT 5.6 opgesplitst na een verzoek van de Amerikaanse overheid. Het bedrijf kondigde een beperkte preview aan voor een kleine groep vertrouwde partners, vergelijkbaar met de eerdere lancering van Anthropic's Mythos. OpenAI uitte onvrede over de stap, maar hoopt op bredere beschikbaarheid binnen enkele weken.

De Trump-administratie heeft OpenAI gevraagd de uitrol van GPT-5.6 te beperken tot door de overheid goedgekeurde partners. Het model heeft volgens The Information 'Mythos-achtige' capaciteiten en moet eerst grondig worden getest op veiligheid. CEO Sam Altman verwacht dat een bredere release enkele weken later mogelijk is.

Volgens The Information heeft de Amerikaanse overheid OpenAI gevraagd de brede uitrol van het nieuwe AI-model GPT-5.6 uit te stellen vanwege nationale veiligheidsrisico's. Het model zou in fasen worden uitgebracht, waarbij de overheid vroege gebruikers per geval goedkeurt. OpenAI CEO Sam Altman liet weten dat GPT-5.6 eerst aan een beperkte groep partners beschikbaar wordt gesteld.

De Amerikaanse overheid dwong Anthropic om zijn twee nieuwste modellen, Fable 5 en Mythos 5, terug te trekken vanwege nationale veiligheidsbezwaren, nadat Amazon-onderzoekers een manier vonden om de beveiliging van Fable 5 te omzeilen. Cybersecurity-onderzoekers noemen de maatregel gevaarlijk in een open brief, en Anthropic zelf benadrukt dat dezelfde jailbreaks ook in andere modellen bestaan. De podcast Equity van TechCrunch bespreekt wat het verbod betekent voor ontwikkelaars en of het onbedoeld goed kan uitpakken voor het bedrijf.

De Amerikaanse overheid dwong Anthropic om de twee nieuwste modellen Fable 5 en Mythos 5 terug te trekken, verwijzend naar nationale veiligheidsrisico's nadat Amazon-onderzoekers een manier zouden hebben gevonden om de veiligheidsmaatregelen van Fable 5 te omzeilen. Cybersecurity-onderzoekers ondertekenden een open brief waarin ze de stap gevaarlijk noemen, en Anthropic merkte op dat dezelfde jailbreaks ook in andere modellen voorkomen. De aflevering van TechCrunchs Equity-podcast bespreekt de gevolgen voor ontwikkelaars en de beursgang van Anthropic.

Anthropic mag Claude Mythos en Fable 5 nog steeds niet uitbrengen na een conflict met de Trump-administratie, maar niemand kan precies zeggen wat het bedrijf fout deed. De onduidelijke regels leiden tot onzekerheid bij AI-bedrijven als OpenAI, Google en Meta, die nu vrezen voor eenzelfde lot.

De Amerikaanse overheid grijpt in door Anthropic's Claude Fable 5 en Mythos 5 aan banden te leggen vanwege nationale veiligheidsrisico's. Experts waarschuwen dat AI-modellen met geavanceerde hackmogelijkheden binnen afzienbare tijd de norm zullen worden, ongeacht deze restricties. Zij pleiten voor een breder en transparanter beleid om met deze ontwikkelingen om te gaan.

Op 9 juni bracht Anthropic zijn Fable AI-model uit. Drie dagen later classificeerde de Amerikaanse overheid het als een gevaarlijk wapen en verbood buitenlanders er toegang toe. Omdat Anthropic geen onderscheid kon maken tussen Amerikanen en buitenlanders, schakelde het bedrijf de toegang voor iedereen uit. De auteurs betogen dat het probleem niet één model is, maar de algemene trend van toenemende AI-capaciteiten, en dat echte oplossingen collectieve actie vereisen.

Anthropic heeft de toegang tot de AI-modellen Claude Fable 5 en Mythos 5 voor alle klanten ingetrokken na een Amerikaanse overheidsrichtlijn die een mogelijke jailbreak als nationaal cybersecurityrisico bestempelt. Het bedrijf betwist de onderbouwing en wijst op vergelijkbare mogelijkheden in andere modellen zoals GPT-5.5. De gebeurtenis leidde tot discussie over modelsoevereiniteit en de risico's van afhankelijkheid van één leverancier. Daarnaast werden nieuwe open-weight modellen uitgebracht, waaronder Kimi-K2.7-Code en MiniMax M3, en werden updates op het gebied van benchmarks en agent-infrastructuur besproken.

De Amerikaanse overheid heeft Anthropic opgedragen de toegang tot de AI-modellen Fable 5 en Mythos 5 per direct voor alle buitenlandse staatsburgers te blokkeren, vanwege nationale veiligheidsbezwaren. Anthropic voldoet aan de exportcontrolerichtlijn, maar stelt dat de vermeende jailbreak-kwetsbaarheid klein is en ook door andere modellen zoals OpenAI's GPT-5.5 kan worden aangetoond. Het bedrijf roept op tot een transparanter wettelijk proces voor dergelijke ingrepen.

President Donald Trump heeft een afgezwakte versie van een AI-uitvoeringsbesluit ondertekend. De overheid krijgt 30 dagen exclusieve toegang tot de meest geavanceerde AI-modellen, zoals Anthropic's Claude Mythos en OpenAI's GPT-5.5, voordat ze openbaar worden. Dit is de eerste grote AI-regelgeving in Trumps tweede termijn.

Donald Trump heeft een uitvoeringsbesluit ondertekend dat een vrijwillig kader creëert voor de federale overheid om nieuwe AI-modellen te beoordelen voordat ze openbaar worden gemaakt. Technologiebedrijven worden gevraagd hun AI-modellen tot 30 dagen voor publicatie met de overheid te delen. Het besluit is een balans tussen nationale veiligheid en het stimuleren van innovatie.

President Trump heeft een herziene uitvoeringsbesluit ondertekend dat AI-bedrijven vraagt om vrijwillig nieuwe modellen 30 dagen voor release aan de overheid voor te leggen. Eerder werd een termijn van 90 dagen overwogen, maar na tegenstand van de industrie werd dit versoepeld. Het besluit verbiedt expliciet verplichte licentiëring of voorafgaande goedkeuring.

President Trump heeft een uitvoeringsbevel uitgesteld dat voorafgaande veiligheidscontroles van AI-modellen door de overheid zou hebben vereist. Hij was niet tevreden met de formulering van het bevel, die volgens hem een belemmering zou kunnen vormen voor Amerikaans leiderschap in AI. Het bevel zou onder meer hebben vereist dat AI-bedrijven zoals OpenAI en Anthropic hun geavanceerde modellen 14 tot 90 dagen voor lancering met de overheid delen.

Een coalitie van conservatieve organisaties onder leiding van Humans First heeft president Donald Trump in een open brief opgeroepen tot een uitvoeringsbesluit dat verplichte veiligheidstests voor geavanceerde AI-modellen vereist voordat ze worden uitgebracht. De groep, met onder meer Stephen K. Bannon, waarschuwt voor risico's voor verkiezingen, cyberveiligheid en kritieke infrastructuur. Ze vergelijken AI-risico's met nucleaire technologie en willen onafhankelijk overheidstoezicht.

METR meldt dat het huidige testkader nauwelijks in staat is om de capaciteiten van Claude Mythos te meten, omdat slechts vijf van de 228 taken het relevante vermogensbereik dekken. Palo Alto Networks waarschuwt dat toonaangevende AI-modellen zoals Mythos automatisch kwetsbaarheden combineren tot kritieke aanvalspaden, waardoor de tijd van eerste toegang tot gegevensverwijdering kan krimpen tot 25 minuten.

De Amerikaanse overheid heeft overeenkomsten gesloten met Google DeepMind, Microsoft en xAI om vroege versies van hun nieuwe AI-modellen te onderzoeken op veiligheid en nationale veiligheid voorafgaand aan de openbaarmaking. De Center for AI Standards and Innovation (CAISI), onderdeel van het ministerie van Handel, benadrukt dat dit onderzoek essentieel is voor het begrijpen van de mogelijkheden van nieuwe AI-modellen en het beschermen van de nationale veiligheid. De overeenkomsten richten zich op risico's rond cybersecurity, biologische veiligheid en chemische wapens. OpenAI en Anthropic sloten al twee jaar eerder vergelijkbare overeenkomsten aan met de Biden-administratie. De nieuwe overeenkomsten komen op het moment dat zorgen groeien over de potentie van de nieuwste AI-modellen, zoals Anthrropics Mythos, om gevaarlijk te zijn voor de openbare veiligheid.

OpenAI deelt vooruitgang in de samenwerking met de US CAISI en UK AISI om de veiligheid en beveiliging van AI te versterken. Tijdens deze samenwerking zijn er concrete veiligheidsverbeteringen gerealiseerd, zoals gezamenlijk red-teaming van beveiligingsmaatregelen en het identificeren van nieuwe beveiligingsrisico's in producten zoals ChatGPT Agent. De samenwerking met CAISI en UK AISI heeft geleid tot verbeteringen in de beveiliging van OpenAI's AI-systemen en heeft aangetoond hoe overheden en bedrijven samen kunnen werken aan de evaluatie en verbetering van AI-veiligheid.

DeepL’s Chief Scientist Stefan Mesken bespreekt hoe AI-onderzoek moet evolueren om op te letten bij opkomende mogelijkheden die ontstaan bij grotere modellen en grotere datasets. Hij legt uit dat nieuwe mogelijkheden plotseling en onvoorspelbaar kunnen verschijnen, en dat onderzoekers moeten denken aan problemen die nog niet oplosbaar zijn, maar dat mogelijk worden met toekomstige technologie. Een voorbeeld is Clarify, een interactief taalhulpmiddel dat op de nieuwe generatie LLMs van DeepL is gebaseerd.

OpenAI en negen Amerikaanse nationale laboratoria hebben een unieke gebeurtenis georganiseerd waarbij meer dan 1.000 wetenschappers samenwerken om AI te gebruiken voor wetenschappelijke ontdekkingen. Tijdens de '1,000 Scientist AI Jam Session' testen onderzoekers toekomstige AI-modellen zoals o3- mini in hun vakgebieden en delen feedback om toekomstige systemen te verbeteren. De gebeurtenis onderstrept de samenwerking tussen OpenAI en de Amerikaanse overheid om de leiderschap van de VS in AI en wetenschap te versterken.