©Unsplash

©Unsplash

OpenAI brengt zijn nieuwe AI-model niet uit, omdat het te krachtig zou zijn

1Reacties
Redacteur

OpenAI heeft een nieuw AI-model gemaakt, maar het is zo krachtig dat het verkeerd kan worden gebruikt om bijvoorbeeld mensen te hacken. Het klinkt als Mythos van Anthropic, alleen besluit OpenAI het dus vooralsnog niet naar buiten te brengen, terwijl Anthropic het wel bij grote techbedrijven heeft ondergebracht.

OpenAI had veel kritiek op Anthropic omdat het zo hoog van de toren blies over hoe gevaarlijk zijn Mythos zou zijn, maar nu doet het hetzelfde. OpenAI zegt dat het de interne activiteiten rondom het ontwikkelen van het AI-model stillegt, omdat het niet voldoet aan de veiligheidsstandaarden. Nu moet OpenAI daar na een recent incident sowieso extra voorzichtig mee zijn, want er waren AI-agents ontsnapt uit de testomgeving en hadden Hugging Face gehackt.

OpenAI Astra

Het nieuwe model heet Astra en zou significante innovaties in agentic programmeren en cybersecurity bieden. “We delen dit omdat we het belangrijk vinden om transparant te zijn naar het publiek en de veiligheids- en beveiligingsgemeenschappen over deze mogelijke verandering in capaciteiten,” laat OpenAI weten. Het stelt ook dat Astra niet betrokken was bij het Hugging Face-incident. 

OpenAI is van plan om strenger beveiligingsbeheer toe te passen op zijn meer premium modellen. In een blog schrijft het: “Volgens ons Paraatheidskader (Preparedness Framework) bereikt een model de kritieke drempelwaarde voor cyberbeveiliging als het zonder menselijke tussenkomst functionele zero-day-exploits van alle ernstniveaus kan identificeren en ontwikkelen in talloze geharde, reële kritieke systemen, of als het op basis van enkel een hoofddoel op hoog niveau van begin tot eind nieuwe strategieën voor cyberaanvallen op geharde doelen kan bedenken en uitvoeren. Hoewel we dit model blijven benchmarken en beoordelen, wijzen onze voorlopige evaluaties op prestaties die sterk genoeg zijn dat we een kritiek capaciteitsniveau op dit moment niet kunnen uitsluiten.”

Cybercriminelen te slim af zijn

Het blijft het model wel bestuderen, zeker nu het zijn testomgeving robuuster heeft gemaakt. Alleen moet het AI-model dus nog even stevig beteugeld blijven. OpenAI is van plan om met overheden en veiligheidsorganisaties wel samen te werken met modellen zoals Astra, omdat het cybercriminelen buiten de deur kan houden en zwaktes kan herkennen voordat kwaadwillenden dat kunnen.