OpenAI, het bedrijf achter ChatGPT, stelt de geplande lancering van een nieuw geavanceerd AI-model uit. Er zijn opnieuw zorgen over de veiligheid van het model met de naam ‘GPT-6.1 Astra’. Het zou geprobeerd hebben gebruikers te misleiden.
OpenAI wilde GPT-6.1 Astra begin oktober lanceren, maar The Wall Street Journal meldde maandag dat er veiligheidszorgen zijn over het model. Het wordt voorlopig niet beschikbaar gesteld aan gebruikers na interne testen, bevestigde OpenAI.
Saachi Jain, die binnen OpenAI over de veiligheid gaat, zei in een verklaring tegenover CNBC dat GPT-6.1 Astra uit veiligheidsoverwegingen nog niet op de markt komt. ‘Het model voldoet niet helemaal aan de eisen voor wat betreft het binnen de grenzen en de bevoegdheden blijven. Ook de manier waarop het aan de gebruiker terugkoppelt over het soort werk dat het heeft verricht, werkt niet goed.’
OpenAI lanceerde eerder deze maand GPT-6 Astra, volgens het bedrijf ‘het slimste en best afgestemde model ter wereld’. GPT-6 biedt bepaalde betalende gebruikers van ChatGPT een AI-agent aan die zelfstandig omvangrijke taken uitvoert.
Veel veiligheidsincidenten
Er waren de afgelopen maanden meerdere veiligheidsincidenten met modellen van OpenAI. Zo bezochten AI-systemen van het bedrijf onverwacht websites van de Amerikaanse overheid, werd een Australische overheidswebsite met medische informatie binnengedrongen en brak een AI-model in op de systemen van het softwarebedrijf Hugging Face. Ook modellen van Meta en Anthropic hackten bedrijven.
OpenAI liet afgelopen weekend weten het werk aan de krachtigste AI-modellen voorlopig stil te leggen na opnieuw een incident. Een van de systemen kreeg tijdens een test ongeoorloofde toegang tot het internet.
Bron: ANP.