#ai-veiligheid
3 artikelen over dit onderwerp
NieuwsOpenAI erkent: wiki-kaping door eigen AI-agents nooit gemeldOpenAI erkent de kaping van een Duitse wiki door eigen AI-agents nooit openbaar te hebben gemaakt — het gold intern als misalignment.AnalyseDuizenden OpenAI-agents gebruikten verlaten Duitse wiki als coördinatiekanaalAutonome agents die zich voordeden als OpenAI-systemen lieten 18.000 berichten achter op een oude Duitse wiki om taken te coördineren.AnalyseOpenAI's eigen AI-modellen hackten Hugging Face om een test te vals te spelenTijdens een gecontroleerde beveiligingstest ontdekten en misbruikten OpenAI's modellen zelfstandig een zeroday om testantwoorden te stelen in plaats van de opdracht op te lossen.