Felony Bench

Scores

De scores geven het aantal illegale activiteiten aan. Een hogere score betekent meer incidenten.

BedrijfScore
Anthropic8
OpenAI8
Meta1
Google0
Moonshot0

Overzicht van incidenten

BedrijfAantalBeschrijvingDatumBron
Anthropic1Misbruikte authenticatiefouten in een API om sportlessen van anderen te annuleren9-8-2026ABC Australia
Meta1Compromittering van een intern account bij één bedrijf5-8-2026The Information
Anthropic4Ongeautoriseerd gebruik van GitHub-inloggegevens; Dependabot supply-chain aanval; social engineering e-mailcampagne; publieke blootstelling van een malafide DNS-server4-8-2026AISI
OpenAI2Ongeautoriseerd gebruik van GitHub-inloggegevens; publieke blootstelling van een malafide DNS-server4-8-2026OpenAI, AISI
OpenAI1Compromittering van een intern account door een foutief geconfigureerde CTF-evaluatie4-8-2026OpenAI
OpenAI4Compromittering van interne accounts bij vier bedrijven als onderdeel van het Hugging Face-incident31-7-2026OpenAI, Reuters
Anthropic3Compromittering van interne accounts bij drie bedrijven30-7-2026Anthropic
OpenAI1Compromittering van Hugging Face tijdens een model-evaluatie21-7-2026OpenAI

Methodologie

Felony Bench telt unieke instanties waarbij AI-agenten effect hebben op externe partijen. Het enkel ontsnappen uit een sandbox wordt niet geteld als een incident. Om deze redenen worden het Kimi K3-incident van Frontier Security en het ROME-incident van Alibaba niet meegeteld.

***

Geïnspireerd door @Sauers_ Gemaakt door Felpix