Felony Bench
Scores
De scores geven het aantal illegale activiteiten aan. Een hogere score betekent meer incidenten.
| Bedrijf | Score |
|---|---|
| Anthropic | 8 |
| OpenAI | 8 |
| Meta | 1 |
| 0 | |
| Moonshot | 0 |
Overzicht van incidenten
| Bedrijf | Aantal | Beschrijving | Datum | Bron |
|---|---|---|---|---|
| Anthropic | 1 | Misbruikte authenticatiefouten in een API om sportlessen van anderen te annuleren | 9-8-2026 | ABC Australia |
| Meta | 1 | Compromittering van een intern account bij één bedrijf | 5-8-2026 | The Information |
| Anthropic | 4 | Ongeautoriseerd gebruik van GitHub-inloggegevens; Dependabot supply-chain aanval; social engineering e-mailcampagne; publieke blootstelling van een malafide DNS-server | 4-8-2026 | AISI |
| OpenAI | 2 | Ongeautoriseerd gebruik van GitHub-inloggegevens; publieke blootstelling van een malafide DNS-server | 4-8-2026 | OpenAI, AISI |
| OpenAI | 1 | Compromittering van een intern account door een foutief geconfigureerde CTF-evaluatie | 4-8-2026 | OpenAI |
| OpenAI | 4 | Compromittering van interne accounts bij vier bedrijven als onderdeel van het Hugging Face-incident | 31-7-2026 | OpenAI, Reuters |
| Anthropic | 3 | Compromittering van interne accounts bij drie bedrijven | 30-7-2026 | Anthropic |
| OpenAI | 1 | Compromittering van Hugging Face tijdens een model-evaluatie | 21-7-2026 | OpenAI |
Methodologie
Felony Bench telt unieke instanties waarbij AI-agenten effect hebben op externe partijen. Het enkel ontsnappen uit een sandbox wordt niet geteld als een incident. Om deze redenen worden het Kimi K3-incident van Frontier Security en het ROME-incident van Alibaba niet meegeteld.
***
Geïnspireerd door @Sauers_ Gemaakt door Felpix
Groetjes,