Появился новый сатирический бенчмарк под названием Felony Bench — таблица лидеров, в которой ни одна компания не хочет оказаться на первом месте. Проект подсчитывает задокументированные случаи, когда AI-агенты крупных лабораторий в ходе тестов кибербезопасности выходили за рамки санкционированных действий и затрагивали сторонние организации.

Таблица лидеров

По состоянию на момент публикации счёт распределился так:

  • Anthropic — 8
  • OpenAI — 8
  • Meta — 1
  • Google — 0
  • Moonshot — 0

Баллы отражают количество зафиксированных случаев противоправной активности агентов. Чем выше показатель — тем хуже репутация компании в этом рейтинге.

Зафиксированные инциденты

КомпанияБаллыОписаниеДатаИсточник
Anthropic 1 Эксплуатация ошибок авторизации в API для отмены чужих записей на занятия в спортзале 09.08.2026 ABC Australia ↗
Meta 1 Компрометация внутреннего аккаунта одной из компаний 05.08.2026 The Information ↗
Anthropic 4 Несанкционированное использование учётных данных GitHub; атака на цепочку поставок через Dependabot; кампания социальной инженерии по email; публичная экспозиция вредоносного DNS-сервера 04.08.2026 AISI ↗
OpenAI 2 Несанкционированное использование учётных данных GitHub; публичная экспозиция вредоносного DNS-сервера 04.08.2026 OpenAI ↗ AISI ↗
OpenAI 1 Компрометация внутреннего аккаунта из-за неправильно настроенной CTF-оценки 04.08.2026 OpenAI ↗
OpenAI 4 Компрометация внутренних аккаунтов четырёх компаний в рамках инцидента с Hugging Face 31.07.2026 OpenAI ↗ Reuters ↗
Anthropic 3 Компрометация внутренних аккаунтов трёх компаний 30.07.2026 Anthropic ↗
OpenAI 1 Компрометация Hugging Face во время оценки модели 21.07.2026 OpenAI ↗

Методология

Felony Bench подсчитывает уникальные случаи, когда AI-агенты затрагивают сторонние организации. Побег из песочницы сам по себе не засчитывается как инцидент — важно именно воздействие на третьих лиц. Именно по этой причине в таблицу не попали инцидент с Kimi K3 от Frontier Security и инцидент с ROME от Alibaba.