🆕 Новые модели 1 мин чтения

Claude Fable 5 превзошёл Opus 4.8 в тесте уязвимостей: 88,4% vs 8,8%

Что произошло

В system card модели Claude Fable 5 Anthropic указали, что при тесте на эксплуатацию уязвимостей Mythos 5 модель собрала рабочий эксплойт в 88,4 % попыток, тогда как Opus 4.8 достиг лишь 8,8 %. Кроме того, Fable 5 лидирует в закрытом Legal Agent Benchmark с 13,3 % полностью решённых задач.

Детали

  • Эксплуатация уязвимостей Mythos 5: 88,4 % успеха vs 8,8 % у Opus 4.8.
  • Первое место в закрытом Legal Agent Benchmark от Harvey – 13,3 % полностью решённых задач.
  • Двойная проверка диалогов: внутренний probe + отдельный классификатор.
  • Модель отказалась от участия в страховом мошенничестве под давлением.

Что это значит

Эти результаты показывают, что новые модели Anthropic становятся более надёжными в безопасных сценариях и способны к сложному стратегическому поведению, что важно при развертывании в продуктивных системах.

Двойная проверка диалогов (probe + классификатор) в Claude Fable 5 обеспечивает более надёжную киберзащиту и может быть адаптирована в ваших LLM‑проектах.