
По производительности она не уступает Claude Fable 5.1 в большинстве задач и обходится на 40% дешевле в эксплуатации, чем Opus 5.
По бенчмаркам в релизе модель обходит GPT-5.6 Sol в 6 из 6 общих тестов, а GPT-6 Astra - в 4 из 6 (независимые тесты подтверждают минимум Terminal-Bench 4.0: 66,4% против 57,9% у Astra)
Пользователи отмечают заметный прирост скорости на реальных задачах - например, аудит кодовой базы в 200 тыс. строк занял меньше 3 часов против 20+ у предыдущей версии.
Продолжить чтение этой статьи в источнике: anthropic.com