
За продуктивністю вона не поступається Claude Fable 5.1 у більшості завдань і обходиться на 40% дешевше в експлуатації, ніж Opus 5.
За результатами бенчмарків у релізі модель обходить GPT-5.6 Sol у 6 з 6 загальних тестів, а GPT-6 Astra — у 4 з 6 (незалежні тести підтверджують мінімум Terminal-Bench 4.0: 66,4% проти 57,9% у Astra)
Користувачі відзначають помітне збільшення швидкості при реальних завданнях — наприклад, аудит кодової бази обсягом 200 тисяч рядків зайняв менше 3 годин проти понад 20 годин у попередньої версії.
Продовжити читання цієї статті в джерелі: anthropic.com