
পারফরম্যান্সের দিক থেকে এটি বেশিরভাগ কাজেই Claude Fable 5.1 এর সমান এবং অপারেশনে এটি Opus 5 এর চেয়ে 40% সস্তা।
বেঞ্চমার্কে, রিলিজের মডেলটি 6টি সাধারণ পরীক্ষার মধ্যে 6টিতে GPT-5.6 Sol এর সামনে এগিয়ে আছে, আর GPT-6 Astra এর সামনে 6টির মধ্যে 4টিতে (স্বতন্ত্র পরীক্ষাগুলি Terminal-Bench 4.0 এর কমপক্ষে 66.4% প্রমাণ করে: Astra এর 57.9% এর বিপরীতে)
ব্যবহারকারীরা বাস্তব কাজে গতির উল্লেখযোগ্য বৃদ্ধি লক্ষ্য করেছে—উদাহরণস্বরূপ, 200,000 লাইনের কোড বেসের অডিট আগের সংস্করণের চেয়ে কম করে 3 ঘন্টার মধ্যে শেষ হয়েছে, যেখানে আগের সংস্করণে এটি 20+ ঘন্টা সময় নিত।
উৎসে এই নিবন্ধটি পড়া চালিয়ে যান: anthropic.com