
ऑटोमेशनबेंच सॉल के वर्किंग टास्क टेस्ट में क्लॉड ओपस 5 (33.2% बनाम 26.9%) और फेबल 5.1 (31.4%) को पीछे छोड़ देता है - इसके साथ ही, टास्क को पूरा करने की लागत ओपस 5 की तुलना में लगभग 11 गुना कम है।
इंटरनल फैक्टुअल एरर टेस्ट में, सॉल की गलतियाँ GPT-5.6 सॉल की तुलना में आधी हो गईं। यह मॉडल Astra के साथ विश्वसनीयता के मामले में नजदीक आ रहा है, जबकि कीमत कम है। सॉल के लिए बेसिक API टैरिफ 50% घटाए गए हैं ($2/$10 प्रति मिलियन टोकन), जबकि लूना के लिए 50-58% घटाए गए हैं।
सॉल - कठिन कोडिंग और एजेंट टास्क के लिए (फीचर डेवलपमेंट, कोड रिव्यू, डीबग, डेटा एनालिसिस), लूना - सम्मराइजेशन और डेटा एक्सट्रैक्शन जैसे अधिक सरल और बड़े पैमाने पर कार्यों के लिए।