OpenAI के GPT-5.6 मॉडल AI वर्चस्व की दौड़ में Anthropic के Fable-class को चुनौती देते हैं
OpenAI ने अपने GPT-5.6 परिवार (Sol, Terra, Luna) को जारी किया है, जो AI बेंचमार्क में अत्याधुनिक प्रदर्शन का दावा करता है, Anthropic के Fable-class मॉडलों के ठीक बाद। जबकि OpenAI का Sol 'Agents' Last Exam' और 'Artificial Analysis Coding Agent Index' में आगे है, Anthropic का Fable 5 सॉफ्टवेयर इंजीनियरिंग के लिए एक बेंचमार्क 'SWE-Bench Pro' में बढ़त बनाए हुए है। लेख बताता है कि विभिन्न बेंचमार्क विभिन्न प्रकार की AI क्षमताओं को पुरस्कृत करते हैं—OpenAI व्यापक वर्कफ़्लो प्रबंधन में उत्कृष्ट है, जबकि Anthropic सटीक बग-फिक्सिंग में आगे है। OpenAI बेहतर टोकन दक्षता भी प्रदर्शित करता है, जिससे इसके मॉडल अधिक लागत प्रभावी हो जाते हैं। यह प्रतिस्पर्धा frontier AI में तेजी से हो रहे विकास और विविध शक्तियों को उजागर करती है।
मुख्य बिंदु
- OpenAI का GPT-5.6 Sol व्यापक AI वर्कफ़्लो प्रबंधन कार्यों और टोकन दक्षता में अत्याधुनिक प्रदर्शन का दावा करता है।
- Anthropic का Fable 5 SWE-Bench Pro जैसे सटीक सॉफ्टवेयर इंजीनियरिंग बग-फिक्सिंग बेंचमार्क में बढ़त बनाए हुए है।
- विभिन्न AI बेंचमार्क विशिष्ट क्षमताओं का परीक्षण करते हैं, जिससे मॉडलों के बीच विविध नेतृत्व के दावे होते हैं।
- OpenAI के मॉडल उच्च टोकन दक्षता के कारण बेहतर लागत-प्रभावशीलता प्रदान करते हैं।
- यह प्रतिस्पर्धा frontier AI विकास में तेजी से हो रहे विकास और विविध शक्तियों को दर्शाती है।
परीक्षा तथ्य
- Anthropic के Fable 5 ने SWE-Bench Pro पर 80.3% स्कोर किया।
- OpenAI के GPT-5.6 Sol ने Artificial Analysis Coding Agent Index पर 80 स्कोर किया।
- OpenAI के GPT-5.6 Sol ने Agents' Last Exam पर 53.6 स्कोर किया।
- OpenAI का नया उत्पाद ChatGPT Work है, जो GPT-5.6 पर निर्मित एक agentic मोड है।
पढ़ें। याद रखें। याद करें।
स्पेस्ड-रिपीटिशन फ्लैशकार्ड, दैनिक क्विज़ और ऑफ़लाइन एक्सेस पाएं — एंड्रॉइड पर मुफ़्त।