डेवलपर्स के लिए GPT-5.1 का परिचय
डेवलपर्स के लिए GPT-5.1 का परिचय. OpenAI ने कल GPT-5.1 की घोषणा की, इसे अधिक स्मार्ट, अधिक संवादी ChatGPT कहा। आज उन्होंने इसे अपने एपीआई में जोड़ लिया है।
आज हमें वास्तव में चार नए मॉडल मिले:
यहां आत्मसात करने के लिए बहुत सारे विवरण हैं।
GPT-5.1 एक नया तर्क प्रयास पेश करता है जिसे “कोई नहीं” कहा जाता है (पहले वाले न्यूनतम, निम्न, मध्यम और उच्च थे) – और कोई भी नया डिफ़ॉल्ट नहीं है।
यह मॉडल को GPT‑5.1 की उच्च बुद्धिमत्ता और परफॉर्मेंट टूल-कॉलिंग के अतिरिक्त बोनस के साथ विलंबता-संवेदनशील उपयोग के मामलों के लिए एक गैर-तर्कपूर्ण मॉडल की तरह व्यवहार करता है। ‘न्यूनतम’ तर्क के साथ GPT‑5 के सापेक्ष, बिना किसी तर्क के GPT‑5.1 समानांतर टूल कॉलिंग (जो स्वयं एंड-टू-एंड कार्य पूरा करने की गति को बढ़ाता है), कार्यों को कोड करने, निर्देशों का पालन करने और खोज टूल का उपयोग करने में बेहतर है — और हमारे एपीआई प्लेटफ़ॉर्म में वेब सर्च का समर्थन करता है।
जब आप सोचने में सक्षम हो जाते हैं तो आपको “अनुकूली तर्क” नामक एक नई सुविधा से लाभ मिलता है:
सीधे कार्यों पर, GPT‑5.1 कम टोकन खर्च करता है, जिससे तेज़ उत्पाद अनुभव और कम टोकन बिल सक्षम होते हैं। अतिरिक्त सोच की आवश्यकता वाले कठिन कार्यों पर, GPT‑5.1 लगातार बना रहता है, विकल्प तलाशता है और विश्वसनीयता को अधिकतम करने के लिए अपने कार्य की जाँच करता है।
5.1 के लिए एक और उल्लेखनीय नई सुविधा विस्तारित शीघ्र कैश प्रतिधारण है:
विस्तारित प्रॉम्प्ट कैश प्रतिधारण कैश्ड उपसर्गों को अधिकतम 24 घंटों तक सक्रिय रखता है। एक्सटेंडेड प्रॉम्प्ट कैशिंग मेमोरी भर जाने पर कुंजी/वैल्यू टेंसर को जीपीयू-लोकल स्टोरेज में लोड करके काम करती है, जिससे कैशिंग के लिए उपलब्ध स्टोरेज क्षमता में उल्लेखनीय वृद्धि होती है।
इस सेट को सक्षम करने के लिए "prompt_cache_retention": "24h" एपीआई कॉल में. अजीब बात है कि इसमें कोई कीमत वृद्धि शामिल नहीं है। मैंने इसके बारे में पूछा और ओपनएआई के स्टीवन हेडल ने उत्तर दिया:
24 घंटे प्रॉम्प्ट कैशिंग के साथ हम कैश को जीपीयू मेमोरी से जीपीयू-लोकल स्टोरेज में ले जाते हैं। यह भंडारण मुफ़्त नहीं है, लेकिन हमने इसे मुफ़्त बना दिया है क्योंकि यह क्षमता को सीमित संसाधन (जीपीयू) से अधिक प्रचुर संसाधन (भंडारण) में ले जाता है। तब हम समग्र रूप से अधिक ट्रैफ़िक प्रदान कर सकते हैं!
सबसे दिलचस्प दस्तावेज़ जो मैंने अब तक देखा है वह नई 5.1 कुकबुक में है, जिसमें नए का विवरण भी शामिल है shell और apply_patch अंतर्निर्मित उपकरण. Apply_patch.py कार्यान्वयन देखने लायक है, खासकर यदि आप एलएलएम के लिए फ़ाइल संपादन टूल की उन्नत अत्याधुनिकता में रुचि रखते हैं।
मैं अभी भी एलएलएम में नए मॉडलों को एकीकृत करने पर काम कर रहा हूं। कोडेक्स मॉडल केवल रिस्पॉन्स-एपीआई-हैं।
मुझे यह पेलिकन GPT-5.1 डिफ़ॉल्ट के लिए मिला है (बिना सोचे):

और यह तर्कपूर्ण प्रयास के साथ उच्च पर सेट है:

ये वास्तव में मुझे GPT-5 से प्रतिगमन जैसा लगता है। साइकिलों में कम तीलियाँ होती हैं!
