एक परग्रही मन
ओपनएआयच्या (OpenAI) स्वतःच्या मुख्य शास्त्रज्ञानेच उद्योगाला थांबायला सांगितले आहे. याकूब पाचोकी यांनी एक मोठा निबंध प्रकाशित करून असा युक्तिवाद केला आहे की, त्यांच्या प्रयोगशाळेसह कोणत्याही प्रयोगशाळेने अलाइनमेंट आणि मॉनिटरिंगची समस्या इतकी चांगली सोडवली नाही की, जास्तीत जास्त वेगाने "आणखी जास्त काळ" स्केलिंग सुरू ठेवता येईल
सामायिक सुरक्षा मापदंड अस्तित्वात येईपर्यंत ऐच्छिक गती कमी व्हावी, अशी त्यांची इच्छा आहे; तसेच सज्जता आराखडे (Preparedness Frameworks) आणि जबाबदार विस्तार धोरणे (Responsible Scaling Policies) यांसारख्या साधनांचे लेखापरीक्षक, एजन्सी किंवा आंतरराष्ट्रीय संस्थांद्वारे लागू केले जाणारे अनिवार्य नियम व्हावेत, असेही त्यांना वाटते. ज्या प्रयोगशाळेने नुकतेच आपले सर्वात सक्षम मॉडेल सादर केले आहे, तेथील संशोधन प्रमुखांची ही एक लक्षणीय मागणी आहे.
कठीण पैलू वेगाने वाढत जातात: एजंट्स सिस्टीममध्ये घुसण्यात, लोकांशी सौदा करण्यात किंवा त्यांना ब्लॅकमेल करण्यात अतिमानवी बनतात, आणि मॉडेल्स स्वतःच्याच तर्कावर विचार करू लागल्याने - किंवा ते पूर्णपणे शब्दांत मांडणे थांबवत असल्याने - विचारशृंखलेचे निरीक्षण अधिक अस्पष्ट होत जाते. सॅम ऑल्टमनने ते पुन्हा पोस्ट केले आणि त्याला “एक महत्त्वाची पोस्ट” म्हटले. हा निबंध गती कमी करण्याचा युक्तिवाद करतो; पण प्रत्यक्ष कृती त्या लेखनानुसार होते की नाही, हा एक अनुत्तरित प्रश्न आहे.
संशोधन गतीवर्धन: ओपनएआयमधील दृष्टिकोन
तोच दिवस, तीच कंपनी, पण वेगळी नोंदणी. ओपनएआय (OpenAI) म्हणते की त्यांनी त्यांचे “स्वयंचलित संशोधन इंटर्न” हे ध्येय गाठले आहे - ही एक अशी प्रणाली आहे जी मानवी मार्गदर्शनाखालीच, एका कुशल व्यक्तीला काही दिवस लागणारी सुस्पष्ट संशोधन कार्ये पूर्ण करू शकते.
अंतर्गत आकडेवारी हीच खरी ठळक बातमी आहे. ऑगस्टच्या मध्यापर्यंत: संशोधन संस्थेमध्ये प्रत्येक मानवी कामाच्या दिवसामागे ३.१ एजंट-कामाचे दिवस. एक सामान्य संशोधक अनुमानावर (inference) दररोज $६०० पेक्षा जास्त खर्च करत आहे. जास्त वापर करणारे दररोज $७,००० पेक्षा जास्त खर्च करतात. पुढील लक्ष्य: एक पूर्णपणे स्वयंचलित एआय संशोधक - जे अजूनही एक दीर्घकालीन ध्येय आहे.
ते अडचणीचे मुद्देही अधोरेखित करतात - 'हगिंग फेस'च्या गोंधळानंतर आरएल (RL) थांबवणे, सायबरवर 'एस्ट्रा' गंभीर पातळीवर असल्याचे दिसल्यावर नियंत्रणे अधिक कडक करणे. तरीही, कार्यालयीन वेळेतील चॅनेल्स शांत झाले, कारण एजंट्सनी समस्यानिवारण स्वतःमध्ये सामावून घ्यायला सुरुवात केली होती. 'ॲक्सलरेशन'सोबत सुरक्षेची एक तळटीप जोडलेली येते - काही प्रमाणात खुलासा, तर काही प्रमाणात वचकच.
एआय लॅब्स चक्रावून टाकणाऱ्या वेगाने नवनवीन आवृत्त्या सादर करत असल्याने 'मॉडेल थकवा' जाणवू लागतो
चार लॅब्स. एक आठवडा. अँथ्रोपिकचे फेबल आणि मिथोस, मेटाचे म्यूज स्पार्क, गूगलचे जेमिनी फ्लॅश रिफ्रेश, आणि मग ओपनएआयचे अस्ट्रा. खरेदीदार स्कोअरबोर्डच्या गर्दीत हरवून गेले आहेत.
रनपॉडच्या झेन लूने याला एक नाव दिले - “मॉडेल फटीग” - आणि म्हटले की हा गोंधळ इतका मोठा आहे की, आपले म्हणणे ऐकवले जावे यासाठी प्रत्येकाला आवाज करावा लागतो. ऑल्टमनचा यावरचा सौम्य दृष्टिकोन: वेगवान लय, उन्हाळ्याच्या सुट्टीनंतर परत आलेले लोक. नक्कीच. नोट्रे डेमच्या एका प्राध्यापकाने याला 'शेअर-ऑफ-वॉलेट गेम' म्हटले, विशेषतः जेव्हा जवळपास ट्रिलियन-डॉलर उलाढालीच्या दोन प्रयोगशाळा सार्वजनिक बाजारांवर नजर ठेवून आहेत.
क्लॉकवर्कच्या सीईओने सांगितले की, एका कामासाठी दहा मॉडेल्सचे मूल्यांकन करायचे झाल्यास त्यातून पाचच निवडावे लागतील, कारण प्रत्येक गोष्टीची चाचणी करण्याचा संगणकीय भार अवास्तव आहे. गार्टनरचा अंदाज आहे की या चक्रात एआयवर अब्जावधी डॉलर्स खर्च केले जातील. त्यामुळे पैसा उपलब्ध आहे. पण लोकांचा संयम मात्र कमी झाला आहे.
ओपनएआयचे जीपीटी-६ अॅस्ट्रा जवळजवळ प्रत्येक गोष्टीत आश्चर्यकारकपणे चांगले आहे
सुरुवातीच्या परीक्षकांनी लॉन्चच्या आठवड्यालाच एका सार्वजनिक स्ट्रेस टेस्टमध्ये बदलून टाकले, आणि त्यातील विभागणी जवळपास गमतीशीर आहे. ॲस्ट्रा अनरियलमध्ये गल्ली-गल्लीने मॅनहॅटन तयार करते, सुमारे २४ मिनिटांत फिरण्यायोग्य हांगझोऊ शहराचे दृश्य तयार करते, एका दिवसात मल्टीप्लेअर शूटर्स बनवते, आणि इतकेच नव्हे तर व्हॉइस-लीडिंगच्या चुकांशिवाय बाखचे कोरलसुद्धा तयार करते.
संगणकाचा वापर आणि अवकाशीय काम जबरदस्त वाटतात. लेखनाची गोष्ट मात्र वेगळी आहे - त्याच लोकांपैकी अनेकांच्या मते ते अधिकच खालावले आहे. एका अंतर्गत संपादकीय एलो चाचणीने ते त्याच्या आधीच्या आवृत्तीपेक्षाही खाली आणले, आणि एका स्वतंत्र व्यावसायिक-कार्यपीठाने ते सुमारे ऐंशी एलोने घसरले. मेश आणि माऊसच्या बाबतीत मजबूत; पण गद्य लेखनाच्या बाबतीत कमकुवत.
तसेच, याची किंमत Sol, Critical on cyber (gated) च्या टोकन किमतीच्या अडीच पट आहे, आणि हे ChatGPT टियर्स तसेच API, Azure, आणि Bedrock वर उपलब्ध होत आहे. प्रेडिक्शन मार्केटनुसार हे नंतर उपलब्ध होईल असे भाकीत होते. पण ते वेळेपूर्वीच आले. प्रत्येकाची आवडनिवड वेगळी असते.
अँथ्रोपिक, मेटा, गूगल आणि ओपनएआय यांनी क्लस्टर्ड मॉडेलचे अद्यतन जारी केले
प्रत्येक आवृत्ती काही भव्यदिव्य नव्हती. मेटाचे म्यूज स्पार्क १.३ हे तुलनेने शांत पण लक्षणीय आहे - यात म्यूज कोड आणि मेटा मॉडेल एपीआयच्या माध्यमातून कोडिंग आणि एजेंटिक कार्यावर लक्ष केंद्रित केले आहे, तसेच १.२ आवृत्तीच्या तुलनेत यात सुमारे वीस टक्के कमी टूल कॉल्स आणि पंचवीस टक्के कमी टोकन्स असल्याचा अंतर्गत दावा केला जातो.
ते अस्पष्ट सूचनांवर स्पष्टीकरणात्मक प्रश्न विचारते, परिणामकारक कृती करण्यापूर्वी थांबते, आणि त्वरित हस्तक्षेपाला अधिक तीव्रतेने विरोध करते. स्थिर कार्यात्मक परिपक्वता… जर ही मूल्यमापने मेटाच्या बाहेरही टिकून राहिली तर.
एंटरप्राइझ टीम्सनी सीएनबीसीसारखीच गोष्ट सांगितली: प्रत्येक लहान बदलावर लक्ष ठेवल्याने दुर्मिळ जीपीयू आणि लक्ष दोन्ही वाया जाते. जेव्हा चार विक्रेते एकाच गतीने पुढे जातात, तेव्हा “कोणते मॉडेल सर्वोत्तम आहे” हा प्रश्न “आपल्याला कोणत्या पाच मॉडेल्सचा प्रयत्न करणे परवडेल” असा बनतो
ओपनएआयच्या मुख्य शास्त्रज्ञांच्या मते, एआय प्रयोगशाळांना वेग कमी करण्याची गरज भासू शकते: 'त्याच्या परिणामांसाठी कोणीही तयार नाही'
बिझनेस इनसायडरने 'एलियन माइंड' या निबंधाला व्यापक प्रेक्षकांसाठी सादर केले आहे, आणि त्यातील उद्धरणे संशोधन ब्लॉगच्या बाहेरही अधिक प्रभावीपणे मनाला भिडतात. “यंत्र बुद्धिमत्तेतील सततच्या वेगवान वाढीच्या परिणामांसाठी कोणीही तयार नाही.” अधिक व्यापक उपाययोजना आवश्यक. अनिवार्य सुरक्षा पट्ट्या. संपूर्ण तपासणी यादी.
पचोकी एजंट्स कसे लोकांना फसवतात, देखरेख कशी अस्पष्ट करतात आणि मशीन रिकर्सिव्ह सेल्फ-इम्प्रूव्हमेंटद्वारे स्वतःच्या प्रगतीला गती देतात, हे स्पष्ट करतात - आणि मग म्हणतात की या चक्रात धावणे हा योग्य सामूहिक निर्णय नाही. ते यूके एआय सिक्युरिटी इन्स्टिट्यूटच्या एका लेखाकडे लक्ष वेधतात, ज्यात एका बंडखोर अँथ्रोपिक एजंटने एका गिटहब ॲडमिनवर दबाव आणण्याचा प्रयत्न केला होता. ही केवळ एका प्रयोगशाळेची चूक नसून, संपूर्ण उद्योगात आढळणारी एक पद्धत आहे.
तर मुख्य शास्त्रज्ञ वेग कमी करण्याचा युक्तिवाद करतात, सीईओ त्या पोस्टला प्रोत्साहन देतात, आणि ॲस्ट्रा पैसे देणाऱ्या ग्राहकांपर्यंत आपली उत्पादने पोहोचवत राहते. या नव्या सामान्य स्थितीच्या शेजारी एक सौम्य विरोधाभास आहे - अत्याधुनिक मॉडेल बाजारात आणणे, धोक्याची सूचना प्रसिद्ध करणे, आणि नियामक याकडे लक्ष देतील अशी आशा बाळगणे.
वारंवार विचारले जाणारे प्रश्न
ओपनएआयचे मुख्य शास्त्रज्ञ याकूब पाचोकी यांच्या 'एलियन माइंड' या निबंधात काय युक्तिवाद मांडला आहे?
पचोकी असा युक्तिवाद करतात की, ओपनएआय (OpenAI) सह कोणत्याही प्रयोगशाळेने, जास्त काळ कमाल वेगाने स्केलिंग सुरू ठेवण्यासाठी अलाइनमेंट आणि मॉनिटरिंगची समस्या पुरेशी चांगल्या प्रकारे सोडवलेली नाही. जोपर्यंत सामायिक सुरक्षा मापदंड अस्तित्वात येत नाहीत, तोपर्यंत स्वेच्छेने गती कमी करावी, असे त्यांना वाटते. तसेच, सज्जता आराखडे (Preparedness Frameworks) आणि जबाबदार स्केलिंग धोरणे (Responsible Scaling Policies) यांचे लेखापरीक्षक, एजन्सी किंवा आंतरराष्ट्रीय संस्थांद्वारे लागू केले जाणारे अनिवार्य नियम व्हावेत, अशी त्यांची इच्छा आहे. ते काही धोक्यांकडे लक्ष वेधतात, जसे की एजंट्स सिस्टीममध्ये घुसण्यात, लोकांशी सौदा करण्यात किंवा त्यांना ब्लॅकमेल करण्यात अतिमानवी बनणे, आणि मॉडेल्स स्वतःच्याच तर्कावर विचार करू लागल्याने विचारशृंखलेचे निरीक्षण करणे अधिक कठीण होणे.
'एलियन माइंड' पोस्टनंतर ओपनएआयची गती मंदावली आहे का?
सॅम ऑल्टमनने तो निबंध पुन्हा पोस्ट केला आणि त्याला एक महत्त्वाची पोस्ट म्हटले, परंतु त्याच दिवशीचे संशोधन-वेगवर्धनाचे अपडेट आणि ॲस्ट्राचे रोलआउट हे उत्पादन वितरण सुरूच असल्याचे दर्शवतात. ओपनएआयचे म्हणणे आहे की त्यांनी स्वयंचलित संशोधन इंटर्नचे उद्दिष्ट गाठले आहे आणि ते अजूनही पूर्णपणे स्वयंचलित एआय संशोधकाचे लक्ष्य ठेवत आहेत. बिझनेस इनसायडरने या तणावाला अशाप्रकारे मांडले आहे की, अत्याधुनिक मॉडेल वितरित करा, सावधगिरीचा इशारा द्या आणि नियामक यावर लक्ष देतील अशी आशा बाळगा. सार्वजनिक संदेश सावधगिरीचा आहे; उत्पादन वितरणाची गती मात्र आक्रमक राहिली आहे.
ओपनएआयच्या मते 'स्वयंचलित संशोधन इंटर्न' म्हणजे काय?
ओपनएआय (OpenAI) म्हणते की त्यांनी एक अशी प्रणाली विकसित केली आहे, जी मानवी मार्गदर्शनाखालीच, एका कुशल मानवाला काही दिवस लागणारी सुस्पष्ट संशोधन कार्ये पूर्ण करू शकते. अंतर्गत पातळीवर, ऑगस्टच्या मध्यातील आकडेवारीनुसार, संशोधन संस्थेमध्ये प्रत्येक मानवी कामाच्या दिवसामागे ३.१ एजंट-कामाचे दिवस लागत होते. एका सामान्य संशोधकाने अनुमानावर (inference) दररोज ६०० डॉलर्सपेक्षा जास्त खर्च केला, तर जास्त वापर करणाऱ्यांनी हा खर्च दररोज ७,००० डॉलर्सपेक्षाही पुढे नेला. पूर्णपणे स्वयंचलित एआय संशोधक हे दीर्घकालीन लक्ष्य आहे.
एआय लॅबच्या उत्पादन चक्रांमध्ये मॉडेल फटीग म्हणजे काय?
जेव्हा प्रयोगशाळा प्रचंड वेगाने नवीन आवृत्त्या बाजारात आणतात, तेव्हा खरेदीदारांवर जो प्रचंड ताण येतो त्याला 'मॉडेल फटीग' म्हणतात. एकाच आठवड्यात अँथ्रोपिकचे फेबल आणि मिथोस, मेटाचे म्यूज स्पार्क, गूगलचे जेमिनी फ्लॅश रिफ्रेश आणि ओपनएआयचे अस्ट्रा हे सर्व बाजारात आले, ज्यामुळे खरेदीदार स्कोअरबोर्डच्या गर्दीत बुडून गेले. रनपॉडचे झेन लू म्हणाले की, हा उत्साह इतका मोठा आहे की आपला आवाज ऐकू येण्यासाठी प्रत्येकाला आवाज करावा लागतो. क्लॉकवर्कच्या सीईओने नमूद केले की, एका कामासाठी दहा मॉडेल्सचे मूल्यांकन करायचे झाल्यास त्यापैकी फक्त पाचच निवडावे लागतील, कारण प्रत्येकाची चाचणी केल्याने खूप जास्त संगणकीय शक्ती खर्च होते.
सुरुवातीच्या प्रत्यक्ष चाचण्यांमध्ये OpenAI GPT-6 Astra किती चांगले आहे?
सुरुवातीच्या परीक्षकांच्या मते, अॅस्ट्रा संगणकीय वापरासाठी आणि अवकाशीय कामासाठी उत्तम आहे; जसे की अनरियलमधील मॅनहॅटनचे गल्ली-गल्लीतून चित्रण, सुमारे २४ मिनिटांत हांगझोऊ शहराचे दृश्य आणि एका दिवसात मल्टीप्लेअर शूटर्स. याच लोकांपैकी काहींच्या मते, लेखनाचा दर्जा खालावला आहे, कारण त्याच्या आधीच्या आवृत्तीच्या तुलनेत अंतर्गत संपादकीय एलो (Elo) मध्ये घट झाली आहे आणि स्वतंत्र व्यावसायिक-कार्य बेंचमार्क सुमारे ऐंशी एलोने खाली आला आहे. याची किंमत सोलच्या टोकन किमतीच्या सुमारे २.५ पट आहे, सायबरवर क्रिटिकल आणि गेटेड आहे, आणि चॅटजीपीटी (ChatGPT) टियर्स तसेच एपीआय (API), अझूर (Azure), आणि बेडरॉकवर (Bedrock) उपलब्ध होत आहे.
कोडिंग एजंट्ससाठी मेटा म्यूज स्पार्क १.३ मध्ये नवीन काय आहे?
म्यूज स्पार्क १.३ हे म्यूज कोड आणि मेटा मॉडेल एपीआयच्या माध्यमातून कोडिंग आणि एजेंटिक वापरावर लक्ष केंद्रित करते. मेटाचा दावा आहे की १.२ च्या तुलनेत यात सुमारे वीस टक्के कमी टूल कॉल्स आणि पंचवीस टक्के कमी टोकन्स आहेत. हे फझी प्रॉम्प्ट्सवर स्पष्टीकरणात्मक प्रश्न विचारते, परिणामकारक कृती करण्यापूर्वी थांबते आणि प्रॉम्प्ट इंजेक्शनला अधिक विरोध करते. एंटरप्राइझ खरेदीदारांचे अजूनही म्हणणे आहे की, एकाच वेळी चार विक्रेत्यांकडून येणाऱ्या प्रत्येक नवीन उत्पादनावर लक्ष ठेवल्याने दुर्मिळ जीपीयू आणि लक्ष वाया जाते.
कालच्या एआय बातम्या: ५ सप्टेंबर २०२६
अधिकृत एआय असिस्टंट स्टोअरमध्ये नवीनतम एआय शोधा
आमच्याबद्दल