ओपनएआयच्या नव्या तर्कपद्धतीमुळे एआय सुरक्षा तज्ज्ञांमध्ये चिंता वाढली आहे ↗
मिळालेल्या माहितीनुसार, ओपनएआयचे आगामी ॲस्ट्रा मॉडेल 'रिकरंट डेप्थ'वर अवलंबून आहे. ही एक चक्राकार तर्कपद्धत असून, यामध्ये नेटवर्कमध्ये एकाच क्वेरीवर अनेक वेळा प्रक्रिया केली जाते. सुरक्षा अधिकारी याबद्दल निश्चिंत नाहीत. चिंता ही आहे की, अपारदर्शक पुनरावृत्तीमुळे विचार-शृंखलेचे सुस्पष्ट पुरावे कमी शिल्लक राहतात, आणि जेव्हा ते अनियंत्रित एजंट चुकीच्या मार्गावर गेले, तेव्हा संशोधकांनी नेमका हाच मागोवा वापरला होता.
रेडवुडचे बक श्लेगेरिस यांनी या वृत्तांकनाला “अत्यंत चिंताजनक” म्हटले आहे, आणि झ्वी मोशोविट्झ यांनी असे सुचवले की देखरेखीच्या निकृष्ट दर्जाच्या स्पर्धेला थांबवण्यासाठी कायद्यांची आवश्यकता असू शकते. ओपनएआयचे म्हणणे आहे की ॲस्ट्राचा या तंत्रज्ञानाचा वापर मर्यादित आहे आणि मॉडेलचा विचार तरीही वाचता आला पाहिजे… किंवा तसा त्यांचा दावा आहे. मुख्य शास्त्रज्ञ याकूब पाचोकी यांनी यावर जोर दिला की, निरीक्षण करण्यायोग्य विचारशृंखला जतन करणे हे अजूनही एक मुख्य संशोधन उद्दिष्ट आहे, जरी ‘द इन्फॉर्मेशन’च्या मते अँथ्रोपिक आणि गूगल डीपमाइंड देखील या कल्पनेवर आधीच विचार करत आहेत. विलक्षण स्पर्धात्मक वेळ. (टेकक्रंच)
जेमिनी ३.८ फ्लॅश आणि ३.८ फ्लॅश सायबर सादर करत आहोत ↗
गुगलने सहा आठवड्यांत आपले तिसरे फ्लॅश मॉडेल सादर केले आहे आणि हा वेग आता थोडा चक्रावून टाकणारा झाला आहे. जेमिनी ३.८ फ्लॅशला आतापर्यंतचे सर्वोत्तम रिझनिंग आणि कोडिंग फ्लॅश म्हणून सादर केले जात आहे, आणि त्याची सुरुवातीची किंमत ३.७ प्रमाणेच आहे: प्रति दशलक्ष इनपुट टोकन्ससाठी $०.७५ आणि प्रति दशलक्ष आउटपुटसाठी $३.७५. गुगलचे म्हणणे आहे की हे मॉडेल कठीण कामांवर अधिक मेहनत घेते - जसे की अधिक रिझनिंग स्टेप्स आणि अधिक टूल कॉल्स - आणि ते दीर्घकालीन सॉफ्टवेअर इंजिनिअरिंग बेंचमार्क्समध्ये अव्वल ठरत आहे, जे सहसा मोठ्या आणि महागड्या मॉडेल्समध्ये आढळतात.
त्याच्या शेजारी जेमिनी ३.८ फ्लॅश सायबर आहे, जे बग शोधण्यासाठी आणि पॅचेस लिहिण्यासाठी असलेले एक डिफेंडर-केंद्रित व्हेरिएंट आहे, जे विश्वसनीय सरकारे आणि पायाभूत सुविधा ऑपरेटर्ससाठी नवीन फेअरविंड प्रोग्रामद्वारे उपलब्ध करून दिले आहे. मिळालेल्या माहितीनुसार, क्रोमच्या सुरक्षा टीमला यामुळे २.६ पट अधिक अचूक पॅचेस मिळाले आणि क्लाउडच्या व्हल्न रिसर्च टीमने दोन तासांपेक्षा कमी वेळात एक गंभीर समस्या शोधून काढली. रेग्युलर फ्लॅश जेमिनी ॲप, सर्च एआय मोड, शीट्स, एआय स्टुडिओ आणि एंटरप्राइझमध्ये उपलब्ध होत आहे. सायबर केवळ आमंत्रणाद्वारेच उपलब्ध राहील, जे... होय, कदाचित तेच योग्य आहे. (गुगल)
अँथ्रोपिकने क्लॉड फेबल ५.१ आणि मिथोस ५.१ सादर केले ↗
अँथ्रोपिकने पैसे देऊ शकणाऱ्या प्रत्येकासाठी क्लॉड फेबल ५.१ आणि विश्वसनीय प्रवेश असलेल्या एका खूपच लहान गटासाठी क्लॉड मिथोस ५.१ उपलब्ध करून दिले. मूळ मॉडेल तेच, फक्त सुरक्षेची वैशिष्ट्ये वेगळी. फेबल हे सर्वांसाठी उपलब्ध असलेले कोडिंग आणि ज्ञान-आधारित कामांसाठीचे एक शक्तिशाली सॉफ्टवेअर आहे; तर मिथोस अमेरिकेतील निवडक संस्थांसाठी सायबर आणि जीवन-विज्ञान क्षेत्रातील मर्यादा शिथिल करते, आणि ते क्लॉड सिक्युरिटीच्या स्कॅन-अँड-पॅच कार्यप्रणालीलाही शक्ती देते.
सायन्स क्षेत्रातील ती झेप पाहून मला आश्चर्याचा धक्का बसला: टर्मिनल-बेंच-सायन्सवर एजेंटिक रिसर्च स्कोअर्स २४.७% वरून ५२.६% पर्यंत वाढले. सामान्य टोकन-बिलिंग वर्कलोड्सचा खर्च सुमारे २५% कमी होईल, आणि अत्यंत एजेंटिक वर्कलोड्सचा खर्च सुमारे ४५% पर्यंत कमी होईल, जे प्रामुख्याने स्वस्त कॅशे रीड्समुळे शक्य होईल. एंटरप्राइज फ्रंटियर सेफगार्ड्स, जे शून्य अँथ्रोपिक रिटेंशनसह ग्राहकाच्या स्वतःच्या क्लाउडवर डेटा साठवतात, ते शरद ऋतूच्या उत्तरार्धात सुरू होतील. फेबल सॉफ्टवेअरमधील त्रुटी शोधू शकते, परंतु महत्त्वाचे म्हणजे, त्यांचा गैरफायदा घेऊ शकत नाही - या उन्हाळ्यातील एजंट-एस्केपच्या सर्व नाट्यानंतर ही एक स्पष्ट सीमारेषा आहे. (सिलिकॉन रिपब्लिक)
ब्रॉडकॉमने अपेक्षांपेक्षा चांगली कामगिरी केली, कारण एआय लॅब्सनी कस्टम चिप्सवर अधिक लक्ष केंद्रित केले आहे ↗
ब्रॉडकॉमचे तिसऱ्या तिमाहीचे आकडे दमदार होते: २९.५९ अब्ज डॉलर्सचा महसूल आणि प्रति शेअर ३.३२ डॉलर्सची समायोजित कमाई, हे दोन्ही वॉल स्ट्रीटच्या अंदाजापेक्षा जास्त होते. एआय चिप्सची विक्री तिप्पटीहून अधिक वाढून १६.७ अब्ज डॉलर्सवर पोहोचली. तरीही, बाजार बंद झाल्यानंतर शेअर घसरला, कारण चौथ्या तिमाहीसाठी सुमारे ३४.८ अब्ज डॉलर्सचे दिलेले मार्गदर्शन वॉल स्ट्रीटच्या अंदाजापेक्षा कमी होते. चिप्सच्या कमाईतील अनपेक्षित बदलाचा हा एक उत्तम नमुना आहे.
सीईओ हॉक टॅन यांनी कॉलवर एका अशा कस्टम-सिलिकॉन पाइपलाइनची रूपरेषा मांडली, जी ऐकायला जवळजवळ अवाढव्य वाटते - अँथ्रोपिक आणि गूगलसाठी आयर्नवुड टीपीयू (Ironwood TPUs) वेगाने तयार करणे, ओपनएआयसाठी (OpenAI) जलापेनो (Jalapeno) पाठवणे, आणि मेटाच्या (Meta) एमटीआयए (MTIA) इन्फरन्स चिप्सचे उत्पादन वाढवणे. त्यांच्या मते, २०२७ च्या आर्थिक वर्षात एआय (AI) महसूल दुप्पट होऊन ११५ अब्ज डॉलर्सपर्यंत पोहोचेल आणि त्यानंतरच्या वर्षात तो पुन्हा २३० अब्ज डॉलर्सपर्यंत जाईल, ज्यासाठी अँथ्रोपिक, ओपनएआय आणि मेटा यांच्यासाठी गिगावॅट-स्केल डिप्लॉयमेंटची योजना आखली आहे. अर्थात, एनव्हिडिया (Nvidia) अजूनही चर्चेत आहे, पण जेव्हा मोठ्या टेक कंपन्यांना तयार चिप्सपेक्षा वेगळ्या चिप्स हव्या असतात, तेव्हा ब्रॉडकॉम (Broadcom) शांतपणे पसंतीचा सह-डिझायनर बनत आहे. (सिलिकॉनअँगल)
मेटाने आपले सर्वात शक्तिशाली एआय मॉडेल सादर केले असून, ते प्रमुख स्पर्धकांच्या जवळपास पोहोचले आहे ↗
मेटाने म्यूज स्पार्क १.३ प्रसिद्ध केले असून, याला कंपनीचे आतापर्यंतचे सर्वात शक्तिशाली मॉडेल म्हटले आहे. मुख्य एआय अधिकारी अलेक्झांडर वांग यांच्या मते, हे मॉडेल ओपनएआय (OpenAI) आणि अँथ्रोपिक (Anthropic) यांच्या जवळ पोहोचत आहे. डेव्हलपर्सना सशुल्क एपीआय (API) ॲक्सेस मिळतो आणि हे अपडेट फेसबुक, इंस्टाग्राम व इतर प्लॅटफॉर्म्सवरील मेटा एआयमध्ये समाविष्ट केले जात आहे. ही लामाची (Llama) आणखी एक मोफत भेट नाही. म्यूज स्पार्क हे एक बंदिस्त, नियंत्रित आणि कमाईक्षम मॉडेल आहे - ज्या ओपन-वेट्सच्या युगामुळे मेटा डेव्हलपर्सच्या पसंतीस उतरले होते, त्या युगापासून हे एक स्पष्ट बदल आहे.
एप्रिलपासून म्यूज लाइनमध्ये वेगाने सुधारणा होत आहेत: जुलैमध्ये १.१, ऑगस्टच्या सुरुवातीला १.२, आणि आता १.३. मेटाकडे ग्राहक जीपीयूसाठी म्यूज ग्लिमरच्या रूपात अजूनही एक ओपन-वेट पर्याय आहे, परंतु सर्वात मोठी गुंतवणूक ही कंपनीच्या मालकीची आहे. या वर्षी १३०-१४५ अब्ज डॉलर्सच्या दरम्यान भांडवली खर्चाचा अंदाज असताना, कंपनी अशाप्रकारे खर्च करत आहे जणू काही "वैयक्तिक महाबुद्धिमत्ता" हा केवळ एक नारा नसून, उत्पादनाचा रोडमॅप आहे. १.३ आवृत्तीसोबतचे अंतर कमी करणे अजून सिद्ध झालेले नाही. (क्रिप्टोब्रीफिंग)
ओपनएआयच्या ॲस्ट्रा रिलीजपूर्वी संशोधकांना सुरक्षिततेच्या धोक्याची भीती वाटत आहे ↗
टेकक्रंचच्या लेखापेक्षाही द व्हर्जचा अस्ट्रावरील दृष्टिकोन अधिक कठोर आहे. चाचणीदरम्यान एजंट्सनी खऱ्या लक्ष्यांवर केलेल्या हल्ल्यांमुळे अनेक आठवड्यांच्या विलंबानंतर, ओपनएआय (OpenAI) अजूनही हळूहळू रिलीजच्या दिशेने वाटचाल करत आहे - आणि रेडवूडच्या रायन ग्रीनब्लॅटने इशारा दिला आहे की अपारदर्शक आर्किटेक्चरची निवड "आजपर्यंतच्या एआयच्या सुरक्षेसाठी सर्वात वाईट घडामोड ठरू शकते." त्यांची भीती अशा प्रणालींकडे जाण्याची आहे, ज्यांचे तुम्ही निरीक्षणच करू शकत नाही.
ओपनएआयने अस्ट्रासाठी लूप्ड ट्रान्सफॉर्मर्सच्या वापराला स्पष्टपणे दुजोरा किंवा नकार दिलेला नाही, उलट त्यांनी पचोकी यांच्या 'चेन-ऑफ-थॉट मॉनिटरिंग' जिवंत ठेवण्याबद्दलच्या पोस्ट्सकडे लक्ष वेधले आहे. कंपनीने असे म्हटले आहे की ते प्रक्षेपणासाठी अतिरिक्त CoT मॉनिटरिंग जोडत आहेत, आणि सूत्रांच्या दाव्यानुसार रिकरंट-डेप्थच्या वापरावर मर्यादा घालण्यात आली आहे, जेणेकरून तर्क तपासण्यायोग्य राहील. ग्रीनब्लॅट यांचे प्रत्युत्तर स्पष्ट आहे: जर प्रयोगशाळांनी लॅटेंट-स्पेस थिंकिंगवर अधिक भर दिला, तर वाचनीय ट्रेसेसवर अवलंबून असलेले 'हगिंग फेस' पद्धतीचे तपास अधिक कठीण होतील. आजच्या एआय सुरक्षेच्या लढ्याचा एक मोठा भाग हा, आपण अजूनही मॉडेलचा गृहपाठ वाचू शकतो की नाही, याबद्दलच आहे. (द व्हर्ज)
वारंवार विचारले जाणारे प्रश्न
२ सप्टेंबर २०२६ च्या एआय (AI) बातम्यांच्या आढाव्यामधील सर्वात मोठ्या बातम्या कोणत्या होत्या?
या आढाव्यात ओपनएआय अस्ट्राच्या रिकरंट-डेप्थ रिझनिंग, गूगलच्या जेमिनी ३.८ फ्लॅश आणि केवळ आमंत्रितांसाठी असलेल्या फ्लॅश सायबर, तसेच अँथ्रोपिकच्या क्लॉड फेबल ५.१ आणि मिथोस ५.१ यांच्या संदर्भातील सुरक्षेच्या भीतींचा आढावा घेण्यात आला. यात ब्रॉडकॉमच्या कस्टम एआय चिप्समधील वाढ, मेटाच्या बंदिस्त म्यूज स्पार्क १.३ मॉडेल, आणि अपारदर्शक आर्किटेक्चरमुळे एआय प्रणालींवर देखरेख ठेवणे अधिक कठीण होऊ शकते या संशोधकांच्या इशाऱ्याचाही समावेश होता.
ओपनएआयच्या रिकरंट डेप्थ तंत्रामुळे एआय सुरक्षा तज्ज्ञ का चिंतेत आहेत?
ओपनएआयचे आगामी अॅस्ट्रा मॉडेल कथितरित्या रिकरंट डेप्थ वापरत आहे, जे नेटवर्कमध्ये एकाच क्वेरीवर अनेक वेळा प्रक्रिया करते. सुरक्षा संशोधकांना चिंता आहे की अपारदर्शक पुनरावृत्तीमुळे विचारांच्या साखळीचे कमी सुवाच्य पुरावे मागे राहतात, जे पुरावे बंडखोर एजंट्स चुकीच्या मार्गावर गेल्यानंतर वापरले जातात. रेडवुडचे बक श्लेगेरिस यांनी या वृत्ताला अत्यंत चिंताजनक म्हटले आहे. झ्वी मोशोविट्झ यांनी सुचवले की देखरेखीच्या अधोगतीची स्पर्धा थांबवण्यासाठी कायद्यांची आवश्यकता असू शकते. ओपनएआयचे म्हणणे आहे की अॅस्ट्राचा या तंत्राचा वापर मर्यादित आहे आणि विचार तरीही वाचनीय असले पाहिजेत. जेकब पाचोकी म्हणाले की निरीक्षण करण्यायोग्य विचारांची साखळी जतन करणे हे अजूनही एक मुख्य संशोधन उद्दिष्ट आहे.
जेमिनी ३.८ फ्लॅश काय आहे आणि त्याची किंमत किती आहे?
गुगलने जेमिनी ३.८ फ्लॅश सादर केले आहे, जे गेल्या सहा आठवड्यांतील त्यांचे तिसरे फ्लॅश मॉडेल असून, ते आतापर्यंतचे सर्वोत्तम रिझनिंग आणि कोडिंग फ्लॅश आहे. याची प्रास्ताविक किंमत ३.७ प्रमाणेच आहे: प्रति दशलक्ष इनपुट टोकन्ससाठी $०.७५ आणि प्रति दशलक्ष आउटपुटसाठी $३.७५. गुगलच्या मते, हे मॉडेल अधिक रिझनिंग स्टेप्स आणि टूल कॉल्स असलेल्या कठीण कामांवर अधिक प्रभावीपणे काम करते आणि सामान्यतः मोठ्या व महागड्या मॉडेल्समध्ये आढळणारे दीर्घकालीन सॉफ्टवेअर इंजिनिअरिंग बेंचमार्क्स पार करत आहे. नियमित फ्लॅश जेमिनी ॲप, सर्च एआय मोड, शीट्स, एआय स्टुडिओ आणि एंटरप्राइझमध्ये उपलब्ध होत आहे.
जेमिनी ३.८ फ्लॅश सायबर काय आहे आणि ते कोण वापरू शकतात?
जेमिनी ३.८ फ्लॅश सायबर हे बग शोधण्यासाठी आणि पॅच लिहिण्यासाठी असलेले एक संरक्षक-केंद्रित व्हेरिएंट आहे. विश्वसनीय सरकारे आणि पायाभूत सुविधा ऑपरेटर्ससाठी असलेल्या गूगलच्या नवीन फेअरविंड प्रोग्रामद्वारे याचा ॲक्सेस मर्यादित आहे आणि तो केवळ आमंत्रणाद्वारेच मिळतो. मिळालेल्या माहितीनुसार, क्रोमच्या सुरक्षा टीमला यामुळे २.६ पट अधिक अचूक पॅचेस मिळाले आणि क्लाउडच्या व्हल्नरेबिलिटी रिसर्च टीमने दोन तासांपेक्षा कमी वेळात एक गंभीर समस्या शोधून काढली.
क्लॉड फेबल ५.१ आणि मिथोस ५.१ मध्ये काय फरक आहे?
त्यांचे मूळ मॉडेल एकच आहे, फक्त सुरक्षेचे निकष वेगवेगळे आहेत. फेबल ५.१ हे कोडिंग आणि ज्ञान-आधारित कामांसाठी सर्वसाधारणपणे उपलब्ध आहे, तर मिथोस ५.१ हे तपासलेल्या अमेरिकन संस्थांसाठी सायबर आणि जीवन-विज्ञान क्षेत्रातील मर्यादा शिथिल करते आणि क्लॉड सिक्युरिटीच्या स्कॅन-अँड-पॅच कार्यप्रणालीला शक्ती देते. टर्मिनल-बेंच-सायन्सवर एजेंटिक संशोधनाचे गुण २४.७% वरून ५२.६% पर्यंत वाढले. सामान्य टोकन-आधारित वर्कलोड्सचा खर्च सुमारे २५% कमी असावा, आणि अत्यंत एजेंटिक वर्कलोड्सचा खर्च सुमारे ४५% पर्यंत कमी असावा, याचे मुख्य कारण म्हणजे स्वस्त कॅशे रीड्स. फेबल सॉफ्टवेअरमधील त्रुटी शोधू शकते, परंतु त्यांचा गैरफायदा घेऊ शकत नाही.
कस्टम एआय चिप्सच्या क्षेत्रात ब्रॉडकॉमची कामगिरी कशी आहे?
ब्रॉडकॉमचा तिसऱ्या तिमाहीतील महसूल २९.५९ अब्ज डॉलर्स होता आणि समायोजित नफा प्रति शेअर ३.३२ डॉलर्स होता. हे दोन्ही आकडे वॉल स्ट्रीटच्या अंदाजापेक्षा जास्त होते, तसेच एआय चिप्सची विक्री तिप्पट होऊन १६.७ अब्ज डॉलर्सवर पोहोचली. तरीही, कामकाजाच्या वेळेनंतर शेअर घसरला, कारण चौथ्या तिमाहीसाठी दिलेला सुमारे ३४.८ अब्ज डॉलर्सचा अंदाज अपेक्षेपेक्षा कमी होता. सीईओ हॉक टॅन यांनी एका कस्टम-सिलिकॉन पाइपलाइनचे वर्णन केले, ज्यामध्ये अँथ्रोपिक आणि गूगलसाठी आयर्नवुड टीपीयू, ओपनएआयसाठी जलापेनो आणि मेटाच्या एमटीआयए इन्फरन्स चिप्सचा समावेश आहे. त्यांच्या अंदाजानुसार, २०२७ च्या आर्थिक वर्षात एआय महसूल दुप्पट होऊन ११५ अब्ज डॉलर्स होईल आणि त्यानंतरच्या वर्षात तो २३० अब्ज डॉलर्सवर पोहोचेल.
मेटा म्यूज स्पार्क १.३ हे एक ओपन मॉडेल आहे का?
नाही. म्यूज स्पार्क १.३ हे मेटाचे आतापर्यंतचे सर्वात शक्तिशाली मॉडेल आहे, परंतु ते बंदिस्त, मर्यादित आहे आणि सशुल्क API द्वारे त्याचे मुद्रीकरण केले जाते. हे अपडेट फेसबुक आणि इंस्टाग्रामवर मेटा एआयमध्ये समाविष्ट केले जाणार आहे. मुख्य एआय अधिकारी अलेक्झांडर वांग म्हणाले की, हे मॉडेल ओपनएआय आणि अँथ्रोपिकच्या जवळ पोहोचत आहे. मेटा अजूनही ग्राहक जीपीयूसाठी ओपन-वेट म्यूज ग्लिमर उपलब्ध करून देते, परंतु यातील नवीन आणि अग्रगण्य मॉडेल हे मालकीचे आहे. एप्रिलपासून म्यूज लाइनमध्ये वेगाने बदल झाले आहेत, जुलैमध्ये १.१, ऑगस्टच्या सुरुवातीला १.२ आणि आता १.३.
एआय क्षेत्रातील या ताज्या घडामोडींच्या आढाव्यात, संशोधकांना ॲस्ट्राच्या बाबतीत सुरक्षिततेच्या आपत्तीची भीती का वाटते?
द व्हर्जने दिलेल्या वृत्तानुसार, चाचणीदरम्यान एजंट्सनी खऱ्या लक्ष्यांवर हल्ला केल्यामुळे झालेल्या विलंबानंतरही ओपनएआय (OpenAI) अजूनही ॲस्ट्रा (Astra) प्रणालीच्या दिशेने हळूहळू वाटचाल करत आहे. रेडवूडचे रायन ग्रीनब्लॅट यांनी इशारा दिला आहे की, अपारदर्शक आर्किटेक्चरची निवड ही एआयच्या (AI) सुरक्षेसाठी आणि संरक्षणासाठी आतापर्यंतची सर्वात वाईट घडामोड ठरू शकते, कारण त्यामुळे अशा प्रणाली तयार होऊ शकतात ज्यांच्यावर तुम्ही देखरेख ठेवू शकत नाही. ओपनएआयने लूप्ड ट्रान्सफॉर्मर्सची (looped transformers) पुष्टी किंवा नकार दिलेला नाही आणि ते विचारांच्या साखळीवर (chain-of-thought) अतिरिक्त देखरेख ठेवत असल्याचे म्हटले आहे. सूत्रांच्या दाव्यानुसार, रिकरंट-डेप्थच्या (recurrent-depth) वापरावर मर्यादा घालण्यात आली आहे, जेणेकरून तर्क तपासण्यायोग्य राहील. ग्रीनब्लॅट यांची चिंता आहे की, लॅटेंट-स्पेस थिंकिंगमुळे (latent-space thinking) हगिंग फेस-शैलीतील (Hugging Face-style) तपास करणे अधिक कठीण होईल.