Meta ने मंगळवारी म्युज स्पार्क 1.3 जारी केले, मॉडेलची नवीनतम आवृत्ती जी त्याच्या म्यूज कोड कोडिंग एजंट आणि मेटा मॉडेल API ला सामर्थ्य देते, असे म्हणतात की अद्यतन एजंटिक आणि कोडिंग कार्यांमध्ये सुधारित कार्यप्रदर्शन प्रदान करते. Meta च्या AI रिसर्च ब्लॉगवर प्रकाशित केलेली घोषणा, कंपनी एक वर्षानंतर आपली मॉडेल लाइन स्पर्धात्मक ठेवण्यासाठी काम करते ज्यामध्ये प्रतिस्पर्ध्यांनी अथक गतीने जलद, स्वस्त आणि अधिक सक्षम प्रणाली पाठवली. Meta च्या AI पुश आणि विस्तीर्ण ब्रेकिंग एआय न्यूज सायकलच्या अधिक कव्हरेजसाठी, प्रकाशन प्रत्येक मोठ्या मॉडेलच्या रिलीजचा मागोवा घेते.
मेटा काय म्हणतो ते नवीन आहे
Meta च्या ब्लॉग पोस्टनुसार, Muse Spark 1.3 हे वापरकर्त्यांसोबत सहयोग करून आणि एकाच, लांब धाग्यात अनेक वर्कफ्लो जगल करून "दीर्घ-क्षितिजाचे कार्य अधिक चांगल्या प्रकारे टिकवून ठेवण्यासाठी" डिझाइन केले आहे. जेव्हा ओपन-एंडेड उद्दिष्ट दिले जाते, तेव्हा कंपनी म्हणते की मॉडेल गोंधळलेल्या आणि विवादित स्त्रोतांमध्ये स्वतःचा संदर्भ निर्माण करण्यासाठी साधनांचा वापर करते, त्याच्या योजनेतील अंतर सक्रियपणे दुरुस्त करते आणि अंतिम वितरण करण्यायोग्य मार्गावर ते काय शिकले याचा मागोवा ठेवते.
मेटाने यावरही जोर दिला की मॉडेलला विविध प्रकारच्या हार्नेसच्या संचामध्ये प्रशिक्षित केले गेले जेणेकरून ते विविध एजंटिक वातावरणात सामान्यीकृत होईल - साधने, मेमरी आणि फीडबॅक लूपचे स्कॅफोल्डिंग जे मॉडेलला चॅटबॉट ऐवजी एजंट म्हणून कार्य करते तेव्हा त्याभोवती असते.
सहयोग करण्यासाठी तयार केलेले, फक्त प्रतिसाद देत नाही
घोषणेमधील एक आवर्ती थीम सहयोग आहे. मेटा म्हणते की म्यूज स्पार्क 1.3 जेव्हा प्रॉम्प्ट अस्पष्ट असतात तेव्हा स्पष्टीकरण करणारे प्रश्न विचारते, जेव्हा ते अडकते तेव्हा वापरकर्त्याला कॉल करते आणि परिणामी कृती करण्यापूर्वी पुष्टी करते. दीर्घ कार्यांवर, मॉडेल वापरकर्त्याच्या प्राधान्यांशी जुळवून घेते, एकतर वारंवार प्रगती अद्यतने प्रदान करते किंवा पार्श्वभूमीत शांतपणे कार्य करते.
कंपनीने असेही म्हटले आहे की हे मॉडेल पूर्वीच्या म्युझ स्पार्क मॉडेल्सपेक्षा अधिक विश्वासार्हतेने जटिल, दीर्घ-स्वरूपातील सूचनांचे पालन करते, अनेक-चरण कार्यांमध्ये तपशीलवार आवश्यकता जतन करून अडचणी सोडल्याशिवाय किंवा विनंती केलेल्या वर्कफ्लोपासून दूर न जाता.
स्वतःच्या मर्यादांची चांगली जाणीव
मेटा ने कॅलिब्रेटेड स्व-ज्ञान म्हणता येईल अशा सुधारणांवर प्रकाश टाकला. मॉडेलला प्रशिक्षित करण्यात आले होते, कंपनीने लिहिले की, "तो काय करू शकतो आणि काय करू शकत नाही, त्याला काय माहित आहे आणि काय माहित नाही आणि जेव्हा ते भ्रमनिरास करणाऱ्या परिणामांऐवजी अडथळे आणते तेव्हा त्याची चांगली जाणीव असणे." मल्टीटास्किंगकडेही विशेष लक्ष वेधले गेले: मॉडेल आता अव्यवस्थित, सिंगल-थ्रेडेड संदर्भांमध्ये योग्य टास्कसाठी इनकमिंग प्रॉम्प्ट अधिक अचूकपणे मॅप करते, जरी वापरकर्त्याने पूर्वीच्या विनंत्यांमध्ये व्यत्यय आणला किंवा पुढे नेला तरीही.
म्यूज कोड आणि मेटा मॉडेल API द्वारे रोलआउट करा
म्युज स्पार्क 1.3 म्युज कोड, मेटा टर्मिनल-आधारित कोडिंग एजंट आणि मेटा मॉडेल API द्वारे ताबडतोब आणत आहे. एक उल्लेखनीय चेतावणी: पूर्वी उपलब्ध तर्क पद्धती आज थेट आहेत, परंतु मेटाने सांगितले की "अधिकतम तर्क" फक्त "आम्ही अतिरिक्त सुरक्षा चाचणी पूर्ण केल्यानंतरच" येईल.
सुरक्षा पुनरावलोकनाच्या मागे एक मोड गेट करण्याचा निर्णय अलीकडच्या काही महिन्यांत संपूर्ण उद्योगात दृश्यमान असलेल्या पॅटर्नचा प्रतिध्वनी करतो, कारण मूल्यमापन पूर्ण होत असताना प्रयोगशाळा त्यांची सर्वात सक्षम कॉन्फिगरेशन वाढवत ठेवतात. मेटा ने संपूर्ण प्रकाशन "वैयक्तिक सुपरइंटिलिजन्स" च्या दिशेने एक पाऊल म्हणून तयार केले, ही महत्त्वाकांक्षा मार्क झुकरबर्गने गेल्या वर्षी संशोधन प्रयत्नांची पुनर्रचना केल्यापासून कंपनीच्या एआय धोरणाच्या केंद्रस्थानी ठेवली आहे.
विकसकांकडून लवकर लक्ष
रिलीझने हॅकर न्यूजवर त्वरित लक्ष वेधले, जिथे कथेने काही तासांतच शेकडो अपव्होट्स गोळा केले. डेव्हलपर सायमन विलिसनने नवीन मॉडेलच्या विरोधात त्यांचा नेहमीचा पेलिकन-ऑन-अ-सायकल SVG बेंचमार्क चालवला आणि नोंदवले की म्यूज स्पार्क 1.3 ने 1.2 पेक्षा लक्षणीय चांगले परिणाम दिले, प्रति धाव सुमारे चार सेंट.
या रिलीझसाठी प्रेक्षक किती नाटकीयपणे परिपक्व झाले आहेत हे त्वरित समुदाय तपासणी प्रतिबिंबित करते. म्युज कोड स्वतःच ऑगस्टच्या सुरुवातीला लाँच झाला, म्यूज स्पार्क 1.2 द्वारे समर्थित, आणि डेव्हलपर्सनी तेव्हापासून सिस्टमला रिव्हर्स-इंजिनियरिंग जुन्या गेम बायनरीपासून दररोजच्या बग फिक्सिंगपर्यंत सर्व गोष्टींवर काम करण्यासाठी ठेवले आहे. हॅकर न्यूजवरील टिप्पणीकर्त्यांनी 1.3 ची त्याच्या पूर्ववर्तीशी तुलना केली, तर इतरांनी नमूद केले की ते कार्याच्या आधारावर मेटा मॉडेल्स आणि GLM-5.3-फ्लॅश सारख्या प्रतिस्पर्ध्यांमध्ये गेले होते.
स्पर्धात्मक चित्र
रिलीझच्या आसपासचा संदर्भ चेंजलॉगइतकाच महत्त्वाचा आहे. गुगलने या आठवड्यात जेमिनी 3.8 फ्लॅश आणि एक सहचर सायबर-केंद्रित प्रकार पाठवले - अंदाजे सहा आठवड्यांतील तिचे तिसरे फ्लॅश-क्लास मॉडेल, Ars Technica ने नमूद केल्याप्रमाणे - OpenAI त्याच्या Astra मॉडेलच्या आसपासच्या सार्वजनिक गाथेशी झगडत आहे. त्या पार्श्वभूमीवर, मेटा म्युझ स्पार्क 1.3 ला हेडलाइनचा पाठलाग करणाऱ्या बेंचमार्क लीडरऐवजी व्यावहारिक, एजंटिक वर्कहॉर्स म्हणून स्थान देत आहे.
सुधारणा पुरेशा आहेत की नाही हे मॉडेलच्या बाजूने प्रकाशित मेटा मूल्यांकनामध्ये आणि शेवटी, ज्या विकासकांच्या हातात गेल्या महिन्यात ताण-चाचणी म्यूज कोड घालवला आहे ते ठरवले जाईल. कंपनीने त्याच्या मूल्यमापनांच्या तपशिलांसह सोबतचा अहवाल देण्याचे वचन दिले आणि सांगितले की अधिक सक्षम तर्क पद्धती मागे आहेत.
आत्तासाठी, मेटाचा संदेश सरळ आहे: तुम्ही कोड लिहिण्यासाठी आणि एजंट्स चालवण्यासाठी वापरत असलेले मॉडेल नोकरीच्या निंदनीय भागांमध्ये चांगले झाले आहे — संदर्भ धारण करणे, स्वतःच्या योजना दुरुस्त करणे आणि मदत केव्हा मागायची हे जाणून घेणे.
---
एआयच्या पुढे राहानवीनतम AI बातम्या, विश्लेषण आणि यश मिळवा — सर्व एकाच ठिकाणी.
अधिक AI बातम्या वाचा →