OpenAI ஆனது GPT-6.1 Sol ஐ செப்டம்பர் 29 அன்று வெளியிட்டது, GPT-6 Sol ஆனது, அந்த மாதிரி அறிமுகமான ஏழு நாட்களுக்குப் பிறகு, சுயாதீன தரப்படுத்தல் நிறுவனமான செயற்கை பகுப்பாய்வு கூறுகிறது. இந்த இடமாற்றம் நிறுவனத்தின் DevDay டெவலப்பர் மாநாட்டுடன் ஒத்துப்போனது, இதில் பங்கேற்பாளர்கள் GPT-6.1 Sol ஐப் புதிதாக அறிமுகப்படுத்தப்பட்ட டாட்ஸ் முகவர்களுடன் உடனடியாகப் பயன்படுத்தத் தொடங்கலாம் என்று CNET அறிவித்தது மற்றும் சந்தா மாற்றங்களின் தொகுப்பு.
2026 ஆம் ஆண்டின் முடுக்கிவிடப்பட்ட தரநிலைகளின்படி கூட ஏழு நாள் ஃபிளாக்ஷிப்-டு-ஃபிளாக்ஷிப் மாற்றீடு அசாதாரணமானது, மேலும் OpenAI ஏன் வேகமாக நகர்ந்தது என்று வரையறைகள் தெரிவிக்கின்றன. மாடல் லான்ச்கள், பெஞ்ச்மார்க் சண்டைகள் மற்றும் அவற்றின் கீழ் உள்ள விலைப் போர் ஆகியவற்றின் தொடர்ச்சியான கவரேஜிற்காக, AI Buzz Wire அவை நிகழும்போது முக்கியமான முன்னேற்றங்களைக் கண்காணிக்கும்.
ஏழு நாட்களில் அளவிடக்கூடிய ஜம்ப்
GPT-6.1 Sol ஆனது நிறுவனத்தின் நுண்ணறிவு குறியீட்டில் GPT-6 Sol ஐ விட 4 புள்ளிகளையும், GPT-5.6 Sol ஐ விட 5 புள்ளிகளையும் பெற்றுள்ளது, OpenAI இன் மிகவும் திறமையான மாடலான GPT-6 Astra ஐ விட 1 புள்ளி கீழே இறங்குகிறது என்று செயற்கை பகுப்பாய்வு தெரிவிக்கிறது. நிறுவனத்தின் மதிப்பீடு பகுத்தறிவு, அறிவாற்றல் வேலை, கணிதம் மற்றும் முகவர் பணிகள் ஆகியவற்றை ஒரு ஒப்பீட்டு மதிப்பெண்ணாகக் கலக்கிறது.
ஆதாயங்கள் எங்கு குவிகின்றன என்பதை துணை மதிப்பெண்கள் காட்டுகின்றன. GPT-6.1 Sol ஆனது AA-Briefcase v1.1 இல் 4 புள்ளிகளையும், GDPval-AA v2.1 இல் 5 புள்ளிகளையும் மேம்படுத்தியது, இவை இரண்டும் சோதனை முகவர் அறிவு வேலை. டெர்மினல்-பெஞ்ச் 4.0 புள்ளிகளில் 12 புள்ளிகள் உயர்ந்து, உண்மையான முனையச் சூழல்களில் சிறந்த செயல்திறனுக்கான புள்ளிகள், மனிதநேயத்தின் கடைசித் தேர்வு 5 புள்ளிகள் மற்றும் GDP.pdf 6 புள்ளிகள் உயர்ந்தது.
ஆராய்ச்சிக்காக மாதிரிகளைப் பயன்படுத்தும் எவருக்கும் ஒரு எண் தனித்து நிற்கிறது: AA-Omniscience இல் துல்லியம் 8 புள்ளிகள் உயர்ந்தது, மாயத்தோற்றம் விகிதம் 60 சதவீதத்திலிருந்து 54 சதவீதமாகக் குறைந்தது. இரண்டு புள்ளிவிவரங்களும் முழுமையான சொற்களில் அதிகமாக உள்ளன, ஆனால் பணிப்பாய்வுகளுக்கு பயணத்தின் திசை முக்கியமானது, அங்கு நம்பிக்கையான தவறான பதில் பதில் இல்லாததை விட மோசமாக இருக்கும்.
அதே ஸ்டிக்கர் விலை, நடைமுறையில் மலிவானது
விலை நிர்ணயத்தில், GPT-6.1 Sol ஆனது GPT-6 Sol இன் ரேட் கார்டை ஒரு மில்லியன் உள்ளீட்டு டோக்கன்களுக்கு $2 மற்றும் ஒரு மில்லியனுக்கு $10 வெளியீட்டு டோக்கன்களை வைத்திருக்கிறது, ஆனால் கேச் ரீட் தள்ளுபடி 90 சதவீதத்திலிருந்து 95 சதவீதமாக உயர்கிறது. GPT-6.1 Sol இன் முகவர் பணிச்சுமைகளுக்கான கலப்பு விலை GPT-6 Sol ஐ விட சற்றே குறைவாக உள்ளது என்று செயற்கைப் பகுப்பாய்வு குறிப்பிடுகிறது, GPT-6 Sol 50 சதவிகிதம் தள்ளுபடியில் GPT-5.6 Sol க்கு அறிமுகப்படுத்தப்பட்ட போது பல பயனுள்ள விலைக் குறைப்புகளை விரிவுபடுத்துகிறது.
விலை நிர்ணயம் தான் இங்கு உண்மையான கதை. இரண்டு வெளியீடுகளின் இடைவெளியில், ஓபன்ஏஐ அதன் நடு-நிலை எல்லைக் கோட்டின் பயனுள்ள செலவை இரண்டு முறை பாதியாகக் குறைத்துள்ளது, அதே நேரத்தில் ஒவ்வொரு முறையும் தரத்தை மேல்நோக்கி நகர்த்துகிறது.
ஒரு பணிக்கான செலவு: $0.72 மற்றும் $3.26
ஒரு பணிக்கான செலவு என்பது GPT-6 அஸ்ட்ராவுடனான இடைவெளி அப்பட்டமாக மாறும். அதிகபட்ச முயற்சியில், செயற்கைப் பகுப்பாய்வு GPT-6.1 Sol ஐ ஒரு நுண்ணறிவு குறியீட்டு பணிக்கு $0.72 என்று நிர்ணயிக்கிறது, GPT-6 அஸ்ட்ராவின் $3.26 இல் கால் பங்கிற்கும் குறைவாக உள்ளது. அதன் சொந்த முன்னோடிக்கு எதிராக சேமிப்பு 31 சதவீதம் (ஜிபிடி-6 சோலுக்கு $1.05), மற்றும் ஜிபிடி-5.6 சோலுக்கு எதிராக அவை 64 சதவீதத்தை ($1.99) எட்டுகின்றன.
நிறுவனத்தின் கூற்றுப்படி, GPT-6.1 Sol இன் ஒவ்வொரு முயற்சி நிலையும் செலவு-செயல்திறன் பரேட்டோ எல்லையைத் தள்ளுகிறது - அதாவது கொடுக்கப்பட்ட அளவிலான நுண்ணறிவுக்கு, அது கண்காணிக்கும் மாதிரிகளில் மலிவான விருப்பம் இல்லை. டோக்கன்-செயல்திறன் படம் மிகவும் கலவையானது: GPT-6.1 Sol GPT-6 Sol ஐ விட சுமார் 10 முதல் 30 சதவிகிதம் அதிகமான வெளியீட்டு டோக்கன்களை முயற்சி நிலைகளில் பயன்படுத்துகிறது, இருப்பினும் அதன் குறைந்த மற்றும் நடுத்தர முயற்சி அமைப்புகள் டோக்கன் செயல்திறனுக்காக மிகவும் உகந்ததாக இருக்கும். குறியீட்டு.
ஏன் ஏழு நாள் திருப்புமுனை முக்கியமானது
DevDay இன் பரந்த ஸ்லேட் அதே படத்தை வலுப்படுத்துகிறது. சிஎன்இடியின் அறிக்கை டெவலப்பர்கள் உடனடியாகப் பயன்படுத்தக்கூடிய மூன்று விஷயங்களைச் சுற்றி மாநாட்டை உருவாக்கியது - ஜிபிடி-6.1 சோல், டாட்ஸ் ஏஜெண்டுகள் மற்றும் மறுவேலை செய்யப்பட்ட சந்தா திட்டங்கள் - தொலைதூர ஆராய்ச்சி முன்னோட்டத்தை விட. டெவலப்பர்களுக்கான செய்தி இன்று கிடைக்கும், நாளை சாத்தியமில்லை.
போட்டித் தடையானது பயிற்சி ஓட்டங்களில் இருந்து பயிற்சிக்கு பிந்தைய சுத்திகரிப்பு மற்றும் சேவை உள்கட்டமைப்பிற்கு மாறியுள்ளது என்பதற்கான இந்த குறுகிய சமிக்ஞையை ஃபிளாக்ஷிப் காட்டுகிறது. ஒரு வாரத்தில் அனுப்பப்படும் புள்ளி-நிலை மேம்படுத்தல், தொடக்க நிலை மாடலைக் காட்டிலும் உகந்த சோதனைச் சாவடி மற்றும் புதிய விலைத் தாளைப் போலத் தோற்றமளிக்கிறது, மேலும் போட்டியாளர்களும் அதே வழியில் செயல்படுகின்றனர்: Google செப்டம்பர் 30 அன்று ஜெமினி 4 ஆர்கானை அறிவித்தது, இது ஆரம்பத்தில் அதன் Fairwind திட்டத்தின் மூலம் நம்பகமான சைபர் டிஃபென்டர்களை $2/10 விலையில் சென்றடைகிறது.
டெவலப்பர்களுக்கு, சரிபார்க்கப்பட்ட எண்களில் இருந்து மூன்று நடைமுறைக் குறிப்புகள் பின்பற்றப்படுகின்றன. முதலாவதாக, அதிக கேச் மறுபயன்பாட்டுடன் கூடிய ஏஜென்டிக் பணிச்சுமைகள் 95 சதவீத கேச் தள்ளுபடியிலிருந்து உடனடியாகப் பயனடைகின்றன. இரண்டாவதாக, வரவுசெலவுத்திட்டங்கள் இடம்பெயர்வதற்கு முன் அதிக வெளியீட்டு டோக்கன் நுகர்வு மாதிரியாக இருக்க வேண்டும், ஏனெனில் மாதிரி நீண்ட நேரம் நினைத்தாலும் ஒரு டோக்கன் விலை மாறாது. மூன்றாவதாக, உளவுத்துறையின் கடைசி புள்ளியானது 4x விலை பிரீமியம் மதிப்புள்ள பணிகளுக்கான உச்சவரம்பாக அஸ்ட்ரா உள்ளது - GPT-6.1 Sol இன் வழக்கு என்னவென்றால், பெரும்பாலான வேலைகளுக்கு அது இல்லை.
திரும்பத் திரும்பச் சொல்லத் தகுந்த எச்சரிக்கை: இந்த புள்ளிவிவரங்கள் ஒரு சுயாதீன மதிப்பீட்டாளரிடமிருந்து வந்தவை, இருப்பினும் அதன் முறை கடுமையானது, மேலும் குறியீட்டு மதிப்பெண்கள் குறிப்பிட்ட பணிச்சுமை கலவைகளுக்கு வெகுமதி அளிக்கின்றன. தேவைப்படும் பணிச்சுமைகளைக் கொண்ட குழுக்கள் உற்பத்தி போக்குவரத்தை மாற்றியமைக்கும் முன் தங்கள் சொந்த மதிப்பீடுகளை மீண்டும் இயக்க வேண்டும்.
---
AIக்கு முன்னால் இருங்கள்சமீபத்திய AI செய்திகள், பகுப்பாய்வு மற்றும் முன்னேற்றங்கள் - அனைத்தையும் ஒரே இடத்தில் பெறுங்கள்.
மேலும் AI செய்திகளைப் படிக்கவும் →