இன்செப்ஷன் லேப்ஸ் செவ்வாயன்று மெர்குரி 2.5 ஐ வெளியிட்டது, இது அதன் வணிகப் பரவல் மொழி மாதிரியின் புதிய பதிப்பாகும், இது சந்தையில் மிகவும் திறமையான டிஃப்யூஷன் எல்எல்எம் என நிறுவனம் விவரிக்கிறது மற்றும் அதன் அறிவுக்கு, இதுவரை பயிற்றுவிக்கப்பட்ட மிகப்பெரிய பரவல் மொழி மாதிரி. நிறுவனத்தின் அறிவிப்பின்படி, இந்த மாடல் அதன் முன்னோடியான மெர்குரி 2 ஐ விட 40% புத்திசாலித்தனத்தை வழங்குகிறது, அதே சமயம் குறைந்த தாமதம், குறைந்த செலவில் சேவை செய்யும் சுயவிவரத்தைத் தக்க வைத்துக் கொண்டது, இது பரவலான கட்டமைப்பை அதிக அளவு பணிச்சுமைகளுக்கு கவர்ச்சிகரமானதாக மாற்றியுள்ளது.

CEO Stefano Ermon தலைமையிலான நிறுவனம், மெர்குரி 2.5 ஆனது GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite மற்றும் Claude Haiku 4.5 உள்ளிட்ட விலை-உகந்த எல்லை மாடல்களுடன் ஒப்பிடத்தக்கது என்று கூறுகிறது. அந்த ஒப்பீடுகள் விற்பனையாளர்-அறிக்கை செய்யப்பட்டவை மற்றும் சுயாதீன வரையறைகளால் இன்னும் சரிபார்க்கப்படவில்லை, ஆனால் அவை ஒரு பரவல் மாதிரியை - நீண்ட ஆராய்ச்சி ஆர்வத்தை - தன்னியக்கப் பின்னடைவு பதவியில் இருப்பவர்களுக்கு ஒரு உற்பத்தி மாற்றாக நிலைநிறுத்துகின்றன. சமீபத்திய AI மாடல் செய்திகளுக்கு, AI Buzz Wire இன் தற்போதைய மாடல் கவரேஜைப் பின்பற்றவும். சமீபத்திய AI மாதிரி செய்தி

வேகம், சூழல் மற்றும் விலை

தலைப்பு எண்கள் ஆக்ரோஷமானவை. 260,000 டோக்கன்களின் சூழல் சாளரத்துடன், பரவலாகக் கிடைக்கும் NVIDIA GPUகளில் மெர்குரி 2.5 வினாடிக்கு 1,107 டோக்கன்களை உருவாக்குகிறது என்று Inception Labs கூறுகிறது. ஒரு மில்லியன் உள்ளீட்டு டோக்கன்களுக்கு $0.20 மற்றும் ஒரு மில்லியன் வெளியீட்டு டோக்கன்களுக்கு $0.75 என விலை நிர்ணயம் செய்யப்பட்டுள்ளது, வெளியீட்டு விளம்பரம் ஒரு மில்லியன் உள்ளீட்டிற்கு $0.04 மற்றும் ஒரு மில்லியன் வெளியீட்டிற்கு $0.15 மாடலை 80% தள்ளுபடி செய்கிறது.

திறன் பக்கத்தில், மாதிரியானது டியூன் செய்யக்கூடிய பகுத்தறிவுடன் அனுப்பப்படுகிறது - டெவலப்பர்கள் ஒரு கோரிக்கை அடிப்படையில் ஆழத்திற்கான தாமதத்தை வர்த்தகம் செய்ய அனுமதிக்கிறது - இணையான கருவி அழைப்புகள் மற்றும் கட்டமைக்கப்பட்ட தலைமுறைக்கான திட்டத்துடன் சீரமைக்கப்பட்ட JSON வெளியீடு ஆகியவற்றுடன். உற்பத்தி டெலிமெட்ரி மூலம் இயக்கப்படும் பயிற்சி வளையத்தின் முதல் விளைவாக நிறுவனம் வெளியீட்டை உருவாக்குகிறது: மெர்குரி 2 தொடங்கப்பட்டதிலிருந்து, ஆயிரக்கணக்கான டெவலப்பர்கள் அதைக் கட்டமைத்துள்ளனர், டஜன் கணக்கான நிறுவனங்கள் அதைப் பயன்படுத்தியுள்ளன, மேலும் பயன்பாடு ஒரு வரிசையை விட அதிகமாக வளர்ந்துள்ளது.

ஏன் பரவல் மாதிரிகள் வேகமாக உரையை உருவாக்குகின்றன

OpenAI, Google மற்றும் Anthropic இலிருந்து வரும் மெயின்ஸ்ட்ரீம் LLMகள் தானாகப் பின்னோக்கிச் செல்கின்றன: அவை ஒரு நேரத்தில் ஒரு டோக்கனை உருவாக்குகின்றன, ஒவ்வொரு டோக்கனும் அதற்கு முன் உருவாக்கப்பட்ட அனைத்தையும் நிபந்தனையுடன் உருவாக்குகின்றன. அந்த தொடர்ச்சியான சார்பு தலைமுறை வேகத்தின் கீழ் ஒரு கடினமான தளத்தை வைக்கிறது. டிஃப்யூஷன் மொழி மாதிரிகள் அதற்குப் பதிலாக இரைச்சலின் தொகுதியுடன் தொடங்கி அனைத்து டோக்கன்களையும் இணையாக மீண்டும் மீண்டும் செம்மைப்படுத்துகின்றன, இது மாடல் சுத்தமாக ஒன்றிணைவதற்கு பயிற்சியளிக்கப்பட்டவுடன் வழக்கமான GPU வன்பொருளில் அதிக செயல்திறனை அனுமதிக்கிறது.

வர்த்தக பரிமாற்றம் வரலாற்று ரீதியாக தரமாக உள்ளது: பரவல் மாதிரிகள் பகுத்தறிவு மற்றும் அறிவுறுத்தல்-பின்வரும் அளவுகோல்களில் தன்னியக்க பின்னடைவை பின்தொடர்ந்தன. இன்செப்ஷன் லேப்ஸின் முக்கிய பந்தயம் - மற்றும் மெர்குரி 2.5 க்கு அடிப்படையான கூற்று - இந்த இடைவெளியானது, பெரும்பாலான வாடிக்கையாளர்கள் உண்மையில் உணரும் அச்சில் பரவல் வெற்றி பெறும் அளவிற்கு இந்த இடைவெளி குறைந்து விட்டது: உற்பத்தி அளவு தாமதம் மற்றும் செலவு.

ஆரம்பகால வாடிக்கையாளர்களிடமிருந்து உற்பத்தி உரிமைகோரல்கள்

இந்த அறிவிப்பு பெஞ்ச்மார்க் அட்டவணைகளை விட வாடிக்கையாளர் வரிசைப்படுத்தல்களில் பெரிதும் சாய்ந்துள்ளது. நேரடி வாடிக்கையாளர் அழைப்புகளுக்கான AI ஃபோன் முகவர்களை உருவாக்கும் OpenCall, மெர்குரிக்கு நகர்வது அதன் சராசரி மாதிரி மறுமொழி தாமதத்தை தோராயமாக 170 மில்லி விநாடிகளுக்கு கொண்டு வந்ததாக தெரிவித்துள்ளது. OpenCall இன் இணை நிறுவனரும் CEOவுமான Oliver Silverstein, நிறுவனத்தின் P99 மறுமொழி நேரம் பல நிமிடங்களிலிருந்து ஒரு வினாடிக்கும், அதன் சராசரி 0.4 வினாடிகளில் இருந்து 0.2க்குக் கீழும் குறைந்துள்ளது என்று கூறினார்.

AI குறியீட்டு உதவியாளர் தயாரிப்பாளரான ஆக்மென்ட் கோட், சூழல் சுருக்கம், மாதிரி ரூட்டிங் மற்றும் MCP கருவி தேடலுக்கு மெர்குரியைப் பயன்படுத்துகிறது. இன்செப்ஷன் லேப்ஸின் கூற்றுப்படி, மெர்குரிக்கு கச்சிதமான பணிச்சுமைகளை நகர்த்துவது அந்த படியின் தாமதத்தை சுமார் 150 வினாடிகளில் இருந்து 27 வினாடிகள் வரை 82% குறைத்து, தரத்தை பராமரிக்கும் போது அதன் செலவை 90% குறைத்தது. பொருளாதாரம் எங்கு கடிக்கிறது என்பதை பயன்பாட்டு வழக்கு விளக்குகிறது: குறியீட்டு முகவர்கள் ஒவ்வொரு முதன்மை தலைமுறையைச் சுற்றி பல சிறிய துணை மாதிரி அழைப்புகளைச் செய்கிறார்கள், மேலும் அந்த அழைப்புகள் முழுவதும் தாமதம் மற்றும் செலவு கலவை.

மாடலை இயக்கும் என்விடியா, அதன் வன்பொருளையும் எடைபோடுகிறது. என்விடியாவின் ஆக்சிலரேட்டட் கம்ப்யூட்டிங் குழுமத்தின் தயாரிப்பின் மூத்த மேலாளரான ஸ்ருதி கோபார்கர், என்விடியா AI உள்கட்டமைப்பில் மேம்பட்ட பரவல் அடிப்படையிலான மொழி மாதிரிகளை இன்செப்ஷன் கொண்டுள்ளது, மேலும் மெர்குரி 2.5 இன் தரம் எவ்வளவு விரைவாக புதிய வேகத்தை மேம்படுத்துகிறது என்பதைக் காட்டுகிறது. உற்பத்தி தயார் அமைப்புகள்.

மெர்குரி குரல் மற்றும் மெர்குரி ரூட்டர் மாதிரிக்காட்சிகள்

மாடலுடன், இன்செப்ஷன் லேப்ஸ் இரண்டு புதிய தயாரிப்புகளின் மாதிரிக்காட்சிகளை அறிவித்தது. மெர்குரி குரல் என்பது 170 மில்லி விநாடிகளுக்குக் குறைவான நேரத்திலிருந்து முதல் டோக்கனை விளம்பரப்படுத்தும், இறுக்கமான தாமத வரவுசெலவுகளைக் கொண்ட குரல் முகவர்களுக்காக உகந்த ஒரு பரவலான LLM ஆகும். மெர்குரி ரூட்டர் ஒரு பரவல் மாதிரியைப் பயன்படுத்தி உள்வரும் தூண்டுதல்களைப் புரிந்துகொண்டு, திறந்த அல்லது மூடிய - தரம், வேகம் மற்றும் செலவு ஆகியவற்றின் சிறந்த கலவையை வழங்குகிறது, அதன் போட்டியாளர்களுக்கு மேலே ஒரு அடுக்காக இன்செப்ஷனை நிலைநிறுத்துகிறது.

மெர்குரி 2.5 இன்செப்ஷனின் சொந்த API மூலமாகவும், Baseten மற்றும் OpenRouter மூலமாகவும் கிடைக்கிறது. நிறுவன வரிசைப்படுத்தல்கள் அர்ப்பணிப்பு திறன், ஆட்டோஸ்கேலிங், இணக்கக் கட்டுப்பாடுகள் மற்றும் உள்ளமைக்கக்கூடிய தரவுத் தக்கவைப்பைச் சேர்க்கின்றன. ஏபிஐ முயற்சிக்கும் டெவலப்பர்களுக்கு நிறுவனம் 100 மில்லியன் இலவச டோக்கன்களை வழங்குகிறது.

நிறுவனம் ஏற்கனவே அதன் அடுத்த மாடலைப் பயிற்றுவிக்கத் தொடங்கியுள்ளதாகக் கூறியது - இன்னும் பெரியது, வரவிருக்கும் மாதங்களில் வெளியீட்டை இலக்காகக் கொண்டது - இது பரவலின் வேகம் அல்லது டோக்கன் செயல்திறனைக் கொடுக்காத திறனில் ஒரு பாய்ச்சல் என்று விவரிக்கிறது. அந்தக் கூற்று இருந்தால், விலையும் தாமதமும் பெரும்பாலான ஒப்பந்தங்களைத் தீர்மானிக்கும் சந்தையின் சரக்கு அடுக்குகளில், தன்னியக்கப் பின்னடைவு பதவியில் இருப்பவர்கள் மீதான அழுத்தம் முதலில் உணரப்படும்.

AIக்கு முன்னால் இருங்கள்

சமீபத்திய AI மேம்பாடுகளைப் பின்தொடரவும் மற்றும் புதிய மாடல் கட்டிடக்கலைகள் தயாரிப்பில் ஈடுபடும் போது செயற்கை நுண்ணறிவு செய்திகளை உடைக்கவும்.

மேலும் AI செய்திகளைப் படிக்கவும் →