ஸ்ட்ராட்டா எனப்படும் அதிகம் அறியப்படாத திறந்த மூல திட்டத்திற்கு ஒரு தருணம் உள்ளது. அலிபாபாவின் Qwen3.8-Flash-Next-ஐ இயக்கும் MIT-உரிமம் பெற்ற இயந்திரம் — 125 பில்லியன் அளவுரு நிபுணர்களின் கலவை மாடல் — சாதாரண கேமிங் பிசிக்களில், அக்டோபர் 4 அன்று ஹேக்கர் செய்திகளின் முதல் பக்கத்தில் 640 புள்ளிகளுக்கு மேல் படமாக்கப்பட்டது, மேலும் அதன் GitHub களஞ்சியமானது செப்டம்பர் 2000 முதல் 2000 வரை ஸ்டார்11 உருவாக்கப்பட்டது.

சுருதி எளிமையானது: பொதுவாக சர்வரில் வாழும் 125 பில்லியன் அளவுரு மாதிரியானது அரட்டை அடிக்கலாம், குறியீடு எழுதலாம், படங்களைப் படிக்கலாம் மற்றும் குறியீட்டு முகவர்களை முழுவதுமாக நுகர்வோர் கிராபிக்ஸ் கார்டில் இயக்கலாம், இயந்திரத்தை விட்டு எதுவும் வெளியேறாது.

ஸ்ட்ராட்டா உண்மையில் என்ன செய்கிறது

ஸ்ட்ராட்டா என்பது ஒரு அனுமான இயந்திரம் மற்றும் விண்டோஸ் மற்றும் லினக்ஸிற்கான ஒரு கிளிக் நிறுவி ஆகும். அதன் ஆவணங்களின்படி, தேவைகள் எல்லைக்குட்பட்ட மாதிரி தரநிலைகளின்படி மிதமானவை: NVIDIAவின் RTX 20, 30, 40 அல்லது 50 தொடர்கள் அல்லது AMD இன் ரேடியான் RX 6000, 7000 அல்லது 9000 தொடர்களில் இருந்து குறைந்தபட்சம் 12GB VRAM கொண்ட ஒரு GPU, குறைந்தபட்சம் 30GB S.S. AMSD, 32GB அளவு இலவசம்

என்ஜின் Q2_0 முதல் IQ3_S வரை பல சுருக்க நிலைகளில் Qwen3.8-Flash-Next இன் அளவுப்படுத்தப்பட்ட பதிப்புகளை அனுப்புகிறது, மேலும் ஒரு குறியீடு-சிறப்பு மாறுபாடு. இது லோக்கல் ஹோஸ்டில் OpenAI மற்றும் Anthropic-compatible APIகளை வெளிப்படுத்துகிறது, அதாவது ChatGPT அல்லது Claude க்காக உருவாக்கப்பட்ட கருவிகள் — Claude Code, Cursor மற்றும் Codex போன்ற குறியீட்டு முகவர்கள் உட்பட — குறைந்த மாற்றங்களுடன் உள்ளூர் சர்வரில் சுட்டிக்காட்டலாம். விருப்ப பட உள்ளீடு மற்றும் பல-ஜிபியு ஆதரவு ஆகியவை சேர்க்கப்பட்டுள்ளன, மேலும் நிறுவி AI-உதவி அமைவு பயன்முறையை வழங்குகிறது, இது ஒரு குறியீட்டு உதவியாளரை ஒரு ஒட்டப்பட்ட வரியில் இருந்து இயந்திரத்தை உள்ளமைக்க உதவுகிறது.

வேக எண்கள்

இரண்டு நுகர்வோர் டெஸ்க்டாப்களில் அளவிடப்பட்ட திட்டத்தின் வெளியிடப்பட்ட வரையறைகள், வெளியீடு பரவுவதற்குக் காரணம். NVIDIA RTX 5070 இல் 12GB VRAM உடன் Ryzen 5 7600 மற்றும் 64GB RAM உடன் இணைக்கப்பட்டுள்ளது, Strata தெரிவிக்கிறது:

  • Q2_0 அளவீடு: ஒரு வினாடிக்கு 94 டோக்கன்கள் தலைமுறை மற்றும் 2,650 டோக்கன்கள் 32K-டோக்கன் ஆவணத்தில் உடனடி செயலாக்கத்திற்கு
  • IQ3_S: இரண்டாவது தலைமுறைக்கு 53 டோக்கன்கள், வினாடிக்கு 1,620 டோக்கன்கள் உடனடி செயலாக்கம்
  • கோடர் மாறுபாடு: இரண்டாவது தலைமுறைக்கு 55 டோக்கன்கள்

AMD பக்கத்தில், 16GB VRAM உடன் RX 9070 XT ஆனது Q2_0 இல் வினாடிக்கு 60 டோக்கன்களை நிர்வகித்தது. 24GB VRAM உடன் கூடிய RTX 3090 வினாடிக்கு 100 முதல் 140 டோக்கன்களை எட்ட வேண்டும் என்று ஆவணங்கள் மதிப்பிடுகின்றன - பெரும்பாலான மக்கள் படிக்கும் வேகத்தை விட வேகமாக.

ஒப்பிடுகையில், ஆறு மாதங்களுக்கு முன்பு, 70 பில்லியன் அளவுரு அடர்த்தியான மாதிரியை உள்நாட்டில் பயன்படுத்தக்கூடிய வேகத்தில் இயக்க நூற்றுக்கணக்கான ஜிகாபைட்கள் ஒருங்கிணைந்த நினைவகம் அல்லது ஆக்கிரமிப்பு ஊக டிகோடிங் தந்திரங்களைக் கொண்ட ஒரு பணிநிலையம் தேவைப்பட்டது.

125B மாடல் ஏன் கேமிங் கார்டில் பொருந்துகிறது

இரண்டு தொழில்நுட்பங்கள் இதை சாத்தியமாக்குகின்றன. முதல் மாதிரி தானே. AI Buzz Wire அதன் வெளியீட்டில் உள்ளடக்கியது போல், Qwen3.8-Flash-Next என்பது சுமார் 125 பில்லியன் மொத்த அளவுருக்கள் கொண்ட நிபுணர்களின் கலவையாகும், ஆனால் ஒரு டோக்கனுக்கு சுமார் 6 பில்லியன் மட்டுமே செயலில் உள்ளது - எனவே உருவாக்கப்படும் ஒவ்வொரு வார்த்தையும் நெட்வொர்க்கின் சிறிய ஸ்லைஸைத் தொட்டு, ஒரு டோக்கனுக்கு கணக்கீட்டை வியத்தகு முறையில் குறைக்கிறது.

இரண்டாவது அளவீடு. ஸ்ட்ராடாவின் வேகமான முன்னமைவுகள் மாதிரியின் எடையை ஒரு அளவுருவிற்கு இரண்டு அல்லது மூன்று பிட்களாக சுருக்கி, 12 ஜிபி ஜிபியு மற்றும் சிஸ்டம் ரேம் முழுவதும் பொருந்தக்கூடிய கால்தடத்திற்கு சில துல்லியத்தை வர்த்தகம் செய்கிறது. அந்த பரிமாற்றம் முக்கிய எச்சரிக்கையாகும்: Q2-வகுப்பு மற்றும் IQ2-வகுப்பு அளவுகள் பகுத்தறிவு-கடுமையான பணிகளின் தரத்தை அளவிடக்கூடிய அளவில் குறைக்கின்றன, மேலும் வாங்குபவர்கள் ஒவ்வொரு பணிச்சுமைக்கும் உத்தரவாதமாக இல்லாமல் தலைப்பு வேக எண்களை ஒரு தொடக்க புள்ளியாக கருத வேண்டும். களஞ்சியத்தில் உள்ள சமூக அளவுகோல் பக்கங்கள் அளவுகள் முழுவதும் தர முடிவுகளைக் கண்காணிக்கும்.

ஒரு பெரிய உள்ளூர்-AI அலையின் பகுதி

உள்ளூர் அனுமானத்திற்கான வேகமான வேகத்தின் மத்தியில் ஸ்ட்ராடா வருகிறது. அலிபாபாவின் க்வென் குடும்பம், மிக அதிகமாகப் பதிவிறக்கம் செய்யப்பட்ட ஓப்பன் வெயிட் மாடல் வரிசையாக மாறியுள்ளது, மெட்டா மற்றும் கூகுள் ஆகியவை தங்களுடைய சொந்த ஓப்பன் சோர்ஸ் போட்டி மாடல்களைக் கொண்டுள்ளன, மேலும் பல கருவிகள் இப்போது வாடிக்கையாளர்களை தங்கள் சாதனங்களை விட்டு வெளியேறும் சந்தாக்கள் அல்லது தரவு இல்லாமல் திறமையான உதவியாளர்களை இயக்க அனுமதிக்கிறது.

"நுகர்வோர் வன்பொருள்" என்பதன் வரையறை எவ்வாறு மாறுகிறது என்பதையும் இந்தத் திட்டம் பிரதிபலிக்கிறது. முதன்மையாக கேமிங்கிற்காக அனுப்பப்பட்ட 12ஜிபி VRAM கொண்ட ஒரு இடைப்பட்ட 2026 கிராபிக்ஸ் கார்டு, இரண்டு ஆண்டுகளுக்கு முன்பு எல்லை அமைப்புகளை வரையறுத்த அளவு வகுப்பில் உள்ள ஒரு மாடலுக்கான சாத்தியமான அனுமான முடுக்கியாக உள்ளது.

ஸ்ட்ராட்டா ஆரம்பகால மென்பொருளாகவே உள்ளது — களஞ்சியத்தின் வெளியீடுகள் பழைய GPUகள் மற்றும் AVX2 அல்லாத செயலிகளில் கடினமான விளிம்புகளை ஆவணப்படுத்துகிறது - ஆனால் திட்டம் MIT உரிமம் பெற்றது, இலவசம் மற்றும் திறந்த வெளியில் உருவாக்கப்பட்டது, Intel Arc, பழைய டெஸ்லா மற்றும் ரேடியான் கார்டுகள் மற்றும் சமூக உறுப்பினர்களால் ஆவணப்படுத்தப்பட்ட பல-GPU ரிக்குகள்.

டெவலப்பர்களுக்கு, லோக்கல் ஹோஸ்ட் ஏபிஐ இணக்கத்தன்மை மிகவும் நடைமுறையானதாக இருக்கலாம்: OpenAI அல்லது Anthropic SDK க்கு எதிராக எழுதப்பட்ட எந்த ஸ்கிரிப்ட் அல்லது ஏஜெண்டும் அடிப்படை URL ஐ மாற்றுவதன் மூலம் உள்ளூர் Qwen வரிசைப்படுத்தலுக்குத் திருப்பிவிடப்படலாம், Strata ஆனது தனியுரிமை-உணர்வு முன்மாதிரி, ஆஃப்லைனில் பயன்படுத்துதல் அல்லது வெறுமனே பயன்படுத்துதல் ஆகியவற்றுக்கான குறைந்த உராய்வு விருப்பமாக மாற்றும்.

எப்படி முயற்சி செய்வது

தொடங்குவதற்கு கையேடு கொண்ட டெர்மினல் அமர்வு தேவையில்லை. நிறுவி இயக்கிகள், மாடல் எடைகள் மற்றும் உள்ளூர் சேவையகத்தை ஒரே பாஸில் வழங்குகிறது, மேலும் களஞ்சியத்தில் ஒரு AI குறியீட்டு உதவியாளரில் நேரடியாக ஒட்டுவதற்கு வடிவமைக்கப்பட்ட அமைவுக் கோப்பு உள்ளது, இது இயந்திரத்தை தன்னியக்கமாக உள்ளமைக்கிறது. எடைகள் வட்டில் இருந்து ஏற்றப்படும் போது முதல் துவக்கங்கள் மெதுவாக இருக்கும்; ஆவணம் ஒரு SSD ஐ பரிந்துரைக்கிறது மற்றும் நீண்ட உரையாடல்கள் கணினி RAM இல் அதிக வேலைகளை மாற்றும் என்று எச்சரிக்கிறது.

AI க்கு முன்னால் இருங்கள்

திறந்த மூல மாதிரிகள், உள்ளூர் AI கருவிகள் மற்றும் அனுமான வன்பொருள் பற்றிய சமீபத்திய தகவல்களை அறிய AI Buzz Wire ஐப் பின்தொடரவும்.

மேலும் AI செய்திகளைப் படிக்கவும் →