முன்னாள் OpenAI ஆராய்ச்சியாளரால் நிறுவப்பட்ட ஒரு புதிய AI ஸ்டார்ட்அப், முற்றிலும் புதிய வகை மாடல் என்று அழைக்கப்படுவதைத் தொடங்கியுள்ளது - இது உங்களுக்கு ஒரு கட்டுரையை எழுத முடியாது, மேலும் அதுவே சரியான புள்ளி என்று கூறுகிறது.
TypeSafe AI ஆனது அதன் முதல் "சிஸ்டம் ஒன் மாடல்" வெளியீட்டை செவ்வாயன்று அறிவித்தது, இது Jev என பெயரிடப்பட்டது, இது ஆரம்ப அணுகலில் உடனடியாக கிடைக்கும். நிறுவனம் Diogo Almeida என்பவரால் நிறுவப்பட்டது, ChatGPT இன் அறிவுறுத்தலுக்குப் பின்னால் உள்ள ஆராய்ச்சி, OpenAI இல் அவர் பங்களித்த வேலையின் மூலம் வளர்ந்ததாகக் கூறுகிறார். இரண்டு வருடங்கள் திருட்டுத்தனமாக இருந்த பிறகு, தன்னியக்கம் உண்மையில் தோல்வியடையும் இடத்தில் அரட்டையில் தொழில்துறையின் நிர்ணயம் மறைந்துவிட்டது என்று அவர் வாதிடுகிறார். For more context on this story, see our ongoing AI news.
"மாடல்கள் பல ஆண்டுகளாக அரட்டையில் மனிதநேயமற்றவர்களாக இருக்கிறார்கள், எனவே அனைத்து ஆட்டோமேஷன் எங்கே?" அல்மேடா வெளியீட்டு இடுகையில் எழுதினார். "கடந்த நான்கு வருடங்களாக இதுவே எனது உந்து கேள்வியாக உள்ளது."
உண்மையில் 'சிஸ்டம் ஒன்' மாடல் என்றால் என்ன
வேகமான, உள்ளுணர்வு சிந்தனை மற்றும் மெதுவான, வேண்டுமென்றே பகுத்தறிதல் ஆகியவற்றுக்கு இடையேயான உளவியலின் வேறுபாட்டிலிருந்து இந்தப் பெயர் பெறப்பட்டது. பெரிய மொழி மாதிரிகள் டோக்கன் மூலம் உரை டோக்கனை உருவாக்கும் போது - நெகிழ்வான, பொதுவான மற்றும் அவ்வப்போது நம்பிக்கையற்ற முட்டாள்தனத்திற்கு ஆளாகிறது - TypeSafe's Jev குறுகலான ஒன்றைச் செய்ய கட்டமைக்கப்பட்டுள்ளது: உள்ளீடாக கட்டமைக்கப்படாத நிலையை எடுத்து, அளவீடு செய்யப்பட்ட நிகழ்தகவுகளுடன் இணைக்கப்பட்ட, கட்டமைக்கப்பட்ட முடிவுகளை தட்டச்சு செய்யவும்.
நிறுவனம் ஜெவ்வை "எல்லை-உளவுத்துறை செயல்பாடு அழைப்பு: கட்டமைக்கப்படாத நிலை, டைப் செய்யப்பட்ட நிகழ்தகவு முடிவுகள்" என்று விவரிக்கிறது. சாத்தியமான வெளியீடுகள் முன்கூட்டியே வரையறுக்கப்பட்டிருப்பதாலும், மாடல் இலவச வடிவ சரங்களை உருவாக்காததாலும், TypeSafe அது வகை பிழைகளை உருவாக்க முடியாது என்று கூறுகிறது - இது புள்ளியியல் ரீதியாக சாத்தியமில்லாமல் கணித ரீதியாக உத்தரவாதம் அளிக்கப்படுகிறது என்று நிறுவனம் கூறுகிறது - மேலும் உரை உருவாக்கும் மாதிரிகள் மாயத்தை ஏற்படுத்த முடியாது.
வெளியீட்டு இடுகையின் படி, கட்டிடக்கலை மூன்று வழிகளில் பிரதான நடைமுறையில் இருந்து விலகுகிறது: ஒரு புதிய மாதிரி கட்டமைப்பு, அனைத்து வெளியீடுகளையும் வரிசையாக இல்லாமல் ஒரே வினவலில் உருவாக்கும் ஒரு இணையான மாதிரி, மற்றும் ஒரு பயிற்சி முறை நிறுவனம் அளவீடு செய்யப்பட்ட முடிவுகளுக்கான வலுவூட்டல் கற்றல் (RLCD) என்று அழைக்கிறது. வெளியீடுகள்.
உரிமைகோரல்கள்: 100x வேகமாக, செலவில் ஒரு பகுதி
TypeSafe வெளியிடும் எண்கள் ஆக்ரோஷமானவை. "சிஸ்டம் ஒன் வடிவ" பணிகள் - வகைப்படுத்தல், ரூட்டிங், ஸ்கோரிங், பிரித்தெடுத்தல் மற்றும் கிளை முடிவுகள் - 70 முதல் 500 மில்லி விநாடிகளில் பதிலளிக்கும் போது, 3 முதல் 329 வினாடிகள் வரை, எல்லைப்புற மாடல்களுக்கு 3 முதல் 329 வினாடிகள் வரை பதிலளிக்கும் போது, தற்போதுள்ள எல்லை எல்எல்எம்களுடன் ஒப்பிடக்கூடிய நுண்ணறிவை Jev வழங்குகிறது என்று நிறுவனம் கூறுகிறது. இது 40x முதல் 200 மடங்கு வேகமாக செயல்படும் என்று நிறுவனம் கூறுகிறது.
விலையும் இதேபோல் வழக்கத்திற்கு மாறானது: ஒரு மில்லியன் உள்ளீட்டு டோக்கன்களுக்கு $0.042, வெளியீட்டு டோக்கன்கள் இலவசம், ஏனெனில் வெளியீடுகள் டோக்கன் மூலம் உருவாக்கப்படுவதற்குப் பதிலாக இணையாகக் கணக்கிடப்படுகின்றன. விலை நிர்ணயம் நிலையானது என்பதை இன்னும் நிரூபிக்க முடியவில்லை என்று நிறுவனம் தனது பதிவில் ஒப்புக்கொண்டது.
"அசாதாரண உரிமைகோரல்களுக்கு அசாதாரண சான்றுகள் தேவை," என்று இடுகை கூறுகிறது, அதற்கு என்ன ஆதாரம் உள்ளது.
ரசீதுகள் - மற்றும் சந்தேகம் உள்ளவர்கள் என்ன சொல்கிறார்கள்
TypeSafe ஆனது GPT-5.6 Terra உடன் Jev ஐ ஒப்பிடும் ஒரு பக்கவாட்டு டெமோவை வெளியிட்டது, இது ஒத்த உளவுத்துறையில் மிகவும் ஒப்பிடக்கூடிய எல்லை மாடலாக விவரிக்கிறது, மேலும் பதிவு செய்யப்பட்ட ஓட்டத்தில் உண்மையான தெளிவற்ற தீர்ப்பு அழைப்பை உள்ளடக்கிய ஒரே கருத்து வேறுபாடு கூறுகிறது. இது ஒரு புதிய "பணிப்பாய்வு ஏவல்" முறையை அறிமுகப்படுத்தியது, இது மிகப்பெரிய வெளிப்புற மாதிரிகள் - OpenAI's Astra மற்றும் Anthropic's Fable - ஒரு நிலையான கணக்கீட்டு வரைபடத்தில் ஒருமித்த மாதிரிகளை அளவிடுகிறது, மேலும் Jev "கிட்டத்தட்ட 2 ஆர்டர்கள் அளவுகளுக்கு Pareto எல்லைக்கு சொந்தமானது" என்று கூறுகிறது.
குறிப்பிடத்தக்க வகையில், நிறுவனம் "antibenchmaxxing" என்ற தலைப்பில் ஒரு இடுகையை வெளியிட்டது, இது பாரம்பரிய வரையறைகளை ஏன் தவிர்க்கிறது என்பதை விளக்குகிறது, மென்பொருள் பணிப்பாய்வுகளுக்குள் கட்டமைக்கப்பட்ட முடிவுகளுக்காக வடிவமைக்கப்பட்ட மாதிரி அர்த்தமுள்ள உலகளாவிய ஒப்பீட்டை எதிர்க்கிறது என்று வாதிடுகிறது.
ஹேக்கர் நியூஸ் மீதான எதிர்வினை, சில மணிநேரங்களுக்குள் நூற்றுக்கணக்கான புள்ளிகளை ஈர்த்தது, உண்மையான உற்சாகம் முதல் சுட்டிக்காட்டப்பட்ட சந்தேகம் வரை. பல வர்ணனையாளர்கள் பொதுச் சான்றுகள் பெரும்பாலும் டெமோ வீடியோக்களைக் கொண்டிருப்பதாகக் குறிப்பிட்டனர் - டூம் கேம்ப்ளே லூப்பை இயக்கும் மாதிரியைக் காட்டுவது உட்பட - மீண்டும் உருவாக்கக்கூடிய மூன்றாம் தரப்பு மதிப்பீடுகளைக் காட்டிலும். மற்றவர்கள் இந்த அணுகுமுறையானது மிகவும் வேகமான, எல்லை-தர வகைப்படுத்தி, எல்.எல்.எம்களுக்கு மாற்றாக இல்லாமல் பணிச்சுமைகளின் ஒரு பகுதிக்கு பயனுள்ளதாக இருக்கும் என்று வாதிட்டனர்.
அனுதாபமுள்ள பார்வையாளர்கள் கூட ஆதாரத்தின் சுமையை தெளிவாக வடிவமைத்தனர். "ஆமாம், அவர்கள் சந்தேகம் கொண்டவர்களாகப் பேசுகிறார்கள், ஆனால் டெமோக்களின் இரண்டு வீடியோக்களைத் தவிர, ஒரு டன் ஆதாரங்களை வழங்கவில்லை" என்று ஒரு வர்ணனையாளர் எழுதினார். "ஒரு நேரடி டெமோ மிகவும் உறுதியானதாக இருக்கும்."
ஏன் இது எப்படியும் மேட்டர்
பிட்ச் ஒரு உண்மையான வலி புள்ளியில் இறங்குகிறது. வணிக மென்பொருளில் உற்பத்தி எல்எல்எம் அழைப்புகளின் பெரும்பகுதி உருவாக்கப்படவே இல்லை - அவை பைனரி தீர்ப்புகள், வகை பணிகள் மற்றும் உரைநடையில் மூடப்பட்ட ரூட்டிங் முடிவுகள். ஒரு மாதிரியானது 70 மில்லி விநாடிகளில் அளவீடு செய்யப்பட்ட நம்பிக்கையுடன் அந்த அழைப்புகளை பூஜ்ஜிய வெளியீட்டுச் செலவில் செய்ய முடிந்தால், AI-இயங்கும் மென்பொருளின் பொருளாதாரம் கணிசமாக மாறுகிறது: நிகழ்நேர பயனர் இடைமுகங்கள் நடைமுறைக்கு வருகின்றன, மேலும் LLMகளுடன் தானியங்குபடுத்துவதற்கு மிகவும் விலையுயர்ந்த பைப்லைன் படிகள் எல்லா இடங்களிலும் இயங்கும் அளவுக்கு மலிவானதாக மாறும்.
TypeSafe இன் பரிந்துரைக்கப்பட்ட பயன்பாட்டு நிகழ்வுகளில் தரவை வகைப்படுத்துதல் மற்றும் ரூட்டிங் செய்தல், LLM வெளியீடுகளைச் சரிபார்த்தல் மற்றும் பாதுகாத்தல், ஜெயில்பிரேக்குகளைக் கண்டறிதல் மற்றும் பெரிய தரவுத்தொகுப்புகளில் வரைபடத்தைக் குறைத்தல் பகுப்பாய்வு ஆகியவை அடங்கும் - சுற்றியுள்ள குறியீடு மாதிரியின் சுதந்திரத்தைக் கட்டுப்படுத்தும் மற்றும் பிழைகளைப் பிடிக்கக்கூடிய பணிச்சுமைகள்.
நிறுவனம் திறந்த கேள்விகளைப் பற்றி நேர்மையாக உள்ளது: அதன் வெளியிடப்பட்ட எவல்கள் அமெரிக்க மேற்கு கடற்கரையில் உள்ள மடிக்கணினிகளில் இருந்து இயக்கப்பட்டன, மேலும் நீண்ட கால விலை நிலைத்தன்மை நிரூபிக்கப்படவில்லை. Jev இன் உளவுத்துறை கூறுவது, சுயாதீன சோதனையுடன் தொடர்பைத் தக்கவைப்பது என்பது "சிஸ்டம் ஒன் மாடல்கள்" ஒரு வகையாக மாறுமா அல்லது ஆர்வமாக மாறுமா என்பதைத் தீர்மானிக்கும்.
நிறுவனத்தின் இணையதளம் மூலம் ஆரம்ப அணுகல் இப்போது திறக்கப்பட்டுள்ளது.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →