ஸ்டார்ட்அப் TypeSafe AI இலிருந்து LLM அல்லாத "முடிவு மாடல்" Jev, Pokémon Red-ஐ நிறைவு செய்துவிட்டது - ப்ராஜெக்ட்டின் இணையதளத்தின்படி, மொத்தக் கணக்கீட்டுச் செலவில் சுமார் $1.65 செலவில் 37 மணிநேரம் மற்றும் 40 நிமிடங்களில் பேலட் டவுனில் இருந்து ஹால் ஆஃப் ஃபேம் வரை போராடி வருகிறது.

டெவலப்பர் கிறிஸ்டியன் மதிசென் கட்டமைத்த ரன், டோக்கன்கள் மற்றும் செலவுகளுடன் நேரடியாக ஒளிபரப்பப்பட்டது மற்றும் கிட்ஹப்பில் ஓப்பன் சோர்ஸ் செய்யப்பட்டது. இது வார இறுதியில் ஹேக்கர் நியூஸின் முதல் பக்கத்திற்குச் சென்றது, நூற்றுக்கணக்கான வாக்குகளை ஈர்த்தது மற்றும் AI முகவர்களின் எதிர்காலத்தைப் பற்றி அது என்ன சொல்கிறது என்பது பற்றிய ஒரு உற்சாகமான விவாதம். டாம்ஸ் ஹார்டுவேர் சாதனையை உள்ளடக்கியது, பாரம்பரிய சாட்போட்கள் பல மாதங்களாக ஸ்தம்பித்திருந்த இடத்தில் எல்எல்எம் அல்லாத இயந்திரம் வெற்றி பெற்றது - மேலும் கிளாட் ஓபஸ் 5 மாடலை அதன் முட்டுச்சந்தில் வழியாகப் பயிற்றுவித்தது.

எண்களால் இயக்கம்

AI அமைப்பிற்கு இந்த ஓட்டம் எவ்வளவு அசாதாரணமானது என்பதை திட்டத்தின் சொந்த கண்காணிப்பு புள்ளிவிபரங்கள் காட்டுகின்றன:

  • மொத்த நேரம்: 37 மணிநேரம், 40 நிமிடங்கள்
  • எடுக்கப்பட்ட முடிவுகள்: 16,150
  • உள்ளீடு டோக்கன்கள்: தோராயமாக 39.2 மில்லியன்
  • மொத்த ஜெவ் செலவு: சுமார் $1.65
  • வழக்கமான முடிவு நேரம்: 0.4 வினாடிகள்
  • எதிரிகள் சண்டையிட்டனர்: தோராயமாக 1,660
  • குழு துடைப்பான்கள்: 16
  • எலைட் நான்கு முயற்சிகள்: 15
  • கடினமான நீட்சி: வெற்றி சாலை

இறுதி ஹால் ஆஃப் ஃபேம் அணி: 83 ஆம் நிலையில் உள்ள கரிசார்ட், கிராவலர் (62), நிடோக்வீன் (45), பீட்ரில் (44), ஹான்டர் (39) மற்றும் பிரைம்பேப் (29) ஆகியோரால் ஆதரிக்கப்பட்டது.

பொருளாதாரம் தான் தலைப்பு. காபியின் விலையை விட பதினாறாயிரம் முடிவுகள் எல்எல்எம்-அடிப்படையிலான கேம்-பிளேயிங் ஏஜெண்டுகளுடன் ஒரு குறிப்பிடத்தக்க மாறுபாடு ஆகும். ஜெவ் விரைவாக முடிவெடுக்க முடியும், ஆனால் டூமை விளையாடுவதற்கு இன்னும் விரைவாக முடியவில்லை என்ற முடிவுக்குப் பிறகு தான் போகிமொனைத் தேர்ந்தெடுத்ததாக மதிசென் கூறினார்.

ஏன் போகிமொன் ரெட் AIக்கு கடினமாக உள்ளது

போகிமொன் ரெட் என்பது ஏஜெண்டிக் AI க்கு சாத்தியமில்லாத அளவுகோலாக மாறியுள்ளது. 1996 கேம் பாய் கிளாசிக் நீண்ட அடிவான திட்டமிடலைக் கோருகிறது: நிலைகளை அரைத்தல், ஆறு பேர் கொண்ட குழுவை நிர்வகித்தல், வரைபடம் இல்லாமல் பிரமை போன்ற குகைகளுக்கு வழிசெலுத்துதல் மற்றும் ஒரு முக்கியப் பொருளைத் தவறவிட்டால் பின்வாங்குதல். மொழி மாதிரி முகவர்கள் வரலாற்று ரீதியாக வட்டங்களில் அலைந்து திரிந்தனர், குகைகளில் சிக்கிக் கொண்டனர், மேலும் தேவையற்ற செயல்களுக்காக மகத்தான பட்ஜெட்டுகளை எரித்தனர்.

ஜெவ் அடிப்படையில் வேறுபட்ட அணுகுமுறையை எடுக்கிறார். உரையை உருவாக்குவதற்குப் பதிலாக, மாடல் நேரடியாக அளவீடு செய்யப்பட்ட முடிவுகளை வழங்குகிறது - ஒரு வடிவமைப்பு TypeSafe AI ஆனது பெரிய மாடல்களின் வேண்டுமென்றே, மொழி-கடுமையான பகுத்தறிவுக்கு மாற்றாக "சிஸ்டம் ஒன்" என சந்தைப்படுத்தப்பட்டுள்ளது. டாம்ஸ் ஹார்டுவேரின் முந்தைய மாடலின் கவரேஜ் படி, ஜெவ் தோராயமாக 193 மடங்கு வேகமாகவும், முடிவெடுக்கும் பணிகளில் LLM மாற்றுகளை விட 445 மடங்கு மலிவாகவும் இருப்பதாக நிறுவனம் கூறுகிறது.

கேட்ச், டெவலப்பர் ஒப்புக்கொண்டது, ஜெவுக்கு உதவி தேவை. டாம்ஸ் ஹார்டுவேரைப் பொறுத்தவரை, கிளாட் ஓபஸ் 5 முடிவெடுக்கும் மாதிரியை அதன் டெட் எண்ட்கள் மூலம் பயிற்றுவித்தது - ஒரு கலப்பின அணுகுமுறை இதில் ஒரு பெரிய மொழி மாதிரியானது மூலோபாய வழிகாட்டுதலை வழங்குகிறது, அதே நேரத்தில் வேகமான, மலிவான மாதிரி ஆயிரக்கணக்கான தனிப்பட்ட முடிவுகளை செயல்படுத்துகிறது. ஜெவ் "அடுத்து எங்கு செல்ல வேண்டும் என்று அவருக்கு ஒரு வழிகாட்டி இருப்பதால் மட்டுமே தெரியும்" என்று திட்டப் பக்கம் தந்திரமாக குறிப்பிடுகிறது.

AI முகவர்களுக்கு இது என்ன அர்த்தம்

இதன் விளைவாக, AI ஏஜெண்டுகளின் எதிர்காலம் எல்லாவற்றையும் செய்யும் ஒரு மாபெரும் மாடல் அல்ல, மாறாக உழைப்பைப் பிரிப்பதே என்ற வளர்ந்து வரும் வாதத்தின் தரவுப் புள்ளியாகும்: வேகமான, மலிவான, உயர் அதிர்வெண் முடிவுகளைக் கையாளும் சிறப்பு மாதிரிகள், நிலைமை தெளிவற்றதாக இருக்கும்போது மட்டுமே மெதுவாக பகுத்தறிவு மாதிரிகள் நுழைகின்றன.

ரோபாட்டிக்ஸ், கேமிங் மற்றும் நிகழ் நேரக் கட்டுப்பாட்டு அமைப்புகளுக்கு - முடிவுகள் மில்லி விநாடிகளில் வர வேண்டிய டொமைன்கள் மற்றும் பட்ஜெட்கள் சென்ட்களில் அளவிடப்படுகின்றன - அந்த கட்டிடக்கலை ஈர்க்கிறது. ஒரு கிடங்கு ரோபோ, கேம் விளையாடும் NPC அல்லது ஒரு வர்த்தக அமைப்பு ஒவ்வொரு மைக்ரோ-ஆக்ஷனுக்கும் 2-வினாடி GPT-பாணி சுற்று பயணத்தை வாங்க முடியாது.

ஹேக்கர் நியூஸில் உள்ள சந்தேகம் கொண்டவர்கள் ரன் எச்சரிக்கைகளை சுட்டிக்காட்டினர்: விளையாட்டு பல தசாப்தங்களாக பழமையானது மற்றும் முழுமையாக ஆவணப்படுத்தப்பட்டுள்ளது, பயிற்சி மாதிரியானது மூலோபாய கனரக தூக்குதலைச் செய்தது, மேலும் 15 எலைட் நான்கு முயற்சிகள் சோதனை மற்றும் பிழையை பரிந்துரைக்கின்றன. அவை நியாயமான புள்ளிகள் - ஆனால் அவை மிகவும் சுவாரஸ்யமான சமிக்ஞையை இழக்கின்றன. பதினாறாயிரம் நல்ல முடிவுகள் ஒவ்வொன்றும் $0.0001 இல் எடுக்கப்பட்டால், அவை எப்போதாவது அளவில் இயங்க வேண்டுமானால், அவற்றின் விலைத் தன்னாட்சி முகவர்களுக்குத் தேவைப்படும்.

முன்னாள் OpenAI RLHF ஆராய்ச்சியாளரால் நிறுவப்பட்ட TypeSafe AI, மாற்றாக இல்லாமல் மொழி மாதிரிகளுக்கு ஒரு நிரப்பியாக Jev ஐ நிலைநிறுத்தியுள்ளது. Pokémon திட்டம் - குறியீடு, ஸ்ட்ரீம் மற்றும் பொது செலவு முறிவு - ஒரு முடிவெடுக்கும் முதல் அடுக்கு என்ன செய்ய முடியும் என்பதை இன்னும் தெளிவான ஆர்ப்பாட்டம்.

முழு மூலக் குறியீடும் GitHub இல் கிடைக்கிறது, மேலும் விக்டரி சாலையில் உள்ள ஒவ்வொரு துடைப்பையும் சேர்த்து, YouTube இல் முடிக்கப்பட்ட ஓட்டத்தைப் பார்க்கலாம்.

AI க்கு முன்னால் இருங்கள்

சமீபத்திய AI மேம்பாடுகளுக்கு AI Buzz Wire ஐப் பின்தொடரவும்.

மேலும் AI செய்திகளைப் படிக்கவும் →