AI முன்னோடியான Fei-Fei Li நிறுவிய ஸ்பேஷியல் நுண்ணறிவு நிறுவனமான வேர்ல்ட் லேப்ஸ், செப்டம்பர் 1, 2026 அன்று அட்லஸை அதன் அடுத்த தலைமுறை "ஓம்னி" உலக மாடல் என்று விவரிக்கிறது. ஒரு நிறுவனத்தின் வலைப்பதிவு இடுகையில், குழு அட்லஸ் உரை, படங்கள், வீடியோ மற்றும் 3D ஆகியவற்றில் சொந்தமாகச் செயல்படுவதற்கு முன்பிருந்தே பயிற்சி பெற்றதாகக் கூறியது - அந்த பணிகளில் ஏதேனும் ஒன்றில் நிபுணத்துவம் பெறுவதற்குப் பதிலாக உலகங்களை உருவாக்க, புனரமைக்க மற்றும் உருவகப்படுத்துவதற்காக உருவாக்கப்பட்ட ஒரு மாதிரி.

நிறுவனத்தை நிறுவியதில் இருந்து லி வெற்றி பெற்றுள்ள உலக மாதிரிகள் ஆய்வறிக்கைக்கு இந்த வெளியீடு ஒரு மைல்கல் ஆகும்: AI இன் அடுத்த எல்லையானது மொழியில் மட்டுமல்ல, உலகங்கள் எவ்வாறு தோன்றுகின்றன, செயல்படுகின்றன மற்றும் உருவாகின்றன என்பதைப் புரிந்துகொள்ளும் அமைப்புகளில் உள்ளது. உலக ஆய்வகங்கள், ஆக்கப்பூர்வமான பயனர்களுக்கு கற்பனையான உலகங்களை வழங்குவதற்கும், நிஜ உலகத்தை அதிக நம்பகத்தன்மையுடன் உருவகப்படுத்துவதற்கும், ரோபோக்கள் செயல்களைத் திட்டமிடுவதற்கும் அடித்தளமாக தொழில்நுட்பத்தை வடிவமைக்கிறது. இது மற்றும் பிற எல்லைப்புற ஆராய்ச்சி முயற்சிகள் பற்றிய மேலும் தகவலுக்கு, எங்கள் AI தொழில்துறை கவரேஜை ஆராயுங்கள்.

ஒரு மாதிரி, ஒரு பகிரப்பட்ட இடஞ்சார்ந்த சூழல்

கட்டிடக்கலை ரீதியாக, அட்லஸை உலக ஆய்வகங்கள் மல்டிமாடல் தன்னியக்க டிஃப்யூஷன் டிரான்ஸ்பார்மர் என்று அழைக்கின்றன. ஒரு பெரிய மொழி மாதிரியைப் போலவே, இது முதலில் அதன் உள்ளீடுகளை ஒரு சூழலில் குறியாக்கம் செய்து பின்னர் அந்த சூழலில் நிபந்தனைக்குட்பட்ட வெளியீடுகளை உருவாக்குகிறது. வித்தியாசம் இடஞ்சார்ந்தது: ஒவ்வொரு உள்ளீட்டுப் படமும் விண்வெளியில் ஒரு 3D நிலையில் அமைக்கப்பட்டு, நிறுவனம் இடஞ்சார்ந்த சூழலை உருவாக்குகிறது, மேலும் அட்லஸ் அடுத்து வருவதை உருவாக்குகிறது, அதே நேரத்தில் தான் பார்த்த எல்லாவற்றிலும் 3D-இணக்கமாக இருக்கிறது - அதைத் தாண்டி என்ன இருக்கிறது என்று கற்பனை செய்கிறது.

அந்த வடிவமைப்பு வழக்கமான வீடியோ ஜெனரேட்டர்களில் போல்ட் செய்ய சிரமமாக இருக்கும் திறன்களை செயல்படுத்துகிறது. தொடர்பில்லாத இரண்டு குறிப்புப் படங்களை வெவ்வேறு 3D நிலைகளில் சூழலில் வைக்கலாம், மேலும் அட்லஸ் அவற்றுக்கிடையே சுமூகமாக இடைக்கணிப்பு செய்யும் ஒரு உலகத்தை உருவாக்கும், கதவுகள், நடைபாதைகள் மற்றும் இரண்டு காட்சிகளை நம்பத்தகுந்த வகையில் இணைக்கும் மாற்றங்களைக் கண்டுபிடிக்கும். பயிற்சி கணக்கீடு அதிகரிக்கும் போது செயல்திறன் மேம்படுவதன் மூலம் இந்த மாடல் அளவிடப்பட்டதாக உருவாக்கப்பட்டுள்ளது என்றும் நிறுவனம் கூறியுள்ளது.

பிக்சல்-சரியான கேமரா கட்டுப்பாடு மற்றும் நீண்ட வடிவ வீடியோ

அட்லஸின் மார்க்கீ ஜெனரேஷன் அம்சம் கேமராவால் கட்டுப்படுத்தப்படும் வீடியோ ஆகும். ஒன்று முதல் ஆறு உள்ளீட்டுப் படங்கள் வரை, துல்லியமாக குறிப்பிடப்பட்ட கேமரா பாதைகளைப் பின்பற்றி, 1440p தெளிவுத்திறனில் ஒரு நிமிட வீடியோவை மாடல் உருவாக்க முடியும். உலக ஆய்வகங்கள், கேமரா வடிவியல் என்பது ஒரு சொந்த உள்ளீட்டு வகை என்பதை வலியுறுத்துகிறது - கரடுமுரடான உரைத் தூண்டுதல்களுக்கு அப்பாற்பட்டது - எனவே படைப்பாளிகள் ஒவ்வொரு காட்சியையும் கட்டமைத்து ஒவ்வொரு இயக்கத்தையும் கட்டுப்படுத்த முடியும். டெமோக்களில், ஸ்லாட் மெஷினின் நெம்புகோலை இழுப்பதற்குப் பதிலாக, "இயக்குநர் நாற்காலியில்" இருப்பது போன்ற அனுபவத்தை விவரிக்கும் ஒரு ஒத்திசைவான ஒரு நிமிட கிளிப்பை உருவாக்க, குழு ஒரு காட்சி வழியாக கேமரா பாதைகளை கையால் வடிவமைத்தது.

இந்த மாதிரியானது உரையிலிருந்து படங்கள் மற்றும் 360-டிகிரி பனோரமாக்களை உருவாக்குகிறது, சிக்கலான அறிவுறுத்தல்களைப் பின்பற்றும் திறன், உரையை வழங்குதல் மற்றும் பல்வேறு காட்சி பாணிகளை உருவாக்கும் திறன் கொண்டது.

ஸ்பெஷலிஸ்ட் மாடல்களுக்கு சவால் விடும் புனரமைப்பு

புனரமைப்புப் பக்கத்தில், வேர்ல்ட் லேப்ஸ் ஒரு தைரியமான கூற்றை முன்வைக்கிறது: அட்லஸ் இரண்டு அல்லது மூன்று சாதாரண படங்களிலிருந்து நிஜ உலகக் காட்சிகளை புனரமைக்கிறது, "3D புனரமைப்புக்கு மட்டுமே பிரத்யேகமாகப் பயிற்றுவிக்கப்பட்ட மாதிரிகள் மூலம் அதிநவீன முடிவுகளை விஞ்சுகிறது." நிறுவனம் 3D கணினி பார்வையில் பல தசாப்தங்களாக பழமையான அடிப்படை பிரச்சனையாக அரிதான உள்ளீடுகளில் இருந்து நாவல் காட்சி தொகுப்பை அழைக்கிறது.

அட்லஸ் நூற்றுக்கும் மேற்பட்ட உள்ளீட்டுப் படங்களையும் உண்மையான சூழல்களை உண்மையாக மகிழ்விக்க முடியும். ஒரு ஆர்ப்பாட்டத்தில், குழு ஸ்டான்போர்டின் மெயின் குவாட் பகுதியை இரண்டு முதல் இருபத்தைந்து தரைமட்ட புகைப்படங்கள் வரை மீண்டும் உருவாக்கியது, பின்னர் வளாகத்திற்கு மேலே பறக்கும் வான்வழி பாதைகளை உருவாக்கியது - இதுவரை எந்த கேமராவும் கைப்பற்றப்படாத காட்சிகளை நிரப்பியது.

நடைமுறைப் பயன்பாட்டிற்காக, அட்லஸ் 2டி பிரேம்களில் நிற்காது. இது இமேஜ் பிரேம்கள் மற்றும் 3டி டெப்த் மேப்களில் இயங்குகிறது, உலகங்களை புள்ளி மேகங்கள் அல்லது 3டி காஸியன் ஸ்ப்ளாட்டுகளாக வெளியிடுகிறது, அவை சாதனத்தில் உயர் தெளிவுத்திறன் மற்றும் பிரேம் விகிதங்களில் வழங்குகின்றன. வேர்ல்ட் லேப்ஸின் முதல் தயாரிப்பான மார்பிளில் பயன்படுத்தப்பட்ட அதே பிரதிநிதித்துவம் இதுவாகும், எனவே அட்லஸ் வெளியீடுகள் நிறுவனத்தின் தற்போதைய பைப்லைனில் நேரடியாக செருகப்படுகின்றன.

புல்லட் நேரத்திலிருந்து ரோபோ பயிற்சி வரை

அட்லஸின் உருவகப்படுத்துதல் திறன்கள் ரோபாட்டிக்ஸுக்கு மிகவும் முக்கியமானதாக இருக்கலாம். அட்லஸ் ஒரு காட்சியை மறுகட்டமைக்க மற்றும் சாத்தியமற்ற கோணங்களில் இருந்து "புல்லட் நேரத்தை" மறுவடிவமைக்க, சிறப்புப் பிடிப்பு ஸ்டுடியோ தேவையில்லை, முக்காலி மற்றும் முறுக்குக் கட்டைகளுடன் பொருத்தப்பட்ட மூன்று சாதாரண செல்போன் கேமராக்களின் காட்சிகள் போதுமானது என்று நிறுவனம் காட்டியது.

Real-to-Sim பணிப்பாய்வுகளுக்கு, அட்லஸ் குறுகிய தொலைபேசி வீடியோக்களிலிருந்து இடைவெளிகளை மறுகட்டமைக்கிறது, பின்னர் RGB மற்றும் ஆழமான தரவை உருவாக்குகிறது, உருவகப்படுத்தப்பட்ட ரோபோவின் உடலில் பொருத்தப்பட்ட கேமராக்கள் ஒரு பாதையில் கண்காணிக்கும் - உலகம் மற்றும் ரோபோவின் பார்வை அதே மாதிரியில் இருந்து வருகிறது. நிறுவனம் 24 பிரேம்கள் ஒவ்வொன்றையும் பயன்படுத்தி பெரிய ஸ்கேன் செய்யப்பட்ட சூழல்களில் வழிசெலுத்தலை நிரூபித்தது, மேலும் ஒரு பணி உருவகப்படுத்தப்பட்டவுடன் பொருள்கள், நிலைகள் மற்றும் காட்சிகளை மாற்றுவதன் மூலம் உருவகப்படுத்தப்பட்ட பணிகள் மாறுபடும் கையாளுதல் காட்சிகள்.

ஏன் இது முக்கியமானது

உலக மாதிரிகள் பெருகிய முறையில் பெரிய மொழி மாதிரிகளுக்கு ஒரு நிரப்பியாகப் பார்க்கப்படுகின்றன: LLMகள் உலகின் விளக்கங்களைப் பற்றிய காரணம், அதே சமயம் உலக மாதிரிகள் உலகையே மாதிரியாகக் கொண்டிருக்கின்றன - காலப்போக்கில் அதன் வடிவியல், இயற்பியல் மற்றும் இயக்கவியல். அட்லஸின் கூற்றுக்கள் வெளிப்புற ஆய்வுக்கு உட்பட்டால், பயன்பாடுகள் VFX, கேமிங், டிசைன், இன்ஜினியரிங் மற்றும் ரோபோட் பயிற்சி ஆகியவற்றைக் கொண்டிருக்கும், செயற்கையான ஆனால் உடல் ரீதியாக நம்பத்தகுந்த சூழல்கள் கற்பிக்கும் இயந்திரங்களின் செலவை வியத்தகு முறையில் குறைக்கலாம்.

மாடலின் பின்னால் உள்ள நிறுவனம் அதன் சொந்த உரிமையில் குறிப்பிடத்தக்கது. உலக ஆய்வகங்கள் Fei-Fei Li என்பவரால் நிறுவப்பட்டது - ஜஸ்டின் ஜான்சன், பென் மில்டன்ஹால் மற்றும் கிறிஸ்டோஃப் லாஸ்னர் ஆகியோருடன் இணைந்து இமேஜ்நெட்டின் உருவாக்கம் ஆழமான கற்றல் சகாப்தத்தை தூண்டிய ஸ்டான்ஃபோர்ட் பேராசிரியரும், அதன் முதலீட்டாளர் பட்டியலில் a16z, Nvidia, AMD, Intel, Adobe, Salesforce, மற்றும் சாம்சங் போன்றவையும் அடங்கும். நிறுவனத்தின் முதல் தயாரிப்பான மார்பிள், படங்கள், வீடியோ, உரை மற்றும் 3D தளவமைப்புகளிலிருந்து நிலையான 3D உலகங்களை உருவாக்க பயனர்களை அனுமதிக்கிறது, மேலும் அதன் எதிர்கால பதிப்புகளை அட்லஸ் வழங்கும் என்று வேர்ல்ட் லேப்ஸ் கூறியது.

அட்லஸ் இன்னும் பொதுவாகக் கிடைக்கவில்லை: நிறுவனம் முன்கூட்டிய அணுகலுக்கான கோரிக்கைகளை ஏற்றுக்கொள்கிறது. இருப்பினும், வெளியீடு AI அமைப்புகளை நோக்கி இன்னும் உறுதியான படிகளில் ஒன்றாகும், அவை வெறும் இயற்பியல் உலகத்தை விவரிக்கவில்லை, ஆனால் அதன் நிலையான, கையாளக்கூடிய மாதிரியை வைத்திருக்கின்றன.

---

AIக்கு முன்னால் இருங்கள்

சமீபத்திய AI செய்திகள், பகுப்பாய்வு மற்றும் முன்னேற்றங்கள் - அனைத்தையும் ஒரே இடத்தில் பெறுங்கள்.

மேலும் AI செய்திகளைப் படிக்கவும் →