OpenAI Jalapeño-এর জন্য প্রথম বেঞ্চমার্ক ফলাফল প্রকাশ করেছে, এর কাস্টম ইনফারেন্স চিপ, এবং সংখ্যাগুলি আকর্ষণীয়: SemiAnalysis' InferenceX বেঞ্চমার্কে, নতুন সিলিকন ব্যবহারকারী প্রতি আরও বেশি টোকেন এবং বর্তমানে উপলব্ধ অত্যাধুনিক ইনফারেন্স প্রসেসরের তুলনায় প্রতি কিলোওয়াট বেশি থ্রুপুট উভয়ই নিবন্ধিত করেছে — একটি তুলনা যার মধ্যে রয়েছে ব্ল্যাকওয়েলের সিস্টেম। ফলাফলগুলি মঙ্গলবার পালো অল্টোর হট চিপস সম্মেলনে উপস্থাপন করা হয়েছিল, চিপটি কীভাবে তৈরি করা হয়েছিল তার একটি বিশদ প্রযুক্তিগত চেহারার পাশাপাশি। প্রতিটি AI মডেল রিলিজ কে আন্ডারপিন করে এমন কম্পিউট রেস ট্র্যাক করা পাঠকদের জন্য, এটি বছরের সবচেয়ে পরিণত হার্ডওয়্যার ডেটাপয়েন্টগুলির মধ্যে একটি।

টেকক্রাঞ্চ দ্বারা রিপোর্ট করা একটি প্রেস কলে ওপেনএআই-এর হার্ডওয়্যার প্রধান রিচার্ড হো বলেছেন, "মূল কথা হল ফলাফলগুলি শিল্পের অবস্থার তুলনায় একটি খুব, অত্যন্ত উল্লেখযোগ্য পারফরম্যান্স অগ্রগতি দেখায়।" "Jalapeño প্রতি ইউনিট পাওয়ারের জন্য আরও বেশি AI কাজ পরিবেশন করতে পারে, পাশাপাশি আরও দ্রুত প্রতিক্রিয়া প্রদান করতে পারে। এটি অনেক গ্রাহকদের পরিবেশন করা খুবই দক্ষ, কিন্তু এটি খুব কম লেটেন্সিও হতে পারে।"

সম্পূর্ণ ইনফারেন্স পাইপলাইনের জন্য নির্মিত একটি চিপ

Jalapeño জুন 2026-এ OpenAI-এর প্রথম কাস্টম সিলিকন হিসাবে উন্মোচিত হয়েছিল, ব্রডকমের সাথে ঘনিষ্ঠ সহযোগিতায়, OpenAI-এর নিজস্ব AI মডেলগুলি চিপের বিকাশ প্রক্রিয়ায় সহায়তা করে। অংশীদারিত্ব নিজেই 2025 সালের অক্টোবরে, যখন OpenAI নেটওয়ার্কিং জায়ান্টের পাশাপাশি একটি বহু-প্রজন্মীয় কাস্টম অ্যাক্সিলারেটর প্রোগ্রামের পরিকল্পনা তৈরি করেছিল।

ওপেনএআই অনুসারে জালাপেনোকে সাধারণ-উদ্দেশ্যের জিপিইউ থেকে আলাদা করে তোলে, এটি যে মডেলগুলি পরিবেশন করবে তার সাথে কনসার্টে ডিজাইন করা হয়েছিল। কারণ কোম্পানি সম্পূর্ণ স্ট্যাক নিয়ন্ত্রণ করে — এআই পণ্য, মডেল, চিপ এবং মেমরি — এর প্রকৌশলীরা অনুমান প্রক্রিয়ার নির্দিষ্ট পর্যায়গুলি আক্রমণ করতে সক্ষম হয়েছিল যা প্রায়ই ঘর্ষণ সৃষ্টি করে।

বিশেষ করে, Jalapeño প্রক্রিয়াকরণের প্রিফিল এবং যোগাযোগের পর্যায়গুলির সময় বিলম্ব কমানোর জন্য ডিজাইন করা হয়েছে, যা OpenAI বলে যে স্কেলে বড় ভাষা মডেলগুলি পরিবেশন করার সময় ঘন ঘন বাধা হিসাবে কাজ করে।

"আমরা ডাটা চলাচল এবং যোগাযোগের বিলম্ব কমাতে Jalapeño ডিজাইন করেছি," কোম্পানিটি ফলাফল উপস্থাপন করে একটি ব্লগ পোস্টে লিখেছে। "এর মানে হল যে মডেল স্টেট, একটি প্রতিক্রিয়া তৈরি করার সময় ব্যবহৃত কেভি ক্যাশে সহ, স্পষ্টভাবে স্থাপন করা যেতে পারে এবং স্থানীয় রাখা যেতে পারে যখন সিস্টেম প্রতিটি অনুমান পর্বের জন্য গণনা, মেমরি এবং নেটওয়ার্কিংয়ের সঠিক সমন্বয় সক্রিয় করে।"

যে কেউ উত্পাদন এআই কাজের চাপ চালাচ্ছে তার জন্য শেষ পয়েন্টটি গুরুত্বপূর্ণ। কেভি ক্যাশে - একটি মডেল একটি প্রতিক্রিয়া তৈরি করার সময় যে সঞ্চিত প্রসঙ্গ ধারণ করে - আধুনিক অনুমানে সবচেয়ে বড় মেমরি এবং ব্যান্ডউইথের মাথাব্যথাগুলির মধ্যে একটি। এটিকে একটি ক্লাস্টার জুড়ে এলোমেলো করার পরিবর্তে স্থানীয় এবং স্পষ্টভাবে পরিচালিত রাখা, লেটেন্সি এবং পাওয়ার ব্যাক করার একটি ক্লাসিক উপায়।

ব্ল্যাকওয়েলের চেয়ে ভালো — এখনকার জন্য

শিরোনাম তুলনা একটি এনভিডিয়া ব্ল্যাকওয়েল সিস্টেমের বিরুদ্ধে, বর্তমানে ফ্রন্টিয়ার এআই ইনফারেন্সের ওয়ার্কহরস। একই দিনে SemiAnalysis দ্বারা প্রকাশিত স্বাধীন বিশ্লেষণ, "OpenAI Jalapeño: Nvidia Blackwell এর চেয়ে ভালো" শিরোনামে চিপের প্রাথমিক ফলাফল সম্পর্কে একই ধরনের উপসংহারে পৌঁছেছে এবং গল্পটি দ্রুত হ্যাকার নিউজের সবচেয়ে আলোচিত আইটেমগুলির মধ্যে একটি হয়ে উঠেছে।

তবে ওপেনএআই নির্বাহী এবং বিশ্লেষকরা একইভাবে সতর্কতার আহ্বান জানিয়েছেন। হো অনুমান করেছেন যে Jalapeño 2026 সালের শেষের দিকে মোতায়েন করবে "খুব ছোট ভলিউমে," 2027 সালে আরও উল্লেখযোগ্য স্থাপনা আসছে। Jalapeño পূর্ণ মাত্রায় পৌঁছানোর সময়, প্রতিযোগিতাটি উল্লেখযোগ্যভাবে অগ্রসর হতে পারে — Nvidia-এর রোডম্যাপ চলতে থাকে, এবং Google, Amazon এবং Microsoft সহ অন্যান্য হাইপারস্কেলারগুলি তাদের নিজস্ব কাস্টমিক সিলমোহরগুলিকে ব্যবহার করে।

টেকক্রাঞ্চ যেমন উল্লেখ করেছে, আজকের শিল্পের অবস্থার বিপরীতে পরিমাপ করা বেঞ্চমার্ক একটি স্ন্যাপশট, গ্যারান্টি নয়। একটি চিপ যেটি 2026 সালে দক্ষতার উপর জিতবে তাকে অবশ্যই পরের বছর Nvidia এবং এর প্রতিদ্বন্দ্বী জাহাজের বিরুদ্ধে জয়ী হতে হবে।

কেন OpenAI তার নিজস্ব সিলিকন তৈরি করছে

কৌশলগত যুক্তি সহজবোধ্য: অনুমান হল ওপেনএআই-এর সবচেয়ে বড় পুনরাবৃত্ত খরচ। প্রতিটি ChatGPT ক্যোয়ারী, প্রতিটি API কল, এবং প্রতিটি এজেন্টিক টাস্ক কম্পিউট বার্ন করে, এবং বাজার মূল্যে Nvidia থেকে সেই কম্পিউটটি ভাড়া নেওয়ার ফলে ব্যবহারের স্কেল হিসাবে মার্জিন চাপা পড়ে। ওপেনএআই-এর নিজস্ব মডেলগুলিতে সুর করা একটি কাস্টম চিপ - ব্রডকমের সাথে যৌথভাবে ডিজাইন করা হয়েছে এবং ওপেনএআই-এর মডেলগুলি নিজেরাই তৈরি করেছে - কোম্পানিকে প্রতি ওয়াট এবং ডলার প্রতি আরও ব্যবহারকারীদের পরিষেবা দেওয়ার একটি উপায় দেয়৷

Jalapeño-কেও একটি বহুজাতিক প্ল্যাটফর্ম হিসেবে পরিকল্পনা করা হয়েছে, একটি একক অংশের পরিবর্তে। ওপেনএআই বলেছে যে এটি এআই পণ্য, মডেল, চিপস এবং মেমরি একসাথে বিকাশ করতে চায়, যাতে প্রতিটি প্রজন্মের সিলিকন যে মডেলগুলি চলবে তার সাথে সহ-অপ্টিমাইজ করা হয়। যদি প্রথম-প্রজন্মের ফলাফলগুলি উত্পাদনে ধরে রাখে, Jalapeño পরবর্তী সমস্ত কিছুর জন্য টেমপ্লেট হয়ে ওঠে।

বাজি OpenAI এর বাইরেও প্রসারিত। এনভিডিয়ার AI এক্সিলারেটরের আধিপত্য তিন বছর ধরে শিল্পে একক শক্ত বাধা হয়ে দাঁড়িয়েছে, এবং প্রতিটি বিশ্বাসযোগ্য বিকল্প - হোক না Google-এর TPU টিম, Amazon, বা এখন OpenAI থেকে - AI পরিকাঠামো নির্মাণকারী প্রত্যেকের জন্য আলোচনার ল্যান্ডস্কেপ পরিবর্তন করে৷ এনভিডিয়া নিজেই কথিতভাবে গ্রাহকদেরকে এআই সার্ভারে 15 শতাংশ বা তার বেশি দাম বৃদ্ধির বিষয়ে সতর্ক করছে কারণ মেমরির খরচ বেড়েছে, যা শুধুমাত্র অভ্যন্তরীণ বিকল্পগুলির আবেদনকে তীক্ষ্ণ করে।

এরপর কি আসে

আপাতত, Jalapeño প্রতিশ্রুতিশীল কাগজের সংখ্যা সহ একটি প্রাক-প্রোডাকশন অংশ হিসাবে রয়ে গেছে। আসল পরীক্ষাটি 2026 এর শেষে আসে, যখন প্রথম ছোট ভলিউমগুলি স্থাপন করা হয়, এবং বিশেষ করে 2027 সালে, যখন OpenAI অর্থপূর্ণ স্কেল আশা করে। মূল প্রশ্নগুলি উত্তরহীন থেকে যায়: ডেটাসেন্টার স্কেলে বাস্তব-বিশ্বের নির্ভরযোগ্যতা, মালিকানার মোট খরচ বনাম ভাড়া দেওয়া ব্ল্যাকওয়েল ক্ষমতা, এবং দক্ষতার প্রান্তটি এনভিডিয়ার পরবর্তী প্রজন্মের বিরুদ্ধে টিকে আছে কিনা।

তবুও, প্রথম বেঞ্চমার্কগুলি একটি মাইলফলক চিহ্নিত করে: প্রথমবারের মতো বড় AI ল্যাবগুলির মধ্যে একটি সর্বজনীনভাবে কাস্টম ইনফারেন্স সিলিকন প্রদর্শন করেছে যা কার্যক্ষমতার ক্ষেত্রে দায়িত্বশীলদের সেরাকে হারাতে পারে বলে মনে হচ্ছে। এমন একটি শিল্পের জন্য যা এনভিডিয়া সরবরাহকে একটি কৌশলগত লাইফলাইন হিসাবে বিবেচনা করেছে, এটি একটি প্রকৃত ইনফ্লেকশন পয়েন্ট।

---

এআই থেকে এগিয়ে থাকুন

সর্বশেষ AI খবর, বিশ্লেষণ এবং সাফল্য পান — সব এক জায়গায়।

আরও এআই খবর পড়ুন →