استاندارد جدیدی برای معنای "باز" در هوش مصنوعی روز پنجشنبه تنظیم شد. مؤسسه مدلهای بنیادی (IFM)، یک مؤسسه هوش مصنوعی مستقر در ابوظبی، K2 Horizon را منتشر کرد، ناوگانی متشکل از شش مدل زبان که همه چیز از وزنهای نهایی گرفته تا دادههای آموزشی، پستهای بازرسی میانی، کد آموزشی و سیاهههای ریزدانه را ارسال میکند – بستهای که رویترز آن را بهعنوان مدلهای کاملا متنباز توصیف میکند که با دادههای آموزشی و کد آنها منتشر شدهاند.
بیشتر نسخههای با وزن باز هنوز در وزنهها متوقف میشوند و به افراد خارجی اجازه میدهند تا حدس بزنند که این مدلها واقعاً چگونه ساخته شدهاند. K2 Horizon رویکردی مخالف دارد و ورود آن لحظهای مهم برای هر کسی است که [مدلهای هوش مصنوعی وزن باز] (https://aibuzzwire.news) را در سراسر صنعت ردیابی میکند.
شش مدل، از ساعت تا شرکتی
این ناوگان دارای شش اندازه است: پارامترهای 375B-A23B، 36B-A4B، 32B، 7B، 3.7B و 0.9B. بر اساس اعلام IFM، مدل ها به عنوان یک سیستم متصل به جای شش نسخه نامرتبط طراحی شده اند.
کوچکترین مدل، محیطهای بسیار محدودی مانند ساعتها و عینکها را هدف قرار میدهد، در حالی که مدلهای 3.7B و 7B برای تلفنها و سایر برنامههای کاربردی روی دستگاه قرار دارند. مدل متراکم 32B و مدل پراکنده 36B-A4B در ایستگاه های کاری محلی و سرویس دهی کارآمد طراحی شده اند، و پرچمدار 375B-A23B قوی ترین قابلیت های ناوگان را در استقرار سازمانی پرمشقت حمل می کند. هر شش مدل با پشتیبانی کوانتیزاسیون ارسال می شوند.
مدلها معماری اصلی، واژگان، روششناسی آموزشی، رابطها، زیرساخت ارزیابی و ابزار استقرار را با مدل 0.9B با استفاده از واژگان کوچکتر به اشتراک میگذارند. IFM میگوید که سازگاری حرکت بین اندازهها، مسیریابی پویا در ناوگان و مطالعه چگونگی مقیاس قابلیتها را آسانتر میکند.
آنچه "کاملا باز" در واقع پوشش می دهد
اینجا جایی است که K2 Horizon از هنجار صنعت خارج می شود. برای هر مدل در ناوگان، IFM میگوید که چرخه عمر آموزش را از پیشآموزش از طریق استدلال و پس از آموزش عامل باز میکند.
این نسخه شامل پستهای بازرسی میانی، دادههای آموزشی یا دستورالعملهای دقیق ساخت داده، مستندات معماری باز، ترکیبات مخلوط، کد آموزشی، پیکربندیها، گزارشهای آموزشی دقیق، نتایج ارزیابی و وزنهای نهایی است. مدلها و کدها تحت مجوز Apache 2.0 منتشر شدهاند که یکی از مجازترین در استفاده تجاری است. مجموعههای داده تحت مجوزهای قابل اجرا خود، مانند ODC-BY منتشر میشوند و IFM متعهد میشود که در مواردی که توزیع مجدد امکانپذیر نیست، نحوه ساخت و ترکیب دادهها را افشا کند.
IFM همچنین این نسخه را به عنوان اولین خانواده مدل باز تعریف می کند که فرآیند توسعه کامل را از طریق آموزش پس از آموزش به نمایش می گذارد. در عمل، این بدان معناست که محققان میتوانند نحوه ظهور استدلال، استفاده از ابزار، برنامهریزی و رفتارهای عاملی را در طول آموزش مطالعه کنند، روشها را بازتولید کنند و آنها را با ابزارها و حوزههای جدید تطبیق دهند - کاری که معمولاً زمانی غیرممکن است که فقط وزنهای نهایی منتشر شود.
ادعای عملکرد
IFM میگوید مدلهای کوچکتر ناوگان، نتایج پیشرفتهای را در مقیاسهای مربوط به خود ارائه میکنند. طبق گزارشها، مدلهای 0.9B، 3.7B و 7B کلاسهای اندازه خود را در ریاضیات، استدلال، قابلیتهای عمومی، کدگذاری و وظایف عاملی هدایت میکنند.
برخی از مشخصات این اعلامیه: K2 Horizon 0.9B در AIME 2026 امتیاز بالاتر از 48 را کسب می کند، یک معیار ریاضی رقابتی که برای مدل های کوچک وحشیانه باقی می ماند. مدلهای 3.7B و 7B برای نتایج قوی SWE-bench و BrowseComp برجسته شدهاند که به مهندسی نرمافزار و قابلیت مرور چند مرحلهای که برای اندازه آنها غیرمعمول است اشاره میکند. مدل 36B-A4B مکانیزم جدیدی از ترکیب ارزش توجه (MoVA) را معرفی میکند که IFM به دلیل تواناییهایی که از آن چیزی که تعداد پارامترهای فعال آن نشان میدهد بیشتر است، اعتبار میدهد. مدل های 32B و 375B-A23B به عنوان رتبه بندی در بین مدل های برتر در کلاس های مربوطه خود توصیف می شوند.
مانند هر ارزیابی منتشر شده در آزمایشگاه، این ارقام خود گزارش می شوند و تأیید مستقل زمان می برد. اما اگر اعداد و ارقام ادامه پیدا کند، سطوح پایه و متوسط ناوگان میتواند انتظار توسعهدهندگان را از مدلهایی که با سختافزار مصرفکننده کار میکنند، تغییر دهد.
چرا ابوظبی همچنان در هوش مصنوعی باز ظاهر می شود
انتشار ردپای رو به رشد امارات متحده عربی در توسعه مدل باز را تقویت می کند. اکوسیستم هوش مصنوعی ابوظبی - که توسط مؤسساتی از جمله MBZUAI، که سیستم استدلال K2 Think را با G42 در سال 2025 راه اندازی کرد، لنگر انداخته است - به طور مداوم انتشارات باز را به عنوان یک متمایزکننده استراتژیک قرار داده است، الگویی که رویترز در پوشش خود از انتشار روز پنجشنبه ثبت کرد.
زمان بندی همچنین در بازار در حال تغییر برای مدل های باز قرار می گیرد. توافق انویدیا برای خرید Hugging Face به مبلغ تقریبی 12.9 میلیارد دلار که این هفته اعلام شد، نشان میدهد که چقدر ارزش تجاری در اطراف پلتفرمهای توزیع مدل باز انباشته شده است. در همین حال، هایپراسکیلرها برای مجوز دادن به مدلهای وزن باز از آزمایشگاههای چینی صف کشیدهاند و شرکتهای هوش مصنوعی غربی نامهای منتشر کردند که در آن نسبت به محدودیتهای زودهنگام وزنههای باز هشدار داد.
در مقابل این پسزمینه، یک ناوگان مجاور مرزی که کل خط لوله آموزشی خود را منتشر میکند، به محققان، استارتآپها و دولتها جایگزینی برای وابستگی به APIهای بسته تعدادی از ارائهدهندگان آمریکایی میدهد.
بعدی چه چیزی را تماشا کنیم
سه سوال تعیین می کند که آیا K2 Horizon فراتر از سرفصل ها اهمیت دارد یا خیر. اول، آیا میتوان نتایج معیار را توسط ارزیابهای مستقل بازتولید کرد، بهویژه برای مدلهای کوچکی که در آن ادعاها بسیار چشمگیر هستند؟ دوم، با توجه به اینکه IFM اذعان میکند که برخی از دادههای آموزشی را نمیتوان مجددا توزیع کرد و در عوض با دستور تهیه شده است، مجوزهای داده در عمل چقدر مجاز هستند؟ سوم، آیا شرکتها واقعاً یک مدل پراکنده 375B را در خارج از یک ابر بزرگ پیادهسازی خواهند کرد، یا تأثیر عملی در سطح 7B و کمتر که روی تلفنها و لپتاپها اجرا میشود متمرکز خواهد شد؟
محتمل ترین اثر فوری بر شفافیت تحقیق است. K2 Horizon با پوینتهای بازرسی، گزارشها و دستور العملهای دادهها، یک مثال کامل از نحوه ایجاد یک خانواده مدل مدرن با استدلال و عامل ارائه میدهد - چیزی که جامعه هرگز در این مقیاس نداشته است.
از هر توسعه بزرگ هوش مصنوعی جلوتر باشید
نسخه های مدل هر ماه سریعتر می آیند. قبل از اینکه مهم باشد، با هر راه اندازی و معیار همراه باشید.
---
از هوش مصنوعی جلوتر بمانیدآخرین اخبار، تحلیل ها و پیشرفت های هوش مصنوعی را دریافت کنید - همه در یک مکان.
بیشتر بخوانید اخبار هوش مصنوعی →