Anthropic اولین نگاه در نوع خود را در خط لوله توسعه خود در این هفته منتشر کرد و فاش کرد که مدل Claude آن اکنون 26 درصد از تحقیقات و توسعه هوش مصنوعی در شرکت را هدایت می‌کند — از کمتر از 1 درصد در فوریه 2026. رویترز، واشنگتن پست و سایر رسانه ها.

این پست تا حدی یک تمرین شفاف‌سازی و تا حدودی یک استدلال است: آنتروپیک از آزمایشگاه‌های مرزی دیگر می‌خواهد که همان اعداد را منتشر کنند، تا عموم مردم و دولت‌ها بتوانند ردیابی کنند که با چه سرعتی کلیدهای ساخت هوش مصنوعی در اختیار هوش مصنوعی قرار می‌گیرد. For more context on this story, see our ongoing artificial intelligence updates.

سه عدد برای ردیابی توسعه هوش مصنوعی

این شرکت سه اندازه‌گیری را پیشنهاد کرد که می‌گوید سرعت توسعه در آزمایشگاه‌های مرزی را روشن می‌کند: میزان تحقیق و توسعه هوش مصنوعی توسط خود هوش مصنوعی چقدر انجام می‌شود، عملکرد عوامل هوش مصنوعی چقدر خوب نظارت می‌شود و نحوه محاسبه بین کار با قابلیت و کار ایمنی.

شماره تیتر از چیزی است که Anthropic آن را شاخص اتوماسیون تحقیق و توسعه می نامد. این شرکت هر نوع کار تحقیق و توسعه هوش مصنوعی انجام شده در شرکت را فهرست‌بندی کرد، میزان خودکار بودن هر کار در حال حاضر را رتبه‌بندی کرد و نتایج را با استفاده از مقیاسی که توسط گروه تحقیقاتی Epoch AI توسعه داده شد، جمع‌آوری کرد. مقیاس از AL0 (بدون دخالت هوش مصنوعی) تا AL5 (هوش مصنوعی کاملاً مستقل عمل می‌کند، بدون هیچ انسانی در حلقه)، با AL3 به معنای «همکاری» AI در بخش‌های بزرگ کار تحت هدایت نزدیک انسان و AL4 به معنای هوش مصنوعی «رهبری»، که بیشتر یک کار را از سر به انتها از یک دستور فوق‌العاده انسانی تکمیل می‌کند.

از آگوست 2026، آنتروپیک گزارش داد، کلود 26 درصد از کارهای تحقیق و توسعه هوش مصنوعی شرکت را رهبری می کند. سهم کار در سطح یا بالاتر از سطح "هوش مصنوعی همکاری می کند" بالای 90٪ است. کلود برای هیچ یک از زیرمجموعه های اندازه گیری شده از کار تحقیق و توسعه هوش مصنوعی به طور کامل مستقل عمل نمی کند.

30000 نماینده، یک مانیتور

دومین اندازه گیری مربوط به نظارت است. آنتروپیک فاش کرد که تا اوت 2026 تقریباً 30000 نماینده در هر زمان در شرکت در پرکاربردترین پلتفرم داخلی آن کار تحقیقاتی و مهندسی انجام می دادند.

طبق پست، هر اقدامی که این عوامل انجام می‌دهند، قبل از اجرا، معمولاً در عرض چند ثانیه از یک مانیتور آنلاین عبور می‌کند. آنتروپیک می گوید که بیش از یک میلیارد تصمیم از سوی عوامل تحقیقاتی و مهندسی خود را در ماه آگوست تجزیه و تحلیل کرده و دریافته است که سهم فعالیت های مسدود شده یا تشدید شده توسط مانیتورها 0.002 درصد بوده است.

در مورد تخصیص محاسباتی، سومین اندازه گیری، این شرکت گفت که در طول هفته مورد بررسی، تقریباً 6 درصد از محاسباتی که به تحقیق و توسعه هوش مصنوعی اختصاص داده شده است، به ایمنی اختصاص داده شده است.

جانشین خود را بسازد - با نظارت انسان ها

قاب بندی به اندازه شکل ها اهمیت دارد. مدل‌های آنتروپیک به طور فزاینده‌ای در ساخت نسل بعدی همان مدل‌ها مشارکت می‌کنند - چیزی که محققان آن را خود-بهبودی بازگشتی می‌نامند، و تیتر واشنگتن پست با صراحت بیشتر به عنوان یک ربات چت «کار ساخت جانشین خود را به عهده می‌گیرد».

Anthropic مراقب است که بین "AI سرنخ‌ها" و "AI جایگزین می‌شود" خطی بکشد. در AL4، یک انسان همچنان نظارت می کند و می تواند مداخله کند. این شرکت به صراحت گزارش داد که هیچ زیرمجموعه اندازه گیری شده ای از کار تحقیق و توسعه آن در AL5 اجرا نمی شود. اما مسیر شیب‌دار است: کاهش از کمتر از 1% به 26% در تقریباً هفت ماه نشان می‌دهد که اگر روند فعلی ادامه داشته باشد، سهم کار مبتنی بر هوش مصنوعی می‌تواند قبل از پایان دهه به نصف برسد.

روش شناسی محدودیت های واقعی دارد و آنتروپیک این را می گوید. رتبه‌بندی‌های اتوماسیون آن با نمونه‌برداری از سوابق کاری خود شرکت - از جمله پیام‌های Slack و اسناد داخلی - و اینکه هم انسان‌ها و هم یک مدل قاضی میزان خودکار بودن هر کار را ارزیابی می‌کنند. در یک آزمایش کور، کارکنان بدون اینکه بدانند مدل‌ها چه شواهدی جمع‌آوری کرده‌اند، وظایف را رتبه‌بندی کردند. این شرکت گزارش داد که قاضی مدل آن تقریباً به همان میزانی که انسان ها با یکدیگر موافق بودند، با انسان ها موافق بود: توافق دقیق مدل به انسان 59٪ بود، در حالی که توافق انسان به انسان فقط 35٪ بود و رتبه بندی مدل و انسان در 97٪ مواقع در یک سطح از یکدیگر قرار داشتند.

این شرکت همچنین ریسک خودارجاعی را در روش‌شناسی خود تصدیق کرد: آنتروپیک از مدل‌های خود برای کمک به ارزیابی سیستم‌های خود استفاده کرد، که می‌تواند به این معنی باشد که مدل قاضی همان نوع خطاهایی را انجام می‌دهد که مدلی که بررسی می‌کند. این استدلال می کند که تأیید شخص ثالث پاسخ واقعی است.

چشم های بیرون می آیند

برای این منظور، Anthropic می‌گوید که قصد دارد ارزیاب‌های مستقل شخص ثالث را از چندین سازمان در داخل شرکت تعبیه کند و به آنها دسترسی به فرآیندهای داخلی، سیستم‌ها و داده‌های قابل مقایسه با آنچه تیم‌های ارزیابی ریسک داخلی دارند، بدهد. سازمان غیرانتفاعی تحقیقاتی هوش مصنوعی خارجی METR قبلاً پلتفرم نظارت آفلاین Anthropic را تشکیل داده است.

این افشاگری در بحبوحه بحث تشدید شده در مورد سرعت انجام می شود. داریو آمودی، مدیر عامل آنتروپیک، خواستار هماهنگی برای کاهش سرعت مرزها شده است و این شرکت خاطرنشان می کند که در صورت وجود چنین هماهنگی، انتظار می رود تعداد خود تغییر کند. این هفته، Anthropic و OpenAI نیز موضوع نامه‌ای عمومی از کارشناسان ایمنی بودند که در آن استدلال می‌کردند که آزمایشگاه‌ها به ارزیاب‌های ایمنی واقعاً مستقل نیاز دارند.

این که آیا رقبا از آنتروپیک پیروی می کنند یا خیر، این سوال باز است. این شرکت استدلال می‌کند که هر توسعه‌دهنده مرزی می‌تواند این اقدامات را به طور منظم با استفاده از روش‌شناسی عمومی منتشر کند. تا زمانی که این کار را انجام ندهند، تنها اعداد عمومی در مورد سرعت ساخت هوش مصنوعی توسط هوش مصنوعی از خود آزمایشگاه ها می آید.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →