Anthropic اولین نگاه در نوع خود را در خط لوله توسعه خود در این هفته منتشر کرد و فاش کرد که مدل Claude آن اکنون 26 درصد از تحقیقات و توسعه هوش مصنوعی در شرکت را هدایت میکند — از کمتر از 1 درصد در فوریه 2026. رویترز، واشنگتن پست و سایر رسانه ها.
این پست تا حدی یک تمرین شفافسازی و تا حدودی یک استدلال است: آنتروپیک از آزمایشگاههای مرزی دیگر میخواهد که همان اعداد را منتشر کنند، تا عموم مردم و دولتها بتوانند ردیابی کنند که با چه سرعتی کلیدهای ساخت هوش مصنوعی در اختیار هوش مصنوعی قرار میگیرد. For more context on this story, see our ongoing artificial intelligence updates.
سه عدد برای ردیابی توسعه هوش مصنوعی
این شرکت سه اندازهگیری را پیشنهاد کرد که میگوید سرعت توسعه در آزمایشگاههای مرزی را روشن میکند: میزان تحقیق و توسعه هوش مصنوعی توسط خود هوش مصنوعی چقدر انجام میشود، عملکرد عوامل هوش مصنوعی چقدر خوب نظارت میشود و نحوه محاسبه بین کار با قابلیت و کار ایمنی.
شماره تیتر از چیزی است که Anthropic آن را شاخص اتوماسیون تحقیق و توسعه می نامد. این شرکت هر نوع کار تحقیق و توسعه هوش مصنوعی انجام شده در شرکت را فهرستبندی کرد، میزان خودکار بودن هر کار در حال حاضر را رتبهبندی کرد و نتایج را با استفاده از مقیاسی که توسط گروه تحقیقاتی Epoch AI توسعه داده شد، جمعآوری کرد. مقیاس از AL0 (بدون دخالت هوش مصنوعی) تا AL5 (هوش مصنوعی کاملاً مستقل عمل میکند، بدون هیچ انسانی در حلقه)، با AL3 به معنای «همکاری» AI در بخشهای بزرگ کار تحت هدایت نزدیک انسان و AL4 به معنای هوش مصنوعی «رهبری»، که بیشتر یک کار را از سر به انتها از یک دستور فوقالعاده انسانی تکمیل میکند.
از آگوست 2026، آنتروپیک گزارش داد، کلود 26 درصد از کارهای تحقیق و توسعه هوش مصنوعی شرکت را رهبری می کند. سهم کار در سطح یا بالاتر از سطح "هوش مصنوعی همکاری می کند" بالای 90٪ است. کلود برای هیچ یک از زیرمجموعه های اندازه گیری شده از کار تحقیق و توسعه هوش مصنوعی به طور کامل مستقل عمل نمی کند.
30000 نماینده، یک مانیتور
دومین اندازه گیری مربوط به نظارت است. آنتروپیک فاش کرد که تا اوت 2026 تقریباً 30000 نماینده در هر زمان در شرکت در پرکاربردترین پلتفرم داخلی آن کار تحقیقاتی و مهندسی انجام می دادند.
طبق پست، هر اقدامی که این عوامل انجام میدهند، قبل از اجرا، معمولاً در عرض چند ثانیه از یک مانیتور آنلاین عبور میکند. آنتروپیک می گوید که بیش از یک میلیارد تصمیم از سوی عوامل تحقیقاتی و مهندسی خود را در ماه آگوست تجزیه و تحلیل کرده و دریافته است که سهم فعالیت های مسدود شده یا تشدید شده توسط مانیتورها 0.002 درصد بوده است.
در مورد تخصیص محاسباتی، سومین اندازه گیری، این شرکت گفت که در طول هفته مورد بررسی، تقریباً 6 درصد از محاسباتی که به تحقیق و توسعه هوش مصنوعی اختصاص داده شده است، به ایمنی اختصاص داده شده است.
جانشین خود را بسازد - با نظارت انسان ها
قاب بندی به اندازه شکل ها اهمیت دارد. مدلهای آنتروپیک به طور فزایندهای در ساخت نسل بعدی همان مدلها مشارکت میکنند - چیزی که محققان آن را خود-بهبودی بازگشتی مینامند، و تیتر واشنگتن پست با صراحت بیشتر به عنوان یک ربات چت «کار ساخت جانشین خود را به عهده میگیرد».
Anthropic مراقب است که بین "AI سرنخها" و "AI جایگزین میشود" خطی بکشد. در AL4، یک انسان همچنان نظارت می کند و می تواند مداخله کند. این شرکت به صراحت گزارش داد که هیچ زیرمجموعه اندازه گیری شده ای از کار تحقیق و توسعه آن در AL5 اجرا نمی شود. اما مسیر شیبدار است: کاهش از کمتر از 1% به 26% در تقریباً هفت ماه نشان میدهد که اگر روند فعلی ادامه داشته باشد، سهم کار مبتنی بر هوش مصنوعی میتواند قبل از پایان دهه به نصف برسد.
روش شناسی محدودیت های واقعی دارد و آنتروپیک این را می گوید. رتبهبندیهای اتوماسیون آن با نمونهبرداری از سوابق کاری خود شرکت - از جمله پیامهای Slack و اسناد داخلی - و اینکه هم انسانها و هم یک مدل قاضی میزان خودکار بودن هر کار را ارزیابی میکنند. در یک آزمایش کور، کارکنان بدون اینکه بدانند مدلها چه شواهدی جمعآوری کردهاند، وظایف را رتبهبندی کردند. این شرکت گزارش داد که قاضی مدل آن تقریباً به همان میزانی که انسان ها با یکدیگر موافق بودند، با انسان ها موافق بود: توافق دقیق مدل به انسان 59٪ بود، در حالی که توافق انسان به انسان فقط 35٪ بود و رتبه بندی مدل و انسان در 97٪ مواقع در یک سطح از یکدیگر قرار داشتند.
این شرکت همچنین ریسک خودارجاعی را در روششناسی خود تصدیق کرد: آنتروپیک از مدلهای خود برای کمک به ارزیابی سیستمهای خود استفاده کرد، که میتواند به این معنی باشد که مدل قاضی همان نوع خطاهایی را انجام میدهد که مدلی که بررسی میکند. این استدلال می کند که تأیید شخص ثالث پاسخ واقعی است.
چشم های بیرون می آیند
برای این منظور، Anthropic میگوید که قصد دارد ارزیابهای مستقل شخص ثالث را از چندین سازمان در داخل شرکت تعبیه کند و به آنها دسترسی به فرآیندهای داخلی، سیستمها و دادههای قابل مقایسه با آنچه تیمهای ارزیابی ریسک داخلی دارند، بدهد. سازمان غیرانتفاعی تحقیقاتی هوش مصنوعی خارجی METR قبلاً پلتفرم نظارت آفلاین Anthropic را تشکیل داده است.
این افشاگری در بحبوحه بحث تشدید شده در مورد سرعت انجام می شود. داریو آمودی، مدیر عامل آنتروپیک، خواستار هماهنگی برای کاهش سرعت مرزها شده است و این شرکت خاطرنشان می کند که در صورت وجود چنین هماهنگی، انتظار می رود تعداد خود تغییر کند. این هفته، Anthropic و OpenAI نیز موضوع نامهای عمومی از کارشناسان ایمنی بودند که در آن استدلال میکردند که آزمایشگاهها به ارزیابهای ایمنی واقعاً مستقل نیاز دارند.
این که آیا رقبا از آنتروپیک پیروی می کنند یا خیر، این سوال باز است. این شرکت استدلال میکند که هر توسعهدهنده مرزی میتواند این اقدامات را به طور منظم با استفاده از روششناسی عمومی منتشر کند. تا زمانی که این کار را انجام ندهند، تنها اعداد عمومی در مورد سرعت ساخت هوش مصنوعی توسط هوش مصنوعی از خود آزمایشگاه ها می آید.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →