Anthropic Claude Sonnet 5 را منتشر کرده است و آن را عاملی ترین مدل کلاس Sonnet می داند که این شرکت ساخته است. مدل جدید که در 30 ژوئن 2026 رونمایی شد، میتواند برنامهریزی کند، از ابزارهایی مانند مرورگرها و پایانهها استفاده کند و بهطور مستقل در سطحی اجرا شود که همین چند ماه پیش به مدلهای بزرگتر و بسیار گرانتر نیاز داشت. این راهاندازی در لحظهای انجام میشود که کل صنعت هوش مصنوعی در حال رقابت برای تبدیل چتباتها به عوامل توانمندی است که میتوانند به جای پاسخگویی صرف به سؤالات، از طرف کاربر عمل کنند.
برای توسعهدهندگانی که آخرین پیشرفتها را دنبال میکنند، این خبر به بخش شلوغی از اخبار هوش مصنوعی اضافه میکند که چشمانداز رقابتی را تغییر داده است. Anthropic فریم Sonnet 5 را بهعنوان لحظهای که قابلیت عامل در نهایت به قیمتهای متوسط میرسد، تغییر میدهد که میتواند نحوه بودجه تیمها را برای گردشهای کاری مستقل تغییر دهد.
عملکردی که با پرچمدار رقابت می کند
به گفته آنتروپیک، Sonnet 5 فاصله بین سری Sonnet میان رده و مدل های سطح بالای Opus این شرکت را کاهش می دهد. عملکرد آن نزدیک به Opus 4.8 است، اما با قیمت های بسیار پایین تر، و نشان دهنده پیشرفت قابل توجهی نسبت به نسخه قبلی خود، Sonnet 4.6، در استدلال، استفاده از ابزار، کدگذاری و کار دانش است.
Anthropic منحنیهای عملکرد هزینه را منتشر کرد که مدل را با Sonnet 4.6 و Opus 4.8 در دو ارزیابی عامل مقایسه میکند: BrowseComp، که جستجوی عامل را اندازهگیری میکند، و OSWorld-Verified، که استفاده از رایانه را آزمایش میکند. این شرکت میگوید که Sonnet 5 طیف گستردهتری از گزینههای کارایی هزینه را نسبت به Sonnet 4.6 ارائه میکند و در سطوح تلاش بالاتر، میتواند در برخی از وظایف با Opus 4.8 مطابقت داشته باشد.
قیمت گذاری تهاجمی برای نمایندگان
قیمت گذاری در زمین اصلی است. Claude Sonnet 5 با قیمت اولیه 2 دلار به ازای هر میلیون توکن ورودی و 10 دلار به ازای هر میلیون توکن خروجی راه اندازی می شود، که تا 31 آگوست 2026 در دسترس است. پس از آن پنجره، به 3 دلار در هر میلیون توکن ورودی و 15 دلار در هر میلیون توکن خروجی می رسد.
برای مقایسه، قیمت Opus 4.8 به ازای هر میلیون توکن ورودی 5 دلار و به ازای هر میلیون توکن خروجی 25 دلار است. از آنجایی که نمایندگان، تعداد زیادی توکن را به عنوان استدلال و فراخوانی ابزارها در طی مراحل مختلف می سوزانند، این شکاف قیمت برای بودجه های سازمانی بسیار مهم است. آزمایشکنندگان دسترسی اولیه که توسط Anthropic ذکر شدهاند، توصیف کردند که Sonnet 5 وظایف پیچیدهای را که در آن مدلهای قبلی Sonnet کوتاه میآمدند، به پایان میرساند، و خروجی خود را بدون اینکه صریحاً از او خواسته شود، بررسی میکرد.
در دسترس بودن در هر طرح
Claude Sonnet 5 در تمام برنامه های Anthropic از روز عرضه در دسترس است. این مدل پیشفرض برای کاربران رایگان و حرفهای است و برای مشتریان Max، Team و Enterprise در دسترس است. توسعه دهندگان می توانند از طریق Claude API با استفاده از شناسه مدل «claude-sonnet-5» و همچنین از طریق Claude Code و Claude Platform به آن دسترسی داشته باشند.
عرضه گسترده قابل توجه است زیرا عملکرد نمایندگی توانا را در اختیار کاربران رایگان قرار می دهد، نه فقط به مشتریان سازمانی پول پرداخت می کند. Anthropic گفت که خط Sonnet از لحاظ تاریخی جایی بوده است که دوران نمایندگی برای بسیاری از توسعه دهندگان آغاز شد و به Claude Sonnet 3.5، 3.6 و 3.7 به عنوان اولین مدل هایی اشاره کرد که مهارت های کدنویسی و استفاده از ابزار قوی را نشان دادند.
یک داستان ایمنی ساخته شده است
ایمنی بخش مهمی از اعلامیه بود. Anthropic گفت که ارزیابیهایش نشان میدهد که Sonnet 5 به طور کلی نرخ رفتارهای نامطلوب کمتری نسبت به Sonnet 4.6 نشان میدهد و به طور کلی برای استفاده در زمینههای عامل ایمنتر است. این شرکت همچنین خاطرنشان کرد که این مدل نسبت به مدلهای فعلی Opus، توانایی بسیار کمتری برای انجام وظایف امنیت سایبری دارد، یک انتخاب طراحی عمدی که خطر سوء استفاده را حتی با بالا رفتن قابلیتهای عمومی کاهش میدهد.
کارت سیستم Claude Sonnet 5 که در کنار مدل منتشر شده است، مجموعه گسترده تری از ارزیابی ها را با جزئیات گزارش می کند. آنتروپیک شفافیت در مورد تست ایمنی را به عنوان یک تمایز رقابتی قرار داده است زیرا تنظیمکنندهها در ایالات متحده و اروپا نسخههای مدل مرزی را بررسی میکنند.
لحظه عامل گسترده تر
پرتاب در میان رقابت شدید فرود آمد. رقبایی از جمله OpenAI، گوگل و مجموعهای از آزمایشگاههای چینی که به سرعت در حال حرکت هستند، همگی به سمت مدلهایی پیش میروند که میتوانند به جای تولید متن ساده، اقدامات چند مرحلهای انجام دهند. با ارائه قابلیت عامل مجاور Opus با قیمت Sonnet، Anthropic شرط میبندد که میدان نبرد بعدی امتیازات معیار خام نیست، بلکه هزینه اجرای قابل اعتماد یک عامل برای کارهای طولانی و پیچیده است.
با قفل شدن قیمت اولیه تا پایان آگوست، توسعه دهندگان اکنون دریچه ای برای تست استرس Sonnet 5 در برابر سخت ترین حجم کاری عاملی خود قبل از اعمال نرخ های بالاتر دارند.
از هوش مصنوعی جلوتر بمانید
سرعت عرضه مدل ها هیچ نشانه ای از کند شدن را نشان نمی دهد. برای پوشش مداوم راهاندازیهای جدید، دورهای تأمین مالی، و تغییر خطمشی، از [AI Buzz Wire] (https://aibuzzwire.news) دیدن کنید تا آخرین پیشرفتهای هوش مصنوعی در صورت وقوع پیدا کنند.
بیشتر بخوانید اخبار هوش مصنوعی →





