Anthropic Claude Sonnet 5 را منتشر کرده است و آن را عاملی ترین مدل کلاس Sonnet می داند که این شرکت ساخته است. مدل جدید که در 30 ژوئن 2026 رونمایی شد، می‌تواند برنامه‌ریزی کند، از ابزارهایی مانند مرورگرها و پایانه‌ها استفاده کند و به‌طور مستقل در سطحی اجرا شود که همین چند ماه پیش به مدل‌های بزرگ‌تر و بسیار گران‌تر نیاز داشت. این راه‌اندازی در لحظه‌ای انجام می‌شود که کل صنعت هوش مصنوعی در حال رقابت برای تبدیل چت‌بات‌ها به عوامل توانمندی است که می‌توانند به جای پاسخگویی صرف به سؤالات، از طرف کاربر عمل کنند.

برای توسعه‌دهندگانی که آخرین پیشرفت‌ها را دنبال می‌کنند، این خبر به بخش شلوغی از اخبار هوش مصنوعی اضافه می‌کند که چشم‌انداز رقابتی را تغییر داده است. Anthropic فریم Sonnet 5 را به‌عنوان لحظه‌ای که قابلیت عامل در نهایت به قیمت‌های متوسط ​​می‌رسد، تغییر می‌دهد که می‌تواند نحوه بودجه تیم‌ها را برای گردش‌های کاری مستقل تغییر دهد.

عملکردی که با پرچمدار رقابت می کند

به گفته آنتروپیک، Sonnet 5 فاصله بین سری Sonnet میان رده و مدل های سطح بالای Opus این شرکت را کاهش می دهد. عملکرد آن نزدیک به Opus 4.8 است، اما با قیمت های بسیار پایین تر، و نشان دهنده پیشرفت قابل توجهی نسبت به نسخه قبلی خود، Sonnet 4.6، در استدلال، استفاده از ابزار، کدگذاری و کار دانش است.

Anthropic منحنی‌های عملکرد هزینه را منتشر کرد که مدل را با Sonnet 4.6 و Opus 4.8 در دو ارزیابی عامل مقایسه می‌کند: BrowseComp، که جستجوی عامل را اندازه‌گیری می‌کند، و OSWorld-Verified، که استفاده از رایانه را آزمایش می‌کند. این شرکت می‌گوید که Sonnet 5 طیف گسترده‌تری از گزینه‌های کارایی هزینه را نسبت به Sonnet 4.6 ارائه می‌کند و در سطوح تلاش بالاتر، می‌تواند در برخی از وظایف با Opus 4.8 مطابقت داشته باشد.

قیمت گذاری تهاجمی برای نمایندگان

قیمت گذاری در زمین اصلی است. Claude Sonnet 5 با قیمت اولیه 2 دلار به ازای هر میلیون توکن ورودی و 10 دلار به ازای هر میلیون توکن خروجی راه اندازی می شود، که تا 31 آگوست 2026 در دسترس است. پس از آن پنجره، به 3 دلار در هر میلیون توکن ورودی و 15 دلار در هر میلیون توکن خروجی می رسد.

برای مقایسه، قیمت Opus 4.8 به ازای هر میلیون توکن ورودی 5 دلار و به ازای هر میلیون توکن خروجی 25 دلار است. از آنجایی که نمایندگان، تعداد زیادی توکن را به عنوان استدلال و فراخوانی ابزارها در طی مراحل مختلف می سوزانند، این شکاف قیمت برای بودجه های سازمانی بسیار مهم است. آزمایش‌کنندگان دسترسی اولیه که توسط Anthropic ذکر شده‌اند، توصیف کردند که Sonnet 5 وظایف پیچیده‌ای را که در آن مدل‌های قبلی Sonnet کوتاه می‌آمدند، به پایان می‌رساند، و خروجی خود را بدون اینکه صریحاً از او خواسته شود، بررسی می‌کرد.

در دسترس بودن در هر طرح

Claude Sonnet 5 در تمام برنامه های Anthropic از روز عرضه در دسترس است. این مدل پیش‌فرض برای کاربران رایگان و حرفه‌ای است و برای مشتریان Max، Team و Enterprise در دسترس است. توسعه دهندگان می توانند از طریق Claude API با استفاده از شناسه مدل «claude-sonnet-5» و همچنین از طریق Claude Code و Claude Platform به آن دسترسی داشته باشند.

عرضه گسترده قابل توجه است زیرا عملکرد نمایندگی توانا را در اختیار کاربران رایگان قرار می دهد، نه فقط به مشتریان سازمانی پول پرداخت می کند. Anthropic گفت که خط Sonnet از لحاظ تاریخی جایی بوده است که دوران نمایندگی برای بسیاری از توسعه دهندگان آغاز شد و به Claude Sonnet 3.5، 3.6 و 3.7 به عنوان اولین مدل هایی اشاره کرد که مهارت های کدنویسی و استفاده از ابزار قوی را نشان دادند.

یک داستان ایمنی ساخته شده است

ایمنی بخش مهمی از اعلامیه بود. Anthropic گفت که ارزیابی‌هایش نشان می‌دهد که Sonnet 5 به طور کلی نرخ رفتارهای نامطلوب کمتری نسبت به Sonnet 4.6 نشان می‌دهد و به طور کلی برای استفاده در زمینه‌های عامل ایمن‌تر است. این شرکت همچنین خاطرنشان کرد که این مدل نسبت به مدل‌های فعلی Opus، توانایی بسیار کمتری برای انجام وظایف امنیت سایبری دارد، یک انتخاب طراحی عمدی که خطر سوء استفاده را حتی با بالا رفتن قابلیت‌های عمومی کاهش می‌دهد.

کارت سیستم Claude Sonnet 5 که در کنار مدل منتشر شده است، مجموعه گسترده تری از ارزیابی ها را با جزئیات گزارش می کند. آنتروپیک شفافیت در مورد تست ایمنی را به عنوان یک تمایز رقابتی قرار داده است زیرا تنظیم‌کننده‌ها در ایالات متحده و اروپا نسخه‌های مدل مرزی را بررسی می‌کنند.

لحظه عامل گسترده تر

پرتاب در میان رقابت شدید فرود آمد. رقبایی از جمله OpenAI، گوگل و مجموعه‌ای از آزمایشگاه‌های چینی که به سرعت در حال حرکت هستند، همگی به سمت مدل‌هایی پیش می‌روند که می‌توانند به جای تولید متن ساده، اقدامات چند مرحله‌ای انجام دهند. با ارائه قابلیت عامل مجاور Opus با قیمت Sonnet، Anthropic شرط می‌بندد که میدان نبرد بعدی امتیازات معیار خام نیست، بلکه هزینه اجرای قابل اعتماد یک عامل برای کارهای طولانی و پیچیده است.

با قفل شدن قیمت اولیه تا پایان آگوست، توسعه دهندگان اکنون دریچه ای برای تست استرس Sonnet 5 در برابر سخت ترین حجم کاری عاملی خود قبل از اعمال نرخ های بالاتر دارند.

از هوش مصنوعی جلوتر بمانید

سرعت عرضه مدل ها هیچ نشانه ای از کند شدن را نشان نمی دهد. برای پوشش مداوم راه‌اندازی‌های جدید، دورهای تأمین مالی، و تغییر خط‌مشی، از [AI Buzz Wire] (https://aibuzzwire.news) دیدن کنید تا آخرین پیشرفت‌های هوش مصنوعی در صورت وقوع پیدا کنند.

بیشتر بخوانید اخبار هوش مصنوعی →