نشرت Anthropic حسابًا هندسيًا مفصلاً لكيفية جعلها claude.ai وتطبيق Claude لسطح المكتب أسرع بثلاث مرات تقريبًا في سباق سريع مدته أسبوعين، والتطور هو أن معظم العمل قام به كلود نفسه. يصف المنشور، المنشور على مدونة Anthropic الهندسية، حملة أداء يتم تشغيلها من قناة Slack واحدة مع نموذج الذكاء الاصطناعي في كل موضوع، وإيجاد الاختناقات، وبناء المعايير، وتحسينات الشحن، ومراقبة كل عملية نشر.

والأرقام التي تم قياسها عند النسبة المئوية الخامسة والسبعين كبيرة. انخفض الوقت اللازم للوصول إلى صفحة قابلة للكتابة عند التحميل الجديد لموقع claude.ai من 3.1 ثانية إلى 0.55 ثانية. انخفض زمن بدء جلسة Claude Code الجديدة من 0.8 ثانية إلى 0.3 ثانية، وانخفض زمن تحميل جلسة Claude Cowork السحابية من 2.6 ثانية إلى 0.73 ثانية. بشكل إجمالي، تقدر Anthropic أن التحسينات ستوفر عشرات الآلاف من ساعات الانتظار للمستخدم يوميًا. لمزيد من السياق حول هذه القصة، راجع أخبار الذكاء الاصطناعي.

القياس أولا ثم التحرك

بدأ السباق بالقياس بدلاً من الكود. باستخدام Claude لتحليل بيانات الاستخدام من خلال خادم Datadog MCP، حدد الفريق رحلات المستخدم الأربع التي تمثل 95 بالمائة من النشاط: تشغيل التطبيق، وبدء محادثة، وتحميل محادثة موجودة، وإرسال رسالة. عبر الويب وسطح المكتب، تم تقسيم هذه الرحلات إلى ثلاثة عشر قياسًا مختلفًا، وأضاف الفريق أدوات حتى أصبح كل منها قابلاً للمقارنة بشكل مباشر - بدءًا من تفاعل المستخدم وانتهاء بمجرد عرض النتيجة.

مع وجود خطوط الأساس، قام الفريق بإعداد قائمة تضم ما يقرب من عشرين مشروعًا منتقاة بعناية، يستهدف كل منها رحلة محددة، وطلب من كلود تقدير تأثير كل منها بالمللي ثانية لتحديد أهداف العدو السريع. وصلت الخطة مبكرًا: تقارير إنسانية أصابت اثني عشر هدفًا من أصل ثلاثة عشر هدفًا في اليوم الثالث. وقد ترك ذلك مساحة لكلود لتحديد المزيد من الفرص واقتراح مسارات عمل جديدة، والتي سرعان ما تحولت إلى مشاريع كاملة خاصة بها ودفعت النتائج إلى ما هو أبعد من الأهداف الأصلية.

ما تم شحنه بالفعل

تبدو التغييرات الفنية وكأنها قائمة مرجعية لأعمال أداء الويب الحديثة. من أجل عمليات إطلاق أسرع، قام الفريق بإنشاء مؤلف ثابت في HTML حتى يتمكن المستخدمون من البدء في الكتابة أثناء تهيئة React، وقاموا مسبقًا بتجميع ذاكرة التخزين المؤقت لرمز V8 بحيث لا تتم إعادة ترجمة العملية الرئيسية لسطح المكتب من البداية عند بدء التشغيل. من أجل التنقل بشكل أسرع بين المحادثات، يظل الملحن مثبتًا بدلاً من هدمه وإعادة بنائه، ويتم جلب الجلسات مسبقًا عندما يمرر المستخدم فوقها، ويتم تقليل عمليات إعادة عرض الشريط الجانبي بنسبة 90 بالمائة.

حجم تاريخ الدمج هو الشكل الرئيسي: تم إجراء أكثر من ثلاثة آلاف تغيير خلال السباق دون وقوع حادث واحد يواجه العميل أو التراجع، وفقًا للمنشور.

كلود تاج: وكيل ذو حواجز حماية

تم إجراء السباق على ما تسميه Anthropic كلود تاغ، وهو حاليًا في مرحلة تجريبية ويوصف بأنه نموذج بحث داخلي يمكن مقارنته تقريبًا بـ Opus 5.5. تقسيم العمل هو الجزء الأكثر أهمية في القصة. اكتشف كلود الاختناقات، وقام ببناء معايير، ونفذ الإصلاحات، وراقب كل عملية نشر - حيث عمل بشكل غير متزامن لساعات في المرة الواحدة، وحتى بين عشية وضحاها. لقد حدد البشر الأهداف، وقاموا بالمقايضات، ووافقوا على كل تغيير قبل أن يندمجوا.

أراد الفريق أيضًا التكرار بشكل أسرع من إيقاع النشر الخاص به، لذلك قام ببناء قياسات معملية كبديل للقراءات الواقعية. ومن بين الأسئلة التي طرحها المهندسون: هل يمكن أن تحل أعداد تعليمات JavaScript محل توقيت ساعة الحائط كإشارة استجابة أسرع للتحقق من صحة النماذج الأولية قبل النشر؟

سبب أهمية الهندسة بمساعدة الذكاء الاصطناعي

يعتبر منشور Anthropic أقل أهمية بالنسبة للتحسينات المحددة - الأصداف الثابتة والجلب المسبق وتقليل العرض هي تقنيات راسخة - مقارنة بما يوضحه حول التطوير القائم على الذكاء الاصطناعي على نطاق الإنتاج. قام أحد المختبرات الحدودية للتو بشحن إصلاح شامل للأداء يتضمن ثلاثة آلاف تغيير لمنتج استهلاكي رئيسي، حيث يقوم وكلاء الذكاء الاصطناعي بالجزء الأكبر من أعمال التحديد والتنفيذ والتحقق، بينما يحتفظ البشر بسلطة الموافقة على كل تغيير.

وتهبط النتيجة أيضًا في سياق تنافسي حيث تكون الاستجابة إحدى ميزات المنتج. يتنافس كلود بشكل مباشر مع ChatGPT من OpenAI وGemini من Google لجذب انتباه المستهلكين والمطورين، كما أن السرعة الملموسة تشكل الاستخدام اليومي للمنتجات المساعدة بقدر ما تؤثره جودة النموذج. يؤدي تقليل وقت التفاعل من 3.1 ثانية إلى 0.55 ثانية إلى معالجة الشكوى الأكثر شيوعًا لدى المستخدمين بشأن المنتج.

بالنسبة للفرق الهندسية التي تراقب من الخارج، فإن الدرس القابل للنقل من حساب Anthropic هو بنية الحلقة: قياس رحلات المستخدم بدقة، والسماح للنموذج باقتراح التغييرات والتحقق من صحتها مقابل تلك القياسات، والاحتفاظ ببوابة موافقة بشرية، وتوسيع النطاق فقط بالسرعة التي يمكن لنظام القياس التحقق منها. الإطار الأنثروبي الخاص هو أنه بمجرد أن يتمكن كلود من قياس شيء ما، فإنه يمكنه جعله أسرع - لذلك استمر الفريق في العثور على المزيد من الأشياء لقياسها.

ويبقى أن نرى ما إذا كانت سباقات السرعة المماثلة التي يقودها الوكيل تصبح ممارسة قياسية عبر صناعة البرمجيات، لكن Anthropic قدمت واحدة من أكثر نقاط البيانات العامة واقعية حتى الآن والتي يمكنها العمل على نطاق واسع. يمكن للقراء الذين يتتبعون كيفية قيام الذكاء الاصطناعي بإعادة تشكيل تطوير البرمجيات متابعة تغطية أبحاث الذكاء الاصطناعي الخاصة بنا لمزيد من التطورات.

---

ابق على اطلاع بأخبار الذكاء الاصطناعي

آخر أخبار وتحليلات وإنجازات الذكاء الاصطناعي — في مكان واحد.

اقرأ المزيد من أخبار الذكاء الاصطناعي →