Anthropic פרסמה תיאור הנדסי מפורט כיצד היא הפכה את claude.ai ואת אפליקציית שולחן העבודה של קלוד למהירות יותר בערך פי שלושה בספרינט של שבועיים, והטוויסט הוא שרוב העבודה נעשתה על ידי קלוד עצמו. הפוסט, שפורסם בבלוג ההנדסה של Anthropic, מתאר קמפיין ביצועים המופעל מערוץ Slack יחיד עם מודל ה-AI בכל שרשור, מציאת צווארי בקבוק, בניית אמות מידה, שיפורים במשלוח וצפייה בכל פריסה.
המספרים, הנמדדים באחוזון ה-75, משמעותיים. הזמן לדף שניתן להקליד על מטען חדש של claude.ai ירד מ-3.1 שניות ל-0.55 שניות. התחלת סשן חדש של קלוד קוד ירד מ-0.8 שניות ל-0.3 שניות, וטעינת סשן ענן של קלוד קווורק ירד מ-2.6 שניות ל-0.73 שניות. במצטבר, Anthropic מעריכה שהשיפורים חוסכים עשרות אלפי שעות המתנה של משתמשים מדי יום. For more context on this story, see our ongoing artificial intelligence updates.
תחילה מודדים, ואז זזים
הספרינט התחיל במדידה ולא בקוד. באמצעות קלוד לניתוח נתוני שימוש דרך שרת Datadog MCP, הצוות זיהה את ארבעת מסעות המשתמש המהווים 95 אחוז מהפעילות: הפעלת האפליקציה, התחלת שיחה, טעינת שיחה קיימת ושליחת הודעה. ברחבי האינטרנט ובשולחן העבודה המסעות הללו התחלקו לשלוש עשרה מדידות נפרדות, והצוות הוסיף מכשור עד שכל אחת מהן הייתה ניתנת להשוואה ישירות - החל באינטראקציה של המשתמש והסתיימו לאחר הצגת התוצאה.
עם קווי היסוד, הצוות ערך רשימה של כעשרים פרויקטים שנבחרו ביד, שכל אחד מהם מכוון למסע ספציפי, והורה לקלוד להעריך את ההשפעה של כל אחד באלפיות שניות כדי להגדיר יעדי ספרינט. התוכנית נחתה מוקדם: דיווחים אנתרופיים פוגעים ב-12 מתוך 13 המטרות ביום השלישי. זה הותיר מקום לקלוד לזהות הזדמנויות נוספות ולהציע זרמי עבודה חדשים, שזרמו במהירות לפרויקטים מלאים משלהם ודחפו את התוצאות מעבר ליעדים המקוריים.
מה נשלח בפועל
השינויים הטכניים נקראים כמו רשימת בדיקה של עבודת ביצועי אינטרנט מודרנית. להשקות מהירות יותר, הצוות אפה מלחין סטטי לתוך ה-HTML כך שמשתמשים יוכלו להתחיל להקליד במהלך אתחול React, והרכיב מראש מטמון קוד V8 כך שהתהליך הראשי של מעטפת שולחן העבודה לא יעבור הידור מחדש מאפס בעת ההפעלה. לניווט מהיר יותר בין שיחות, המלחין נשאר רכוב במקום להיקרע ונבנה מחדש, הפעלות נשלפות מראש כאשר משתמש מרחף מעליהן, והעיבוד מחדש של סרגל הצד נחתך ב-90 אחוז.
קנה המידה של היסטוריית המיזוג הוא נתון הכותרת: יותר משלושת אלפים שינויים נחתו במהלך הספרינט ללא תקרית אחת מול לקוח או חזרה לאחור, לפי הפוסט.
קלוד טאג: סוכן עם מעקות בטיחות
הספרינט רץ על מה שאנתרופיק מכנה קלוד טאג, שנמצא כעת בגרסת בטא ומתואר כמודל מחקר פנימי הדומה בערך לאופוס 5.5. חלוקת העבודה היא החלק המשמעותי ביותר בסיפור. קלוד מצא צווארי בקבוק, בנה אמות מידה, יישם תיקונים ופיקח על כל פריסה - עובד באופן אסינכרוני במשך שעות בכל פעם, אפילו בן לילה. בני אדם קבעו את המטרות, ביצעו את ההחלפות ואישרו כל שינוי לפני מיזוגו.
הצוות גם רצה לחזור מהר יותר מקצב הפריסה שלו, אז הוא בנה מדידות מעבדה בתור פרוקסי לקריאה בעולם האמיתי. בין השאלות שהמהנדסים שאלו: האם ספירת הוראות JavaScript יכולה להחליף את תזמון שעון הקיר כאות משוב מהיר יותר לאימות אבות טיפוס לפני פריסה?
למה זה חשוב להנדסה בסיוע בינה מלאכותית
הפוסט של Anthropic בולט פחות עבור האופטימיזציות הספציפיות - קליפות סטטיות, שליפה מראש והפחתת רינדור הן טכניקות מבוססות - מאשר במה שהוא מדגים לגבי פיתוח מונע בינה מלאכותית בקנה מידה ייצור. מעבדת גבול שלחה זה עתה שיפוץ ביצועים של שלושת אלפים שינויים של מוצר דגל לצריכה עם סוכני בינה מלאכותית שעושים את עיקר עבודת הזיהוי, ההטמעה והאימות, בעוד שבני האדם שמרו על סמכות האישור על כל שינוי.
התוצאה נוחתת גם בהקשר תחרותי שבו היענות היא תכונה של המוצר. קלוד מתחרה ישירות ב-ChatGPT של OpenAI וב-Gemini של גוגל על תשומת לב צרכנים ומפתחים, והמהירות הנתפסת מעצבת את השימוש היומיומי במוצרי אסיסטנט באותה מידה כמו איכות הדגם. קיצוץ הזמן לאינטראקטיביות מ-3.1 שניות ל-0.55 שניות נותן מענה לתלונה הנפוצה ביותר של משתמשים על המוצר.
עבור צוותי הנדסה הצופים מבחוץ, הלקח שניתן להעברה מהחשבון של Anthropic הוא מבנה הלולאה: למדוד את מסעות המשתמש במדויק, לתת למודל להציע ולאמת שינויים מול אותן מדידות, לשמור על שער אישור אנושי ולהרחיב את ההיקף רק מהר ככל שמערכת המדידה יכולה לאמת. המסגור של אנתרופיק עצמו הוא שברגע שקלוד יכול למדוד משהו, זה יכול להפוך אותו למהיר יותר - אז הצוות המשיך למצוא עוד דברים למדוד.
האם ספרינטים דומים מונעי סוכנים הופכים לפרקטיקה סטנדרטית בכל תעשיית התוכנה נותר לראות, אבל אנתרופיק סיפקה את אחת מנקודות הנתונים הציבוריות הקונקרטיות ביותר עד כה, שבהן הם יכולים לעבוד בקנה מידה. קוראים שעוקבים אחר האופן שבו בינה מלאכותית מעצבת מחדש את פיתוח התוכנה יכולים לעקוב אחר סיקור מחקר הבינה המלאכותית שלנו לפיתוחים נוספים.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →