Anthropic — כיצד נולדה חברת ה-AI שמדברת על בטיחות יותר מאשר על יכולות
2021, סן-פרנסיסקו, יציאה דרמטית מ-OpenAI ויצירת Claude — המתחרה המרכזי של ChatGPT
Anthropic — כיצד נולדה חברת ה-AI שמדברת על בטיחות יותר מאשר על יכולות
במהלך שנת 2020 ותחילת 2021, מאחורי הקלעים של מעבדת המחקר המובילה OpenAI, החל להתפתח קרע אידאולוגי עמוק. קבוצה של חוקרים בכירים, בהובלת דריו אמודיי (Dario Amodei), אז סגן נשיא למחקר (VP of Research) בחברה, חשה דאגה גוברת והולכת. הקצב המהיר של מסחור המודלים, ובמיוחד סביב השקת GPT-3, יצר מתח פנימי סביב השאלה האם פיתוח היכולות של בינה מלאכותית מקדים באופן מסוכן את מחקר הבטיחות שלה. הקרע הזה הוביל בסופו של דבר לעזיבה מתואמת ודרמטית, שהולידה את אחת המתחרות המסקרנות והמשפיעות ביותר בתעשייה: חברת Anthropic.
הפיצול מ-OpenAI והקמת החברה
העזיבה של צוות אמודיי מ-OpenAI התרחשה בהדרגה במהלך השנים 2020-2021. דריו אמודיי התעמת פנימית על קצב המסחור של GPT-3, מתוך חשש שהמרוץ להשגת ביצועים דוחק הצידה את הבלמים הנדרשים. ב-28 במאי 2021 הוכרזה רשמית הקמתה של Anthropic, שקבעה את מטה החברה בסן פרנסיסקו, קליפורניה (San Francisco, CA).
החברה הוקמה על ידי שבעה מייסדים, כולם יוצאי OpenAI:
- דריו אמודיי (Dario Amodei) - משמש כ-CEO.
- דניאלה אמודיי (Daniela Amodei) - אחותו של דריו, לשעבר VP of Operations ב-OpenAI, המשמשת כנשיאת החברה (President).
- טום בראון (Tom Brown) - כותב המאמר הראשי של GPT-3.
- סם מקנדליש (Sam McCandlish) - דוקטור לפיזיקה וחוקר חוקי סקיילינג (scaling laws).
- ג'ארד קפלן (Jared Kaplan) - פרופסור לפיזיקה שהפך לחוקר למידת מכונה (ML).
- ג'ק קלארק (Jack Clark) - לשעבר מנהל המדיניות (Policy Director) של OpenAI.
- כריס אולה (Chris Olah) - חלוץ בתחום הניתנות לפירוש של מודלים (interpretability) וממייסדי Distill.pub.
כדי להבטיח שהחברה לא תסטה מחזונה המקורי בלחץ בעלי המניות, Anthropic הוקמה במבנה תאגידי ייחודי של חברה לתועלת הציבור (Public-Benefit Corporation - PBC). משימתה המוצהרת הוגדרה בבירור: "AI safety research and the responsible deployment of AI systems" (מחקר בטיחות AI ופריסה אחראית של מערכות AI).
גיוסי הון ושותפויות ענק
למרות הדגש על בטיחות, פיתוח מודלי שפה ענקיים דורש משאבי מחשוב עצומים. Anthropic הצליחה לגייס סכומי עתק כבר מתחילת דרכה. במאי 2021, החברה השלימה סבב גיוס Series A של 124 מיליון דולר בהובלת יאן טאלין (Jaan Tallinn), ממייסדי Skype. באפריל 2022, גייסה 580 מיליון דולר בסבב Series B שהובל על ידי סם בנקמן-פריד (Sam Bankman-Fried) מ-FTX - פרט שהפך למעורר עניין רב במבט לאחור.
במאי 2023 גייסה החברה 450 מיליון דולר בסבב Series C. הפריצה הגדולה של שותפויות הענן הגיעה בספטמבר 2023, כאשר ענקית הטכנולוגיה Amazon השקיעה בחברה 4 מיליארד דולר (השקעה שהתרחבה ל-8 מיליארד דולר בשנת 2024). חודש לאחר מכן, באוקטובר 2023, השקיעה Google סכום של 2 מיליארד דולר בחברה. בשנים 2024-2025, סבבי גיוס נוספים הזניקו את שווי החברה ליותר מ-60 מיליארד דולר.
פריצות דרך מחקריות וגישת ה-Constitutional AI
כחלק מחזונה, כ-שליש (1/3) מצוות העובדים של Anthropic מוקדש באופן בלעדי למחקר בטיחות - שיעור גבוה משמעותית בהשוואה למתחרותיה בתעשייה. החברה שמה דגש עצום על ניתנות לפירוש (interpretability), בהובלת הצוות של כריס אולה (Chris Olah).
במהלך השנים הציגה Anthropic שורה של תרומות מחקריות משמעותיות:
- בשנת 2022 הציגה החברה את גישת ה-Constitutional AI (בינה מלאכותית חוקתית). במקום להסתמך אך ורק על משוב אנושי (RLHF), המודל מאומן לעקוב אחר "חוקה" כתובה של עקרונות באמצעות למידת חיזוק ממשוב של AI (גישת RLAIF).
- באותה שנה (2022) פרסם צוות ה-interpretability את המחקר "Discovering Latent Knowledge in Language Models".
- בשנת 2023 פורסם המאמר "Specific Problems in AI Safety".
- בשנת 2024 פורסם המאמר "Sleeper Agents", שהראה כיצד אימוני בטיחות סטנדרטיים עלולים להיכשל.
- עוד בשנת 2024, הציגה החברה פריצת דרך משמעותית בתחום ה-mechanistic interpretability עם פרסום המחקר "Scaling Monosemanticity".
בנוסף למחקרים אלו, Anthropic הובילה ופיתחה שיטות עבודה מומלצות בתחום הנדסת הפרומפטים (prompt engineering), כולל שימוש בהקשרים ארוכים (long context), למידה מכמה דוגמאות (few-shot), ושימוש במבנה XML.
האבולוציה של Claude: משחקן חדש למוביל ביצועים
לצד המחקר התיאורטי, Anthropic פיתחה את משפחת מודלי השפה שלה, Claude, שהפכה למתחרה הישירה של GPT מבית OpenAI.
- בדצמבר 2022 הוכרז לראשונה Claude בגרסה מוגבלת.
- במרץ 2023 הושק Claude 1 לציבור הרחב.
- ביולי 2023 הושק Claude 2, שהציג חלון הקשר (context window) של 100K טוקנים - הגדול ביותר בתעשייה באותה עת.
- במרץ 2024 הושקה משפחת מודלי Claude 3, שכללה שלוש רמות ביצועים: Opus, Sonnet ו-Haiku.
- ביוני 2024 הושק Claude 3.5 Sonnet, שהיה המודל הראשון של Claude שעקף באופן עקבי את GPT-4 במבחני ביצועי תכנות (coding benchmarks).
- באוקטובר 2024 שוחררה גרסה חדשה של Claude 3.5 Sonnet עם יכולת Computer Use, שהובילה פריצת דרך בשליטה של סוכני AI במחשב.
- בפברואר 2025 הושק Claude 3.7 Sonnet, שהציג יכולות חשיבה מורחבת (extended thinking).
- בהמשך שנת 2025 הושקה משפחת מודלי Claude 4 לצד Claude Code, מוצר ממשק שורת פקודה (CLI).
- בשנת 2026 הושקו הדגמים המתקדמים Claude 4.7 ו-Opus 4.7.
כיום, Anthropic ניצבת בחזית תעשיית הבינה המלאכותית היוצרת, לא רק כמעבדת מחקר מובילה אלא כקול המצפון של התעשייה כולה. הסיפור של Anthropic מוכיח כי הדילמה בין מהירות הפיתוח לבין בטיחות המערכות אינה חייבת להסתיים בפשרה על ביצועים. דרך שילוב של מחקר בטיחות מעמיק, מבנה תאגידי ייחודי וחדשנות טכנולוגית פורצת דרך, החברה הצליחה להוכיח שדווקא הגישה המבוקרת והזהירה יכולה להוביל ליצירת המודלים החזקים והיעילים ביותר בשוק.
מקורות
— סוף הכתבה —
חזרה לארכיון ↗