AlphaGo נגד לי סדול — מארס 2016, סיאול, שבוע שעשה היסטוריה
5 משחקים, 4-1 ל-DeepMind, ומשחק מהפכני שגרם לאלוף עולם לעזוב את הספורט
ב-9 במארס 2016, התכנסו מאות עיתונאים, מיליוני צופים ברחבי העולם, וכ-280 מיליון צופים בסין לבדה, כדי לחזות באירוע שנחשב עד אז למדע בדיוני. במלון Four Seasons Hotel בסיאול, דרום קוריאה, התיישב Lee Sedol, אלוף עולם 18 פעמים בדרגת דאן 9 ואחד משחקני ה-Go הגדולים בהיסטוריה, מול לוח עץ מסורתי. מולו לא ישב אדם, אלא Aja Huang, מדען מחשב שהניח את האבנים בשמה של AlphaGo – תוכנת בינה מלאכותית שפותחה על ידי DeepMind, חברת בת של Google. Lee Sedol הגיע למפגש בביטחון מלא, כשהוא צופה ניצחון מוחץ של 5-0 או 4-1 לטובתו. אך במהלך השבוע הבא, בין ה-9 ל-15 במארס 2016 (מיום רביעי עד יום שלישי, משחק אחד ביום), עולם הבינה המלאכותית והחשיבה האנושית השתנה לעד.
האתגר הבלתי אפשרי של משחק ה-Go
משחק ה-Go, שנוצר בסין העתיקה לפני אלפי שנים, נחשב במשך עשורים למבצר האחרון של העליונות האנושית על המחשב במשחקי לוח. בעוד שבשנת 1997 הביסה Deep Blue של IBM את אלוף העולם בשחמט גארי קספרוב באמצעות כוח חישוב גס (brute-force search), הרי שבמשחק ה-Go גישה זו נידונה לכישלון מוחלט.
במשחק ה-Go יש כ-10^170 מצבים חוקיים אפשריים על הלוח – מספר בלתי נתפס הגדול בהרבה ממספר האטומים ביקום הנראה, וגדול לאין שיעור ממשחק השחמט (לו כ-10^47 מצבים). כדי להתמודד עם המורכבות הזו, צוות הפיתוח של DeepMind בראשות המנכ"ל והמייסד השותף Demis Hassabis (חוקר מוח ועילוי שחמט בעברו) והחוקר המוביל David Silver, פיתח ארכיטקטורה מהפכנית.
הם שילבו בין כמה טכנולוגיות פורצות דרך:
- Policy network – רשת עצבית המנחשת את המהלכים הבאים הסבירים ביותר.
- Value network – רשת עצבית המעריכה את הסתברות הניצחון מכל מצב נתון.
- Monte Carlo Tree Search – אלגוריתם הסורק מהלכים עתידיים פוטנציאליים.
- Self-play reinforcement learning – למידת חיזוק עצמית, במסגרתה המערכת שיחקה מיליוני משחקים נגד עצמה כדי להשתפר.
DeepMind, שהוקמה בלונדון בשנת 2010 ונרכשה על ידי Google בינואר 2014 תמורת כ-500 מיליון דולר, העמידה את הטכנולוגיה הזו למבחן האולטימטיבי מול Lee Sedol בסדרה של הטוב מחמישה משחקים.
לי סדול — אלוף עולם 18 פעמים, פרש מהספורט ב-2019מהלך 37: הרגע שבו המכונה הפכה ליצירתית
המשחק הראשון הסתיים בהפסד מפתיע ומזעזע עבור Lee Sedol. אך היה זה המשחק השני, שנערך ב-10 במארס, שסיפק את הרגע ההיסטורי והמדהים ביותר של הטורניר, רגע ששינה את האופן שבו בני אדם תופסים יצירתיות של מכונות.
במהלך ה-37 של המשחק השני, AlphaGo ביצעה מהלך של "shoulder hit" בשורה החמישית של הלוח. הפרשנים והמומחים באולם הגיבו בתחילה בתדהמה מוחלטת וכינו את המהלך טעות קשה. אולם, ככל שהמשחק התקדם, התברר עומק הגאונות של המהלך. מומחים הגדירו אותו מאוחר יותר כ"יפהפה" וציינו כי "no human would play it" (אף בן אנוש לא היה משחק אותו). Lee Sedol עצמו היה כה המום מהמהלך, שהוא קם מכיסאו ויצא מהחדר למשך 15 דקות כדי לעכל את מה שראה. המהלך ה-37 הוכיח כי AlphaGo לא רק מחקה מהלכים אנושיים, אלא מסוגלת לייצר אסטרטגיות מקוריות לחלוטין.
מהלך 78: "נגיעת האלוהים" האנושית
לאחר שלושה הפסדים רצופים, הניצחון בטורניר כבר הוכרע לטובת AlphaGo (שזכתה בפרס של מיליון דולר, אותו תרמה DeepMind ל-UNICEF ולארגוני Go). עם זאת, המשחק הרביעי ב-13 במארס הפך למפגן של רוח הלחימה האנושית.
במהלך ה-78 של המשחק, Lee Sedol ביצע מהלך מבריק ובלתי צפוי במרכז הלוח, שזכה לכינוי "נגיעת האלוהים" ("God's touch"). המהלך המתוחכם בלבל לחלוטין את רשתות ההערכה של AlphaGo, וגרם לה לבצע סדרה של טעויות מביכות ותגובות גרועות. Lee Sedol רשם את ניצחונו היחיד וההיסטורי בטורניר, בתוצאה הסופית של 4-1 לטובת AlphaGo. רגע זה נחשב כיום באופן נרחב לפעם האחרונה שבה בן אנוש ניצח את תוכנת ה-Go הטובה בעולם במשחק תחרותי רשמי.
מ-AlphaGo לפתרון מסתרי החיים
ההשלכות של הטורניר בסיאול הדהדו במהירות ברחבי העולם המדעי. באוקטובר 2016, גרסה משופרת בשם AlphaGo Master שיחקה בזהויות בדויות ברשת וניצחה 60 משחקים רצופים נגד שחקנים מקצוענים מובילים ללא אף הפסד. במאי 2017, הביסה AlphaGo את Ke Jie, המדורג ראשון בעולם באותה עת, בתוצאה 3-0 ב-Wuzhen, סין.
באוקטובר 2017 הציגה DeepMind את AlphaGo Zero – גרסה שביססה את יכולותיה ללא כל ידע אנושי מוקדם, אלא באמצעות למידה עצמית מוחלטת (self-play). היא הביסה את הגרסה המקורית של AlphaGo בתוצאה המדהימה 100-0. חודשיים לאחר מכן, בדצמבר 2017, הושקה AlphaZero, שהכלילה את השיטה לשחמט ולשוגי (shogi), והביסה את תוכנות העל Stockfish (בשחמט) ו-Elmo (בשוגי) בתוך שעות ספורות של אימון עצמי בלבד.
עבור Lee Sedol, ההבנה כי המכונה עברה את גבול היכולת האנושית הובילה להחלטה דרמטית. בנובמבר 2019 הוא הודיע על פרישה ממשחק מקצועני, והסביר: "Even if I become the number one, there is an entity that cannot be defeated." (גם אם אהיה מספר אחת, ישנה ישות שלא ניתן להביס).
אך המורשת של שבוע ההיסטוריה בסיאול חרגה בהרבה מעבר למשחקי לוח. הטכנולוגיה שפותחה עבור AlphaGo הולידה את AlphaFold 2 בשנת 2021, אשר פתרה את אתגר קיפול החלבונים – בעיה מדעית וביולוגית קשה שלא נפתרה במשך 50 שנה. פריצת דרך זו אף זיכתה את Demis Hassabis בפרס נובל לכימיה לשנת 2024, והוכיחה כי המהלך ה-37 בסיאול היה רק הצעד הראשון במסע של הבינה המלאכותית לפענוח סודות היקום.
מקורות
— סוף הכתבה —
חזרה לארכיון ↗