דיווח חדש מצביע על מהלך מפתיע של אפל בשוק הבינה המלאכותית: החברה מפתחת שרת AI המבוסס על שבבי M8 Ultra עתידיים מתוצרתה, ובוחנת שימוש ב-NVLink Fusion של Nvidia כדי לחבר ביניהם. היעד האפשרי: מכירת שרתים למפתחים, חברות וממשלות החל מ-2029.
- אפל מפתחת לפי דיווח חדש שרתים המיועדים להרצת מודלים של בינה מלאכותית.
- השרתים עשויים להתבסס על שניים או ארבעה שבבי M8 Ultra עתידיים של אפל.
- החברה קיימה שיחות על שימוש ב-NVLink Fusion של Nvidia, טכנולוגיה שמאפשרת לחבר מעבדים ומאיצי AI במהירות גבוהה.
- בניגוד לתשתיות שמיועדות בעיקר לאימון מודלים, המוצר של אפל מכוון לפי הדיווח בעיקר ל-inference – הרצת המודל לאחר שכבר אומן.
- היעד האפשרי הוא 2029, אבל המוצר עדיין בפיתוח והתוכנית יכולה להשתנות או להתבטל.
הכתבה המלאה
אפל עשויה לחזור לשוק שממנו יצאה לפני יותר מעשור – הפעם בגלל הבינה המלאכותית.
לפי דיווח של The Information שפורסם השבוע וצוטט ברויטרס, אפל מפתחת שרת AI המבוסס על שבבים מתוצרתה, ובוחנת לשלב בו את טכנולוגיית NVLink Fusion של Nvidia. המוצר מיועד לפי הדיווח למפתחים, חברות וגופים ממשלתיים, ועשוי להגיע לשוק בסביבות 2029. אפל ו-Nvidia לא הגיבו לדיווח, ורויטרס ציינה כי לא אימתה אותו באופן עצמאי.
אם המהלך יתממש, הוא יסמן שינוי משמעותי באסטרטגיה של אפל: החברה, שמוכרת בעיקר מכשירי צריכה ומחשבים, תציע גם תשתית מחשוב שמיועדת ישירות לשוק הארגוני ולמרוץ הגלובלי סביב AI.
שבבי אפל, אבל לא רק טכנולוגיה של אפל
לפי הדיווח, השרתים עשויים להגיע בשתי תצורות – עם שני שבבי M8 Ultra או עם ארבעה. ה-M8 Ultra עדיין אינו מוצר קיים, אלא חלק ממפת הדרכים העתידית של סדרת השבבים שאפל מפתחת בעצמה.
החלק המעניין יותר הוא דווקא מה שיחבר בין המעבדים.
אפל בחנה שימוש ב-NVLink Fusion של Nvidia – טכנולוגיה שמאפשרת לחברות להשתמש בשבבים שהן עצמן מפתחות, אבל לחבר אותם באמצעות תשתית התקשורת המהירה של Nvidia. המטרה היא לאפשר למספר מעבדים לעבוד יחד על משימת AI גדולה בלי שהעברת המידע ביניהם תהפוך לצוואר בקבוק.
במילים אחרות: אפל רוצה לשמור את המוח של השרת אצלה, אבל עשויה להשתמש ב"כבישים" של Nvidia כדי לאפשר למוחות האלה לדבר זה עם זה במהירות.
למה Nvidia חשובה גם כשלא משתמשים ב-GPU שלה
הדיווח מדגים שינוי מעניין במעמדה של Nvidia.
החברה התפרסמה בזכות מעבדי ה-GPU שלה, שהפכו לבסיס של תשתיות AI בחברות כמו OpenAI, Meta ומיקרוסופט. אבל בשנים האחרונות יותר ויותר ענקיות טכנולוגיה מפתחות מאיצי AI משלהן כדי לצמצם עלויות ותלות בספק חיצוני.
NVLink Fusion מאפשרת ל-Nvidia להישאר חלק מאותה תשתית גם כאשר הלקוח אינו משתמש במעבד שלה.
הטכנולוגיה מיועדת בדיוק למודל הזה: חברה יכולה להשתמש בשבב מותאם אישית שלה, אבל להכניס אותו לתשתית שרתים, תקשורת וקירור המבוססת על המערכת האקולוגית של Nvidia. גם AWS, MediaTek וחברות נוספות אימצו או הודיעו על תוכניות להשתמש ב-NVLink Fusion.
עבור Nvidia, זהו ניסיון להבטיח שגם עולם שבו אמזון, גוגל, אפל וחברות נוספות מפתחות שבבים משלהן לא יהפוך בהכרח לעולם שבו היא נשארת מחוץ למרכז הנתונים.
להרחבה על החברה והמעמד שלה בשוק ה-AI אפשר לקרוא גם במדריך שלנו: מניית Nvidia: מה החברה עושה, איך היא מרוויחה ומה משפיע על NVDA.
לא לאמן את ה-AI – אלא להריץ אותו
יש כאן גם הבחנה חשובה בין שני חלקים שונים של שוק הבינה המלאכותית.
אימון של מודל גדול דורש כמויות עצומות של כוח מחשוב במשך שבועות ולעיתים חודשים. אבל לאחר שהמודל כבר אומן, צריך להריץ אותו בכל פעם שמשתמש שואל שאלה, יוצר תמונה או מפעיל שירות מבוסס AI. החלק הזה נקרא inference.
לפי הדיווח, השרתים של אפל מיועדים בעיקר לשוק הזה.
זו הבחנה חשובה משום שככל שמספר משתמשי ה-AI גדל, כך גדלה גם כמות כוח המחשוב הנדרשת להפעלת המודלים ביום-יום. Nvidia עצמה מציגה את NVLink Fusion גם כפתרון לתשתיות inference בקנה מידה גדול.
אפל כבר בונה את תשתית ה-AI שלה
המהלך אינו מגיע משום מקום.
אפל כבר מפעילה את Private Cloud Compute – מערכת שנועדה להריץ משימות Apple Intelligence מורכבות בענן תוך שמירה על מודל האבטחה והפרטיות שלה.
ביוני 2026 הודיעה החברה שהיא מרחיבה את המערכת גם מעבר למרכזי הנתונים שלה ומשתפת פעולה עם Google ו-Nvidia כדי להריץ עומסי עבודה חדשים של Apple Intelligence בתשתיות חיצוניות.
שרת עצמאי שאפל תוכל למכור לאחרים יהיה צעד שונה בהרבה: במקום להשתמש בתשתית AI רק לצורך המוצרים והשירותים שלה, היא תתחיל להתחרות על הלקוחות שמקימים תשתיות AI בעצמם.
חזרה לשוק שאפל נטשה ב-2011
לאפל כבר הייתה בעבר סדרת שרתים.
ה-Xserve הושק בתחילת שנות ה-2000 ונועד לשוק העסקי ולמרכזי נתונים, אבל אפל הפסיקה את המכירה שלו ב-2011. מאז היא התרחקה כמעט לחלוטין משוק השרתים המסורתי.
הפעם התנאים שונים. שבבי Apple Silicon שפיתחה החברה עבור מחשבי Mac ואייפון העניקו לה ניסיון רב בתכנון מעבדים חזקים וחסכוניים באנרגיה, והביקוש למחשוב AI יצר שוק חדש שבו החיסכון בחשמל ובעלויות הופך למשמעותי במיוחד.
אם אפל אכן תציע שרת מבוסס M8 Ultra, היא תנסה למעשה לקחת את היתרונות שבנתה במחשבים האישיים ולהעביר אותם אל מרכז הנתונים.
למה שאפל בכלל תרצה למכור שרתים?
שוק הבינה המלאכותית יוצר הזדמנות כלכלית עצומה מחוץ למוצרים שאפל מוכרת כיום.
מפתחים וחברות זקוקים לכמויות גדלות של כוח מחשוב כדי להפעיל מודלים ושירותי AI. חלק גדול מהשוק הזה נשלט כיום בידי Nvidia ובידי שירותי הענן של אמזון, מיקרוסופט וגוגל.
אפל אינה שחקנית מרכזית בו.
שרת המבוסס על שבבים שלה יאפשר לה להיכנס לשוק הזה בדרך שמתאימה לאסטרטגיה הקבועה שלה: שליטה עמוקה ככל האפשר בחומרה ובתוכנה.
אבל הבחירה האפשרית ב-NVLink Fusion גם מראה את גבולות הגישה הזו. אפילו חברה שמפתחת בעצמה את המעבדים שלה יכולה להעדיף להשתמש בחלק מתשתית Nvidia במקום לבנות לבדה מערכת שלמה מאפס.
למה זה חשוב ל-Nvidia
עבור Nvidia, עסקה אפשרית עם אפל יכולה להיות חשובה גם מעבר להכנסה הישירה ממנה.
האתגר הגדול של החברה בשנים הקרובות הוא עלייתם של שבבי AI מותאמים אישית. אמזון מפתחת את Trainium, גוגל את TPU, וחברות נוספות משקיעות במעבדים משלהן.
NVLink Fusion נועד להפוך את המגמה הזאת לאיום קטן יותר: גם אם החברות לא קונות את ה-GPU של Nvidia, הן עדיין יכולות להשתמש בטכנולוגיית התקשורת, השרתים והרשת שלה.
אם גם אפל תאמץ את המערכת, Nvidia תחזק עוד יותר את מעמדה לא רק כיצרנית שבבים – אלא כספקית של התשתית שעליה פועל שוק ה-AI כולו.
עדיין רחוק ממוצר מוגמר
עם כל המשמעות האפשרית של המהלך, חשוב לשמור על פרופורציות.
לפי הדיווח, הפרויקט החל לפני כשנה, והיעד האפשרי להשקה נמצא רק ב-2029. עד אז אפל יכולה לשנות את התכנון, לבחור בטכנולוגיית תקשורת אחרת או להחליט שלא להשיק את המוצר כלל.
גם השימוש ב-NVLink Fusion עדיין אינו עסקה סופית.
אבל עצם העובדה שאפל בוחנת שרתים עסקיים ושיתוף פעולה טכנולוגי עם Nvidia מלמדת עד כמה מרוץ ה-AI משנה את הגבולות בין חברות הטכנולוגיה הגדולות.
אחרי מה לעקוב
השאלה המרכזית תהיה האם אפל אכן תמשיך עד למוצר מסחרי ב-2029, והאם NVLink Fusion תיבחר כחלק מהארכיטקטורה הסופית. כדאי לעקוב גם אחרי השאלה האם השרתים ישמשו בעיקר להפעלת מודלים של אפל או יהפכו למוצר רחב יותר שמפתחים וחברות יוכלו לרכוש ולהפעיל עם מודלים משלהם.
הזווית הישראלית
ישראל היא מרכז משמעותי לפיתוח שבבים ותשתיות תקשורת עבור חברות הטכנולוגיה הגדולות, ובפרט עבור Nvidia, שמעסיקה בארץ אלפי עובדים בתחומי שבבים, תקשורת ומרכזי נתונים. ככל שהתחרות עוברת ממעבד AI בודד לתכנון של מערכת שלמה – שבבים, תקשורת, זיכרון ושרתים – החשיבות של תחומי התשתית שבהם פועלים מרכזי הפיתוח המקומיים עשויה לגדול.
עבור משקיעים ישראלים, הסיפור גם מדגים מדוע התחרות סביב Nvidia מורכבת יותר מהשאלה מי ייצר את שבב ה-AI המהיר ביותר. גם חברות שמפתחות שבבים בעצמן עשויות להמשיך להשתמש בחלקים אחרים מהמערכת האקולוגית שלה.