Qwen3.8-Max: המודל הסיני שמאתגר את GPT, קלוד וג'מיני
עליבאבא שחררה את המודל הכי חזק שלה עד היום ב-3 באוגוסט 2026. הציונים שלו צמודים לקלוד Fable 5 ומקדימים את GPT-5.6 ואת ג'מיני 3.1 Pro. בדקנו מה הוא באמת מביא, כמה הוא עולה, ואיך מנסים אותו מישראל.
Qwen3.8-Max הוא המודל הכי חזק שקבוצת Qwen בעליבאבא הוציאה עד היום. הוא בנוי בארכיטקטורת MoE עם 2.4 טריליון פרמטרים, קורא טקסט, תמונות ווידאו, ומחזיק חלון הקשר של מיליון טוקן. בבדיקות של שימוש אוטונומי במחשב הוא עוקף את GPT-5.6 Sol ואת ג'מיני 3.1 Pro, וצמוד לקלוד Fable 5.
בשבוע האחרון עולם המודלים קיבל שחקן חדש. עליבאבא הסינית שחררה את Qwen3.8-Max, המודל הדגל של קבוצת Qwen שלה, והציונים שהוא הביא הפכו אותו מיד לנושא הכי חם ברשתות של אנשי הבינה. הוא הוצג לראשונה ב-19 ביולי בכנס הבינה העולמי בשנחאי, וב-3 באוגוסט הוא נפתח לכולם.
מה שמושך תשומת לב הוא לא רק הגודל. Qwen3.8-Max מגיע כמה שבועות אחרי Kimi K3 של Moonshot, ומחזק מגמה ברורה: המודלים הסיניים סוגרים את הפער מול האמריקאים, ולפעמים עוקפים אותם בבדיקות. הפעם עליבאבא גם מבטיחה לפתוח את המשקלים, צעד ראשון עבורה במודל מסדרת Max.
מה זה Qwen3.8-Max
Qwen היא קבוצת הבינה של עליבאבא, שמוציאה מודלים כבר כמה שנים. Qwen3.8-Max הוא הגרסה הגדולה והחזקה במשפחה. הוא בנוי בארכיטקטורת MoE, ראשי תיבות של Mixture of Experts, שיטה שמפצלת את המודל להרבה תת-מומחים ומפעילה רק את החלק הרלוונטי לכל שאלה.
בזכות השיטה הזו המודל מגיע ל-2.4 טריליון פרמטרים בסך הכל, אבל מפעיל רק 95 מיליארד מהם בכל טוקן. התוצאה היא מודל ענק שרץ מהר וזול יותר ממה שגודל כזה דורש בדרך כלל. הקלט שלו מולטימודלי. הוא מקבל טקסט, תמונות ווידאו באותה בקשה.
במקום להפעיל את כל המודל על כל שאלה, MoE מפעיל רק את תת-המומחים הרלוונטיים. ככה אפשר להגיע לגודל עצום בלי לשלם על כל הפרמטרים בכל בקשה. זו אותה גישה שמאחורי DeepSeek ו-Kimi.
מה חדש במודל
01ארכיטקטורה בקנה מידה של 2.4 טריליון
זה אחד המודלים הגדולים שפורסמו בפומבי. הגודל לבד לא מבטיח איכות, אבל בשילוב עם ה-MoE הוא נותן ל-Qwen מרחב לתשובות מדויקות במשימות מורכבות בלי לזחול.
02חלון הקשר של מיליון טוקן
אפשר להזין למודל מסמכים שלמים, בסיסי קוד גדולים או שיחות ארוכות מאוד, והוא זוכר את הכל בתוך אותה בקשה. מיליון טוקן הם בערך כמה ספרים יחד. זה מציב אותו באותה ליגה של קלוד Fable 5 וג'מיני 3.1 Pro מבחינת אורך הקלט.
03קלט מולטימודלי אמיתי
המודל לא מוגבל לטקסט. אפשר להראות לו תמונה ולבקש הסבר, או להזין קטע וידאו ולשאול עליו שאלות. השילוב הזה שימושי לניתוח מסכים, מסמכים סרוקים או הקלטות.
04שימוש אוטונומי במחשב וסוכנים
כאן Qwen3.8-Max באמת בולט. הוא הוביל בבדיקת OSWorld עם 86.1, בדיקה שמודדת כמה טוב מודל מבצע משימות אמיתיות במחשב לבד. ב-PaperBench, בדיקה של שחזור ושיפור מאמרי מחקר, הוא קיבל 93.0. עליבאבא מדגישה יכולת להריץ כמה תת-סוכנים במקביל דרך מנגנון שהיא קוראת לו Dynamic Workflows.
05תאימות ל-OpenAI ול-Anthropic
עליבאבא השיקה את המודל דרך QwenCloud עם תאימות מובנית לפרוטוקולים של OpenAI ושל Anthropic. בפועל זה אומר שמפתחים שכבר עובדים מול GPT או קלוד יכולים לחבר את Qwen עם שינוי קטן בקוד.
06משקלים פתוחים בדרך
עליבאבא הודיעה שתשחרר את המשקלים של המודל בהמשך החודש. הקהילה בפורומים כמו r/LocalLLaMA התעניינה במיוחד בגרסה קטנה יותר בגודל 27 מיליארד פרמטרים, שאפשר יהיה להריץ על חומרה של תחנת עבודה. זו נקודה חשובה למי שרוצה מודל פרטי על שרת משלו.
הסיפור האמיתי הוא לא הגודל, אלא שמודל סיני מוביל בבדיקות של שימוש אוטונומי במחשב, ובמחיר נמוך מהמתחרים המערביים.
Qwen3.8-Max מול GPT, קלוד וג'מיני
עליבאבא מיצבה את המודל מול שלושת הדגלים המערביים. הנה איך הוא נראה מולם בנקודות שפורסמו. במקום שאין בו מספר רשמי, ציינו זאת.
| קטגוריה | Qwen3.8-Max | Claude Fable 5 | GPT-5.6 Sol | Gemini 3.1 Pro |
|---|---|---|---|---|
| ציון OSWorld (שימוש במחשב) | 86.1 | 85.0 | 83.2 | 76.2 |
| חלון הקשר | מיליון טוקן | מיליון טוקן | משתנה לפי גרסה | מיליון טוקן בקלט |
| קלט נתמך | טקסט, תמונה, וידאו | טקסט ותמונה | טקסט ותמונה | טקסט, תמונה, וידאו |
| מחיר למיליון טוקן | 2 / 6 דולר | גבוה יותר | משתנה לפי גרסה | 2 / 12 דולר |
| משקלים פתוחים | כן, בהמשך החודש | לא | לא | לא |
המסקנה פשוטה. בשימוש אוטונומי במחשב Qwen מקדים את כולם, והמחיר שלו נמוך מג'מיני 3.1 Pro בצד הפלט וזול מקלוד Fable 5. היתרון של המתחרים המערביים נשאר הבשלות, התמיכה הרשמית והשילוב בכלים קיימים. לרשימה רחבה יותר, בדקו את כלי ה-AI המומלצים ל-2026.
האם זה עובד בעברית ומישראל
הצ'אט של Qwen מבין וכותב עברית, ומחזיר תשובה סבירה. אבל כמו רוב המודלים שאומנו בעיקר על אנגלית וסינית, הפלט חזק יותר באנגלית. לטקסטים חשובים בעברית כדאי לעבור על התוצאה.
הגישה מישראל פשוטה. נכנסים לצ'אט Qwen בדפדפן, מתחברים עם חשבון, ומתחילים. מי שרגיל למודלים סיניים פתוחים כמו DeepSeek ימצא כאן חוויה מוכרת, כולל אותן שאלות של פרטיות שכדאי לקחת בחשבון לפני שמזינים מידע רגיש.
Qwen הוא שירות של חברה סינית. לעבודה עם נתונים אישיים או עסקיים רגישים כדאי לבדוק את מדיניות הפרטיות ואת מיקום השרתים, בדיוק כמו בכל שירות ענן זר.
כמה זה עולה
לשימוש בצ'אט אין תשלום ואין מנוי בסגנון ChatGPT Plus. מי שמחבר את המודל למערכת שלו עובר ל-API, ושם המחיר נמדד לפי טוקנים. ביחס לביצועים, המחיר של Qwen נחשב נמוך.
איך מתחילים
אפשר להתחיל בלי כרטיס אשראי ובלי התקנה, ולעבור ל-API רק אם צריך.
01נכנסים לצ'אט Qwen
פותחים את הצ'אט של Qwen בדפדפן ומתחברים עם חשבון. זה החינמי, וזה מספיק כדי לבדוק את המודל על שאלות אמיתיות שלכם.
02בודקים על משימה שלכם
במקום שאלות טריוויה, תנו לו מסמך ארוך לתמצת, קטע קוד לתקן או תמונה לנתח. ככה תראו אם היכולות שמפרסמים מתורגמות לעבודה שלכם.
03מחברים ל-API אם צריך
מפתחים פונים ל-QwenCloud. יש ניסיון חד-פעמי של מיליון טוקן למשתמשים חדשים, והתאימות לפרוטוקולים של OpenAI ו-Anthropic מקצרת את החיבור.
למי זה מתאים
- אתם צריכים מודל חזק לשימוש אוטונומי במחשב ולמשימות ארוכות
- אתם עובדים עם קבצים גדולים וצריכים חלון הקשר של מיליון טוקן
- אתם רוצים קלט של טקסט, תמונה ווידאו במקום אחד
- חשוב לכם מחיר API נמוך ביחס לביצועים
- אתם מתכננים להריץ מודל פתוח על שרת משלכם בהמשך
- אתם צריכים תמיכה רשמית בעברית ברמה של GPT או קלוד
- אתם מעדיפים חברה אמריקאית או אירופית מסיבות פרטיות ורגולציה
- אתם רוצים מודל שכבר רץ מקומית היום, המשקלים עוד לא שוחררו
- אתם צריכים יציבות ארוכת טווח, המודל בן ימים
- הכלים שלכם כבר משולבים סביב מודל אחר
✓מה חשוב לזכור
- Qwen3.8-Max הוא המודל הכי חזק של עליבאבא עד היום, עם 2.4 טריליון פרמטרים בארכיטקטורת MoE.
- בבדיקת OSWorld לשימוש אוטונומי במחשב הוא קיבל 86.1, לפני GPT-5.6 Sol וג'מיני 3.1 Pro.
- המחיר ב-API הוא 2 דולר קלט ו-6 דולר פלט למיליון טוקן, נמוך מהרבה מתחרים מערביים.
- חלון ההקשר הוא מיליון טוקן, והקלט כולל טקסט, תמונה ווידאו.
- עליבאבא הבטיחה לשחרר משקלים פתוחים בהמשך החודש, כולל גרסה קטנה יותר להרצה מקומית.
שאלות ותשובות
מה זה Qwen3.8-Max? ▼
המודל הגדול והחזק של קבוצת Qwen בעליבאבא, שיצא ב-3 באוגוסט 2026. הוא בנוי בארכיטקטורת MoE עם 2.4 טריליון פרמטרים ו-95 מיליארד פעילים בכל טוקן, וקורא טקסט, תמונות ווידאו.
כמה עולה Qwen3.8-Max? ▼
ב-API המחיר הוא 2 דולר למיליון טוקני קלט ו-6 דולר למיליון טוקני פלט, עם 0.25 דולר לקלט ממטמון. בצ'אט Qwen אפשר להשתמש בחינם בלי מנוי.
האם Qwen3.8-Max חזק מ-GPT ומקלוד? ▼
בבדיקת OSWorld לשימוש אוטונומי במחשב הוא קיבל 86.1, לפני GPT-5.6 Sol Max עם 83.2 וג'מיני 3.1 Pro עם 76.2, וקצת מעל קלוד Fable 5 עם 85.0. במשימות אחרות התמונה משתנה.
האם המשקלים של Qwen3.8-Max פתוחים? ▼
עליבאבא הודיעה שתשחרר את המשקלים בהמשך החודש. זו הפעם הראשונה שהיא פותחת מודל מסדרת Max, כולל גרסה קטנה יותר להרצה מקומית.
אפשר להשתמש ב-Qwen בעברית? ▼
כן. הצ'אט מבין וכותב עברית. חלק מהתשובות עדיין חזקות יותר באנגלית ובסינית, אז לטקסטים חשובים כדאי לעבור על הפלט.
איך מנסים את Qwen3.8-Max מישראל? ▼
נכנסים לצ'אט Qwen בדפדפן ומתחברים עם חשבון. מפתחים יכולים לפנות ל-QwenCloud, שתומך בפרוטוקולים של OpenAI ו-Anthropic, עם ניסיון חד-פעמי של מיליון טוקן.