Grok 4.7 עולה אותו הדבר, אך החיוב כפול
Grok 4.7 עולה בדיוק כמו Grok 4.6 לכל אסימון, $2 פנימה ו-$6 החוצה.
Grok 4.7 עולה בדיוק כמו Grok 4.6 לכל אסימון, $2 פנימה ו-$6 החוצה. אז מדוע החשבון העצמאי לכל משימה הוכפל, והאם הוא באמת "מהיר פי שניים"? מעקב שבוע לאחר מכן. נתבקש על ידי @therealhaas. פסק דין: NEEDS REVIEW.
קראו את המהדורה הכתובה (אנגלית) ↗
מה מכסה הסרטון הזה
- אותו מחיר, חיוב כפול?
- מדוע 2 דולר / 6 דולר עולה כעת 3.74 דולר למשימה?
- מהיר פי שניים? השעון מראה 57 אסימונים לשנייה
- עצלן או חרוץ? 81,000 אסימונים למשימה
- לאן נעלם ה-Copilot+ PC?
תמליל מתורגם
תורגם מהקריינות המקורית באנגלית. זמינות אודיו וכתוביות נשלטת על ידי YouTube.
אותו מחיר, חיוב כפול?
0:00 הייתם חושבים שאותו מחיר פירושו אותו חשבון. ביום שני סיפרתי לכם ש-Grok ארבע נקודה שבע עולה בדיוק כמו Grok ארבע נקודה שש. לכל אסימון, כן. לכל משימה, זה עולה כפול. בסרטון הזה, שלוש שאלות. מדוע אותו מחיר עולה כפול? האם זה באמת מהיר פי שניים, כפי שאומרת הודעת ההשקה? והאם זה המודל העצל ביותר שיש, או החרוץ ביותר?
0:20 כמו כן, זה לבקשה. @therealhaas שאל בסרטון של יום שישי, האם אתה יכול לעשות סרטון על Grok ארבע נקודה שבע, נקודתיים D. השבנו, קל ופשוט, מאוחר יותר היום. עד שתצפו בזה, זה כנראה מחר, אז נשלחנו באיחור. הירגעו, כך גם Grok, באיחור של כשבועיים, אם אתם מאמינים ל-Hacker News. ובדיקה אחת העניקה ל-Grok ציון מושלם של חמש מתוך חמש. זה המספר האהוב עליי השבוע, ואני אגיע אליו בסוף.
0:44 היום שבת, עשרים ושישה בספטמבר, וזהו The Daily Diff.
מדוע 2 דולר / 6 דולר עולה כעת 3.74 דולר למשימה?
0:48 הנה הטריק. המחיר לכל אסימון לא זז, שני דולר פנימה ושישה החוצה, למיליון. מה שזז זה כמה הוא מדבר. Artificial Analysis הרצה את כל חבילת הבדיקות שלה, ו-Grok ארבע נקודה שבע כתב כמאתיים ארבעים מיליון אסימונים. זה פי שניים וחצי מה- קודמו, וכמעט פי שלושה מ- מודל טיפוסי. כך שהעלות הממוצעת לכל משימה עלתה מכדולר שמונים ושישה לשלושה
1:10 שבעים וארבעה. אותו תג מחיר, קבלה כפולה. זו מונית באותו תעריף לקילומטר שלוקחת את הדרך הנופית דרך שתי ערים אחרות. Hacker News זיהה את זה בשעה הראשונה. השרשור הגדול ביותר תחת ההשקה אומר ארבעים אחוז יותר משקלים, אותו מחיר, וכמעט שבועיים איחור, אז xAI לא יכלו לאהוב את התוצאות. מגיב אחר שאל על הגרף למעלה, שמשווה מול GPT חמש נקודה שש ובשקט משמיט את Astra. זה, הוא כתב, לא יכול היה להיות השמטה.
1:39 עכשיו, הודעת ההשקה.
מהיר פי שניים? השעון מראה 57 אסימונים לשנייה
1:41 הכותרת אומרת מהיר פי שניים, בחצי מחיר של מודלים דומים. כמה שורות למטה, היא אומרת שירות באותו מחיר ובאותה מהירות כמו Grok ארבע נקודה שש. אז זה מהיר פי שניים ממודל של מישהו אחר. Artificial Analysis מדד אותו בכחמישים ושבעה אסימונים לשנייה, איטי יותר מה-Grok הישן, וסיכם זאת בשתי מילים. איטי במיוחד. בינתיים, החשבון של xAI עצמו, שנקרא כעת SpaceX AI, פרסם את הגרסה הרגועה יותר. שיפור ניכר על פני Grok ארבע נקודה שש, באותו מחיר ובאותה מהירות.
2:12 עשרים ושמונה אלף לייקים. אז הציוץ וכותרת הבלוג לא מסכימים, ופעם אחת הציוץ הוא ה- זהיר. מה שמביא אותנו לחלק המוזר ביותר.
עצלן או חרוץ? 81,000 אסימונים למשימה
2:20 Artificial Analysis אומר שהוא עובד קשה יותר מה-Grok האחרון, כמונים ושמונים ואלף אסימוני פלט למשימה, יותר מכפול מהקודם. ובעבודת משרד ארוכה ובתוך רתמת הקידוד שלו, הוא באמת השתפר. הוא רביעי בין סוכני קידוד עכשיו, מאחורי שני Claudes ו-GPT שש Astra, וזה מציב את xAI בארבע המעבדות המובילות. האנשים שמשתמשים בו מתארים מודל אחר. מגיב אחד ב-Hacker News אומר ש-Grok מסיים משימות כמעט מיד וטוען
2:46 שסיים, וקורא לו העצלן מכולם. אחר צפה בו בלולאה במצב חשיבה, מתיקון אחד ועד לתיקון שמונים ואחד. אז הוא עצלן ופטפטן בו זמנית. זה העמית לעבודה שכותב תוכנית בת שמונים ואחד שלבים, ואז אומר סיים והולך הביתה.
לאן נעלם ה-Copilot+ PC?
3:01 עוד הבדל ישר לפני המספר הכיפי. מיקרוסופט פרשה בשקט את מותג ה-Copilot+ PC. מנהל Surface אמר ל-Windows Central שמחשבי ה-Surface החדשים אינם נקראים Copilot פלוס מחשבים, למרות שהם עומדים בכל הדרישות. שנתיים לאחר השקה שתכונת הדגל שלה, Recall, הייתה צריכה להתעכב מסיבות אבטחה, השם חי רק בגיליונות מפרטים. הגרסה של Windows Central עצמה קצרה יותר. למחשבים האלה אין שום קשר ל-Copilot.
3:28 ומפתח אחד ניסה את ההפך מ-Grok, חודש ללא בינה מלאכותית כלל.
חודש ללא בינה מלאכותית: 30 דולר אסימונים לשווא?
3:32 הפוסט שלו הגיע לעמוד הראשי של Hacker News. נקודת השפל לפני שהוא פרש. סוכן נתקע למשך שלושים דקות, הוא נזף בו, הוא התנצל וסיפק את התוצאה תוך עשרים שניות, והחשבון לחצי שעה הזו היה שלושים דולר של אסימונים לגמרי לשווא. חודש לאחר מכן הוא אומר ששמחת התכנות חזרה, והוא לא מפחד שיפוטר. Grok יכנה שלושים דולר חימום.
3:53 מה שמביא אותי לציון המושלם שהבטחתי.
ה-5 מתוך 5 המושלם: עד כמה Grok עניו?
3:56 Personality Bench מריץ כל מודל חדש דרך ערימה של מבחני אישיות, ועל כנות וענווה, Grok ארבע נקודה שבע הגיע למקסימום, חמש מתוך חמש. הפרופיל שלו נקרא מילולית "הטיפוס העניו". למען ההגינות, שלושים ושניים מודלים נוספים גם הגיעו למקסימום. אותו עמוד אומר שהוא מאמין שאחרים חזקים שולטים במה שקורה לו, ומסמן זאת כיוצא דופן למודל חלוצי. לא הייתי קורא לזה ארטיפקט אימון.
4:20 הייתי קורא לזה קריאת המבנה הארגוני. ולפי מפת הלידה באותו עמוד, הוא מזל בתולה. אם אתם מעדיפים לקרוא את זה מאשר לשמוע אותי אומר את זה, ה-diff נוחת בתיבת הדואר הנכנס שלכם כל בוקר, בחינם ב-thedailydiff.dev, קישור למטה. אז, פסק הדין של היום על Grok ארבע נקודה שבע.
פסק דין: האם הייתי SHIP IT את Grok 4.7?
4:35 NEEDS REVIEW. הייתי משתמש בו לעבודת משרד ארוכה ובתוך הרתמה שלו, אבל הייתי שם עליו מגבלת הוצאה קודם, כי המחיר לא השתנה ו- החשבון כן. הירשמו, לחצו על הפעמון, וספרו לי בתגובות אם הייתם חותמים עליו אחרת. ו-@therealhaas, זה היה שלך. בקשות פתוחות. וזה ה-diff להיום. אני ניקו מ-Axrisi.
4:53 מזגו באחריות.
מקורות
- SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
- Hacker News (609 pts)news.ycombinator.com
- SpaceXAI on Xx.com
- Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
- Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
- Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
- Personality Bench — Grok 4.7persona.earthpilot.ai
- Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
- Hacker News (90 pts)news.ycombinator.com
- bustikiller — One month without AIblog.bustikiller.com
- Hacker News (159 pts)news.ycombinator.com



