A Grok 4.7 ugyanannyiba kerül, de duplán számláz
A Grok 4.7 tokenenként pontosan annyiba kerül, mint a Grok 4.6: 2 dollár be és 6 dollár ki.
A Grok 4.7 tokenenként pontosan annyiba kerül, mint a Grok 4.6: 2 dollár be és 6 dollár ki. Akkor miért duplázódott meg a feladatonkénti független számla, és tényleg „kétszer olyan gyors”? Egy héttel későbbi utánkövetés. Kérte: @therealhaas. Ítélet: ÁTTEKINTÉS SZÜKSÉGES.
Olvassa el az írott kiadást (angolul) ↗
Amit ez a videó tartalmaz
- Ugyanaz az ár, dupla számla?
- Miért kerül most 2 $ / 6 $ 3,74 dollárba feladatonként?
- Kétszer olyan gyors? Az óra szerint 57 token másodpercenként
- Lusta vagy szorgalmas? 81 000 token feladatonként
- Hova lett a Copilot+ PC?
Lefordított átirat
Az eredeti angol narrációból fordítva. A rendelkezésre álló hangot és feliratokat a YouTube vezérli.
Ugyanaz az ár, dupla számla?
0:00 Azt gondolnád, hogy ugyanaz az ár, ugyanazt a számlát jelenti. Hétfőn azt mondtam, hogy a Grok négy pont hét pontosan annyiba kerül, mint a Grok négy pont hat. Tokenenként igen. Feladatonként duplájába kerül. Ebben a videóban három kérdés. Miért kerül ugyanaz az ár duplájába? Tényleg kétszer olyan gyors, ahogy az indító poszt írja? És ez a leglustább modell, vagy a legszorgalmasabb?
0:20 Ez is kérésre készült. A The Real Haas pénteki videója alatt kérdezte: tudnál-e videót csinálni a Grok négy pont hétről, kettőspont D. Azt válaszoltuk: pofon egyszerű, még ma. Mire ezt nézed, valószínűleg már holnap van, szóval késve SHIP IT-eltünk. Nyugi, a Grok is, körülbelül két hetes késéssel, ha hiszünk a Hacker News-nak. És egy teszt ötösből ötöst adott a Groknak. Ez a hét kedvenc számom, és a végén rátérek.
0:44 Szombat van, szeptember huszonhatodik, és ez a The Daily Diff.
Miért kerül most 2 $ / 6 $ 3,74 dollárba feladatonként?
0:48 Itt a trükk. A tokenenkénti ár nem változott, két dollár be és hat ki, milliónként. Ami változott, az az, hogy mennyit beszél. Az Artificial Analysis lefuttatta a teljes tesztcsomagját, és a Grok négy pont hét körülbelül kétszáznegyvenmillió tokent írt. Ez két és félszerese az elődjének, és majdnem háromszorosa egy tipikus modellnek. Így az átlagos feladatonkénti költség körülbelül egy dollár nyolcvanhatról három
1:10 hetvennégyre nőtt. Ugyanaz az árcédula, dupla a számla. Ez olyan, mint egy taxi, aminek ugyanaz a kilométerenkénti ára, de két másik városon keresztül visz. A Hacker News az első órában észrevette. A legnagyobb szál az indítás alatt azt mondja: negyven százalékkal több súly, ugyanaz az ár, és majdnem két hetes késéssel, szóval az xAI nem szerethette az eredményeket. Egy másik hozzászóló a fenti diagramról kérdezett, amely a GPT öt pont hat ellen hasonlít össze, és csendesen kihagyja az Astrát. Ez, írta, nem lehetett figyelmetlenség.
1:39 Most pedig az indító poszt.
Kétszer olyan gyors? Az óra szerint 57 token másodpercenként
1:41 A főcím azt írja, kétszer olyan gyors, féláron a hasonló modellekhez képest. Néhány sorral lejjebb azt írja, ugyanazon az áron és sebességgel szolgálják fel, mint a Grok négy pont hatot. Tehát kétszer olyan gyors, mint valaki más modellje. Az Artificial Analysis körülbelül ötvenhét tokent mért másodpercenként, lassabban, mint a régi Grok, és két szóban összegezte. Jelentősen lassú. Eközben az xAI saját fiókja, ami most már SpaceX AI néven fut, a nyugodtabb verziót posztolta. Jelentős javulás a Grok négy pont hat felett, ugyanazon az áron és sebességgel.
2:12 Huszonnyolcezer like. Szóval a tweet és a blog főcíme ellentmond egymásnak, és ezúttal a tweet a óvatos. Ami elvezet minket a legfurcsább részhez.
Lusta vagy szorgalmas? 81 000 token feladatonként
2:20 Az Artificial Analysis szerint keményebben dolgozik, mint az utolsó Grok, körülbelül nyolcvanegyezer kimeneti token feladatonként, több mint duplája az előzőnek. És hosszú irodai munkában és saját kódoló felületén valóban javult. Jelenleg a negyedik a kódoló ügynökök között, két Claude és a GPT hat Astra mögött, és ezzel az xAI a legjobb négy labor közé került. Azok, akik használják, más modellnek írják le. Egy Hacker News hozzászóló szerint a Grok szinte azonnal befejezi a feladatokat és azt állítja,
2:46 kész, és a leglustábbnak nevezi mind közül. Egy másik azt figyelte, ahogy gondolkodó módban ciklusba kerül, az első javítástól egészen a nyolcvanegyedik javításig. Tehát lusta és terjengős is egyszerre. Ez az a munkatárs, aki egy nyolcvanegy lépéses tervet ír, aztán azt mondja, kész, és hazamegy.
Hova lett a Copilot+ PC?
3:01 Még egy egyenes diff a mókás szám előtt. A Microsoft csendben megszüntette a Copilot plus PC márkanevet. A Surface főnök a Windows Centralnak elmondta, hogy az új Surface PC-ket nem hívják Copilot plusz PC-knek, annak ellenére, hogy minden követelménynek megfelelnek. Két évvel egy olyan bevezetés után, amelynek kiemelt funkcióját, a Recallt, biztonsági okokból el kellett halasztani, a név már csak a specifikációs lapokon él. A Windows Central saját véleménye rövidebb. Ezeknek a PC-knek semmi közük a Copilothoz.
3:28 És egy fejlesztő kipróbálta a Grok ellentétét, egy hónapot nulla AI-val.
Egy hónap nulla AI-val: 30 dollárnyi token semmiért?
3:32 A posztja felkerült a Hacker News címlapjára. A mélypont, mielőtt kilépett. Egy ügynök harminc percig állt, leszidta, bocsánatot kért és húsz másodperc alatt teljesített, és annak a fél órának a számlája harminc dollárnyi token volt abszolút semmiért. Egy hónappal később azt mondja, visszatért a programozás öröme, és nem fél attól, hogy kirúgják. A Grok harminc dollárt bemelegítésnek nevezne.
3:53 Ami elvezet a megígért tökéletes pontszámhoz.
Az ötösből a tökéletes ötös: mennyire szerény a Grok?
3:56 A Personality Bench minden új modellt egy sor személyiségteszten futtat át, és az őszinteség és szerénység terén a Grok négy pont hét maximális pontszámot ért el, ötből ötöt. A profilját szó szerint szerény típusnak nevezik. Az igazsághoz hozzátartozik, hogy harminckét másik modell is elérte a maximumot. Ugyanez az oldal azt írja, hogy hisz abban, hogy hatalmas mások irányítják, ami vele történik, és ezt szokatlannak jelöli egy határmodellnél. Én ezt nem nevezném képzési műterméknek.
4:20 Én ezt a szervezeti ábra olvasásának nevezném. És az ugyanazon az oldalon található születési diagram szerint Szűz. Ha inkább elolvasnád ezt, mint hallanád tőlem, a diff minden reggel megérkezik a postaládádba, ingyenesen a thedailydiff.dev címen, link lent. Tehát, a mai ítélet a Grok négy pont hétre vonatkozóan.
Ítélet: SHIP IT Grok 4.7?
4:35 ÁTTEKINTÉS SZÜKSÉGES. Hosszú irodai munkához és a saját felületén használnám, de először beállítanék rá egy kiadási korlátot, mert az ár nem változott, de a számla igen. Iratkozz fel, nyomd meg a csengőt, és írd meg kommentben, ha te másképp pecsételted volna le. És The Real Haas, ez a tied volt. A kérések nyitottak. És ennyi a diff mára. Niko vagyok az Axrisitől.
4:53 SHIP IT felelősségteljesen.
Források
- SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
- Hacker News (609 pts)news.ycombinator.com
- SpaceXAI on Xx.com
- Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
- Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
- Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
- Personality Bench — Grok 4.7persona.earthpilot.ai
- Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
- Hacker News (90 pts)news.ycombinator.com
- bustikiller — One month without AIblog.bustikiller.com
- Hacker News (159 pts)news.ycombinator.com



