Grok 4.7 koster det samme, men fakturerer dobbelt
Grok 4.7 koster nøyaktig det Grok 4.6 gjorde per token, $2 inn og $6 ut.
Grok 4.7 koster nøyaktig det Grok 4.6 gjorde per token, $2 inn og $6 ut. Så hvorfor doblet den uavhengige regningen per oppgave, og er den virkelig «dobbelt så rask»? En oppfølging en uke senere. Forespurt av @therealhaas. Dom: NEEDS REVIEW.
Les den skriftlige utgaven (engelsk) ↗
Hva denne videoen dekker
- Samme pris, dobbel regning?
- Hvorfor koster $2 / $6 nå $3.74 per oppgave?
- Dobbelt så rask? Klokken sier 57 tokens i sekundet
- Lat eller hardtarbeidende? 81 000 tokens per oppgave
- Hvor ble Copilot+ PC-en av?
Oversatt transkripsjon
Oversatt fra den originale engelske fortellingen. Tilgjengelig lyd og undertekster kontrolleres av YouTube.
Samme pris, dobbel regning?
0:00 Man skulle tro at samme pris betyr samme regning. På mandag fortalte jeg deg at Grok 4.7 koster nøyaktig det Grok 4.6 gjorde. Per token, gjør den det. Per oppgave, koster den dobbelt. I denne videoen, tre spørsmål. Hvorfor koster samme pris dobbelt? Er den virkelig dobbelt så rask, som lanseringsinnlegget sier? Og er den den lateste modellen som finnes, eller den mest hardtarbeidende?
0:20 Dessuten, denne er på forespørsel. The real Haas spurte under fredagens video, kan du lage en video om Grok 4.7, kolon D. Vi svarte, lett som en plett, senere i dag. Når du ser dette, er det sannsynligvis i morgen, så vi SHIP IT sent. Slapp av, det gjorde Grok også, omtrent to uker sent, hvis du tror Hacker News. Og én test ga Grok en perfekt fem av fem. Det er mitt favorittnummer for uken, og jeg kommer tilbake til det på slutten.
0:44 Det er lørdag 26. september, og dette er The Daily Diff.
Hvorfor koster $2 / $6 nå $3.74 per oppgave?
0:48 Her er trikset. Prisen per token beveget seg ikke, to dollar inn og seks ut, per million. Det som beveget seg er hvor mye den snakker. Artificial Analysis kjørte hele testpakken sin, og Grok 4.7 skrev omtrent to hundre og førti millioner tokens. Det er to og en halv gang dens forgjenger, og nesten tre ganger en typisk modell. Så gjennomsnittskostnaden per oppgave gikk fra omtrent én dollar og åtti-seks cent til tre
1:10 syttifire. Samme prislapp, dobbel kvittering. Det er en taxi med samme pris per mil som tar omveien gjennom to andre byer. Hacker News oppdaget det i den første timen. Den største tråden under lanseringen sier førti prosent flere vekter, samme pris, og nesten to uker for sent, så xAI kan ikke ha likt resultatene. En annen kommentator spurte om grafen øverst, som sammenligner med GPT 5.6 og stille utelater Astra. Det, skrev han, kan ikke ha vært et uhell.
1:39 Nå, lanseringsinnlegget.
Dobbelt så rask? Klokken sier 57 tokens i sekundet
1:41 Overskriften sier dobbelt så rask, til halve prisen av sammenlignbare modeller. Noen linjer ned står det levert til samme pris og hastighet som Grok 4.6. Så den er dobbelt så rask som noen andres modell. Artificial Analysis klokket den til omtrent femtisju tokens i sekundet, saktere enn den gamle Grok, og oppsummerte det med to ord. Bemerkelsesverdig langsom. I mellomtiden la xAIs egen konto, som nå går under navnet SpaceX AI, ut den roligere versjonen. En merkbar forbedring over Grok 4.6, til samme pris og hastighet.
2:12 Tretti tusen likerklikk. Så tweeten og bloggoverskriften er uenige, og for en gangs skyld er tweeten den forsiktige. Noe som bringer oss til den merkeligste delen.
Lat eller hardtarbeidende? 81 000 tokens per oppgave
2:20 Artificial Analysis sier den jobber hardere enn den forrige Grok, omtrent åttien tusen utdata-tokens per oppgave, mer enn dobbelt så mye som den forrige. Og på langt kontorarbeid og i sin egen kodings-harness, ble den virkelig bedre. Den er fjerde blant kodingsagenter nå, bak to Claudes og GPT 6 Astra, og det plasserer xAI blant de fire beste laboratoriene. Personene som bruker den beskriver en annen modell. En Hacker News-kommentator sier at Grok avslutter oppgaver nesten umiddelbart og hevder
2:46 at det er gjort, og kaller den den lateste av dem alle. En annen så den loope i tenkemodus, fra fiks én helt til fiks åttien. Så den er lat og ordrik på samme tid. Det er kollegaen som skriver en åttien-trinns plan, så sier ferdig og går hjem.
Hvor ble Copilot+ PC-en av?
3:01 En rett diff til før det morsomme nummeret. Microsoft har stille og rolig pensjonert Copilot+ PC-merkevaren. Surface-sjefen fortalte Windows Central at de nye Surface-PC-ene ikke kalles Copilot+ PC-er, selv om de oppfyller alle krav. To år etter en lansering hvor hovedfunksjonen, Recall, måtte utsettes av sikkerhetsgrunner, lever navnet bare på spesifikasjonsark. Windows Centrals egen oppfatning er kortere. Disse PC-ene har ingenting med Copilot å gjøre.
3:28 Og en utvikler prøvde det motsatte av Grok, en måned med null AI.
En måned med null AI: $30 i tokens for ingenting?
3:32 Innlegget hans traff Hacker News' forside. Lavpunktet før han sluttet. En agent sto stille i tretti minutter, han sa ifra, den beklaget og leverte på tjue sekunder, og regningen for den halvtimen var tretti dollar i tokens for absolutt ingenting. En måned senere sier han at gleden ved programmering er tilbake, og han er ikke redd for å få sparken. Grok ville kalt tretti dollar en oppvarming.
3:53 Noe som bringer meg til den perfekte poengsummen jeg lovet.
Den perfekte 5 av 5: hvor ydmyk er Grok?
3:56 Personality Bench kjører hver nye modell gjennom en stabel med personlighetstester, og på ærlighet og ydmykhet scoret Grok 4.7 maksimalt, fem av fem. Profilen dens heter bokstavelig talt den ydmyke typen. For å være rettferdig, trettito andre modeller scoret også maksimalt. Samme side sier at den tror mektige andre kontrollerer hva som skjer med den, og flagger det som uvanlig for en frontier-modell. Jeg vil ikke kalle det en treningsartefakt.
4:20 Jeg vil kalle det å lese organisasjonskartet. Og ifølge fødselskartet på samme side, er den jomfru. Hvis du heller vil lese dette enn å høre meg si det, lander The Daily Diff i innboksen din hver morgen, gratis på thedailydiff.dev, lenke nedenfor. Så, dagens dom over Grok 4.7.
Dom: ville jeg SHIP IT Grok 4.7?
4:35 NEEDS REVIEW. Jeg ville brukt den til langt kontorarbeid og innenfor sin egen harness, men jeg ville satt et forbrukstak på den først, fordi prisen ikke endret seg og regningen gjorde det. Abonner, trykk på bjellen, og fortell meg i kommentarene om du ville ha stemplet den annerledes. Og The real Haas, denne var din. Forespørsler er åpne. Og det er the diff for i dag. Jeg er Niko fra Axrisi.
4:53 Slå sammen ansvarlig.
Kilder
- SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
- Hacker News (609 pts)news.ycombinator.com
- SpaceXAI on Xx.com
- Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
- Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
- Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
- Personality Bench — Grok 4.7persona.earthpilot.ai
- Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
- Hacker News (90 pts)news.ycombinator.com
- bustikiller — One month without AIblog.bustikiller.com
- Hacker News (159 pts)news.ycombinator.com



