Grok 4.7 koster det samme, men regner dobbelt op
Grok 4.7 koster nøjagtigt det samme som Grok 4.6 pr.
Grok 4.7 koster nøjagtigt det samme som Grok 4.6 pr. token, 2 $ ind og 6 $ ud. Så hvorfor blev den uafhængige regning pr. opgave fordoblet, og er den virkelig "dobbelt så hurtig"? En uge senere opfølgning. Anmodet af @therealhaas. Dom: SKAL GENNEMGÅS.
Læs den skriftlige udgave (engelsk) ↗
Hvad denne video dækker
- Samme pris, dobbelt regning?
- Hvorfor koster 2 $ / 6 $ nu 3,74 $ pr. opgave?
- Dobbelt så hurtig? Uret siger 57 tokens i sekundet
- Doven eller hårdtarbejdende? 81.000 tokens pr. opgave
- Hvor blev Copilot+ PC'en af?
Oversat udskrift
Oversat fra den originale engelske fortælling. Tilgængelig lyd og undertekster styres af YouTube.
Samme pris, dobbelt regning?
0:00 Man skulle tro, at samme pris betyder samme regning. I mandags fortalte jeg dig, at Grok 4.7 koster nøjagtigt det samme som Grok 4.6 gjorde. Pr. token, ja. Pr. opgave, koster det dobbelt. I denne video, tre spørgsmål. Hvorfor koster samme pris dobbelt? Er den virkelig dobbelt så hurtig, som lanceringsopslaget siger? Og er det den dovneste model, eller den mest hårdtarbejdende?
0:20 Dette er også en anmodning. The Real Haas spurgte under fredagens video, kan du lave en video om Grok 4.7, kolon D. Vi svarede, nemt nok, senere i dag. Når du ser dette, er det sandsynligvis i morgen, så vi SHIP IT sent. Slap af, det gjorde Grok også, omkring to uger for sent, hvis du tror Hacker News. Og én test gav Grok en perfekt fem ud af fem. Det er mit yndlingstal i ugen, og jeg vender tilbage til det til sidst. Det er lørdag, den 26. september, og dette er The Daily Diff.
0:44 Her er tricket.
Hvorfor koster 2 $ / 6 $ nu 3,74 $ pr. opgave?
0:48 Prisen pr. token flyttede sig ikke, to dollars ind og seks ud, pr. million. Hvad der flyttede sig, er hvor meget den taler. Artificial Analysis kørte hele sin testsuite, og Grok 4.7 skrev omkring to hundrede og fyrre millioner tokens. Det er to og en halv gange sin forgænger, og næsten tre gange en typisk model. Så gennemsnitsprisen pr. opgave gik fra omkring en dollar og seksogfirs til tre fireoghalvfjerds. Samme pris, dobbelt kvittering.
1:10 Det er en taxa med samme pris pr. mil, der tager den naturskønne rute gennem to andre byer. Hacker News opdagede det i den første time. Den største tråd under lanceringen siger fyrre procent flere vægte, samme pris, og næsten to uger for sent, så xAI kan ikke have elsket resultaterne. En anden kommentator spurgte om diagrammet øverst, som sammenligner med GPT 5.6 og stille og roligt udelader Astra. Det, skrev han, kan ikke have været en forglemmelse. Nu lanceringsopslaget.
1:39 Overskriften siger dobbelt så hurtig, til halv pris af sammenlignelige modeller.
Dobbelt så hurtig? Uret siger 57 tokens i sekundet
1:41 Et par linjer nede står der serveret til samme pris og hastighed som Grok 4.6. Så den er dobbelt så hurtig som en andens model. Artificial Analysis klokkede den til omkring syvoghalvtreds tokens i sekundet, langsommere end den gamle Grok, og opsummerede det i to ord. Bemærkelsesværdigt langsom. I mellemtiden postede xAI's egen konto, som nu går under SpaceX AI, den roligere version. En bemærkelsesværdig forbedring i forhold til Grok 4.6, til samme pris og hastighed. Otteogtyve tusind likes.
2:12 Så tweetet og blogoverskriften er uenige, og for en gangs skyld er tweetet det forsigtige. Hvilket bringer os til den mærkeligste del. Artificial Analysis siger, at den arbejder hårdere end den sidste Grok,
Doven eller hårdtarbejdende? 81.000 tokens pr. opgave
2:20 omkring enogfirs tusind outputtokens pr. opgave, mere end dobbelt så mange som den sidste. Og på langt kontorarbejde og i sin egen kodningssele, forbedrede den sig virkelig. Den er nu nummer fire blandt kodningsagenter, bag to Claudes og GPT 6 Astra, og det placerer xAI i top fire laboratorier. Folk, der bruger den, beskriver en anden model. En Hacker News-kommentator siger, at Grok afslutter opgaver næsten øjeblikkeligt og hævder færdig, og kalder den den dovneste af dem alle.
2:46 En anden så den loop i tænkemode, fra fix et helt til fix enogfirs. Så den er doven og ordrig på samme tid. Det er kollegaen, der skriver en enoghalvfjerds trins plan, og så siger færdig og går hjem. Endnu en direkte forskel før det sjove nummer.
Hvor blev Copilot+ PC'en af?
3:01 Microsoft har stille og roligt trukket Copilot+ PC-brandet tilbage. Surface-chefen fortalte Windows Central, at de nye Surface-pc'er ikke kaldes Copilot + PC'er, selvom de opfylder alle krav. To år efter en lancering, hvis hovedfunktion, Recall, måtte udskydes af sikkerhedsmæssige årsager, lever navnet kun på specifikationsark. Windows Centrals egen holdning er kortere. Disse pc'er har intet at gøre med Copilot. Og en udvikler prøvede det modsatte af Grok, en måned uden AI.
3:28 Hans opslag ramte Hacker News' forside.
En måned uden AI: 30 $ i tokens for ingenting?
3:32 Lavpunktet før han stoppede. En agent sad fast i tredive minutter, han skældte den ud, den undskyldte og leverede på tyve sekunder, og regningen for den halve time var tredive dollars i tokens for absolut ingenting. En måned senere siger han, at glæden ved at programmere er tilbage, og han er ikke bange for at blive fyret. Grok ville kalde tredive dollars for en opvarmning. Hvilket bringer mig til den perfekte score, jeg lovede.
3:53 Personality Bench kører hver ny model gennem en stak personlighedstests,
Den perfekte 5 ud af 5: hvor ydmyg er Grok?
3:56 og på ærlighed og ydmyghed, Grok 4.7 toppede ud, fem ud af fem. Dens profil kaldes bogstaveligt talt den ydmyge type. For at være retfærdig toppede toogtredive andre modeller den også ud. Samme side siger, at den tror, at magtfulde andre kontrollerer, hvad der sker med den, og flagger det som usædvanligt for en frontier-model. Jeg ville ikke kalde det en træningsartefakt. Jeg ville kalde det at læse organisationsdiagrammet.
4:20 Og ifølge fødselshoroskopet på samme side er det en Jomfru. Hvis du hellere vil læse dette end høre mig sige det, lander diffen i din indbakke hver morgen, gratis på thedailydiff.dev, link nedenfor. Så, dagens dom over Grok 4.7. SKAL GENNEMGÅS. Jeg ville bruge den til langt kontorarbejde og inden for dens egen sele,
Dom: ville jeg SHIP IT Grok 4.7?
4:35 men jeg ville først sætte et forbrugsloft på den, fordi prisen ikke ændrede sig, og regningen gjorde. Abonner, tryk på klokken, og fortæl mig i kommentarerne, om du ville have stemplet det anderledes. Og The Real Haas, denne var din. Anmodninger er åbne. Og det er forskellen for i dag. Jeg er Niko fra Axrisi. Flet ansvarligt.
4:53 Flet ansvarligt.
Kilder
- SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
- Hacker News (609 pts)news.ycombinator.com
- SpaceXAI on Xx.com
- Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
- Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
- Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
- Personality Bench — Grok 4.7persona.earthpilot.ai
- Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
- Hacker News (90 pts)news.ycombinator.com
- bustikiller — One month without AIblog.bustikiller.com
- Hacker News (159 pts)news.ycombinator.com



