+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Grok 4.7 kos dieselfde, maar faktureer dubbel

Grok 4.7 kos presies wat Grok 4.6 per token gekos het, $2 in en $6 uit.

Grok 4.7 kos presies wat Grok 4.6 per token gekos het, $2 in en $6 uit. So hoekom het die onafhanklike rekening per taak verdubbel, en is dit regtig "twee keer so vinnig"? 'n Een-week-later opvolg. Versoek deur @therealhaas. Uitspraak: NEEDS REVIEW.

Lees die geskrewe uitgawe (Engels) ↗

Wat hierdie video dek

  • Dieselfde prys, dubbel die rekening?
  • Hoekom kos $2 / $6 nou $3.74 'n taak?
  • Twee keer so vinnig? Die horlosie sê 57 tokens per sekonde
  • Lui of hardwerkend? 81,000 tokens per taak
  • Waar het die Copilot+ PC gegaan?

Vertaalde transkripsie

Vertaal uit die oorspronklike Engelse vertelling. Beskikbare klank en onderskrifte word deur YouTube beheer.

Dieselfde prys, dubbel die rekening?

0:00 Jy sou dink dieselfde prys beteken dieselfde rekening. Maandag het ek jou vertel Grok vier punt sewe kos presies wat Grok vier punt ses gekos het. Per token, ja. Per taak, kos dit dubbel. In hierdie video, drie vrae. Hoekom kos dieselfde prys dubbel? Is dit regtig twee keer so vinnig, soos die bekendstellingspos sê? En is dit die luiaste model wat daar is, of die hardwerkendste?

0:20 Ook, hierdie een is op versoek. Die regte Haas het onder Vrydag se video gevra, kan jy 'n video doen oor Grok vier punt sewe, dubbelpunt D. Ons het geantwoord, maklik, later vandag. Teen die tyd dat jy dit kyk, is dit seker môre, so ons het laat gelewer. Ontspan, soos Grok ook, sowat twee weke laat, as jy Hacker News glo. En een toets het Grok 'n perfekte vyf uit vyf gegee. Dit is my gunsteling nommer van die week, en ek sal dit aan die einde kry.

0:44 Dis Saterdag, ses-en-twintig September, en dit is The Daily Diff.

Hoekom kos $2 / $6 nou $3.74 'n taak?

0:48 Hier is die truuk. Die prys per token het nie beweeg nie, twee dollar in en ses uit, per miljoen. Wat wel beweeg het, is hoeveel dit praat. Artificial Analysis het sy hele toetsreeks uitgevoer, en Grok vier punt sewe het sowat twee honderd veertig miljoen tokens geskryf. Dit is twee en 'n half keer sy voorganger, en amper drie keer 'n tipiese model. So die gemiddelde koste per taak het van sowat 'n dollar ses-en-tagtig na drie

1:10 sewe-en-veertig gegaan. Dieselfde prysetiket, dubbel die kwitansie. Dis 'n taxi met dieselfde tarief per myl wat die skilderagtige roete deur twee ander stede neem. Hacker News het dit in die eerste uur opgemerk. Die grootste draad onder die bekendstelling sê veertig persent meer gewigte, dieselfde prys, en amper twee weke laat, so xAI kon nie van die resultate gehou het nie. Nog 'n kommentator het gevra oor die grafiek bo-aan, wat vergelyk teen GPT vyf punt ses en Astra stilweg uitlaat. Dit, het hy geskryf, kon nie 'n oogsienlike fout gewees het nie.

1:39 Nou, die bekendstellingspos.

Twee keer so vinnig? Die horlosie sê 57 tokens per sekonde

1:41 Die opskrif sê twee keer so vinnig, teen die helfte van die prys van vergelykbare modelle. 'n Paar reëls laer, sê dit word bedien teen dieselfde prys en spoed as Grok vier punt ses. So dis twee keer so vinnig as iemand anders se model. Artificial Analysis het dit op sowat sewe-en-vyftig tokens per sekonde geklok, stadiger as die ou Grok, en dit in twee woorde opgesom. Noemenswaardig stadig. Intussen het xAI se eie rekening, wat nou as SpaceX AI bekend staan, die rustiger weergawe gepos. 'n Noemenswaardige verbetering oor Grok vier punt ses, teen dieselfde prys en spoed.

2:12 Agt-en-twintig duisend laaiks. So die twiet en die blogopskrif stem nie saam nie, en vir eers is die twiet die versigtige een. Wat ons by die vreemdste deel bring.

Lui of hardwerkend? 81,000 tokens per taak

2:20 Artificial Analysis sê dit werk harder as die laaste Grok, sowat een-en-tagtig duisend uitset-tokens per taak, meer as dubbel die laaste een. En op lang kantoorwerk en in sy eie koderingshulpmiddel, het dit regtig verbeter. Dit is nou vierde onder koderingsagente, agter twee Claudes en GPT ses Astra, en dit plaas xAI in die top vier laboratoriums. Die mense wat dit gebruik, beskryf 'n ander model. 'n Hacker News-kommentator sê Grok voltooi take byna onmiddellik en beweer

2:46 klaar, en noem dit die luiaste van almal. 'n Ander het dit in denksmodus gesien lus, van regstelling een tot by regstelling een-en-tagtig. So dis lui en breedsprakig terselfdertyd. Dis die kollega wat 'n een-en-tagtig-stap-plan skryf, dan sê klaar en huis toe gaan.

Waar het die Copilot+ PC gegaan?

3:01 Nog een reguit verskil voor die prettige nommer. Microsoft het stilweg die Copilot plus PC-handelsmerk afgetree. Die Surface-baas het aan Windows Central gesê die nuwe Surface-rekenaars word nie Copilot plus-rekenaars genoem nie, alhoewel hulle aan elke vereiste voldoen. Twee jaar na 'n bekendstelling waarvan die hoofkenmerk, Recall, vir sekuriteit uitgestel moes word, leef die naam slegs op spesifikasieblaaie. Windows Central se eie mening is korter. Hierdie rekenaars het niks met Copilot te doen nie.

3:28 En een ontwikkelaar het die teenoorgestelde van Grok probeer, 'n maand met nul KI.

'n Maand met nul KI: $30 se tokens vir niks?

3:32 Sy pos het die Hacker News-voorblad gehaal. Die laagtepunt voordat hy opgehou het. 'n Agent het dertig minute lank vasgesit, hy het dit aangespreek, dit het om verskoning gevra en in twintig sekondes afgelewer, en die rekening vir daardie halfuur was dertig dollar se tokens vir absoluut niks. 'n Maand later sê hy die vreugde van programmering is terug, en hy is nie bang om afgedank te word nie. Grok sou dertig dollar 'n opwarming noem.

3:53 Wat my bring by die perfekte telling wat ek belowe het.

Die perfekte 5 uit 5: hoe nederig is Grok?

3:56 Personality Bench voer elke nuwe model deur 'n reeks persoonlikheidstoetse, en op eerlikheid en nederigheid het Grok vier punt sewe maksimaal behaal, vyf uit vyf. Sy profiel word letterlik die nederige tipe genoem. Om billik te wees, twee-en-dertig ander modelle het dit ook maksimaal behaal. Dieselfde bladsy sê dit glo kragtige ander beheer wat met dit gebeur, en merk dit as ongewoon vir 'n grensmodel. Ek sou dit nie 'n opleidingsartefak noem nie.

4:20 Ek sou dit noem om die organisasiestruktuur te lees. En volgens die geboortekaart op dieselfde bladsy, is dit 'n Maagd. As jy dit eerder wil lees as om my dit te hoor sê, land die diff elke oggend gratis in jou inkassie by the daily diff dot dev, skakel hieronder. So, vandag se uitspraak oor Grok vier punt sewe.

Uitspraak: sou ek Grok 4.7 SHIP IT?

4:35 NEEDS REVIEW. Ek sal dit gebruik vir lang kantoorwerk en binne sy eie hulpmiddel, maar ek sal eers 'n bestedingsplafon daarop plaas, want die prys het nie verander nie en die rekening wel. Teken in, druk die klokkie, en sê vir my in die kommentaar as jy dit anders sou gestempel het. En die regte Haas, hierdie een was joune. Versoeke is oop. En dis die diff vir vandag. Ek is Niko van Axrisi.

4:53 Smelt verantwoordelik saam.

Bronne

  1. SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
  2. Hacker News (609 pts)news.ycombinator.com
  3. SpaceXAI on Xx.com
  4. Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
  5. Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
  6. Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
  7. Personality Bench — Grok 4.7persona.earthpilot.ai
  8. Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
  9. Hacker News (90 pts)news.ycombinator.com
  10. bustikiller — One month without AIblog.bustikiller.com
  11. Hacker News (159 pts)news.ycombinator.com

Verwante video's