+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

A Grok 4.7 ugyanannyiba kerül, de duplán számláz

A Grok 4.7 tokenenként pontosan annyiba kerül, mint a Grok 4.6: 2 dollár be és 6 dollár ki.

A Grok 4.7 tokenenként pontosan annyiba kerül, mint a Grok 4.6: 2 dollár be és 6 dollár ki. Akkor miért duplázódott meg a feladatonkénti független számla, és tényleg „kétszer olyan gyors”? Egy héttel későbbi utánkövetés. Kérte: @therealhaas. Ítélet: ÁTTEKINTÉS SZÜKSÉGES.

Olvassa el az írott kiadást (angolul) ↗

Amit ez a videó tartalmaz

  • Ugyanaz az ár, dupla számla?
  • Miért kerül most 2 $ / 6 $ 3,74 dollárba feladatonként?
  • Kétszer olyan gyors? Az óra szerint 57 token másodpercenként
  • Lusta vagy szorgalmas? 81 000 token feladatonként
  • Hova lett a Copilot+ PC?

Lefordított átirat

Az eredeti angol narrációból fordítva. A rendelkezésre álló hangot és feliratokat a YouTube vezérli.

Ugyanaz az ár, dupla számla?

0:00 Azt gondolnád, hogy ugyanaz az ár, ugyanazt a számlát jelenti. Hétfőn azt mondtam, hogy a Grok négy pont hét pontosan annyiba kerül, mint a Grok négy pont hat. Tokenenként igen. Feladatonként duplájába kerül. Ebben a videóban három kérdés. Miért kerül ugyanaz az ár duplájába? Tényleg kétszer olyan gyors, ahogy az indító poszt írja? És ez a leglustább modell, vagy a legszorgalmasabb?

0:20 Ez is kérésre készült. A The Real Haas pénteki videója alatt kérdezte: tudnál-e videót csinálni a Grok négy pont hétről, kettőspont D. Azt válaszoltuk: pofon egyszerű, még ma. Mire ezt nézed, valószínűleg már holnap van, szóval késve SHIP IT-eltünk. Nyugi, a Grok is, körülbelül két hetes késéssel, ha hiszünk a Hacker News-nak. És egy teszt ötösből ötöst adott a Groknak. Ez a hét kedvenc számom, és a végén rátérek.

0:44 Szombat van, szeptember huszonhatodik, és ez a The Daily Diff.

Miért kerül most 2 $ / 6 $ 3,74 dollárba feladatonként?

0:48 Itt a trükk. A tokenenkénti ár nem változott, két dollár be és hat ki, milliónként. Ami változott, az az, hogy mennyit beszél. Az Artificial Analysis lefuttatta a teljes tesztcsomagját, és a Grok négy pont hét körülbelül kétszáznegyvenmillió tokent írt. Ez két és félszerese az elődjének, és majdnem háromszorosa egy tipikus modellnek. Így az átlagos feladatonkénti költség körülbelül egy dollár nyolcvanhatról három

1:10 hetvennégyre nőtt. Ugyanaz az árcédula, dupla a számla. Ez olyan, mint egy taxi, aminek ugyanaz a kilométerenkénti ára, de két másik városon keresztül visz. A Hacker News az első órában észrevette. A legnagyobb szál az indítás alatt azt mondja: negyven százalékkal több súly, ugyanaz az ár, és majdnem két hetes késéssel, szóval az xAI nem szerethette az eredményeket. Egy másik hozzászóló a fenti diagramról kérdezett, amely a GPT öt pont hat ellen hasonlít össze, és csendesen kihagyja az Astrát. Ez, írta, nem lehetett figyelmetlenség.

1:39 Most pedig az indító poszt.

Kétszer olyan gyors? Az óra szerint 57 token másodpercenként

1:41 A főcím azt írja, kétszer olyan gyors, féláron a hasonló modellekhez képest. Néhány sorral lejjebb azt írja, ugyanazon az áron és sebességgel szolgálják fel, mint a Grok négy pont hatot. Tehát kétszer olyan gyors, mint valaki más modellje. Az Artificial Analysis körülbelül ötvenhét tokent mért másodpercenként, lassabban, mint a régi Grok, és két szóban összegezte. Jelentősen lassú. Eközben az xAI saját fiókja, ami most már SpaceX AI néven fut, a nyugodtabb verziót posztolta. Jelentős javulás a Grok négy pont hat felett, ugyanazon az áron és sebességgel.

2:12 Huszonnyolcezer like. Szóval a tweet és a blog főcíme ellentmond egymásnak, és ezúttal a tweet a óvatos. Ami elvezet minket a legfurcsább részhez.

Lusta vagy szorgalmas? 81 000 token feladatonként

2:20 Az Artificial Analysis szerint keményebben dolgozik, mint az utolsó Grok, körülbelül nyolcvanegyezer kimeneti token feladatonként, több mint duplája az előzőnek. És hosszú irodai munkában és saját kódoló felületén valóban javult. Jelenleg a negyedik a kódoló ügynökök között, két Claude és a GPT hat Astra mögött, és ezzel az xAI a legjobb négy labor közé került. Azok, akik használják, más modellnek írják le. Egy Hacker News hozzászóló szerint a Grok szinte azonnal befejezi a feladatokat és azt állítja,

2:46 kész, és a leglustábbnak nevezi mind közül. Egy másik azt figyelte, ahogy gondolkodó módban ciklusba kerül, az első javítástól egészen a nyolcvanegyedik javításig. Tehát lusta és terjengős is egyszerre. Ez az a munkatárs, aki egy nyolcvanegy lépéses tervet ír, aztán azt mondja, kész, és hazamegy.

Hova lett a Copilot+ PC?

3:01 Még egy egyenes diff a mókás szám előtt. A Microsoft csendben megszüntette a Copilot plus PC márkanevet. A Surface főnök a Windows Centralnak elmondta, hogy az új Surface PC-ket nem hívják Copilot plusz PC-knek, annak ellenére, hogy minden követelménynek megfelelnek. Két évvel egy olyan bevezetés után, amelynek kiemelt funkcióját, a Recallt, biztonsági okokból el kellett halasztani, a név már csak a specifikációs lapokon él. A Windows Central saját véleménye rövidebb. Ezeknek a PC-knek semmi közük a Copilothoz.

3:28 És egy fejlesztő kipróbálta a Grok ellentétét, egy hónapot nulla AI-val.

Egy hónap nulla AI-val: 30 dollárnyi token semmiért?

3:32 A posztja felkerült a Hacker News címlapjára. A mélypont, mielőtt kilépett. Egy ügynök harminc percig állt, leszidta, bocsánatot kért és húsz másodperc alatt teljesített, és annak a fél órának a számlája harminc dollárnyi token volt abszolút semmiért. Egy hónappal később azt mondja, visszatért a programozás öröme, és nem fél attól, hogy kirúgják. A Grok harminc dollárt bemelegítésnek nevezne.

3:53 Ami elvezet a megígért tökéletes pontszámhoz.

Az ötösből a tökéletes ötös: mennyire szerény a Grok?

3:56 A Personality Bench minden új modellt egy sor személyiségteszten futtat át, és az őszinteség és szerénység terén a Grok négy pont hét maximális pontszámot ért el, ötből ötöt. A profilját szó szerint szerény típusnak nevezik. Az igazsághoz hozzátartozik, hogy harminckét másik modell is elérte a maximumot. Ugyanez az oldal azt írja, hogy hisz abban, hogy hatalmas mások irányítják, ami vele történik, és ezt szokatlannak jelöli egy határmodellnél. Én ezt nem nevezném képzési műterméknek.

4:20 Én ezt a szervezeti ábra olvasásának nevezném. És az ugyanazon az oldalon található születési diagram szerint Szűz. Ha inkább elolvasnád ezt, mint hallanád tőlem, a diff minden reggel megérkezik a postaládádba, ingyenesen a thedailydiff.dev címen, link lent. Tehát, a mai ítélet a Grok négy pont hétre vonatkozóan.

Ítélet: SHIP IT Grok 4.7?

4:35 ÁTTEKINTÉS SZÜKSÉGES. Hosszú irodai munkához és a saját felületén használnám, de először beállítanék rá egy kiadási korlátot, mert az ár nem változott, de a számla igen. Iratkozz fel, nyomd meg a csengőt, és írd meg kommentben, ha te másképp pecsételted volna le. És The Real Haas, ez a tied volt. A kérések nyitottak. És ennyi a diff mára. Niko vagyok az Axrisitől.

4:53 SHIP IT felelősségteljesen.

Források

  1. SpaceXAI — Introducing Grok 4.7 (archived)web.archive.org
  2. Hacker News (609 pts)news.ycombinator.com
  3. SpaceXAI on Xx.com
  4. Artificial Analysis — Benchmarking Grok 4.7artificialanalysis.ai
  5. Artificial Analysis — Grok 4.7 model pageartificialanalysis.ai
  6. Artificial Analysis — Grok 4.6 model pageartificialanalysis.ai
  7. Personality Bench — Grok 4.7persona.earthpilot.ai
  8. Windows Central — The Copilot+ PC brand is deadwww.windowscentral.com
  9. Hacker News (90 pts)news.ycombinator.com
  10. bustikiller — One month without AIblog.bustikiller.com
  11. Hacker News (159 pts)news.ycombinator.com

Kapcsolódó videók