AI-translated from English; not yet reviewed by a fluent editor.

# Grok 4.7 стиже по истој цени токена. Важније је колико кошта завршен посао.

> Grok 4.7 обећава бољи рад на програмирању и пословним задацима. Разматрамо прилог Метјуа Бермана, независне тестове и шта тимови треба да измере пре преласка.

By BIG CHANGE Editorial

Published: 2026-09-22T02:10:45.042Z
Updated: 2026-09-22T02:10:45.042Z
Canonical: https://bigchange.ai/blog/grok-4-7-launch-pricing-benchmarks-cost-of-work

![Hand-drawn workbench with a task folder, an inspected drawing, a document tray, a stopwatch and tokens.](https://bigchange.ai/api/media/file/grok-hero-v1.png)
AI-generated conceptual illustration by BIG CHANGE. Evaluating the time, usage and review needed to finish useful work.

Grok 4.7 је представљен 21. септембра 2026. Тимовима који купују AI за писање кода или анализу пословних података, лансирање поставља практично питање: да ли бољи модел појефтињује завршен посао? Одговор зависи од више од истакнуте цене токена. [Званичне белешке о издању](https://docs.x.ai/developers/release-notes)

Та мешовита слика је тема видеа Метјуа Бермана од 22. септембра, *Не знам шта да мислим о Grok-у 4.7…*. Он доводи у питање избор поређења и тврди да је трошак по завршеном задатку важнији од цене токена. Такође каже да модел још није темељно тестирао. Његов видео је рана процена доступних доказа, а не свеобухватна практична евалуација. [Берманов увод, 0:00](https://www.youtube.com/watch?v=MJllZbpvrAc&t=0s)

Лансирање заслужује пажњу јер користан модел не мора да победи на сваком бенчмарку да би променио колико аутоматизације предузећа могу да приуште. Ипак, мора довољно често да тачно обави посао како би оправдао укупни трошак. Независна тестирања већ откривају напетост: бољи резултати Grok-а 4.7 могу захтевати знатно више генерисаног текста.

За програмере, мала предузећа и тимове који граде агенте одлука је стога практична. Које задатке овај модел може да заврши уз прихватљив квалитет? Колико труда му је потребно? И колико посла остане човеку након што модел каже да је готов?

Прегледали смо целокупне титлове Бермановог видеа од приближно 17 минута и проверили најаву, документацију о производу и евалуацију Artificial Analysis-а. Анализа у наставку не садржи бенчмарк компаније BIG CHANGE нити тврдњу да смо лично тестирали Grok.

## Шта је представљено и где је доступно

Стандардни модел је доступан преко xAI API-ја као `grok-4.7` , као и у Cursor-у и Grok Build-у. API прихвата текст и слике, а генерише текст. Документовани контекстни прозор износи 500.000 токена, уз четири нивоа расуђивања: low, medium, high и xhigh. Подразумевани ниво је high. [Званичне белешке о издању](https://docs.x.ai/developers/release-notes)

SpaceXAI приписује побољшање већем основном моделу и дужем учењу поткрепљеном повратним сигналима на тежим задацима. То је објашњење самог програмера. [Технички преглед лансирања](https://x.ai/news/grok-4-7)

Доступан је и Grok 4.7 Fast. У документацији се описује као исти модел на бржој инфраструктури, уз двоструку стандардну цену токена. Нуди се преко Cursor-а и Grok Build-а, није део бесплатног нивоа Grok Build-а и није доступан преко јавног xAI API-ја. [Документација о производу Grok 4.7](https://docs.x.ai/developers/grok-4-7)

Ове разлике су важне при поређењу снимака екрана, демонстрација и рачуна. Верзија модела, ниво расуђивања и ниво услуге засебни су избори. Демонстрација која користи Fast на xhigh нивоу није процена искуства или трошка API позива на стандардној брзини и нивоу medium.

Поређење са другим моделима на страници лансирања треба раздвојити и од поређења надоградње. SpaceXAI наводи да стандардни Grok 4.7 има исту цену и брзину као Grok 4.6. Не тврди да ће надоградња са верзије 4.6 аутоматски преполовити рачун клијента.

## Картица са ценама има праг за дугачак контекст

Објављене стандардне цене API-ја су:

- До 200.000 улазних токена: 2 долара за улаз, 0,50 долара за кеширани улаз и 6 долара за излаз на милион токена.
- Више од 200.000 улазних токена: 4 долара за улаз, 1 долар за кеширани улаз и 12 долара за излаз на милион токена.

То су цене токена, а не свеобухватан трошак агента који обавља посао. Страница модела истиче више цене за захтеве који премашују 200.000 токена, а белешке о издању наводе те више цене. Цене и доступност проверени су 22. септембра. [Цене модела](https://docs.x.ai/developers/models/grok-4.7) и [белешке о издању](https://docs.x.ai/developers/release-notes)

Дакле, контекстни прозор од 500.000 токена не значи да се за сваки захтев унутар њега наплаћује најнижа цена. Ни велики контекстни прозор не доказује да ће модел доследно пронаћи сваки важан детаљ у великој збирци датотека.

Cursor уводи још једну разлику на нивоу производа: његова документација наводи стандардни прозор од 256.000 токена и максимум од 500.000. Капацитет доступан у уређивачу може се разликовати од спецификације API-ја или зависити од изабраног режима. [Cursor-ова документација о Grok-у 4.7](https://prod.cursor.com/docs/models/grok-4-7)

За тим који обрађује дугачке извештаје, непосредно питање гласи да ли слање целокупног материјала довољно побољшава резултат да оправда трошак. Проналажење релевантних одељака може бити јефтиније и лакше за проверу. Понекад је цео документ неопходан; понекад је то само најлакши начин да се састави упит. Те ситуације не треба планирати као да су исте.

## Бољи резултат може захтевати више токена

Евалуација Artificial Analysis-а од 21. септембра даје Grok-у 4.7 на нивоу xhigh оцену 46 на њиховом Intelligence Index-у, два бода више од Grok-а 4.6. Наводи око 81.000 излазних токена по задатку, у поређењу са 36.000 за Grok 4.6 на нивоу high. Исти извештај наводи 38.000 за Grok 4.6 на нивоу xhigh, тако да чак и поређење истог нивоа расуђивања показује више него двоструку потрошњу излазних токена. [Лансирна евалуација Artificial Analysis-а](https://artificialanalysis.ai/articles/benchmarking-grok-4-7)

То је конкретан разлог да се цена токена раздвоји од трошка задатка. Коришћење 81.000 излазних токена по основној цени од 6 долара за милион износи илустративни трошак од 0,486 долара. За 38.000 токена, трошак би био 0,228 долара. Ови прорачуни намерно искључују улаз, кеширање, трошкове алата, више цене за велики контекст и неуспеле покушаје. То су аритметички прорачуни засновани на пријављеном броју токена, а не измерене укупне цене посла.

Већа количина текста није нужно расипање. Модел би могао да уложи додатни труд у проверу одговора и спречи грешку која би иначе захтевала људску интервенцију. Могао би и дуже да истрајава на погрешном приступу. Сам број токена не разликује продуктивну упорност од скупог понављања.

Берман се враћа овом проблему пред крај видеа и помиње већу потрошњу токена коју је пријавио Artificial Analysis. [Видео, 15:43](https://www.youtube.com/watch?v=MJllZbpvrAc&t=943s)

Корисан резултат је прихваћен производ рада. Измена кода која пролази одговарајуће тестове и преглед, табела чије се формуле слажу са подацима или извештај чије се тврдње могу проверити на основу доказа вреде другачије од одговора који само брзо стигне.

## Бенчмарци показују способан, али неуједначен модел

У табели лансирања Grok 4.7 на нивоу xhigh постиже 46,3% на CursorBench 4.0, мање од 51,8% за Fable 5.1 на нивоу max. Fable такође предњачи у поређењу Terminal-Bench-а. [Табела бенчмарка добављача](https://x.ai/news/grok-4-7)

Пратећи графикон приказује резултат бенчмарка у односу на излазне токене, са опадањем ка десној страни. Линије пореде нивое расуђивања. [Оригинални интерактивни графикон: изаберите Tokens](https://x.ai/news/grok-4-7). [Отворите графикон у пуној величини](https://bigchange.ai/api/media/file/grok-cursorbench-user-chart.png).

![Line chart comparing Grok 4.7, Fable 5.1, Opus 5, GPT-5.6 Sol and Sonnet 5: CursorBench 4.0 score versus average output tokens per task, with fewer tokens to the right.](/api/media/file/grok-cursorbench-user-chart.png)

Кретање нагоре значи виши резултат, а удесно мање генерисаних токена у овој евалуацији. То не значи мањи укупни трошак: и даље су важни цене токена, улазна потрошња и околни агент. Ово је и другачији тест од података о токенима Artificial Analysis-а наведених изнад. Спајањем њихових бројева нестале би разлике у задацима и методологији због којих су оба резултата уопште разумљива.

То је довољно да се одбаци општа тврдња да Grok 4.7 предњачи у свакој врсти програмирања. Довољно је и да оправда пажљивије испитивање конкретних оптерећења. Величина побољшања на једној евалуацији не одређује како ће се модел снаћи са непознатим репозиторијумом, непотпуном пријавом грешке или необичним скупом алата.

Artificial Analysis пружа корисну независну разлику. У извештају се Grok 4.7 са Grok Build-ом оцењује са 56 поена на Coding Agent Index-у, у поређењу са 47 за Grok 4.6 са истим агентом. Изричито раздваја ове резултате са изворним агентом од стандардизоване поставке Intelligence Index-а. [Независна евалуација и напомене о методологији](https://artificialanalysis.ai/articles/benchmarking-grok-4-7)

Окружење агента је важно. Оно обезбеђује алате, управља контекстом и одлучује како ће се захтеви модела извршити. Промена окружења може променити резултате чак и када назив модела остане исти. Спајање резултата рада у терминалу из једне поставке са резултатима софтверског инжењеринга из друге може створити убедљиву табелу која не описује ниједан систем који је ико заиста тестирао.

Берман истиче да у једној табели лансирања недостаје GPT-6 Astra и користи реконструкцију генерисану помоћу AI-ја да би га додао. То је користан подстрек за испитивање поређења, али та реконструкција није независан извор бенчмарка. Не преузимамо додате бројке без провере изворне евалуације. [Видео, 6:03](https://www.youtube.com/watch?v=MJllZbpvrAc&t=363s)

Треба имати у виду и пословни однос. У саопштењу компаније од 14. августа Cursor наводи да га је купио SpaceX. Бенчмарк објављен унутар исте породице производа и даље је користан доказ, али није непристрасна процена конкурентског добављача. [Најава Cursor-ове аквизиције](https://cursor.com/blog/joining-spacex)

## Пословни задаци би могли бити занимљивија прилика

Независна евалуација наводи резултат од 1.657 Elo поена за Grok 4.7 на нивоу xhigh на AA-Briefcase тесту, 111 више од Grok-а 4.6 на нивоу high. Велики део побољшања приписује квалитету анализе, док је квалитет презентације незнатно слабији него код ранијег модела. [Резултати за знањем интензиван рад Artificial Analysis-а](https://artificialanalysis.ai/articles/benchmarking-grok-4-7)

Та разлика је корисна за све који наручују извештаје, табеле или презентације. Одговор може да садржи бољу анализу, а да и даље захтева уређивање или редизајн. И обратно, углачана презентација може прикрити плитко расуђивање. Процена само видљивог завршног изгледа ризикује да награди погрешно побољшање.

Оперативни тим могао би да тестира модел на редовном извештају о учинку. Корисна проба проверила би да ли користи исправан период, усклађује бројке са изворним подацима и разликује уочену промену од предложеног објашњења. Особа која га прегледа треба да забележи колико је исправки било потребно, а не само да ли је извештај на први поглед изгледао професионално.

Малом предузећу можда је мање важно да победи на најтежем бенчмарку, а више да иначе недоступну анализу учини редовним послом. То је уверљив пут ка широј примени. Постаје стварност када је резултат довољно тачан, стигне на време и власнику остави мање посла него да га уради ручно.

Ознаке професионалних бенчмарка не треба мешати са стручним квалификацијама. Резултат у правном раду или клиничком расуђивању описује учинак на тој евалуацији. Не доказује да модел може самостално да реши правни случај клијента или донесе одлуку о нези пацијента. Овај чланак не препоручује коришћење Grok-а за такве одлуке.

## И заштитне мере треба процењивати у контексту

SpaceXAI каже да Grok 4.7 има нови скуп заштитних мера и бољу отпорност на заобилажење ограничења. То је тврдња из најаве, а не гаранција да ће свака апликација која користи модел бити безбедна. [Извештај програмера о безбедности](https://x.ai/news/grok-4-7)

За пословног агента остају бар два питања. Да ли модел на одговарајући начин реагује на захтеве које добија? И да ли апликација ограничава оно што модел заиста може да уради?

Модел може тачно да разуме упутство за промену корисничког записа, а да нема дозволу да ту промену изврши. Може наићи и на злонамерна упутства у документу који је требало да сажме. Контроле приступа и правила за одобравање морају остати део околног система; боље одбијање захтева не замењује их.

Практичан закључак је да треба тестирати цео ток рада. Укључите дозвољене захтеве који треба да успеју, забрањене радње које морају бити блокиране и нејасне случајеве у којима систем треба да затражи појашњење. Производ који пречесто одбија безопасан посао може бити неупотребљив; онај који извршава неовлашћене радње може бити много гори. Ниједан проблем се не види из једне истакнуте оцене.

## Шта видео оставља неразјашњеним

Берманов прилог отвара неколико питања која за сада треба да остану питања. Његово објашњење које повезује цене са доступним рачунарским ресурсима јесте тржишно тумачење, а не објављен обрачун трошка по јединици. Предвиђања о друштвеним мрежама која помиње представљају очекивања, а не доказ испоручених могућности. У завршном поређењу демонстрација и сам признаје да не зна која су подешавања коришћена. [Разговор о ценама, 8:44](https://www.youtube.com/watch?v=MJllZbpvrAc&t=524s), [очекивања, 11:51](https://www.youtube.com/watch?v=MJllZbpvrAc&t=711s) и [разговор о демонстрацији, 15:20](https://www.youtube.com/watch?v=MJllZbpvrAc&t=920s)

У видеу се разматрају и модели са отвореним тежинама. Тај шири конкурентски тренд не треба мешати са лиценцом Grok-а 4.7: Artificial Analysis наводи да је ово издање затвореног кода и да његове тежине нису доступне. [Профил издања Grok-а 4.7](https://artificialanalysis.ai/models/releases/grok-4-7)

Ове разлике држе процену усредсређеном. Производ може бити повољно цењен, а да јавност не зна зашто је добављач одабрао ту цену. Неуспела демонстрација која привлачи пажњу може открити тест који вреди поновити, а да не докаже да је модел уопште лош. Доступан модел може бити користан иако не испуњава раније предвиђање оснивача.

Постоји и граница спонзорства. Берманов видео садржи оглас за Zapier. Он није независан доказ о учинку Grok-а, а његове промотивне тврдње нису препоруке компаније BIG CHANGE.

## Боље мерило за куповину: трошак по прихваћеном задатку

![Sketch of a task passing through model work and validation to delivery, with a retry arrow returning from validation to model work.](/api/media/file/grok-workflow-v1.png)

Тим који разматра Grok 4.7 треба да га упореди са тренутним поступком на малом, репрезентативном скупу задатака. Критеријуме прихватања треба дефинисати пре него што се виде резултати. За програмирање то могу бити релевантни тестови, прегледна измена и изостанак неповезаних промена. За анализу могу бити потребни тачни прорачуни и докази за важне тврдње.

Затим забележите цео рачун: потрошњу улазних и излазних токена, алате, поновне покушаје и време утрошено на преглед или поправку резултата. Урачунајте и неуспеле покушаје. Тај трошак поделите бројем производа рада који испуњавају критеријуме прихватања.

Илустративни пример показује зашто је та разлика важна. Претпоставимо да једна поставка кошта 20 долара за серију од 80 прихваћених резултата. Измерени трошак је 0,25 долара по прихваћеном резултату, пре људског рада. Друга кошта 12 долара, али произведе само 30 прихваћених резултата, па трошак износи 0,40 долара по прихваћеном резултату. Јефтинија серија скупљи је извор употребљивог рада. То су хипотетичке бројке, а не мерења за Grok.

Ниво расуђивања треба да буде део пробе. Виши ниво може оправдати трошак код тешког задатка, а мало допринети код рутинског. Усмеравање само случајева којима је потребан можда би било економичније од покретања сваког захтева на xhigh нивоу, под условом да се и сама одлука о усмеравању процени.

Нека стандарди прегледа буду исти за све моделе. Снижавањем критеријума за јефтинији модел привидно штедите прихватајући лошији рад. Подизање критеријума само за тренутни модел ствара супротну пристрасност. Циљ је поуздан резултат, уз јасан приказ онога што људи још морају да ураде.

## Промена коју вреди пратити

Grok 4.7 тимовима даје још једну могућност за тестирање. Избор захтева процену целог посла: шта модел произведе, шта потроши и шта неко ипак мора да поправи.

Шира последица могла би бити селективнија употреба AI-ја у свакодневном раду. Тим може изабрати једну поставку за рутинску анализу, другу за тешко програмирање, а човека за случајеве у којима се расуђивање или одговорност не могу делегирати. Већа конкуренција тиму даје још једну могућност за тестирање, али не одређује која треба да победи.

За BIG CHANGE, следећа прекретница је мерљиво обављен посао уз мање укупног труда. Ако Grok 4.7 смањи трошак прихваћених производа рада, корисна аутоматизација може постати доступна већем броју организација. Ако додатно расуђивање само премести трошак са цене токена на количину потрошених токена, истакнута цена купцима говори врло мало. Одговор ће пружити докази из завршених задатака, укључујући оне који су прво били неуспешни.

## Sources

- [Метју Берман: Не знам шта да мислим о Grok-у 4.7…](https://www.youtube.com/watch?v=MJllZbpvrAc) — 22. септембар 2026. Видео који је подстакао ову анализу. Временске ознаке воде до разматраних делова; Берман своју процену описује као прелиминарну. Део са спонзорством одвојен је од доказа о моделу.
- [Представљамо Grok 4.7](https://x.ai/news/grok-4-7) — 21. септембар 2026. Најава компаније SpaceXAI и интерактивни графикони бенчмарка. Резултате добављача треба тумачити узимајући у обзир нивое расуђивања; они нису универзална ранг-листа.
- [Белешке о издању за xAI програмере](https://docs.x.ai/developers/release-notes) — Запис од 21. септембра утврђује доступност, контекст, нивое расуђивања и стандардне цене API-ја и цене за дугачак контекст. Проверено 22. септембра; цене и приступ производу могу се променити.
- [Документација о производу Grok 4.7](https://docs.x.ai/developers/grok-4-7) — Објашњава стандардни модел и Fast ниво услуге. Fast је уже доступан од стандардног API модела, па демонстрације и буџети треба да наведу који се ниво користи.
- [Цене модела Grok 4.7](https://docs.x.ai/developers/models/grok-4.7) — Ценовник модела и праг више цене за упите који прелазе 200.000 токена. Цена токена не обухвата поновне покушаје, алате и људски преглед.
- [Cursor-ова документација о Grok-у 4.7](https://prod.cursor.com/docs/models/grok-4-7) — Разликује стандардни контекстни прозор Cursor-а од његовог максимума. Подешавања производа могу се разликовати од капацитета основног API-ја.
- [Artificial Analysis: бенчмаркинг Grok-а 4.7](https://artificialanalysis.ai/articles/benchmarking-grok-4-7) — 21. септембар 2026. Независно тестирање на којем се заснивају разматрања потрошње токена и рада са знањем. Извештај разликује стандардизовану евалуацију од резултата са изворним агентом; те поставке не треба мешати.
- [Artificial Analysis: профил издања Grok-а 4.7](https://artificialanalysis.ai/models/releases/grok-4-7) — Наводи лиценцу затвореног кода и недоступне тежине овог издања. Конкуренција модела са отвореним тежинама, поменута у видеу, не доказује да је овај модел отвореног кода.
- [Cursor је сада део SpaceX-а](https://cursor.com/blog/joining-spacex) — 14. август 2026. Cursor-ова најава аквизиције пружа контекст за процену бенчмарка објављеног у оквиру исте корпоративне породице.
