AI-translated from English; not yet reviewed by a fluent editor.

# Како одабрати GPT-6 модел за продукциони API ток рада

> Водич за избор према задацима за GPT-6 Astra, GPT-6.1 Sol и Luna, са актуелним ценама API-ја и радним листом за процену квалитета, кашњења и трошкова пре пуштања у рад.

By BIG CHANGE Editorial

Published: 2026-10-09T20:51:30.540Z
Updated: 2026-10-09T20:51:30.540Z
Canonical: https://bigchange.ai/blog/choose-gpt-6-model-production-api-workflow

![Conceptual charcoal illustration of blank task cards entering three equal, distinct channels that converge at an empty circular checkpoint.](https://bigchange.ai/api/media/file/gpt6-task-routing-hero-v3.png)
AI-generated conceptual editorial illustration by BIG CHANGE.

OpenAI је објавио [водич кроз породицу GPT-6](https://openai.com/index/practical-guide-building-gpt-6/) 2. октобра 2026. У њему су обједињени избор модела, упутства, дуготрајни задаци и провере пред пуштање у рад. Софтверски тим и даље мора да пронађе комбинацију која пролази његове провере задатака, а остаје у оквирима трошкова и времена одзива.

Тренутни избор у тој породици чине GPT-6 Astra, GPT-6.1 Sol и GPT-6 Luna. Проверили смо OpenAI-јеву API документацију и цене 3. октобра. Метод избора и радни лист у наставку су предлози; нисмо покретали моделе нити мерили продукционо оптерећење.

## Велика промена

- **Шта се променило:** OpenAI сада представља породицу GPT-6 као скуп избора за различита оптерећења, са подесивим степеном расуђивања и алатима за вишекорачни рад. Тимови могу да подесе сваки део тока рада уместо да једно подешавање модела примењују на све задатке.
- **Зашто је важно:** Тим може да измери да ли је за издвајање података потребна Luna, да ли задатак програмирања или истраживања оправдава Sol и у којим случајевима додатне могућности модела Astra оправдавају његову цену. Одговор зависи од успешно завршених задатака, кашњења и укупног трошка тока рада, укључујући употребу алата и неуспеле покушаје.
- **Шта треба пратити:** Дуги токови рада захтевају јасно дефинисане предаје и провере. Током извршавања могу да се измене упутства, док асинхрони резултати алата и делегирани задаци и даље морају да се ускладе пре него што се прихвати коначан одговор.

## Изаберите модел према задатку, па измерите цео ток рада

Почните с репрезентативним скупом стварних задатака и критеријумом прихватања за сваки од њих. OpenAI препоручује [Responses API](https://developers.openai.com/api/docs/guides/deployment-checklist) за рад са актуелним понашањем модела, позивањем алата и стањем разговора. Потребни су API пројекат, акредитиви, приступ наплати и модел доступан том пројекту. На страницама модела није наведена подршка за бесплатни ниво; ограничења брзине зависе од нивоа коришћења. Пре планирања увођења проверите стварни приступ налогу и његова ограничења.

| Задатак који се додељује моделу | Почетни кандидат | Почетни степен | Када унапредити или променити |
| --- | --- | --- | --- |
| Поновљено издвајање података, класификација или структурирани сажетак са јасним одговором | `gpt-6-luna` | Low за рутински рад; упоредите са подразумеваним Medium | Стопа грешака или време провере прелазе праг тима |
| Програмирање, истраживање, употреба алата или корак који захтева стручну процену | `gpt-6.1-sol` | Подразумевано Medium; за захтевне случајеве тестирајте High | Репрезентативни задаци не успевају ни уз добре улазне податке и упутства |
| Најзахтевнији корак расуђивања или провере, где је квалитет пресудан | `gpt-6-astra` | Упоредите Medium и High на истим случајевима | Задржите га само ако измерено побољшање оправдава додатне трошкове и време |

Табела претвара OpenAI-јеве [смернице за моделе](https://openai.com/index/practical-guide-building-gpt-6/) и [странице модела](https://developers.openai.com/api/docs/models/compare) у полазне тачке за процену. Проверите ID-ове модела за API и подржане степене расуђивања: Astra и GPT-6.1 Sol подржавају опсег од Low до Max; Luna подржава и None. GPT-6.1 Sol не подржава None ни Minimal. OpenAI препоручује да се, ако High није довољан, испробају Extra High или Max тамо где су доступни. Упоређујте степене на истом скупу задатака јер се квалитет, трајање и број токена могу мењати истовремено.

За Standard обраду и упите са највише 272.000 улазних токена, тренутне цене текстуалних токена на милион су:

| Модел | Улаз | Кеширани улаз | Упис у кеш | Излаз |
| --- | --- | --- | --- | --- |
| GPT-6 Luna | $0.10 | $0.01 | $0.125 | $0.50 |
| GPT-6.1 Sol | $2.00 | $0.10 | $2.50 | $10.00 |
| GPT-6 Astra | $10.00 | $1.00 | $12.50 | $50.00 |

Извори: странице модела за [Luna](https://developers.openai.com/api/docs/models/gpt-6-luna), [GPT-6.1 Sol](https://developers.openai.com/api/docs/models/gpt-6.1-sol) и [Astra](https://developers.openai.com/api/docs/models/gpt-6-astra). За захтев са више од 272.000 улазних токена примењују се више цене на цео захтев. Други начини обраде, регионална обрада где је доступна и поједини алати мењају износ рачуна. На све три странице наведени су контекстни прозор од 1.050.000 токена и максимално 128.000 излазних токена; велики контекстни прозор је ограничење капацитета, а не разлог да се пошаље сваки доступан документ.

Процените трошак целог пута задатка: улаз, кеширани улаз, уписе у кеш, излаз, накнаде за алате, поновне покушаје и евентуално повећање цене за дугачак контекст. Поделите укупан износ бројем задатака прихваћених по истом критеријуму провере. Затим упоредите кашњење на кораку видљивом кориснику и у целом току рада. Саме цене по јединици не показују који је пут најјефтинији по успешном резултату.

## Пре додавања алата одредите задатак и формат излаза

За сваки корак јасно наведите улаз, намењеног читаоца или следећег корисника резултата, дозвољене изворе и алате, ограничења и услов за завршетак. OpenAI-јев водич такође препоручује да тимови наведу које одлуке модел може да доноси, а за које је потребно одобрење особе. Ускладите упутства за пројекат, вештине и упите о тим границама.

За машински читљив излаз унапред дефинишите поља и дозвољене вредности, а затим користите водич за [Structured Outputs](https://developers.openai.com/api/docs/guides/structured-outputs) када задатку одговара шема. Ваљана структура је само једна провера: поље може да прати шему, а да и даље садржи чињеничну грешку. Ако резултат предајете особи, захтевајте и сам резултат, употребљене доказе, обављене провере и нерешене ставке. Упоредите га са изворним улазима и критеријумом прихватања тима.

При процени [кеширања упита](https://developers.openai.com/api/docs/guides/prompt-caching) поставите стабилна упутства и заједнички референтни материјал пре делова који се мењају од задатка до задатка. Поновна употреба може да смањи трошак улазних токена, али у процену треба урачунати уписе у кеш и каснији контекст. [Ранији водич BIG CHANGE-а о кеширању упита](https://bigchange.ai/blog/gpt-6-prompt-caching-agent-context-costs) детаљно описује дијагностику кеша.

## Омогућите увид у дуготрајне задатке

Водич од [2. октобра](https://openai.com/index/practical-guide-building-gpt-6/) описује усмеравање током извршавања, асинхроне позиве алата и паралелне подагенте за независан рад. Исправка послата преко Responses WebSocket API-ја ставља се у ред; не поништава већ обављене радње нити зауставља алат који већ ради. Асинхрони алат омогућава наставак неповезаног посла, али зависни задаци морају да сачекају његов резултат. Подршка за више агената у GPT-6.1 Sol преко Responses API-ја тренутно је у бета фази.

За вишекорачни рад сачувајте ID задатка, изабрани модел и степен расуђивања, тренутну фазу, ID-ове позива алата и резултата, одобрења и доказе који поткрепљују коначан одговор. Унапред одлучите шта се дешава након истека времена, неуспелог позива алата, измене упутства или дуплираног резултата. Када контекст нарасте, [компакција](https://developers.openai.com/api/docs/guides/compaction) може да смањи количину претходног садржаја; проверите шта настављени процес заиста памти. OpenAI-јев [режим рада у позадини](https://developers.openai.com/api/docs/guides/background) је још једна документована опција за задатке који трају дуже од једног захтева. Изаберите ове контроле према трајању посла и потребама за опоравак.

OpenAI-јев водич препоручује директан API или повезани алат када они могу да обаве корак, а интеракцију преко екрана када је неопходна. BIG CHANGE-ов водич за [задатке у прегледачу преко Agents API-ја](https://bigchange.ai/blog/openai-agents-api-computer-use-browser-guide) описује интерфејс за управљање рачунаром и поступак надзора.

## Радни лист за одлуку коју тим може да понови

За сваког кандидата користите исте случајеве и исто правило провере. Овај радни лист је предложени метод процене; BIG CHANGE није унео нити тестирао резултате.

| За сваки случај и кандидата забележите | Ставка за евиденцију |
| --- | --- |
| Задатак и очекивани резултат | Стварни ID улаза, захтеви за излаз, дозвољени алати, критеријум прихватања |
| Конфигурација | ID модела за API, степен расуђивања, начин обраде, верзија упита, шема или уговор о излазу |
| Исход | Прихваћено, одбијено или захтева проверу; разлог неуспеха; ко је проверио |
| Време | Трајање од почетка до краја и трајање корака видљивог кориснику |
| Потрошња и трошак | Улазни, кеширани улазни, токени за упис у кеш и излазни токени; накнаде за алате; поновни покушаји; повећање трошкова за дугачак контекст или регионалну обраду |
| Одлука | Прихваћени задаци подељени бројем покушаја; укупан трошак подељен бројем прихваћених задатака; нерешене врсте грешака |

Укључите лаке и тешке случајеве, неисправне улазе и прекинуте кораке алата до којих долази у стварном току рада. Држите случајеве непромењеним при поређењу модела, а затим поновите процену након измене упита или дозвола за алате. Разврстајте грешке: недостају докази, погрешно поље, грешка алата, пропуштено упутство или одговор који захтева људску исправку. Пребаците корак на други модел тек када исто правило прихватања покаже корисно побољшање. Јефтинији модел који захтева више дораде може да кошта више по прихваћеном задатку; спорији модел може да буде прихватљив у позадинском кораку, али непогодан за интерактивну употребу.

Пре пуштања у рад проверите стварна ограничења брзине и потрошње пројекта, контроле података, истеке времена, поновне покушаје, надзор и границе људског одобравања у односу на OpenAI-јеву [контролну листу за пуштање у рад](https://developers.openai.com/api/docs/guides/deployment-checklist). Након пуштања задржите проверу узорка и поновите радни лист када се промени назив модела, упит, алат или оптерећење. На основу података о задацима донесите одлуку о усмеравању.

## Извори и додатна литература

- [OpenAI-јев водич за породицу GPT-6 од 2. октобра](https://openai.com/index/practical-guide-building-gpt-6/) излаже препоруке произвођача за моделе, степен расуђивања, упутства и дуготрајне токове рада. Не садржи резултате тестирања BIG CHANGE-а нити препоруку најбољег модела за оптерећење конкретног тима.
- [GPT-6 Luna](https://developers.openai.com/api/docs/models/gpt-6-luna), [GPT-6.1 Sol](https://developers.openai.com/api/docs/models/gpt-6.1-sol) и [GPT-6 Astra](https://developers.openai.com/api/docs/models/gpt-6-astra) документују ID-ове за API, подржане степене расуђивања, контекст, цене и ограничења по нивоу коришћења наведене у овом тексту. И даље треба проверити приступ налогу и наплату.
- [OpenAI-јева контролна листа за пуштање API-ја у рад](https://developers.openai.com/api/docs/guides/deployment-checklist) подржава препоруку да се процене репрезентативни задаци, подеси Responses API и планирају продукционе контроле. Радни лист изнад је предложени метод BIG CHANGE-а, а не поређење модела произвођача.
- [Structured Outputs](https://developers.openai.com/api/docs/guides/structured-outputs), [компакција](https://developers.openai.com/api/docs/guides/compaction) и [режим рада у позадини](https://developers.openai.com/api/docs/guides/background) објашњавају конкретне интерфејсе поменуте у току рада.

## Sources

- [Водич кроз породицу модела GPT-6](https://openai.com/index/practical-guide-building-gpt-6/) — Примарни водич произвођача о улогама модела, степену расуђивања, обликовању упутстава и излаза, кеширању, усмеравању, асинхроним позивима и бета подршци за више агената. Његове препоруке не доказују успешност нити трошак на локалним задацима.
- [Документација за модел GPT-6 Astra](https://developers.openai.com/api/docs/models/gpt-6-astra) — Званични ID модела, подржани степен расуђивања, контекст и максимални излаз, модалитети, Standard цене токена, граница цене за дугачак контекст и ограничења по нивоу коришћења. Цене се могу променити.
- [Документација за модел GPT-6.1 Sol](https://developers.openai.com/api/docs/models/gpt-6.1-sol) — Потврђује актуелни ID модела GPT-6.1 Sol, подразумеване и подржане нивое расуђивања, позивање алата преко Responses API-ја, контекст, излаз, цене, регионалне услове и услове за дугачак контекст, као и ограничења по нивоу коришћења.
- [Документација за модел GPT-6 Luna](https://developers.openai.com/api/docs/models/gpt-6-luna) — Потврђује намену модела за усмерене задатке, опсег степена расуђивања од None до Max, подршку за алате у Responses API-ју, ограничења контекста и излаза, Standard цене и ограничења по нивоу коришћења.
- [Контролна листа за пуштање API-ја у рад](https://developers.openai.com/api/docs/guides/deployment-checklist) — OpenAI-јеве продукционе препоруке за Responses, избор модела и степена расуђивања, репрезентативне процене, контроле алата и контекста, поузданост и надзор. Не потврђује ваљаност предложеног радног листа.
- [Структурирани излази модела](https://developers.openai.com/api/docs/guides/structured-outputs) — Званични интерфејс за шеме излаза. Усклађена структура не доказује чињеничну тачност; у тексту се зато захтева посебна провера.
- [Кеширање упита](https://developers.openai.com/api/docs/guides/prompt-caching) — Званичне информације о понашању кеша и смерницама за стабилан почетак упита, овде поменуте укратко. Ранији текст BIG CHANGE-а бр. 29 детаљно обрађује дијагностику кеша.
- [Компакција](https://developers.openai.com/api/docs/guides/compaction) — Званични механизам за смањивање контекста дугог разговора; у тексту се саветује провера задржаног стања уместо претпоставке да је све сачувано.
- [Режим рада у позадини](https://developers.openai.com/api/docs/guides/background) — Описује режим Responses API-ја за дуготрајне задатке; овде је наведен само као доступна опција за континуитет рада.
