SVET NE STOJI U MESTU.RSS
BIG CHANGE.

Markdown izdanje

AI-translated from English; not yet reviewed by a fluent editor.

# Izaberite GPT-6 model za produkcioni API proces

> Vodič zasnovan na zadacima za GPT-6 Astra, GPT-6.1 Sol i Luna, sa aktuelnim cenama API-ja i radnim listom za procenu kvaliteta, kašnjenja i troškova pre puštanja u rad.

By BIG CHANGE Editorial

Published: 2026-10-09T20:51:30.540Z
Updated: 2026-10-09T20:51:30.540Z
Canonical: https://bigchange.ai/blog/choose-gpt-6-model-production-api-workflow

![Conceptual charcoal illustration of blank task cards entering three equal, distinct channels that converge at an empty circular checkpoint.](https://bigchange.ai/api/media/file/gpt6-task-routing-hero-v3.png)
AI-generated conceptual editorial illustration by BIG CHANGE.

OpenAI je objavio [vodič kroz porodicu GPT-6 modela](https://openai.com/index/practical-guide-building-gpt-6/) 2. oktobra 2026. U njemu objedinjuje izbor modela, uputstva, dugotrajne zadatke i provere za primenu. Softverski tim i dalje mora da pronađe kombinaciju koja prolazi njegove provere zadataka u okviru ograničenja troškova i vremena odziva.

Aktuelni izbori u toj porodici, prema vodiču, jesu GPT-6 Astra, GPT-6.1 Sol i GPT-6 Luna. OpenAI-jevu API dokumentaciju i cene proverili smo 3. oktobra. Metod izbora i radni list u nastavku su predlozi; nismo pokretali modele niti merili produkciono opterećenje.

## Suštinska promena

- **Šta se promenilo:** OpenAI sada predstavlja porodicu GPT-6 kao skup modela za različita radna opterećenja, sa prilagodljivim nivoom rezonovanja i alatima za višekoračne zadatke. Timovi mogu da podese svaki deo procesa umesto da jednim podešavanjem modela pokrivaju sve zadatke.
- **Zašto je to važno:** Tim može da izmeri da li je za izdvajanje podataka dovoljan Luna, da li zadatak programiranja ili istraživanja opravdava Sol i za koje zadatke dodatne mogućnosti Astre opravdavaju njenu cenu. Odgovor zavisi od završenih zadataka, kašnjenja i ukupnog troška procesa, uključujući korišćenje alata i neuspele pokušaje.
- **Na šta treba obratiti pažnju:** Dugotrajni zadaci zahtevaju jasne predaje i provere. Usmeravanje tokom izvršavanja može da ažurira uputstva, ali asinhrone rezultate alata i delegirani rad ipak treba uskladiti pre prihvatanja konačnog odgovora.

## Izaberite model prema zadatku, a zatim merite ceo proces

Počnite reprezentativnim skupom stvarnih zadataka i kriterijumom prihvatanja za svaki od njih. OpenAI preporučuje [Responses API](https://developers.openai.com/api/docs/guides/deployment-checklist) za aktuelno ponašanje modela, pozivanje alata i rad sa stanjem. Potrebni su API projekat, akreditivi, pristup naplati i model dostupan tom projektu. Stranice modela ne navode podršku za besplatan nivo; ograničenja učestalosti zahteva zavise od nivoa korišćenja. Pre planiranja primene proverite stvarni pristup i ograničenja naloga.

| Zadatak koji se dodeljuje modelu | Početni kandidat | Početni nivo napora | Kada unaprediti ili promeniti |
| --- | --- | --- | --- |
| Ponavljano izdvajanje, klasifikacija ili strukturirani sažetak sa jasnim odgovorom | `gpt-6-luna` | Low za rutinske zadatke; uporedite sa podrazumevanim nivoom Medium | Stopa grešaka ili vreme pregleda prelaze prag tima |
| Programiranje, istraživanje, korišćenje alata ili korak koji zahteva stručnu procenu | `gpt-6.1-sol` | Podrazumevani Medium; testirajte High u teškim slučajevima | Reprezentativni zadaci ne uspevaju ni uz dobre ulazne podatke i uputstva |
| Najzahtevniji korak rezonovanja ili pregleda, u kome je kvalitet presudan | `gpt-6-astra` | Poredite Medium i High na istim slučajevima | Zadržite ga samo kada izmereno poboljšanje opravdava dodatni trošak i vreme |

Ova tabela pretvara OpenAI-jeve [preporuke za modele](https://openai.com/index/practical-guide-building-gpt-6/) i [stranice modela](https://developers.openai.com/api/docs/models/compare) u polazne tačke za procenu. Proverite ID-jeve modela za API i podržane nivoe napora: Astra i GPT-6.1 Sol podržavaju nivoe od Low do Max; Luna podržava i None. GPT-6.1 Sol ne podržava None i Minimal. OpenAI preporučuje da, ako High nije dovoljan, isprobate Extra High ili Max tamo gde su podržani. Uporedite nivoe napora na istom skupu zadataka jer se kvalitet, trajanje i broj tokena mogu menjati zajedno.

Za standardnu obradu i upite sa najviše 272.000 ulaznih tokena, aktuelne cene teksta po milionu tokena iznose:

| Model | Ulaz | Keširani ulaz | Upis u keš | Izlaz |
| --- | --- | --- | --- | --- |
| GPT-6 Luna | 0,10 USD | 0,01 USD | 0,125 USD | 0,50 USD |
| GPT-6.1 Sol | 2,00 USD | 0,10 USD | 2,50 USD | 10,00 USD |
| GPT-6 Astra | 10,00 USD | 1,00 USD | 12,50 USD | 50,00 USD |

Izvori: stranice modela [Luna](https://developers.openai.com/api/docs/models/gpt-6-luna), [GPT-6.1 Sol](https://developers.openai.com/api/docs/models/gpt-6.1-sol) i [Astra](https://developers.openai.com/api/docs/models/gpt-6-astra). Zahtev sa više od 272.000 ulaznih tokena naplaćuje se po višim cenama za ceo zahtev. Drugi režimi obrade, obrada u regionu gde je dostupna i neki alati menjaju račun. Sve tri stranice navode kontekst od 1.050.000 tokena i najveći izlaz od 128.000 tokena; veliki kontekst je ograničenje kapaciteta, a ne razlog da se pošalje svaki dostupan dokument.

Procenite trošak celog toka rada: ulazne, keširane ulazne i izlazne tokene, upise u keš, naknade za alate, ponovne pokušaje i doplatu za dugačak kontekst. Taj zbir podelite brojem zadataka prihvaćenih prema istom pravilu pregleda. Zatim uporedite kašnjenje u koraku koji vidi korisnik i u celom procesu. Same jedinične cene ne govore timu koji je postupak najjeftiniji po uspešnom rezultatu.

## Pre dodavanja alata precizirajte zadatak i izlaz

Za svaki korak navedite jasan ulaz, predviđenog čitaoca ili narednog korisnika rezultata, dozvoljene izvore i alate, ograničenja i uslov završetka. OpenAI-jev vodič savetuje timovima i da navedu koje odluke model može da donosi, a za koje je potrebno odobrenje osobe. Uputstva za projekat, veštine i promptovi treba da budu usklađeni u pogledu tih granica.

Za mašinski čitljiv izlaz unapred definišite polja i dozvoljene vrednosti, a zatim koristite vodič [Strukturirani izlazi](https://developers.openai.com/api/docs/guides/structured-outputs) kada zadatku odgovara šema. Smatrajte ispravnu strukturu jednom od provera: polje može da odgovara šemi, a ipak da sadrži netačne činjenice. Ako rezultat predaje čoveku, zahtevajte rezultat, korišćene dokaze, izvršene provere i nerešena pitanja. Uporedite ga sa izvornim ulazima i kriterijumom prihvatanja tima.

Pri proceni [keširanja promptova](https://developers.openai.com/api/docs/guides/prompt-caching) stabilna uputstva i zajedničke referentne materijale postavite pre promenljivih detalja zadatka. Ponovno korišćenje može da smanji trošak ulaza koji se ponavlja, ali procena treba da obuhvati upise u keš i kasniji kontekst. BIG CHANGE-ov [raniji vodič za keširanje promptova](https://bigchange.ai/blog/gpt-6-prompt-caching-agent-context-costs) detaljno obrađuje dijagnostiku keša.

## Obezbedite uvid u dugotrajne zadatke

Vodič od [2. oktobra](https://openai.com/index/practical-guide-building-gpt-6/) opisuje usmeravanje tokom izvršavanja, asinhrone pozive alata i paralelne podagente za nezavisan rad. Ispravka poslata kroz Responses WebSocket API stavlja se u red; ne poništava završene radnje niti zaustavlja alat koji već radi. Asinhroni alat omogućava nastavak nepovezanog rada, ali koraci koji zavise od rezultata moraju da sačekaju. Podrška za više agenata u Responses API-ju za GPT-6.1 Sol trenutno je u beta fazi.

Za višekoračno izvršavanje sačuvajte ID zadatka, izabrani model i nivo napora, trenutnu fazu, ID-jeve poziva alata i njihovih rezultata, odobrenja i dokaze na kojima se zasniva konačan odgovor. Unapred odlučite šta se dešava posle isteka vremena, neuspelog poziva alata, izmenjenog uputstva ili dupliranog rezultata. Kada kontekst poraste, [sažimanje konteksta](https://developers.openai.com/api/docs/guides/compaction) može da smanji količinu informacija koje se prenose dalje; proverite šta je zaista sačuvano u nastavku rada. OpenAI-jev [pozadinski režim](https://developers.openai.com/api/docs/guides/background) još je jedna dokumentovana mogućnost za zadatke koji traju duže od jednog zahteva. Izaberite kontrole prema trajanju posla i potrebama za oporavak.

OpenAI-jev vodič preporučuje direktni API ili povezani alat kada oni mogu da obave korak, a interakciju sa ekranom kada je neophodna. BIG CHANGE-ov vodič za [zadatke sa pregledačem u Agents API-ju](https://bigchange.ai/blog/openai-agents-api-computer-use-browser-guide) objašnjava interfejs za korišćenje računara i nadzor.

## Radni list za odluku koju tim može da ponovi

Koristite iste slučajeve i ista pravila pregleda za svakog kandidata. Ovaj radni list je predloženi metod procene; BIG CHANGE nije uneo niti testirao rezultate.

| Zabeležiti za svaki slučaj i kandidata | Stavka koju treba zabeležiti |
| --- | --- |
| Zadatak i očekivani rezultat | ID stvarnog ulaza, zahtevi za izlaz, dozvoljeni alati, kriterijum prihvatanja |
| Konfiguracija | ID modela za API, nivo napora, režim obrade, verzija prompta, šema ili ugovor o izlazu |
| Ishod | Prihvaćeno, odbijeno ili zahteva pregled; razlog neuspeha; recenzent |
| Vreme | Trajanje celog procesa i trajanje koraka koji vidi korisnik |
| Korišćenje i naplata | Ulazni tokeni, keširani ulazni tokeni, tokeni za upis u keš i izlazni tokeni; naknade za alate; ponovni pokušaji; doplate za dugačak kontekst ili obradu u regionu |
| Odluka | Prihvaćeni zadaci podeljeni brojem pokušanih zadataka; ukupan trošak podeljen brojem prihvaćenih zadataka; nerešeni tipovi grešaka |

Uključite lake i teške slučajeve, neispravne ulaze i prekide rada alata koji se javljaju u stvarnom procesu. Poredite modele na nepromenjenom skupu slučajeva, a zatim ponovite procenu posle izmene promptova ili dozvola za alate. Razvrstajte neuspehe po tipu: nedostaju dokazi, pogrešno polje, greška alata, propušteno uputstvo ili odgovor koji čovek mora da ispravi. Prebacite korak na drugi model tek kada ista pravila prihvatanja pokažu korisno poboljšanje. Jeftiniji model uz više dorade može da bude skuplji po prihvaćenom zadatku; sporiji model može da odgovara pozadinskom koraku, ali ne i interaktivnom.

Pre objavljivanja proverite stvarna ograničenja cena i potrošnje, kontrole podataka, vremenska ograničenja, ponovne pokušaje, nadzor i granice ljudskog odobravanja u odnosu na OpenAI-jevu [kontrolnu listu za produkciju](https://developers.openai.com/api/docs/guides/deployment-checklist). Posle objavljivanja zadržite uzorkovani pregled i ponovite procenu kada se promene alias modela, prompt, alat ili radno opterećenje. Odluku o usmeravanju zasnujte na prikupljenim podacima o zadacima.

## Izvori i dodatna literatura

- [OpenAI-jev vodič za porodicu GPT-6 od 2. oktobra](https://openai.com/index/practical-guide-building-gpt-6/) iznosi preporuke dobavljača za modele, nivoe napora, uputstva i dugotrajne tokove rada. Ne sadrži rezultate testiranja BIG CHANGE-a niti određuje najbolji model za radno opterećenje konkretnog tima.
- [Dokumentacija modela GPT-6 Luna](https://developers.openai.com/api/docs/models/gpt-6-luna), [Dokumentacija modela GPT-6.1 Sol](https://developers.openai.com/api/docs/models/gpt-6.1-sol) i [Dokumentacija modela GPT-6 Astra](https://developers.openai.com/api/docs/models/gpt-6-astra) navode ID-jeve API-ja, podržane nivoe napora, kontekst, cene i stepenasta ograničenja korišćena u tekstu. I dalje treba proveriti pristup i naplatu konkretnog naloga.
- [OpenAI-jeva kontrolna lista za primenu API-ja](https://developers.openai.com/api/docs/guides/deployment-checklist) podržava preporuke za procenu reprezentativnih zadataka, podešavanje Responses API-ja i planiranje produkcionih kontrola. Radni list iznad je predloženi metod BIG CHANGE-a, a ne rezultat dobavljačkog benchmarka.
- [Strukturirani izlazi](https://developers.openai.com/api/docs/guides/structured-outputs), [sažimanje konteksta](https://developers.openai.com/api/docs/guides/compaction) i [pozadinski režim](https://developers.openai.com/api/docs/guides/background) objašnjavaju konkretne interfejse pomenute u toku rada.

## Sources

- [Vodič za porodicu modela GPT-6](https://openai.com/index/practical-guide-building-gpt-6/) — Primarni vodič dobavljača za uloge modela, nivoe rezonovanja, oblikovanje uputstava i izlaza, keširanje, usmeravanje, asinhrone pozive i beta podršku za više agenata. Njegove preporuke ne utvrđuju uspešnost zadataka niti troškove u konkretnom okruženju.
- [Dokumentacija modela GPT-6 Astra](https://developers.openai.com/api/docs/models/gpt-6-astra) — Zvanični ID modela, podržani nivo napora, kontekst i maksimalni izlaz, modaliteti, standardne cene tokena, granica za višu cenu dugog konteksta i ograničenja nivoa korišćenja. Cene se mogu menjati.
- [Dokumentacija modela GPT-6.1 Sol](https://developers.openai.com/api/docs/models/gpt-6.1-sol) — Potvrđuje aktuelni ID modela 6.1 Sol, podrazumevane i podržane nivoe rezonovanja, pozivanje alata u Responses API-ju, kontekst, izlaz, cene, regionalne i dugokontekstne uslove i stepenasta ograničenja.
- [Dokumentacija modela GPT-6 Luna](https://developers.openai.com/api/docs/models/gpt-6-luna) — Potvrđuje da je namenjen fokusiranim zadacima, podržava nivoe napora od None do Max, alate u Responses API-ju, ograničenja konteksta i izlaza, standardne cene i ograničenja prema nivou korišćenja.
- [Kontrolna lista za primenu API-ja](https://developers.openai.com/api/docs/guides/deployment-checklist) — OpenAI-jeve preporuke za produkciju: Responses, izbor modela i napora, reprezentativne procene, kontrole alata i konteksta, pouzdanost i nadzor. Ne potvrđuju predloženi radni list.
- [Strukturirani izlazi modela](https://developers.openai.com/api/docs/guides/structured-outputs) — Zvanični interfejs za šeme izlaza. Usklađenost strukture ne potvrđuje činjeničnu tačnost; članak predlaže odvojenu proveru.
- [Keširanje promptova](https://developers.openai.com/api/docs/guides/prompt-caching) — Zvanične smernice o ponašanju keša i stabilnim prefiksima, ovde ukratko pomenute. BIG CHANGE-ov raniji članak broj 29 detaljno obrađuje dijagnostiku keša.
- [Sažimanje konteksta](https://developers.openai.com/api/docs/guides/compaction) — Zvanični mehanizam za smanjenje konteksta dugih razgovora; članak preporučuje proveru zadržanog stanja umesto pretpostavke da je sve savršeno sačuvano.
- [Pozadinski režim](https://developers.openai.com/api/docs/guides/background) — Dokumentuje dugotrajni režim u Responses API-ju; naveden je samo kao dostupna mogućnost za nastavak rada.