OpenAI je objavio vodič kroz porodicu GPT-6 modela 2. oktobra 2026. U njemu objedinjuje izbor modela, uputstva, dugotrajne zadatke i provere za primenu. Softverski tim i dalje mora da pronađe kombinaciju koja prolazi njegove provere zadataka u okviru ograničenja troškova i vremena odziva.

Aktuelni izbori u toj porodici, prema vodiču, jesu GPT-6 Astra, GPT-6.1 Sol i GPT-6 Luna. OpenAI-jevu API dokumentaciju i cene proverili smo 3. oktobra. Metod izbora i radni list u nastavku su predlozi; nismo pokretali modele niti merili produkciono opterećenje.

Suštinska promena

  • Šta se promenilo: OpenAI sada predstavlja porodicu GPT-6 kao skup modela za različita radna opterećenja, sa prilagodljivim nivoom rezonovanja i alatima za višekoračne zadatke. Timovi mogu da podese svaki deo procesa umesto da jednim podešavanjem modela pokrivaju sve zadatke.
  • Zašto je to važno: Tim može da izmeri da li je za izdvajanje podataka dovoljan Luna, da li zadatak programiranja ili istraživanja opravdava Sol i za koje zadatke dodatne mogućnosti Astre opravdavaju njenu cenu. Odgovor zavisi od završenih zadataka, kašnjenja i ukupnog troška procesa, uključujući korišćenje alata i neuspele pokušaje.
  • Na šta treba obratiti pažnju: Dugotrajni zadaci zahtevaju jasne predaje i provere. Usmeravanje tokom izvršavanja može da ažurira uputstva, ali asinhrone rezultate alata i delegirani rad ipak treba uskladiti pre prihvatanja konačnog odgovora.

Izaberite model prema zadatku, a zatim merite ceo proces

Počnite reprezentativnim skupom stvarnih zadataka i kriterijumom prihvatanja za svaki od njih. OpenAI preporučuje Responses API za aktuelno ponašanje modela, pozivanje alata i rad sa stanjem. Potrebni su API projekat, akreditivi, pristup naplati i model dostupan tom projektu. Stranice modela ne navode podršku za besplatan nivo; ograničenja učestalosti zahteva zavise od nivoa korišćenja. Pre planiranja primene proverite stvarni pristup i ograničenja naloga.

Zadatak koji se dodeljuje modelu

Početni kandidat

Početni nivo napora

Kada unaprediti ili promeniti

Ponavljano izdvajanje, klasifikacija ili strukturirani sažetak sa jasnim odgovorom

gpt-6-luna

Low za rutinske zadatke; uporedite sa podrazumevanim nivoom Medium

Stopa grešaka ili vreme pregleda prelaze prag tima

Programiranje, istraživanje, korišćenje alata ili korak koji zahteva stručnu procenu

gpt-6.1-sol

Podrazumevani Medium; testirajte High u teškim slučajevima

Reprezentativni zadaci ne uspevaju ni uz dobre ulazne podatke i uputstva

Najzahtevniji korak rezonovanja ili pregleda, u kome je kvalitet presudan

gpt-6-astra

Poredite Medium i High na istim slučajevima

Zadržite ga samo kada izmereno poboljšanje opravdava dodatni trošak i vreme

Ova tabela pretvara OpenAI-jeve preporuke za modele i stranice modela u polazne tačke za procenu. Proverite ID-jeve modela za API i podržane nivoe napora: Astra i GPT-6.1 Sol podržavaju nivoe od Low do Max; Luna podržava i None. GPT-6.1 Sol ne podržava None i Minimal. OpenAI preporučuje da, ako High nije dovoljan, isprobate Extra High ili Max tamo gde su podržani. Uporedite nivoe napora na istom skupu zadataka jer se kvalitet, trajanje i broj tokena mogu menjati zajedno.

Za standardnu obradu i upite sa najviše 272.000 ulaznih tokena, aktuelne cene teksta po milionu tokena iznose:

Model

Ulaz

Keširani ulaz

Upis u keš

Izlaz

GPT-6 Luna

0,10 USD

0,01 USD

0,125 USD

0,50 USD

GPT-6.1 Sol

2,00 USD

0,10 USD

2,50 USD

10,00 USD

GPT-6 Astra

10,00 USD

1,00 USD

12,50 USD

50,00 USD

Izvori: stranice modela Luna, GPT-6.1 Sol i Astra. Zahtev sa više od 272.000 ulaznih tokena naplaćuje se po višim cenama za ceo zahtev. Drugi režimi obrade, obrada u regionu gde je dostupna i neki alati menjaju račun. Sve tri stranice navode kontekst od 1.050.000 tokena i najveći izlaz od 128.000 tokena; veliki kontekst je ograničenje kapaciteta, a ne razlog da se pošalje svaki dostupan dokument.

Procenite trošak celog toka rada: ulazne, keširane ulazne i izlazne tokene, upise u keš, naknade za alate, ponovne pokušaje i doplatu za dugačak kontekst. Taj zbir podelite brojem zadataka prihvaćenih prema istom pravilu pregleda. Zatim uporedite kašnjenje u koraku koji vidi korisnik i u celom procesu. Same jedinične cene ne govore timu koji je postupak najjeftiniji po uspešnom rezultatu.

Pre dodavanja alata precizirajte zadatak i izlaz

Za svaki korak navedite jasan ulaz, predviđenog čitaoca ili narednog korisnika rezultata, dozvoljene izvore i alate, ograničenja i uslov završetka. OpenAI-jev vodič savetuje timovima i da navedu koje odluke model može da donosi, a za koje je potrebno odobrenje osobe. Uputstva za projekat, veštine i promptovi treba da budu usklađeni u pogledu tih granica.

Za mašinski čitljiv izlaz unapred definišite polja i dozvoljene vrednosti, a zatim koristite vodič Strukturirani izlazi kada zadatku odgovara šema. Smatrajte ispravnu strukturu jednom od provera: polje može da odgovara šemi, a ipak da sadrži netačne činjenice. Ako rezultat predaje čoveku, zahtevajte rezultat, korišćene dokaze, izvršene provere i nerešena pitanja. Uporedite ga sa izvornim ulazima i kriterijumom prihvatanja tima.

Pri proceni keširanja promptova stabilna uputstva i zajedničke referentne materijale postavite pre promenljivih detalja zadatka. Ponovno korišćenje može da smanji trošak ulaza koji se ponavlja, ali procena treba da obuhvati upise u keš i kasniji kontekst. BIG CHANGE-ov raniji vodič za keširanje promptova detaljno obrađuje dijagnostiku keša.

Obezbedite uvid u dugotrajne zadatke

Vodič od 2. oktobra opisuje usmeravanje tokom izvršavanja, asinhrone pozive alata i paralelne podagente za nezavisan rad. Ispravka poslata kroz Responses WebSocket API stavlja se u red; ne poništava završene radnje niti zaustavlja alat koji već radi. Asinhroni alat omogućava nastavak nepovezanog rada, ali koraci koji zavise od rezultata moraju da sačekaju. Podrška za više agenata u Responses API-ju za GPT-6.1 Sol trenutno je u beta fazi.

Za višekoračno izvršavanje sačuvajte ID zadatka, izabrani model i nivo napora, trenutnu fazu, ID-jeve poziva alata i njihovih rezultata, odobrenja i dokaze na kojima se zasniva konačan odgovor. Unapred odlučite šta se dešava posle isteka vremena, neuspelog poziva alata, izmenjenog uputstva ili dupliranog rezultata. Kada kontekst poraste, sažimanje konteksta može da smanji količinu informacija koje se prenose dalje; proverite šta je zaista sačuvano u nastavku rada. OpenAI-jev pozadinski režim još je jedna dokumentovana mogućnost za zadatke koji traju duže od jednog zahteva. Izaberite kontrole prema trajanju posla i potrebama za oporavak.

OpenAI-jev vodič preporučuje direktni API ili povezani alat kada oni mogu da obave korak, a interakciju sa ekranom kada je neophodna. BIG CHANGE-ov vodič za zadatke sa pregledačem u Agents API-ju objašnjava interfejs za korišćenje računara i nadzor.

Radni list za odluku koju tim može da ponovi

Koristite iste slučajeve i ista pravila pregleda za svakog kandidata. Ovaj radni list je predloženi metod procene; BIG CHANGE nije uneo niti testirao rezultate.

Zabeležiti za svaki slučaj i kandidata

Stavka koju treba zabeležiti

Zadatak i očekivani rezultat

ID stvarnog ulaza, zahtevi za izlaz, dozvoljeni alati, kriterijum prihvatanja

Konfiguracija

ID modela za API, nivo napora, režim obrade, verzija prompta, šema ili ugovor o izlazu

Ishod

Prihvaćeno, odbijeno ili zahteva pregled; razlog neuspeha; recenzent

Vreme

Trajanje celog procesa i trajanje koraka koji vidi korisnik

Korišćenje i naplata

Ulazni tokeni, keširani ulazni tokeni, tokeni za upis u keš i izlazni tokeni; naknade za alate; ponovni pokušaji; doplate za dugačak kontekst ili obradu u regionu

Odluka

Prihvaćeni zadaci podeljeni brojem pokušanih zadataka; ukupan trošak podeljen brojem prihvaćenih zadataka; nerešeni tipovi grešaka

Uključite lake i teške slučajeve, neispravne ulaze i prekide rada alata koji se javljaju u stvarnom procesu. Poredite modele na nepromenjenom skupu slučajeva, a zatim ponovite procenu posle izmene promptova ili dozvola za alate. Razvrstajte neuspehe po tipu: nedostaju dokazi, pogrešno polje, greška alata, propušteno uputstvo ili odgovor koji čovek mora da ispravi. Prebacite korak na drugi model tek kada ista pravila prihvatanja pokažu korisno poboljšanje. Jeftiniji model uz više dorade može da bude skuplji po prihvaćenom zadatku; sporiji model može da odgovara pozadinskom koraku, ali ne i interaktivnom.

Pre objavljivanja proverite stvarna ograničenja cena i potrošnje, kontrole podataka, vremenska ograničenja, ponovne pokušaje, nadzor i granice ljudskog odobravanja u odnosu na OpenAI-jevu kontrolnu listu za produkciju. Posle objavljivanja zadržite uzorkovani pregled i ponovite procenu kada se promene alias modela, prompt, alat ili radno opterećenje. Odluku o usmeravanju zasnujte na prikupljenim podacima o zadacima.

Izvori i dodatna literatura