OpenAI smernice za izbor i primenu GPT-6 modela

OpenAI je 2. oktobra 2026. objavio vodič za porodicu GPT-6, koja obuhvata GPT-6 Astra, GPT-6.1 Sol i GPT-6 Luna. Dokument opisuje izbor modela, upravljanje troškom i latencijom, prilagođavanje instrukcija, kao i vođenje poslova koji mogu trajati satima ili danima.
Izbor modela i priprema za produkciju
GPT-6 Astra je namenjen najzahtevnijem rezonovanju, GPT-6.1 Sol složenom programiranju, istraživanju i radu na računaru, dok je GPT-6 Luna predviđen za fokusirane i ponovljive zadatke većeg obima, poput izdvajanja polja iz faktura, klasifikacije zahteva i izrade strukturisanih sažetaka.
OpenAI preporučuje da se uz model bira i nivo rezonovanja. Nizak nivo odgovara rutinskom izdvajanja činjenica i manjim izmenama, srednji poslovima koji traže procenu, a visok i dodatno visok složenom otklanjanju grešaka, dubljoj analizi i pažljivoj proveri. U API-ju se nivo može promeniti tokom razgovora bez prekida keša.
Za radne tokove u produkciji važno je ukloniti kontekst koji zadatku nije potreban, a zadržati relevantne dokaze. Nezavisni zadaci mogu se pokretati paralelno. Prompt caching služi za ponovnu upotrebu stabilnih instrukcija, referentnog materijala i doslednih definicija alata; OpenAI navodi da keširani ulazni tokeni, u zavisnosti od modela, mogu koštati do 95% manje od ulaznih tokena bez keša.
Za duge razgovore predviđen je compaction, koji smanjuje kontekst uz očuvanje stanja potrebnog za nastavak rada. Pre postavljanja sistema u produkciju, vodič traži testiranje reprezentativnih zadataka i merenje uspeha, latencije i troška po uspešno završenom zadatku, uz plan nadzora ponašanja i kontrola podataka.
Jasne instrukcije umesto krutih recepata
Instrukcija modelu treba da odredi željeni rezultat, publiku, relevantni kontekst, ograničenja i kriterijum završetka. OpenAI savetuje kratke i jasne opise veština, učitavanje dodatnih detalja samo kada su potrebni i zamenu rigidnih procedura smernicama prilagođenim modelima koje tim koristi.
Uputstva poput AGENTS.md treba da kažu kada su određeni dokumenti i testovi relevantni, kao i koje su bezbedne rutinske radnje dozvoljene. Korisno je posebno razdvojiti odluke koje model može samostalno da donese od onih za koje je potrebno odobrenje. Definicija završenog posla može obuhvatiti implementaciju promene, pokretanje, proveru rezultata i ispravljanje neuspeha.
Kontrola dugotrajnih zadataka
Responses WebSocket API podržava usmeravanje tokom izvršavanja: nova instrukcija se stavlja u red, ali ne prekida alat koji već radi niti poništava završene akcije. Asinhrono pozivanje alata omogućava modelu da radi na nezavisnim delovima posla dok aplikacija izvršava sporiji korak, poput testiranja.
GPT-6.1 Sol u Responses API-ju podržava višagentske tokove rada, trenutno u beta fazi. Model može dodeliti nezavisne podzadatke podagentima, na primer istraživanje različitih delova repozitorijuma, a zatim objediniti nalaze. Kod rada u Codexu, GPT-6 Astra može zatražiti pojašnjenje tokom rada, dok se aktivni zadatak može preusmeriti kada se zahtevi promene.
Computer use omogućava Astri, Solu i Luni interakciju sa sajtovima i desktop aplikacijama, uključujući one bez API-ja. OpenAI preporučuje API ili povezani alat kada posao može da se obavi direktno, a rad preko ekrana kada je potrebno čitanje interfejsa, klik ili popunjavanje obrasca. Za poslovne timove praktičan zaključak je da automatizaciju uvedu tek uz merljive kriterijume uspeha, jasne granice ovlašćenja i nadzor troška svakog radnog toka.

