VMTech
Razgovarajmo →

GPT-6.1 Sol donosi niži trošak za napredne AI agente

GPT-6.1 Sol donosi niži trošak za napredne AI agente

OpenAI je predstavio GPT-6.1 Sol, unapređenje modela GPT-6 Sol za agentsko programiranje, upravljanje računarom i profesionalne zadatke. Model se po složenim zadacima približava GPT-6 Astra, dok su standardne API cene ulaznih i izlaznih tokena pet puta niže od Astre: 2 dolara za milion ulaznih, 10 dolara za milion izlaznih i 0,10 dolara za milion keširanih ulaznih tokena.

GPT-6.1 Sol je od danas dostupan korisnicima paketa Plus, Pro, Business, Enterprise i Edu u ChatGPT Work i Codexu, a programerima kroz API pod nazivom gpt-6.1-sol. U režimu Chat modeli za sada nisu dostupni.

Rezultati u programiranju i poslovnim tokovima

U testu DeepSWE v1.1, namenjenom složenim zadacima razvoja softvera u stvarnim bazama koda, GPT-6.1 Sol dostiže nivo GPT-6 Astra uz približno pet puta niži trošak. U odnosu na najbolji rezultat GPT-6 Sol, ostvaruje prednost od 6,4 procentna poena uz manje napora rezonovanja i niži trošak.

Na testu GDP.pdf, koji obuhvata pitanja nad zahtevnim PDF dokumentima sa tabelama, grafikonima, dijagramima i sitnim slovima, GPT-6.1 Sol nadmašuje Opus 5.5 sa rezervnim modelima uz više nego dvostruko niži trošak zadatka na svim proveravanim nivoima rezonovanja. OpenAI navodi i približavanje rezultatima Astre uz oko pet puta nižu cenu zadatka.

AutomationBench proverava izvršavanje višekoračnih poslovnih procesa. Pri srednjem nivou rezonovanja GPT-6.1 Sol nadmašuje Opus 5.5 za 2,2 procentna poena uz približno tri puta niži trošak, a rezultat je 4,8 procentnih poena viši od GPT-6 Sol pri istoj postavci. Kontinuitet razvoja Sol linije vidi se i kroz prethodno predstavljanje GPT-6 Sol i Luna, gde je OpenAI već naglasio niže API cene za prethodnu generaciju.

Rad sa računarom, nauka i tačnost

Na offline skupu OSWorld 2.0, koji meri rad agenata u složenim scenarijima upravljanja računarom, GPT-6.1 Sol je pri maksimalnom rezonovanju sedam procentnih poena ispred GPT-6 Sol uz više nego dvostruko niži trošak. Za Astrom zaostaje 2,1 procentni poen, dok je cena zadatka približno sedam puta niža.

U Terminal-Bench Science 0.1 model obavlja naučne tokove rada koji obuhvataju analizu podataka, modelovanje i dokazivanje teorema. Pri maksimalnom rezonovanju prosečan trošak zadatka GPT-6.1 Sol iznosi 5,47 dolara, naspram 23,21 dolara za Opus 5.5 i 23,80 dolara za Astru. Astra ipak zadržava najviši prijavljeni rezultat od 68,1% i OpenAI je preporučuje za najteže istraživačke zadatke.

OpenAI navodi stopu činjeničnih grešaka od 4,1% pri veoma visokom nivou rezonovanja, u poređenju sa 4,5% za GPT-6 Sol i 4,0% za Astru. Test je zasnovan na anonimizovanim razgovorima u kojima su korisnici ukazali na raniju grešku, pa ne predstavlja uobičajenu učestalost grešaka.

Praktičan okvir za primenu

Za kompanije je GPT-6.1 Sol opcija kada su potrebni česti, višekoračni agentski zadaci, ponovna upotreba konteksta i predvidljiviji API troškovi. Rezultate u produkciji i dalje treba proveravati prema sopstvenim podacima, alatima, ograničenjima pristupa i bezbednosnim pravilima.

#openai#artificialintelligence#agenticai#developers
Otvorena analitika
Na sajtu 5 pregleda
min čitanja 3 29.09.2026
Instagram

GPT-6.1 Sol donosi niži trošak za napredne AI agente

Otvorite objavu na Instagramu ↗