U susretu hrabri pobeđuje! Claude Opus 4.6 i GPT 5.3 Codex ažurirani su istovremeno
Iskreno, kada sam video kako jedna za drugom objavljuju vesti, prva mi pomisao bila: zar se ove dve kompanije dogovorile?
OpenAI i Anthropic gotovo istovremeno objavljuju novu generaciju modela za programiranje — GPT-5.3-Codex i Claude Opus 4.6.

Altman je ovaj put zaista pod pritiskom; posle trostrukog udarca Claude Code, Cowork, Clawdbot, OpenAI zaista oseća pritisak u enterprise softverskom razvoju.
01. GPT-5.3-Codex
Da počnem sa GPT-5.3-Codex iz OpenAI-ja. Najveće iznenađenje za mene je rezultat na OSWorld-Verified benchmark-u.

Moguće da neki ne znaju šta je ovaj test; laički rečeno, AI-u se daje snimak ekrana, a zatim u virtuelnom desktop okruženju obavlja razne kompjuterske zadatke. Prosečan rezultat čoveka je oko 72% — to je verovatnoća da prosečna osoba ispred računara završi zadatak.
Prethodni GPT-5.2-Codex imao je 38.2%; iskreno, to je već bila prilično jaka ocena, jer i vizuelno razumevanje i izvršenje zadataka ozbiljno iskušavaju tvrdu moć. Ali GPT-5.3-Codex se popela na 64.7% — skok od čak 26.5 poena.
Zaista, ovakav skok je u AI svetu apsurdan. Kad model dođe do ove faze, napredak od jednog ili dva procenta zahteva ogroman napor; skok od 26.5 poena ukazuje da je OpenAI sigurno uveo nešto novo u arhitekturu ili metod treniranja.
Još jedan detalj koji sam primetio: OpenAI zvanično tvrdi da je za isti zadatak potrebno tokena prepolovljeno, dok je brzina obrade jednog tokena povećana za 25%. Šta to znači? Brže je i jeftinije — za enterprise korisnike su ta dva pokazatelja značajnija od čistog povećanja tačnosti.

Pored OSWorld-Verified, GPT-5.3-Codex i u drugim benchmark testovima potpuno nadmašuje prethodnika: SWE-Bench Pro došao je do 57%, TerminalBench 2.0 na 76%, a na izazovima iz oblasti sajber bezbednosti CTF čak 77.6% tačnosti — svrstan u kategoriju visoko sposobnih modela.
Nakon ovog ažuriranja, pozicija GPT-5.3-Codexa je jasna — najjači AI agent model za programiranje iz OpenAI-ja, specijalno za složene softverske razvojne zadatke koji zahtevaju dugo rezonovanje.
02. Claude Opus 4.6
Da vidimo i Claude Opus 4.6 iz Anthropic-a.
Iskreno, glavni pravac Claude-a ovaj put nije isti kao kod OpenAI-ja. Dok OpenAI juri na rezultate benchmark-a, Claude više izgleda kao da je produktno iskustvo doveo do savršenstva.
Najveća zvezda je context window od milion tokena. Ako ti ovaj broj ništa ne znači, izračunaću ti: prosečan tehnički blog ima oko 3000 reči, što je oko 5000 tokena; milion tokena je kao 200 ovakvih blogova.
Ili drugačije: možeš direktno da baciš čitavu kodnu bazu srednjeg projekta Claude-u, da on razume globalnu arhitekturu i tek onda piše kod za tebe.
Za razvojne zadatke koji zahtevaju razumevanje složenog biznis scenarija i povezivanje više fajlova, ovo je razorna prednost.
Ranije si morao da hraniš AI segment po segment i da brineš da li će zaboraviti prethodni sadržaj; sada ubaciš sav kontekst odjednom i on daje predloge kao neko ko zaista poznaje projekat.
Opus 4.6 takođe naglašava poboljšanje agentic sposobnosti — jednostavnije rečeno, AI više liči na pravog agenta nego na alatku koja samo ume da razgovara. Sam planira zadatke, izvršava višekoračne workflow-ove i pri problemu samostalno prilagođava strategiju. U realnom razvoju je to posebno važno, jer ga ne možeš nadgledati u svakom koraku.
Još jedan detalj vredan pažnje: Claude Opus 4.6 je već dostupan na glavnim platformama kao što su GitHub Copilot, Amazon Bedrock, Snowflake Cortex AI. To pokazuje da je Anthropic uložio mnogo u ekosistem, a ne zatvoren u sobi.

03. Claude in Excel
Pored nadogradnje samog modela, zanimljive su i novine Claude-a u Excelu.
Novi Plan Mode jednostavno znači "prvo planiraj, pa izvrši". AI prvo analizira arhitekturu projekta i zavisnosti, predlaže nacrt rešenja, a po tvojoj potvrdi kreće u izvršenje.
Ovaj pristup je posebno zgodan za finansije, računovodstvo i druge oblasti koje izuzetno zahtevaju tačnost. Zamisli da AI direktno menja Excel; šta ako pogreši?
Ali uz Plan Mode, AI prvo izloži plan, ti ga pregledaš i potvrdiš, pa kreće — osećaj sigurnosti se odmah povećava.
Osim toga, sada podržava prevlačenje više fajlova, automatsku kompresiju dugih sesija, izbegavanje prepisivanja postojećih ćelija, automatsko snimanje i kompresiju. Svaka pojedinačna funkcija nije nešto naročito, ali zajedno daju osećaj da produktni tim zaista razume bolne tačke korisnika.
Pogledao sam vremensku liniju: Claude for Excel je izašao u oktobru 2025, u januaru 2026. otvorio se Pro korisnicima, a sada je dodao i Plan Mode — tempo iteracije je zaista brz. Čini se da bi Excel u 2026. mogao da postane, posle kodiranja, sledeća oblast visoke vrednosti koju će AI preoblikovati.

04. Ovaj put se zaista bore
Kada sam došao dovde, zastao sam i razmislio: zašto su izabrali isto vreme za objavu?
Površno gledano slučajno, ali dublje, očigledno je pažljivo isplanirani dvoboj.
I OpenAI i Anthropic znaju da drugi priprema ažuriranje, pa čekaju optimalni trenutak da u javnom prostoru pobede.
I pogledaj pozicioniranje proizvoda: GPT-5.3-Codex se predstavlja kao najjači AI agent model za programiranje; Claude Opus 4.6 se predstavlja kao najpametniji model — zvuči kao da su namerno jedan protiv drugog.
Sa stanovišta strategije na tržištu, OpenAI ovaj put više pokazuje mišiće, visokim rezultatima na benchmark-ovima dokazuje tehničku snagu.
Anthropic s druge strane ulaže u produktno iskustvo i integraciju ekosistema, pokušavajući da privuče programere boljim korisničkim iskustvom.
Uzgred, video sam i da će API oblik GPT-4o za nedelju dana biti ugašen — duh vremena.

Moja ljubav je i dalje 4o, možeš li da veruješ.
Jer od GPT-4 do GPT-5.3-Codex, tempo iteracije proizvoda OpenAI-ja zaista je toliko brz da jedva hvataš dah.
05. Šta to znači za običnog programera
Toliko o tehničkim detaljima; neko će pitati, kako mi obični programeri da biramo?
Na primer, ako ti zadatak zahteva razumevanje konteksta celog projekta, context window od milion tokena kod Claude Opus 4.6 dobro dođe.
Ako često obrađuješ vizuelne zadatke — recimo, gledaš snimak ekrana i popravljaš UI ili pišeš frontend kod prema dizajnerskom predlošku — onda ti više znači visok rezultat GPT-5.3-Codex-a na OSWorld-Verified.
Tu je i praktično pitanje cene i brzine. OpenAI kaže da GPT-5.3-Codex za isti zadatak troši upola manje tokena i da je 25% brži — za male timove ili pojedinačne programere sa ograničenim budžetom to je prilično privlačno.

Ali iskreno, najveći korisnik ovog dvoboja smo mi obični programeri. Džinovi se takmiče, a rezultat su bolji proizvodi i niže cene.
Kao sada: Claude ima integraciju sa GitHub Copilot, OpenAI ima macOS aplikaciju Codex — slobodno isprobaj oba, pa vidi koji ti više odgovara toku rada. Nema potrebe da staneš na jednu stranu, važno je da radi.
ending
Ponekad i ja razmišljam — kakav bi AI trebalo da bude?
Ne alat koji nas zamenjuje. Ne pretnja koja nas plaši.
AI bi trebalo da bude saputnik koji nas oslobađa ponavljajućeg rada. Pomoćnik koji nam daje više vremena za razmišljanje o arhitekturi, dizajniranje proizvoda, stvaranje vrednosti.
Na primer, prepusti CRUD AI-ju, a mi se fokusirajmo na biznis logiku i korisničko iskustvo. Uštedi vreme na čitanju tuđeg koda i potraži više industrijske trendove i tehnički napredak. Umesto pisanja testova, uloži to vreme u optimizaciju sistemske arhitekture.
„Značaj tehnološkog napretka nikada nije u zameni čoveka, već u tome da čoveku pruži priliku da radi smislenije stvari."
Ovo ažuriranje — bio to skok od 26 poena kod GPT-5.3-Codex ili context od milion tokena kod Claude Opus 4.6 — u suštini čini AI pametnijim i upotrebljivijim.
A naš zadatak je da razmislimo kako da dobro iskoristimo ovaj alat, umesto da strepimo od zamene.
Reference:
- Introducing Claude Opus 4.6 - Anthropic
- Najjači AI agent model za programiranje iz OpenAI-ja: GPT-5.3-Codex stiže - IT Home
- Sudar prvaka, Claude Opus 4.6 i GPT-5.3 Codex objavljeni istovremeno - Huxiu
- Najjaći "meštar lovac na kralja programiranja": OpenAI i Anthropic duboko u noći istovremeno odjeknuše - 36Kr
