Konačno možemo uživati u Codex + Claude Code, neograničeno tokena!
Nakon što sam pola godine koristio Claude Code i Codex za pisanje koda, najveći utisak je da je efikasnost rada podignuta na maksimum maksimuma.
Ali u isto vreme, novčanik malo boli, prvog dana svakog meseca prvo moram da dopunim 500 dolara.

Ja mogu da priuštim, ali iskreno, mnogi prijatelji iz drugog i trećeg grada se ne usude da koriste top modele kao što su Opus 4.8 i GPT-5.5, jer preko tri hiljade mesečno nije mali iznos.
Da ne govorimo o studentima.
Zato u poslednje vreme stalno "grabim" besplatne modele koji su prilično moćni, jer mnogi pozadinski prijatelji traže.
Baš danas, otkrio sam da je Xunfei Xingchen MaaS platforma ograničeno vreme besplatno otvorila dva modela: Qwen3.6-35B-A3B i Qwen3.5-35B-A3B, i novi i stari korisnici mogu da preuzmu, besplatno neograničeno tokena.
Grabite: https://maas.xfyun.cn/modelSquare?ch=MaaS-jgkol-l7P2y
Zainteresovani, brzo grabite.
Odmah sam ga ubacio u Claude Code, Codex, i moj PaiCLI, za analizu dugih dokumenata, razumevanje koda, zaista je uživanje.

Ko želi da grabi, neka žuri.
01. Proces preuzimanja na Xunfei Xingchen MaaS
Prvi korak, otvorite model bazar Xunfei Xingchen MaaS platforme, adresa je https://maas.xfyun.cn/modelSquare?ch=MaaS-jgkol-l7P2y. Kada uđete videćete mnogo modela, kao što je DeepSeek V4.

Drugi korak, izaberite besplatne modele Qwen3.6-35B-A3B i Qwen3.5-35B-A3B. Na kartici modela kliknite [API poziv], uđite u stranicu konfiguracije servisa.

Treći korak, popunite API naziv modelnog servisa, izaberite aplikaciju koju želite da ovlastite. Ako još uvek nemate aplikaciju, kreirajte je, pa se vratite da je povežete.

Četvrti korak, kopirajte tri ključne informacije:

- modelId: na primer, ovde sam dobio
xopqwen36v35b, to je ime modela koje treba da se popuni kasnije - OpenAI kompatibilna adresa interfejsa:
https://maas-api.cn-huabei-1.xf-yun.com/v2 - API Key: kopira se iz informacija o autentifikaciji servisnog interfejsa
02. Kakvog je nivoa Qwen3.6-35B-A3B?
Qwen3.6-35B-A3B je sparse Mixture of Experts (MoE) model koji je tim Tongyi Qianwen nedavno objavio, pod Apache 2.0 licencom.
Dva broja u imenu su zanimljiva: ukupno 35B parametara, ali pri svakom zaključivanju aktivira samo 3B. To znači da je stvarna količina izračunavanja u radu slična malom modelu od 3B, ali plafon je na nivou 35B.
Juče je jedan prijatelj odmah grabio 200 miliona tokena, besplatno zaista ne boli pri korišćenju.

Ovde da dodam još jednu reč objašnjenja, zašto je dizajn aktivacije 3B važan.
Tradicionalni gusti model, koliki su parametri, toliko se svaki put pri zaključivanju celokupno računa, 35B model pošteno računa 35B, i spor je i troši memoriju.

Ideja MoE-a je da se model razbije u gomilu eksperata, svaki put se izabere samo nekoliko najrelevantnijih eksperata, ostali se odmaraju. Zato Qwen3.6-35B-A3B iako ima 35B parametara, pri jednom zaključivanju pokreće samo 3B, brzina zaključivanja i trošak su blizu malog modela od 3B, dok su baza znanja i gornji limit sposobnosti na nivou 35B. Zato može biti i brz i jeftin, a da i dalje zadrži pristojne sposobnosti.
Sa benchmark rezultatima nema šta da se kaže.

To je i izvorno multimodalni model, sa vizuelnim enkoderom, na više pokazatelja vizuelnog razumevanja i razumevanja dokumenata blizu ili prelazi Claude Sonnet 4.5.
Model sa samo 3B aktivnih parametara postiže ovaj nivo, zaista ima nešto.
Jednom rečenicom: pogodan za analizu dugih dokumenata, razumevanje dugih isečaka koda, generisanje koda, rezonovanje o kompleksnim pitanjima.
Za one koji svakodnevno čitaju izvorni kod i dokumentaciju, besplatno + dovoljno sposobno, zaista se ne može odbiti.
03. Integracija u Claude Code i Codex
Da objasnim kako da se model ubaci u Claude Code i Codex, to su dva Agenta koje najviše koristite.
Prvi korak, preuzmite PaiSwitch, to je točak koji sam sam iskovao, repo adresa https://github.com/itwanger/PaiSwitch. Njegova uloga je slična CC-switch-u, lokalno prebacuje različite osnovne modele za Claude Code i Codex.

Neki su u komentarima pitali, kad već postoji CC-switch, zašto praviti svoj?
Razlog je jednostavan, želim da razumem šta se dešava ispod haube. Na primer, zašto Claude Code i dalje radi normalno kada se prebaci na DeepSeek V4 Pro? Zašto kada Codex menja osnovni model, treba prilagoditi novi set protokola?

Ovde se zapravo krije ključna razlika.
Claude Code koristi Anthropic Messages protokol, Codex koristi OpenAI Responses protokol, a Xunfei MaaS pruža OpenAI Chat Completions protokol. Tri seta protokola su različita, da bi komunicirali, između njih mora postojati sloj za konverziju protokola.

Kao korisnik alata, ne morate uopšte da brinete o ovim detaljima ispod haube, ako radi — radi.
Ali kao bloger koji svima objašnjava tehničke principe, apsolutno ne smem da ne znam.
Zato ovaj točak moram da napravim.
Već sam dodao PaiSwitch-u podršku za Xunfei Xingchen MaaS, ugrađen je novi provajder, i Claude Code i Codex ga mogu koristiti.

Kako tačno radi konverzija?
Na strani Claude Code-a, ide preko lokalnog kanala /claude-proxy/{code}, pretvara Anthropic Messages protokol u OpenAI Chat Completions. Na strani Codex-a, ide preko lokalnog kanala /codex-proxy/{code}/v1, pretvara Responses protokol u Chat Completions. Obe strane podržavaju lora_id i resourceId, pa se mogu koristiti i za pozive fino podešenih modela.
Nakon prilagođavanja, koraci integracije su samo dva.
Prvi korak, u PaiSwitch-u napravite novog provajdera za Xunfei MaaS platformu, popunite tri stvari:
- Base URL:
https://maas-api.cn-huabei-1.xf-yun.com/v2 - Ime modela:
xopqwen36v35b - API Key: iz informacija o autentifikaciji servisnog interfejsa
Isto kao i pre. Nakon popunjavanja obavezno kliknite test konekcije, da vidite da li prolazi.

Drugi korak, na kontrolnoj tabli izaberite model koji želite da prebacite. PaiSwitch je već integrisao gomilu provajdera kao DeepSeek V4, GLM-5.1, Kimi, a sada je i Xunfei MaaS tu. Kad se na platformi pojavi neki novi besplatni model, ja ga odmah mogu ubaciti.

Sledeći korak, mislim da mogu dodati PaiSwitch-u još jednu funkciju, auto modus, po određenom redosledu, automatsko prebacivanje.
Strategija uključuje dinamično rutiranje sa kaznom, svaki model ima osnovni prioritet, ali stvarni redosled koristi "osnovni prioritet + kazneni rezultat".

Klizni prozor za ograničavanje protoka.

Eskalacija hlađenja, kada isti model prvi put u 24 sata okine 429, hlađenje 2 minuta. Drugi put 10 minuta. Treći put 1 sat. Četvrti put direktno hlađenje 24 sata.

I to je smisao pravljenja točkova.
Tako, kad god se na Xunfei Xingchen MaaS platformi pojavi novi model, ili koji su besplatni, mogu ih odmah ubaciti u Claude Code i Codex.

Ako se potrudimo mašte, čini se nije nemoguće ni napraviti API transfer sa PaiSwitch-om.
04. Integracija u PaiCLI
PaiCLI je Agent CLI koji sam napravio, sličan Claude Code, podržava pretragu koda, RAG, saradnju više Agenata, MCP, Skills itd.
Način integracije je jednostavan. Ako i vi koristite Claude Code ili Codex za razvoj, možete direktno baciti HTTP dokumentaciju Xunfei-ja na Agenta, da ga on poveže za vas.
Prema: https://www.xfyun.cn/doc/spark/inference-service-http.html integrišite Qianwen Qwen3.6-35B-A3B

Zatim popunite modelId, API Key i adresu interfejsa koje ste dobili pre u .env konfiguracioni fajl PaiCLI-ja. PaiCLI posebno ima set konfiguracionih stavki za Xunfei MaaS:
# ========== Xunfei Xingchen MaaS konfiguracija ==========
XFYUN_MAAS_API_KEY=vas_api_key
# Ime modela, prema modelId prikazanom na kartici modela
XFYUN_MAAS_MODEL=xopqwen36v35b
# Base URL, novi servisi koriste v2, postojeći servisi po konzoli menjaju u v1
XFYUN_MAAS_BASE_URL=https://maas-api.cn-huabei-1.xf-yun.com/v2
# Pri pozivu fino podešenog modela popunite resourceId sa kartice servisa
XFYUN_MAAS_LORA_ID=0
Nakon popunjavanja restartujte PaiCLI, unesite /model xfyun i prebačeni ste, i možete početi da uživate u ovom modelu.

Prvo sam testirao najčešći scenario: razumevanje koda.
Bacio sam mu isečak koda bez glave i repa, da mi kaže šta taj kod radi i gde je ključna logika. Qwen3.6 je reagovao vrlo brzo, bez okolišanja, jasno je objasnio odgovornost tog koda, ulaz i izlaz, nekoliko ključnih grana. Još vrednije, on ne prevodi red po red, već može da objasni "zašto je ovaj kod ovako napisan", ovo objašnjenje je veoma korisno za one koji uče izvorni kod.

Testiranjem je moj zaključak: za svakodnevno razumevanje koda, sažimanje dokumenata, sasvim dovoljan, a pošto je besplatan, nema nikakvog psihičkog pritiska pri korišćenju.
Znat ćete, za isti posao sa Opus 4.8 ili GPT-5.5, to je stvarno sagorevanje tokena za pravi novac.
Sačuvajte skupe modele za zaista tvrd orah, dok svakodnevne sitne poslove prepustite besplatnom Qwen3.6.
ending
Pišući ovde, sve više osećam da je besplatnost sama po sebi vrsta produktivnosti.
Ne znači da je besplatno nužno dobro, već kada model dovoljnih sposobnosti više ne naplaćuje, usuđujete se da slobodno eksperimentišete.
Usudite se da mu date da pročita čitav repo,
usudite se da ubacite dokument od desetina hiljada reči u komadu,
usudite se da ako jedan prolaz nije dobar, pokrenete još deset,
bez proračuna pri svakom pritisku enter koliko ste novca sagoreli.
Ovo stanje je upravo ono što je učenju i istraživanju najpotrebnije.
Za mnoge prijatelje, ono što nedostaje nije nikad strast, već budžet. Sada pred vama stoji besplatan, prilično sposoban model, onda nemojte oklevati.
[Besplatno korišćenje nije sramota, sramota je kada je prilika pred vama a lenji ste da pružite ruku.]
Sada idite na Xunfei Xingchen MaaS platformu, grabite Qwen3.6-35B-A3B i Qwen3.5-35B-A3B, sada.

https://maas.xfyun.cn/modelSquare?ch=MaaS-jgkol-l7P2y
Ubacite u svoj Claude Code ili Codex i testirajte par dana.
Vidimo se u sledećem.
