
Ni nove grafičke kartice ni rekordnih rezultata u benchmarkovima — AMD-ov nastup na otvaranju IFA 2026 imao je samo jednu temu: Personal AI (osobna umjetna inteligencija).
Uz nju, predstavljene su tri novosti: platforma Ryzen AI Max 400 (kodno ime Gorgon Halo), prvo javno pojavljivanje novog HP ZBooka sljedeće generacije i stolna „superračunala” Threadripper Halo Station s 96 jezgri i potpunim vodenim hlađenjem.

Jack Huynh, viši potpredsjednik i generalni direktor AMD-ovog odjela za računarstvo i grafiku, u 45-minutnom je govoru prošao kroz čitav AMD-ov računalni ekosustav — od misije Artemis II oko Mjeseca, kiruških robota, finskog superračunala LUMI pa sve do PlayStationa 5 Pro.
Potom je pitanje sveo na ono što svakoga od nas svakodnevno zanima: kada AI radi kao zaposlenik — planira, poziva alate i ispravlja rezultate cijeli dan — gdje bi se zapravo trebalo odvijati to računanje?

Jack Huynh, viši potpredsjednik i generalni direktor AMD-ovog odjela za računarstvo i grafiku
AMD-ov odgovor zove se Personal AI. Računalo prvo obrađuje ono što može samo, zadaci koji uključuju osjetljive podatke i osobni kontekst ostaju lokalno koliko god je moguće, a tek kada je potrebna veća snaga, posao se prosljeđuje u oblak ili podatkovni centar.
Slijedeći tu logiku, AMD je predstavio rješenja od računala s 192 GB jedinstvene memorije do stolnih radnih stanica, a suradnjom s Microsoftom i SUSE-om zaokružio je i stranu razvoja za Windows te poslovne primjene. Čini se da svi proizvodi i partneri odgovaraju na isto pitanje: kako natjerati AI da počne raditi s uređaja koji je korisniku najbliži.

Na pozornici su se pojavili i DeepSeek, Qwen, GLM, gpt-oss i Laguna — ali ovaj put kao mjerila sposobnosti, a ne kao zvijezde nastupa.
Qwen3.8-Flash-Next, objavljen tek koji tjedan ranije, već radi na AMD-ovoj novoj platformi, a GLM-5.3-Flash s ukupno 320 milijardi parametara stane u jedinstvenu memoriju. AMD je tim modelima otvorenih težina pokazao da svaki uređaj — od običnog AI računala do stolne radne stanice — ima dovoljno posla za odraditi.
Za proizvođače računalnih čipova nekad je mjerilo bila brzina sličica u igrama, a danas je postalo: koliki model uopće stane u moje računalo.
„AI je nova struja” — ali račun sve teže ide
Jack je razvoj generativne AI sažeo u četiri koraka: najprije je naučila razgovarati, zatim dobila vid i glas, potom počela zaključivati, a 2025. prerasla je iz modela koji odgovara na pitanja u agenta koji planira, poziva alate, provjerava rezultate i nastavlja raditi.
Takav napredak ne donosi samo bolje korisničko iskustvo — donosi i znatno veće računalno opterećenje.
Običan razgovor s ChatGPT-om troši svega nekoliko stotina do nekoliko tisuća tokena, dok zadatak poput „isplaniraj mi obiteljski odmor u Italiji” — pregled kalendara, rezervacija letova, promjena hotela — može lako potrošiti stotine tisuća pa i milijun tokena.
Prema AMD-ovim procjenama, prosječni potrošački korisnik dnevno troši milijune tokena, kreativci desetke milijuna, a programeri i poduzetnici kreću od 50 milijuna naviše.

Globalni podaci govore sami za sebe: u protekloj godini mjesečna obrada AI tokena u svijetu skočila je s oko 0,7 kvadrilijuna (700 bilijuna) na 1,7 kvadrilijuna (1700 bilijuna); do 2030. predviđa se 120 kvadrilijuna tokena mjesečno.
Istovremeno, 93 % tvrtki prekoračuje AI proračun. Jack je naveo primjer aktivnog korisnika koji dnevno generira 15 milijuna izlaznih tokena — putem oblaka to iznosi oko 300 eura na dan, što znači da godišnji trošak AI upotrebe jedne osobe može doseći gotovo 100 000 eura.

„Ne možemo samo trošiti više — moramo računati pametnije.” Ta je rečenica zapravo srž cijelog AMD-ovog nastupa: kako AI vratiti iz oblaka na lokalno računalo.
Modeli se smanjuju, računala rastu
Priča o lokalizaciji ima smisla samo ako su lokalni modeli dovoljno dobri u usporedbi s vlasničkim modelima na vrhu ljestvice — što znači da modeli moraju biti manji, a istovremeno sposobniji.
Model otvorenih težina GPT-OSS-120B koji je OpenAI objavio prošlog kolovoza postigao je 80 bodova na GPQA benchmarku (mjerilo zaključivanja na razini doktoranda) i brzo je postao prvi izbor za lokalno postavljanje kod mnogih programera.
Nekoliko mjeseci kasnije, Alibabin Qwen3.5-9B s tek 9 milijardi parametara nadmašio je taj rezultat na istom benchmarku — s 13 puta manje parametara, a boljim rezultatom.

U posljednjih nekoliko mjeseci natjecanje između otvorenih i zatvorenih modela sve je žešće — od Kimi K3 koji se mjeri s Fableom 5, do DeepSeeka, GLM-a pa čak i Flash modela koji počinju parirati seriji Claude Opus.
AMD-ov plan prati tu putanju: trenutni procesor Gorgon Point, poznat kao Ryzen AI 400 serija, lokalno može pokretati modele s 24 milijarde parametara, dok Strix Halo s 128 GB jedinstvene memorije podržava modele s 200 milijardi parametara.
AMD je na licu mjesta pokazao i usporedbu: otvoreni model Laguna S 2.1, koji u potpunosti radi na Strix Halu, nadmašio je oblačni Claude Sonnet 5 (70,3 boda) na jednom od softversko-inženjerskih benchmarkova.

10 milijuna izlaznih tokena: Claude Sonnet 5 putem oblaka oko 90 eura, lokalno — besplatno
Premještanje računanja natrag na računalo umjesto u podatkovni centar temeljna je AMD-ova ideja o lokalnoj obradi.
Uz brzinu i troškove, privatnost i kontrola još su jedna osjetljiva točka kada je riječ o agentima. AMD želi da podaci ostanu uz korisnika — da korisnik sam odlučuje što smije napustiti uređaj i kamo se šalje.
Treći element je osobni kontekst, koji Jack smatra četvrtim slojem — uz aplikacije, modele i računalnu snagu. Ista naredba „pripremi me za sutra” za zaposlenika znači sastanak s klijentom i tri otvorene stavke, a za studenta ispit i grupu za učenje.
Nije dovoljno da model zna sve o svijetu — mora znati i što korisnika koji pita čeka sutra. Lokalna obrada, privatnost i kontrola te osobni kontekst — to su tri ključna pojma na kojima AMD gradi svoju viziju osobne AI.

Na razini konkretnih proizvoda, AMD je predstavio Gorgon Halo — tržišno ime Ryzen AI Max 400 serija. Jedinstvena memorija raste s 128 GB na 192 GB, a lokalno podržani modeli skaču s 200 milijardi na 300 milijardi parametara.
Na pozornici je prikazan i Zhipuov GLM-5.3-Flash s 320 milijardi parametara koji radi lokalno na Gorgon Halu, a usporedba je pokazala da lokalni model nadmašuje oblačni Claude Fable 5 na istom benchmarku — pri čemu pokretanje Fablea 5 za 10 milijuna izlaznih tokena košta oko 500 eura.
Računalo s tim čipom već postoji: Lenovov ThinkCentre X Ultra, predstavljen kao flagship na IFA 2026, dolazi s Gorgon Halom, dovoljno je kompaktan da stane na stol, a do četiri uređaja mogu se spojiti u klaster.
Jack je također prvi put javno pokazao sljedeću generaciju HP ZBooka pod kodnim imenom Sundance: 192 GB jedinstvene memorije, a na licu mjesta je jednom naredbom lokalno generiran cijeli 3D svijet, nakon čega je isti laptop bez problema pokrenuo Microsoft Flight Simulator.

„Danju stvaraš svjetove, noću igraš igre. U jednoj ruci stvarni svijet, u drugoj onaj koji sam zamišljam.”
Gorgon Halo ipak ostaje kompaktno osobno računalo. Pred kraj govora Jack je „osobnu AI” pomaknuo u sasvim drugu dimenziju.
Threadripper Halo Station, koji je tada prvi put predstavljen, spaja 96-jezgreni Threadripper PRO i AMD Instinct MI350P razine podatkovnog centra u jednoj stolnoj radnoj stanici.
Izloženi primjerak imao je dvije kartice MI350P s mjestom za proširenje na četiri; maksimalna sistemska memorija iznosi 2 TB, a ukupni HBM3E kapacitet u konfiguraciji s četiri kartice doseže 576 GB — sve hlađeno vodom.

AMD tvrdi da može pokretati modele s više od bilijun parametara i naziva ga „najsnažnijom radnom stanicom na svijetu”.
Taj stroj AMD-ovu viziju osobne AI širi s jednog računala na dijeljeni čvor unutar ureda. Može ga koristiti jedan programer, ali i cijeli tim; zadaci koji ne stanu na osobno računalo ne moraju nužno ići u javni oblak s naplatom po tokenu.
Ekosustav lokalne AI: slaganje mozaika
To što hardver može pohraniti model ne znači da agent već može sigurno raditi na računalu.
Agent mora izvršavati radnje kroz aplikacije, usluge i datoteke, operacijski sustav mora biti pristupačan — jer ako je hardver moćan, ali sve radi samo na Linuxovom Ubuntuu, prosječnom korisniku to neće biti lako savladati. Softverski sloj mora i kontrolirati što agent smije vidjeti, što smije mijenjati i kada treba tražiti korisnikovo odobrenje.
Pavan Davuluri, izvršni potpredsjednik Microsofta za Windows i uređaje, objasnio je da Windows prilagođava pristup jedinstvenoj memoriji i raspoređivanje radnog opterećenja kako bi veliki modeli mogli koristiti memoriju i GPU Gorgon Hala.
Microsoft je ranije najavio Microsoft Execution Containers — izolirano izvršno okruženje za agente koje štiti korisnika, podatke i uređaj; ta je mogućnost trenutno još u ranoj fazi pregleda.

Microsoft je predstavio i Project Zenith — Windows iskustvo za programerski hardver koje je odmah spremno za rad. Zahtijeva najmanje 64 GB jedinstvene memorije, dolazi s predinstaliranim VS Codeom, WSL-om, GitHub Copilot CLI-jem, PowerShellom i skupom razvojnih postavki, a bit će dostupno prvo uz uređaje s Ryzen AI Halom.
Davuluri je uživo demonstrirao Alibabin novi model Qwen3.8-Flash-Next sa 125 milijardi parametara kako radi na Gorgon Halu — od pisanja jednostavnih funkcija, lokalne forenzičke analize osjetljivih datoteka, do generiranja cijele web stranice portfolia jednom rečenicom, sve bez spajanja na oblak.
Pavan je toj viziji dao ime: računalo će postati dom „unmetered intelligence” — inteligencije bez mjerenja i naplate.

Od običnog AI računala temeljenog na Gorgon Pointu koje pokreće modele s 24 milijarde parametara, preko Gorgon Hala s 192 GB jedinstvene memorije, do Threadripper Halo Stationa koji cilja modele s više od bilijun parametara — AMD je postavio čitavu hijerarhiju hardvera za osobnu AI.
Hoće li taj put postati novi razlog za kupnju računala, ovisit će ne samo o stabilnosti uređaja, nego vjerojatno još više o tome koliko daleko otvoreni modeli mogu stići.
Čini se da upravo ti otvoreni modeli postaju „dobavljači streljiva” za globalnu priču o renesansi osobnih računala — hardverskim tvrtkama trebaju kako bi dokazale vrijednost lokalne računalne snage, a otvoreni modeli zauzvrat, zahvaljujući novom hardveru, šire svoj utjecaj na stolove diljem svijeta.
Izvor: Ifanr







