PočetnaVijesti iz KineDeepSeek, Qianwen, Zhipu redom se pojavljuju, PC proizvođači su konačno čekali njihovu...

DeepSeek, Qianwen, Zhipu redom se pojavljuju, PC proizvođači su konačno čekali njihovu municiju

Ni nove grafičke kartice ni rekordnih rezultata u benchmarkovima — AMD-ov nastup na otvaranju IFA 2026 imao je samo jednu temu: Personal AI (osobna umjetna inteligencija).

Uz nju, predstavljene su tri novosti: platforma Ryzen AI Max 400 (kodno ime Gorgon Halo), prvo javno pojavljivanje novog HP ZBooka sljedeće generacije i stolna „superračunala” Threadripper Halo Station s 96 jezgri i potpunim vodenim hlađenjem.

Image

Jack Huynh, viši potpredsjednik i generalni direktor AMD-ovog odjela za računarstvo i grafiku, u 45-minutnom je govoru prošao kroz čitav AMD-ov računalni ekosustav — od misije Artemis II oko Mjeseca, kiruških robota, finskog superračunala LUMI pa sve do PlayStationa 5 Pro.

Potom je pitanje sveo na ono što svakoga od nas svakodnevno zanima: kada AI radi kao zaposlenik — planira, poziva alate i ispravlja rezultate cijeli dan — gdje bi se zapravo trebalo odvijati to računanje?

Image

Jack Huynh, viši potpredsjednik i generalni direktor AMD-ovog odjela za računarstvo i grafiku

AMD-ov odgovor zove se Personal AI. Računalo prvo obrađuje ono što može samo, zadaci koji uključuju osjetljive podatke i osobni kontekst ostaju lokalno koliko god je moguće, a tek kada je potrebna veća snaga, posao se prosljeđuje u oblak ili podatkovni centar.

Slijedeći tu logiku, AMD je predstavio rješenja od računala s 192 GB jedinstvene memorije do stolnih radnih stanica, a suradnjom s Microsoftom i SUSE-om zaokružio je i stranu razvoja za Windows te poslovne primjene. Čini se da svi proizvodi i partneri odgovaraju na isto pitanje: kako natjerati AI da počne raditi s uređaja koji je korisniku najbliži.

Image

Na pozornici su se pojavili i DeepSeek, Qwen, GLM, gpt-oss i Laguna — ali ovaj put kao mjerila sposobnosti, a ne kao zvijezde nastupa.

Qwen3.8-Flash-Next, objavljen tek koji tjedan ranije, već radi na AMD-ovoj novoj platformi, a GLM-5.3-Flash s ukupno 320 milijardi parametara stane u jedinstvenu memoriju. AMD je tim modelima otvorenih težina pokazao da svaki uređaj — od običnog AI računala do stolne radne stanice — ima dovoljno posla za odraditi.

Za proizvođače računalnih čipova nekad je mjerilo bila brzina sličica u igrama, a danas je postalo: koliki model uopće stane u moje računalo.

„AI je nova struja” — ali račun sve teže ide

Jack je razvoj generativne AI sažeo u četiri koraka: najprije je naučila razgovarati, zatim dobila vid i glas, potom počela zaključivati, a 2025. prerasla je iz modela koji odgovara na pitanja u agenta koji planira, poziva alate, provjerava rezultate i nastavlja raditi.

Takav napredak ne donosi samo bolje korisničko iskustvo — donosi i znatno veće računalno opterećenje.

Običan razgovor s ChatGPT-om troši svega nekoliko stotina do nekoliko tisuća tokena, dok zadatak poput „isplaniraj mi obiteljski odmor u Italiji” — pregled kalendara, rezervacija letova, promjena hotela — može lako potrošiti stotine tisuća pa i milijun tokena.

Prema AMD-ovim procjenama, prosječni potrošački korisnik dnevno troši milijune tokena, kreativci desetke milijuna, a programeri i poduzetnici kreću od 50 milijuna naviše.

Image

Globalni podaci govore sami za sebe: u protekloj godini mjesečna obrada AI tokena u svijetu skočila je s oko 0,7 kvadrilijuna (700 bilijuna) na 1,7 kvadrilijuna (1700 bilijuna); do 2030. predviđa se 120 kvadrilijuna tokena mjesečno.

Istovremeno, 93 % tvrtki prekoračuje AI proračun. Jack je naveo primjer aktivnog korisnika koji dnevno generira 15 milijuna izlaznih tokena — putem oblaka to iznosi oko 300 eura na dan, što znači da godišnji trošak AI upotrebe jedne osobe može doseći gotovo 100 000 eura.

Image

„Ne možemo samo trošiti više — moramo računati pametnije.” Ta je rečenica zapravo srž cijelog AMD-ovog nastupa: kako AI vratiti iz oblaka na lokalno računalo.

Modeli se smanjuju, računala rastu

Priča o lokalizaciji ima smisla samo ako su lokalni modeli dovoljno dobri u usporedbi s vlasničkim modelima na vrhu ljestvice — što znači da modeli moraju biti manji, a istovremeno sposobniji.

Model otvorenih težina GPT-OSS-120B koji je OpenAI objavio prošlog kolovoza postigao je 80 bodova na GPQA benchmarku (mjerilo zaključivanja na razini doktoranda) i brzo je postao prvi izbor za lokalno postavljanje kod mnogih programera.

Nekoliko mjeseci kasnije, Alibabin Qwen3.5-9B s tek 9 milijardi parametara nadmašio je taj rezultat na istom benchmarku — s 13 puta manje parametara, a boljim rezultatom.

Image

U posljednjih nekoliko mjeseci natjecanje između otvorenih i zatvorenih modela sve je žešće — od Kimi K3 koji se mjeri s Fableom 5, do DeepSeeka, GLM-a pa čak i Flash modela koji počinju parirati seriji Claude Opus.

AMD-ov plan prati tu putanju: trenutni procesor Gorgon Point, poznat kao Ryzen AI 400 serija, lokalno može pokretati modele s 24 milijarde parametara, dok Strix Halo s 128 GB jedinstvene memorije podržava modele s 200 milijardi parametara.

AMD je na licu mjesta pokazao i usporedbu: otvoreni model Laguna S 2.1, koji u potpunosti radi na Strix Halu, nadmašio je oblačni Claude Sonnet 5 (70,3 boda) na jednom od softversko-inženjerskih benchmarkova.

Image

10 milijuna izlaznih tokena: Claude Sonnet 5 putem oblaka oko 90 eura, lokalno — besplatno

Premještanje računanja natrag na računalo umjesto u podatkovni centar temeljna je AMD-ova ideja o lokalnoj obradi.

Uz brzinu i troškove, privatnost i kontrola još su jedna osjetljiva točka kada je riječ o agentima. AMD želi da podaci ostanu uz korisnika — da korisnik sam odlučuje što smije napustiti uređaj i kamo se šalje.

Treći element je osobni kontekst, koji Jack smatra četvrtim slojem — uz aplikacije, modele i računalnu snagu. Ista naredba „pripremi me za sutra” za zaposlenika znači sastanak s klijentom i tri otvorene stavke, a za studenta ispit i grupu za učenje.

Nije dovoljno da model zna sve o svijetu — mora znati i što korisnika koji pita čeka sutra. Lokalna obrada, privatnost i kontrola te osobni kontekst — to su tri ključna pojma na kojima AMD gradi svoju viziju osobne AI.

Image

Na razini konkretnih proizvoda, AMD je predstavio Gorgon Halo — tržišno ime Ryzen AI Max 400 serija. Jedinstvena memorija raste s 128 GB na 192 GB, a lokalno podržani modeli skaču s 200 milijardi na 300 milijardi parametara.

Na pozornici je prikazan i Zhipuov GLM-5.3-Flash s 320 milijardi parametara koji radi lokalno na Gorgon Halu, a usporedba je pokazala da lokalni model nadmašuje oblačni Claude Fable 5 na istom benchmarku — pri čemu pokretanje Fablea 5 za 10 milijuna izlaznih tokena košta oko 500 eura.

Računalo s tim čipom već postoji: Lenovov ThinkCentre X Ultra, predstavljen kao flagship na IFA 2026, dolazi s Gorgon Halom, dovoljno je kompaktan da stane na stol, a do četiri uređaja mogu se spojiti u klaster.

Jack je također prvi put javno pokazao sljedeću generaciju HP ZBooka pod kodnim imenom Sundance: 192 GB jedinstvene memorije, a na licu mjesta je jednom naredbom lokalno generiran cijeli 3D svijet, nakon čega je isti laptop bez problema pokrenuo Microsoft Flight Simulator.

Image

„Danju stvaraš svjetove, noću igraš igre. U jednoj ruci stvarni svijet, u drugoj onaj koji sam zamišljam.”

Gorgon Halo ipak ostaje kompaktno osobno računalo. Pred kraj govora Jack je „osobnu AI” pomaknuo u sasvim drugu dimenziju.

Threadripper Halo Station, koji je tada prvi put predstavljen, spaja 96-jezgreni Threadripper PRO i AMD Instinct MI350P razine podatkovnog centra u jednoj stolnoj radnoj stanici.

Izloženi primjerak imao je dvije kartice MI350P s mjestom za proširenje na četiri; maksimalna sistemska memorija iznosi 2 TB, a ukupni HBM3E kapacitet u konfiguraciji s četiri kartice doseže 576 GB — sve hlađeno vodom.

Image

AMD tvrdi da može pokretati modele s više od bilijun parametara i naziva ga „najsnažnijom radnom stanicom na svijetu”.

Taj stroj AMD-ovu viziju osobne AI širi s jednog računala na dijeljeni čvor unutar ureda. Može ga koristiti jedan programer, ali i cijeli tim; zadaci koji ne stanu na osobno računalo ne moraju nužno ići u javni oblak s naplatom po tokenu.

Ekosustav lokalne AI: slaganje mozaika

To što hardver može pohraniti model ne znači da agent već može sigurno raditi na računalu.

Agent mora izvršavati radnje kroz aplikacije, usluge i datoteke, operacijski sustav mora biti pristupačan — jer ako je hardver moćan, ali sve radi samo na Linuxovom Ubuntuu, prosječnom korisniku to neće biti lako savladati. Softverski sloj mora i kontrolirati što agent smije vidjeti, što smije mijenjati i kada treba tražiti korisnikovo odobrenje.

Pavan Davuluri, izvršni potpredsjednik Microsofta za Windows i uređaje, objasnio je da Windows prilagođava pristup jedinstvenoj memoriji i raspoređivanje radnog opterećenja kako bi veliki modeli mogli koristiti memoriju i GPU Gorgon Hala.

Microsoft je ranije najavio Microsoft Execution Containers — izolirano izvršno okruženje za agente koje štiti korisnika, podatke i uređaj; ta je mogućnost trenutno još u ranoj fazi pregleda.

Image

Microsoft je predstavio i Project Zenith — Windows iskustvo za programerski hardver koje je odmah spremno za rad. Zahtijeva najmanje 64 GB jedinstvene memorije, dolazi s predinstaliranim VS Codeom, WSL-om, GitHub Copilot CLI-jem, PowerShellom i skupom razvojnih postavki, a bit će dostupno prvo uz uređaje s Ryzen AI Halom.

Davuluri je uživo demonstrirao Alibabin novi model Qwen3.8-Flash-Next sa 125 milijardi parametara kako radi na Gorgon Halu — od pisanja jednostavnih funkcija, lokalne forenzičke analize osjetljivih datoteka, do generiranja cijele web stranice portfolia jednom rečenicom, sve bez spajanja na oblak.

Pavan je toj viziji dao ime: računalo će postati dom „unmetered intelligence” — inteligencije bez mjerenja i naplate.

Image

Od običnog AI računala temeljenog na Gorgon Pointu koje pokreće modele s 24 milijarde parametara, preko Gorgon Hala s 192 GB jedinstvene memorije, do Threadripper Halo Stationa koji cilja modele s više od bilijun parametara — AMD je postavio čitavu hijerarhiju hardvera za osobnu AI.

Hoće li taj put postati novi razlog za kupnju računala, ovisit će ne samo o stabilnosti uređaja, nego vjerojatno još više o tome koliko daleko otvoreni modeli mogu stići.

Čini se da upravo ti otvoreni modeli postaju „dobavljači streljiva” za globalnu priču o renesansi osobnih računala — hardverskim tvrtkama trebaju kako bi dokazale vrijednost lokalne računalne snage, a otvoreni modeli zauzvrat, zahvaljujući novom hardveru, šire svoj utjecaj na stolove diljem svijeta.

Izvor: Ifanr

Webimir
Webimir
Webimir čita po cijele dane i uvijek je u toku s najnovijim vijestima i trendovima. Voli podijeliti svoje znanje, i čitateljima prevodi vijesti iz svijeta olakšavajuči im tako snalaženje u labirintu informacija.
RELATED ARTICLES
- Advertisment -
Google search engine

Most Popular

Komentari Čitatelja