"Nešto kao topljeni sir – kad pravi sir više nije za konzumaciju, sirana ga pretopi i prodaje kao nešto novo u trokutima omotanim folijom." - I can't unsee it now. 
- +/- sve poruke
- ravni prikaz
- starije poruke gore
Drago baš naivan...AI iskače iz paštete...dobro jutro hrvatska..otvoreno...AP priča o njemu...vatikan izdaje svoje...triba taj hype iskoristiti...a kasnije
"Ono kad RTX 4080 star 4 godine sa 16 GB VRAM-a pomete namjenski uređaj sa 128 GB memorije."
Koliko je RTX 4080 trošio prilikom tog pometanja?
Sve da je trošio podjednako (nije), logika u srazu s marketingom puši samo tako. ¯\_(ツ)_/¯
"Izvor: vlastito mjerenje, 168 izvođenja, sedam modela, osam tipova upita"
Zanimljivo, fali prvi model koji bih ja isprobao na tome: Gemma4 26B.
Nis pametno za dodati, osim hvala Dragi na odlicnom clanku!
Biti ce zanimljivo vidjeti kako cemo koristiti AI nakon posljednjeg poskupljenja, i koliko cemo moci lokalno procesirati, pogotovo sto je gotovo nemoguce vrtiti frontier modele lokalno (i sto su propriatery), a koliko cemo se maknuti sa Copilot/Claude/... na Opencode, Openrouter i kineske jeftine modele. Ovaj MS laptop je izgleda i nazalost dead on arrival.
"Naša su mjerenja, usput, pokazala da uređaj tijekom rada s velikim modelom vuče svega četrdesetak do pedesetak vata - ne zato što je štedljiv, nego zato što grafička jezgra gladuje čekajući memoriju". U protivnom laptop bi se pregrijavao, tako da je limit od svega 273 gigabajta očekivan. A ništa, čekamo desktop verziju ili N2/N2X
Prvobitna najava Nvidie još 2025. godine išla je u smjeru da će kreirati ARM CPU s ugrađenom RTX grafičkom karticom. I to je trebao biti CPU opće namjene za desktope i mobilne uređaje. Dakle, Windows on ARM uz punu brzinu grafičke kartice kakve imamo danas na desktopima, uz potrošnju energije i zagrijavanje na nivou Macbooka. Kuda i zašto su zabrijali s ovim AI glupostima, nije mi uopće jasno.
Jako dobar članak na temu AI. Hvala! 
Kao i prethodni članci na istu temu.
Uspio sam zavrtiti lokalno model sa 235 milijardi parametara i dobiti 18 tokena po sekundi, i to je dosta pristojan rezultat za tako veliki model. Manji modeli od 30B do 70B su dosta brži.
Računalo je staro 2 godine. Me happy. Bit ce ok za development.
Jako dobar članak na temu AI. Hvala! 
Kao i prethodni članci na istu temu.
Uspio sam zavrtiti lokalno model sa 235 milijardi parametara i dobiti 18 tokena po sekundi, i to je dosta pristojan rezultat za tako veliki model. Manji modeli od 30B do 70B su dosta brži.
Računalo je staro 2 godine. Me happy. Bit ce ok za development.
Tko bi rekao da će i apple jednom biti kralj isplativosti 

