Upravo vidim na viberu da su ubacili neku opciju tog tipa a možeš chatgpt da uvežeš to jes da se uloguješ na svoj nalog.
Bez brige to nije AGI 🙂
Upravo vidim na viberu da su ubacili neku opciju tog tipa a možeš chatgpt da uvežeš to jes da se uloguješ na svoj nalog.

Kako bi podesio neki lokalni LLM da to odradi? Ja sam protiv dopustanja cloud resenjima da drkaju po diskovima i da rade to sto kazu da rade.


Računica 7-8k za lokalni hardver naspram $100 mesečno jeste brutalna, ali mislim da se ovde pomalo mešaju dve različite stvari: privatnost i bezbednost izvršavanja.Možeš Hermes, OpenClaw, verovatno i LM Studio... Samo imaj u vidu da je lokalni model tipa 30B sa manjom kvantizacijom daleko inferiorniji. Ja nemam ograničenje RAM-a (128GB), ali ako učitaš veliki model na DGX Spark, radi dosta sporije nego manji model.
Tu je sada taj problem sa cenama hardvera. Takvo eksperimentisanje bi imalo smisla da npr. DGX Spark košta 1500 eura, a RTX 5090 nije >5000 eur. I sada je tu pitanje isplativosti, Claude Max je 100$, a DGX Spark je 7000-8000$. To je 70-80 meseci pretplate.
Što se tiče podataka, na boot drajvu nema ništa, odavno ne držim podatke tamo.
Ovo sa boot drajvom je samo eksperiment, ne treba mi Claude da mi čisti disk. Ipak, neverovatno je koliko stvari može da odradi npr. na Web Serveru, ako mu daš SSH. Ne samo da mu ti kažeš šta da radi, već mnogo toga i sam pronalazi. Ne bih bio siguran da lokalnom modelu dam pristup production serveru.
Drugi primer gde bi možda lokalni model bio primereniji, je Vibe Coding. Povezao sam Claude na XCode... Napravio za tipa 10 minuta app koja menja inpute na monitoru da ne bih za to korstio BetterDisplay. Task je bio da dva monitora prebacuje na odgovarajuće inpute koji su povezani na dva različita Mac-a. Testirao je sam DDC signale, prepoznao gde je šta povezano, mapirao, kompajlirao, dodelio Apple sertifikat da se Gatekeeper ne buni itd... Mislim da bi to mogao i npr. QWEN3.8, možda bi bilo više pokušaja i grešaka, ali bi na kraju odradio.
Pogledajte prilog 554069Pogledajte prilog 554070
Računica 7-8k za lokalni hardver naspram $100 mesečno jeste brutalna, ali mislim da se ovde pomalo mešaju dve različite stvari: privatnost i bezbednost izvršavanja.
Lokalni model rešava prvi problem - podaci ne moraju da napuste tvoju mašinu. Ali ne rešava automatski drugi. Ako lokalnom agentu daš shell, SSH ključ i write pristup produkciji, može da napravi potpuno isti haos kao cloud agent. Obrnuto, cloud model možeš prilično da ograničiš ako između njega i sistema postoji dobar permission layer.
Zato mislim da sledeći veliki skok kod agenata neće biti samo još pametniji model, nego infrastruktura oko njega. Read-only po defaultu, privilegije samo za konkretan task, prikaz plana ili diff-a pre destruktivne akcije, snapshot/rollback i detaljan log svega što je uradio. Neka sam sortira fajlove, traži spam ili kompajlira aplikaciju, ali za brisanje, firewall, produkcioni DB, deployment ili promenu globalnih mail pravila neka postoji još jedna kapija.
Posebno je zanimljiva kombinacija kada isti agent čita mail/web i istovremeno ima pravo da izvršava komande. Tada sadržaj koji čita više nije samo kontekst, već može posredno da utiče na ono što će uraditi. Tu bih više verovao dobrom sandboxu i sistemu dozvola nego samoj etiketi "lokalno".
Meni zapravo najlogičnije deluje hibrid: jak model može da planira i rezonuje, ali lokalni broker odlučuje koje operacije uopšte smeju da prođu, bez obzira šta mu model zatraži.
Jer pravi napredak nije da agent može da klikne baš sve što može i čovek. Pravi napredak je da mu možeš dati dovoljno slobode da zaista štedi vreme, a da jedna pogrešna odluka ne pretvori demonstraciju od 10 minuta u vikend vraćanja bekapa. 🙂
Samo, MCP je način da model dođe do toolova.
Stopirali su treniranje a obični ljudi ga treniraju svake sekunde... Iz kontrolisane sredine dolazi do pristupa internetu, agenti komunicriaju izmedju sebe, laže i vara. To više nije alatka već entitet. Kako su pristupili zaštiti autorskih prava za sve ove godine, koja uopšte ne postoji, tako će pristupiti i ovome.![]()
OpenAI halts training of latest models as reports mount of AI agents going rogue
Decision follows disclosures that OpenAI agents searching government websites had acted in unexpected wayswww.theguardian.com
Follow along with the video below to see how to install our site as a web app on your home screen.
Napomena: this_feature_currently_requires_accessing_site_using_safari