Kako bi podesio neki lokalni LLM da to odradi? Ja sam protiv dopustanja cloud resenjima da drkaju po diskovima i da rade to sto kazu da rade.
Možeš Hermes, OpenClaw, verovatno i LM Studio... Samo imaj u vidu da je lokalni model tipa 30B sa manjom kvantizacijom daleko inferiorniji. Ja nemam ograničenje RAM-a (128GB), ali ako učitaš veliki model na DGX Spark, radi dosta sporije nego manji model.
Tu je sada taj problem sa cenama hardvera. Takvo eksperimentisanje bi imalo smisla da npr. DGX Spark košta 1500 eura, a RTX 5090 nije >5000 eur. I sada je tu pitanje isplativosti, Claude Max je 100$, a DGX Spark je 7000-8000$. To je 70-80 meseci pretplate.
Što se tiče podataka, na boot drajvu nema ništa, odavno ne držim podatke tamo.
Ovo sa boot drajvom je samo eksperiment, ne treba mi Claude da mi čisti disk. Ipak, neverovatno je koliko stvari može da odradi npr. na Web Serveru, ako mu daš SSH. Ne samo da mu ti kažeš šta da radi, već mnogo toga i sam pronalazi. Ne bih bio siguran da lokalnom modelu dam pristup production serveru.
Drugi primer gde bi možda lokalni model bio primereniji, je Vibe Coding. Povezao sam Claude na XCode... Napravio za tipa 10 minuta app koja menja inpute na monitoru da ne bih za to korstio BetterDisplay. Task je bio da dva monitora prebacuje na odgovarajuće inpute koji su povezani na dva različita Mac-a. Testirao je sam DDC signale, prepoznao gde je šta povezano, mapirao, kompajlirao, dodelio Apple sertifikat da se Gatekeeper ne buni itd... Mislim da bi to mogao i npr. QWEN3.8, možda bi bilo više pokušaja i grešaka, ali bi na kraju odradio.

