Guida pratica per far girare Gemma 4 26B-A4B in locale su MacBook Pro M4 Pro (48 GB) tramite LM Studio 0.4.0 e il nuovo CLI headless lms — Il punto interessante: l’architettura mixture-of-experts attiva solo 4B parametri su 26B per token, il che la rende competitiva con modelli da 400B+ a 51 token/secondo su hardware consumer. Il capitolo finale mostra come puntare Claude Code su un modello locale tramite variabili d’ambiente — zero costi API, zero dati che lasciano la macchina.