
Ollama 0.31 e Gemma 4: +90% di velocità su Apple Silicon
Scopri come il nuovo aggiornamento di Ollama accelera Gemma 4 su Mac grazie alla tecnica Multi-Token Prediction per una programmazione più fluida.
6 articoli con questo tag

Scopri come il nuovo aggiornamento di Ollama accelera Gemma 4 su Mac grazie alla tecnica Multi-Token Prediction per una programmazione più fluida.

Scopri come Gemma 4 sta rivoluzionando lo sviluppo IA con applicazioni on-device, visione multimodale e gestione avanzata del contesto per la gamification.

Scopri come LiteRT-LM ottimizza l'inferenza di Gemma 4 su mobile e desktop, migliorando la velocità fino a 2,2 volte grazie alla tecnologia MTP.

Google DeepMind introduce il Quantization-Aware Training per Gemma 4, rendendo l'IA eseguibile localmente su smartphone e PC con soli 1 GB di RAM.

Scopri Gemma 4 12B, il nuovo modello multimodale di Google DeepMind: architettura senza encoder, efficienza locale e integrazione su laptop con 16GB di RAM.

Abbiamo testato tre dei più piccoli LLM locali (sotto i 2B di parametri): Gemma 4, Qwen 3.5 e LFM2.5. Ecco come si comportano nei compiti quotidiani.