NVIDIA accelera lo sviluppo dell’IA agentica locale con i modelli compatti Gemma 4

Nell’appuntamento di RTX AI Garage di questa settimana parliamo della collaborazione tra NVIDIA e Google per portare nuove capacità agentiche sui PC e sui dispositivi edge. NVIDIA ha infatti annunciato l’ottimizzazione dei nuovi modelli open Gemma 4 per l’infrastruttura AI NVIDIA, dai PC RTX e DGX Spark fino alle piattaforme Jetson e alle GPU Blackwell, aprendo la strada a una nuova generazione di applicazioni AI locali.

La famiglia Gemma 4 introduce modelli compatti ma altamente performanti, progettati per supportare ragionamento, coding, comprensione multimodale e utilizzo di strumenti. Tra i principali punti:

  • i modelli E2B ed E4B, ultra-efficienti e leggeri, pensati per inferenza a bassa latenza e completamente offline su dispositivi edge come smartphone e Jetson Orin Nano, ideali per esperienze AI in tempo reale e sempre attive;
  • i modelli 26B e 31B, più avanzati, progettati per attività complesse come ragionamento, sviluppo software e flussi di lavoro agentici, eseguiti in modo efficiente su GPU NVIDIA RTX e DGX Spark.

Grazie all’integrazione con tool come Ollama e llama.cpp, e con framework come OpenClaw e Unsloth Studio, gli utenti possono sviluppare e distribuire agenti intelligenti capaci di sfruttare il contesto personale in tempo reale, dai file locali ai workflow, automatizzando attività e migliorando la produttività.

Translate »