7 articles · page 1 of 1
Running Gemma 4 26B at 5 tokens/sec on a 13-year-old Xeon with no GPU
2026-07-15
Gemma 4 QAT models: Optimizing compression for mobile and laptop efficiency
2026-06-05
Accelerating Gemma 4: faster inference with multi-token prediction drafters
2026-05-05
Google Gemma 4 Runs Natively on iPhone with Full Offline AI Inference
2026-04-15
I ran Gemma 4 as a local model in Codex CLI
2026-04-12
April 2026 TLDR Setup for Ollama and Gemma 4 26B on a Mac mini
2026-04-03
Google releases Gemma 4 open models
2026-04-02