513 4 weeks ago

Ultra-fast multimodal 2.3B Gemma 4 for on-device edge AI (3.7GB). Adds native vision/audio parsing to Unsloth Dynamic QAT with a 2-token MTP pipeline and a mobile-safe 32K context window. Perfect for smartphones and laptops sharing 8GB of total RAM.

vision tools thinking
ollama run 4skl/gemma4-e2b-mtp

Applications

Claude Code
Claude Code ollama launch claude --model 4skl/gemma4-e2b-mtp
OpenCode
OpenCode ollama launch opencode --model 4skl/gemma4-e2b-mtp
Hermes Agent
Hermes Agent ollama launch hermes --model 4skl/gemma4-e2b-mtp
OpenClaw
OpenClaw ollama launch openclaw --model 4skl/gemma4-e2b-mtp

Models

View all →

Readme

No readme