Device profile · Android
Best local LLMs for Generic Android Phone (8GB RAM)
Generic Android Phone (8GB RAM) has ~4.5 GB usable for model weights and runs 37 of 135 popular models. Best tool: PocketPal AI.
- Usable memory
- ~4.5 GB
- Models run
- 37
- Too large
- 98
- Top pick
- 3B
Runs at Q4_K_M using ~3.2 GB of ~4.5 GB usable.
Runs on Generic Android Phone (8GB RAM)
- TightGemma 4 E2B5.1B · ~4.4 GB at Q4_K_M
- TightGemma 3 4B4B · ~3.8 GB at Q4_K_M
- TightQwen3 4B4B · ~3.8 GB at Q4_K_M
- NE TightNemotron 3 Nano 4B4B · ~3.9 GB at Q4_K_M
- TightPhi-3.5-mini 3.8B3.82B · ~3.7 GB at Q4_K_M
- TightPhi-4-mini 3.8B3.8B · ~3.8 GB at Q4_K_M
- TightPhi-4-mini-reasoning3.8B · ~3.6 GB at Q4_K_M
- TightQwen2.5-VL 3B3.75B · ~4.4 GB at Q4_K_M
- YesGranite 4.1 3B3.4B · ~3.3 GB at Q4_K_M
- YesQwen2.5 3B3.09B · ~3.3 GB at Q4_K_M
- YesQwen2.5 Coder 3B3.09B · ~3 GB at Q4_K_M
- YesLlama 3.2 3B3B · ~3.2 GB at Q4_K_M
- YesSmolLM3 3B3B · ~3 GB at Q4_K_M
- OP YesApple OpenELM 3B3B · ~3 GB at Q4_K_M
- YesGemma 2 2B2.61B · ~2.9 GB at Q4_K_M
- YesGranite 3.1 2B2.53B · ~2.8 GB at Q4_K_M
- S YesSarvam-1 2B2B · ~2.7 GB at Q4_K_M
- YesSmolLM2 1.7B1.7B · ~2.2 GB at Q4_K_M
- YesQwen3 1.7B1.7B · ~2.4 GB at Q4_K_M
- YesQwen2.5 1.5B1.54B · ~2.2 GB at Q4_K_M
- YesQwen2.5 Coder 1.5B1.54B · ~2 GB at Q4_K_M
- MI YesMiniCPM-V 4.61.3B · ~1.6 GB at Q4_K_M
- LF YesLFM2 1.2B1.17B · ~2.5 GB at Q4_K_M
- LF YesLFM2.5 1.2B1.17B · ~1.8 GB at Q4_K_M
- LF YesLFM2.5 1.2B Thinking1.17B · ~1.8 GB at Q4_K_M
- TL YesTinyLlama 1.1B1.1B · ~1.8 GB at Q4_K_M
- OP YesApple OpenELM 1.1B1.1B · ~1.7 GB at Q4_K_M
- YesLlama 3.2 1B1B · ~1.8 GB at Q4_K_M
- YesGemma 3 1B1B · ~1.8 GB at Q4_K_M
- LF YesLFM2 700M0.742B · ~1.9 GB at Q4_K_M
- YesQwen3 0.6B0.6B · ~1.5 GB at Q4_K_M
- YesQwen2.5 0.5B0.494B · ~1.5 GB at Q4_K_M
- YesQwen2.5 Coder 0.5B0.494B · ~1.4 GB at Q4_K_M
- YesSmolLM2 360M0.362B · ~1.2 GB at Q4_K_M
- LF YesLFM2 350M0.354B · ~1.4 GB at Q4_K_M
- YesGemma 3 270M0.27B · ~1.1 GB at Q4_K_M
- YesSmolLM2 135M0.135B · ~1 GB at Q4_K_M
Too large for this device
Best way to run models on Android
Beginner: PocketPal AI, Polished app, download GGUF and run offline.
Power user: MLC LLM / LiteRT-LM, GPU/NPU acceleration paths for supported chips.
NPU acceleration is limited and chip-specific; most apps run on CPU. Expect 1B-4B class.
Full Android tool guide →FAQ
What is the best local LLM for Generic Android Phone (8GB RAM)?
Llama 3.2 3B is the strongest model that runs comfortably, using ~3.2 GB at Q4_K_M of the ~4.5 GB usable on Generic Android Phone (8GB RAM).
How much of Generic Android Phone (8GB RAM)'s memory can I use for a model?
About 4.5 GB. On a CPU-only machine, leave headroom for the OS and apps.
Which tool should I use on Android?
PocketPal AI (Polished app, download GGUF and run offline.) or MLC LLM / LiteRT-LM for speed. NPU acceleration is limited and chip-specific; most apps run on CPU. Expect 1B-4B class.
Compare nearby devices
Hardware with a similar usable pool, and how many of the 135 tracked models each runs next to Generic Android Phone (8GB RAM)'s 37.
Sources
Memory figures are estimates. See methodology.