
LLM runner (local 100%)
On-device AI chat, no network
0 ratings
Free
Rating summary
About
Run LLM on your iPhone, 100% local, no network
(Network needed once to download a model)
Models:
• Qwen2.5 0.5B Instruct — ~0.4 GB (4 GB RAM)
• Llama 3.2 1B Instruct — ~0.8 GB (4 GB RAM)
• Qwen2.5 1.5B Instruct — ~0.9 GB (4 GB RAM)
• Llama 3.2 3B Instruct — ~1.9 GB (6 GB RAM)
• Qwen3 4B Instruct 2507 — ~2.5 GB (6 GB RAM)
• Qwen2.5 7B Instruct — ~4.4 GB (8 GB RAM)
Requires iOS 18 or later.
Qwen models © Alibaba Cloud. Licensed under Apache License 2.0.
Llama 3.2 is licensed under the Llama 3.2 Community License, Copyright © Meta Platforms, Inc. All Rights Reserved. Built with Llama.
On-device inference uses llama.cpp (MIT License).
Show more
What's New in LLM runner (local 100%)
0.1.537
August 26, 2026



