Пример проекта по запуску локальной LLM непосредственно на iPhone без использования сервера.
- Swift
- SwiftUI
- mlx-swift-lm
- swift-huggingface
- swift-transformers
https://github.com/ml-explore/mlx-swift-lm
Библиотека для запуска моделей MLX на устройствах Apple.
https://github.com/huggingface/swift-huggingface
Swift-клиент для работы с Hugging Face Hub: загрузка моделей, токенизаторов и других ресурсов.
https://github.com/huggingface/swift-transformers
Реализация Transformer-моделей на Swift с интеграцией в экосистему Hugging Face.
Модель:
mlx-community/Qwen3-1.7B-4bit
Подходит для большинства современных iPhone. Быстро отвечает и потребляет меньше оперативной памяти.
Модель:
https://huggingface.co/mlx-community/Llama-3.2-3B-Instruct-4bit
Лучшее соотношение качества ответов и производительности.
Модель:
Qwen/Qwen3-1.7B-MLX-bf16
Использует формат BF16, обеспечивает более высокое качество генерации, но требует значительно больше памяти и вычислительных ресурсов.
- iOS 18+
- Xcode 26+
- Устройство Apple Silicon (iPhone/iPad)
- Запуск LLM полностью локально
- Работа без подключения к интернету
- Загрузка моделей с Hugging Face
- Потоковая генерация ответов
- Поддержка нескольких моделей
- Полностью написано на Swift и SwiftUI