Ollama: модель на вашем компьютере одной командой
Программа, которая скачивает и запускает открытые модели локально: `ollama run qwen` — и через минуту чат без интернета и без отправки данных наружу.
Что получается
Запуск любой открытой модели под память вашей видеокарты, инструкция и параметры через Modelfile, API для своих программ, подключение интерфейсов с базой знаний (Open WebUI, AnythingLLM). Своя дообученная модель в GGUF импортируется одной командой.
Не получается: качество модели ограничено вашим железом; интерфейса из коробки нет — только терминал и API; самое частое в поиске «как оплатить ollama» — платить не за что, это бесплатная программа.
Сильные и слабые места
Данные не уходят
Всё считается локально.
Бесплатно
Открытый код, без подписок.
Нужна память
8 ГБ видеопамяти для моделей 7–8 млрд.
Терминал
Интерфейс — отдельными программами.
Своя модель в Ollama
Дообучили через Unsloth → экспорт в GGUF → Modelfile с путём и инструкцией → `ollama create` → модель с вашим стилем запускается как любая другая.
Настроить Ollama под мои данные
Агент подберёт модель под компьютер, напишет Modelfile с инструкцией и подготовит базу знаний из ваших документов.
Поставить задачу →Частые вопросы
Ollama платная?
Нет, полностью бесплатная программа с открытым кодом.
Работает без видеокарты?
Да, на процессоре, но медленно; для моделей от 7 млрд нужна видеокарта.