Автор Тема: Падение llama.cpp/ollama на старом железе  (Прочитано 218 раз)

Оффлайн antsiest

  • Участник
  • *
  • Сообщений: 21
Ноутбук с процессором Intel Core i7-3612QM (Ivy Bridge). Видеокарты старенькие, встроенная Intel HD 4000 и дискретная NVIDIA GT 610M. Проц поменял, но видеокарты слишком старые для текущего пакета из репозитория.

При попытке запустить модель по стандартным мануалам сервер падает сразу после старта. В терминале видна ошибка инициализации Vulkan и вызов `abort()`.

В пакете `llama.cpp` жестко прописан путь (`RPATH=/usr/lib/llama/`). При старте программа принудительно грузит `libggml-vulkan.so` и пытается создать Vulkan-контекст на HD 4000. Драйвер Mesa ANV для Ivy Bridge не поддерживает 16-битные операции (`fp16: 0`), возвращает `Invalid device`, и процесс аварийно завершается. NVIDIA GT 610M (CC 2.1) также не поддерживается современным CUDA-бэкендом.

Ниже рабочий мануал для такого железа. `libggml-vulkan.so` - это не системный драйвер Mesa, а плагин ggml, его временное переименование безопасно.

Запуск в llama.cpp (консоль и веб)
root# apt-get install llama.cpp
root# mv /usr/lib/llama/libggml-vulkan.so /usr/lib/llama/libggml-vulkan.so.bak
# Консольный
User$ llama-cli -hf bartowski/Qwen2.5-3B-Instruct-GGUF:Q4_K_M -ngl 0 -c 4096 --threads 4
Модель в `~/.cache/llama.cpp/`.
User$ llama-server -hf bartowski/Qwen2.5-3B-Instruct-GGUF:Q4_K_M -ngl 0 -c 4096 --threads 4 --port 8081
Веб интерфейс http://localhost:8081/

Возврат после остановки (Ctrl+C):
root# mv /usr/lib/llama/libggml-vulkan.so.bak /usr/lib/llama/libggml-vulkan.so

Сейчас пакет ведет себя не очень дружелюбно на старом железе. Если на этапе `ggml_vulkan_init()` возникает `VK_ERROR_INITIALIZATION_FAILED` (как на HD 4000), программа сразу падает через `abort()`.
Хотелось бы, чтобы в таких случаях она выдавала warning и просто откатывалась на CPU-бэкенд.

---
*P.S. В ollama аналогичная история - внутренний тот же `llama.cpp`, падает.
« Последнее редактирование: 20.07.2026 04:42:30 от antsiest »

Оффлайн SerW

  • Участник
  • *
  • Сообщений: 399
    • Вперед, в Интернет!
Re: Падение llama.cpp/ollama на старом железе
« Ответ #1 : 20.07.2026 09:04:30 »
Понятное дело, что вам нужно менять железо.
У меня очень много железок в продаже, как вариант, хочу вам предложить ноутбук: https://gibibyte.ru/comet-lake-u:10210u.
dragonserw.ru/wiki:basealt

Оффлайн antsiest

  • Участник
  • *
  • Сообщений: 21
Re: Падение llama.cpp/ollama на старом железе
« Ответ #2 : 20.07.2026 14:33:37 »
Понятное дело, что вам нужно менять железо.
У меня очень много железок в продаже, как вариант, хочу вам предложить ноутбук: https://gibibyte.ru/comet-lake-u:10210u.

Благодарю. Мне моего i7 (4C/8T, 8 ГБ) для LaTeX хватает с головой, а LLM на базе​ Qwen2.5-3B. Мне важно, чтобы связка LaTeX + LLM не душилась.

Оффлайн sasha-ant

  • Участник
  • *
  • Сообщений: 20
Re: Падение llama.cpp/ollama на старом железе
« Ответ #3 : 20.07.2026 20:01:23 »
Цитировать
root# apt-get install llama.cpp
так может стоит поставить
llama.cpp-cpu
llama.cpp tools including backend for CPU

Оффлайн antsiest

  • Участник
  • *
  • Сообщений: 21
Re: Падение llama.cpp/ollama на старом железе
« Ответ #4 : 21.07.2026 08:46:23 »
так может стоит поставить
llama.cpp-cpu
llama.cpp tools including backend for CPU

Благодарю, попробую грохнуть вулкан.

root # apt-cache search llama.cpp
libllama - Shared libraries for llama.cpp
libllama-devel - Development files for llama.cpp
llama.cpp - LLM inference in C/C++
llama.cpp-cpu - llama.cpp tools including backend for CPU
llama.cpp-cuda - llama.cpp backend for NVIDIA GPU
llama.cpp-vulkan - llama.cpp backend for GPU

Не смотрел все пакеты, которые ставятся с  `llama.cpp`.
А вы предлагаете делать установку без `llama.cpp-vulkan`.

Оффлайн sasha-ant

  • Участник
  • *
  • Сообщений: 20
Re: Падение llama.cpp/ollama на старом железе
« Ответ #5 : 21.07.2026 17:07:07 »
я например поставил llama.cpp-cuda, и llama.cpp-cpu. и это работает на нвидиа карте+ЦП. Скорее всего если удалить все и поставить только llama.cpp-cpu то будет нормально запускаться без проблем с видеокартой встроеной которая все равно ничего не дает
« Последнее редактирование: 21.07.2026 20:02:06 от sasha-ant »