llama-cpp

Библиотека на C++ для локального inference больших языковых моделей (LLM) в формате GGUF. Позволяет запускать LLM на CPU.

Подключение к проекту

conanfile.py

from conan import ConanFile

class Application(ConanFile):
    settings = "os", "compiler", "arch", "build_type"
    generators = "PkgConfigDeps", "CMakeDeps"

    requires = ("llama-cpp/<version>@aurora",)

.spec файл

%define __provides_exclude_from ^%{_datadir}/%{name}/lib/.*$
%define __requires_exclude ^(libgomp.*|libz.*|libllama.*|libggml.*|libcommon.*|libcurl.*|libssl.*|libcrypto.*)$

BuildRequires: conan

В секции %build:

CONAN_LIB_DIR="%{_builddir}/conan-libs/"
conan-install-if-modified --source-folder="%{_sourcedir}/.." --output-folder="$CONAN_LIB_DIR" -vwarning
PKG_CONFIG_PATH="$CONAN_LIB_DIR":$PKG_CONFIG_PATH
export PKG_CONFIG_PATH

CMakeLists.txt

include(FindPkgConfig)
pkg_check_modules(LLAMACPP REQUIRED IMPORTED_TARGET llama-cpp)
target_link_libraries(${PROJECT_NAME} PRIVATE PkgConfig::LLAMACPP)

Пример использования

Заголовочные файлы:

  • llama.h - основной API
  • chat.h - работа с chat templates
#include "llama.h"
#include "chat.h"
#include <iostream>

int main() {
    llama_model_params params = llama_model_default_params();
    std::cout << "Default GPU: " << params.main_gpu << std::endl;

    bool valid = common_chat_verify_template("chatml", false);
    std::cout << "chatml valid: " << valid << std::endl;

    return 0;
}

Использование в проекте

Документация по использованию Conan-пакетов для разработки приложений для ОС Аврора.

На сервере Conan библиотеки заранее собраны и размещены под различные версии ОС Аврора 4 и ОC Аврора 5. Для данных версий представлены архитектуры armv7hl, aarch64 и x84_64.

Библиотеку можно использовать в проекте с помощью данного conanfile.py

from conan import ConanFile

class Application(ConanFile):
    settings = "os", "compiler", "arch", "build_type"
    generators = "PkgConfigDeps"

    requires = (
        "llama-cpp/b9310@aurora",
    )    

Процесс локальной сборки описан в документации.

llama-cpp

Inference of LLaMA model in pure C/C++
Лицензия
MIT
Версия
Автор
Daniil Markevich <d.markevich@omp.ru>
Домашняя страница
Скачать
armv8
29.66 Mb
MD5: fcf417c1973a51db7573a754dc189d85
Updated: 25.05.2026, 17:50:08
armv7
29.33 Mb
MD5: 0390985369741a94127818a70280f86e
Updated: 25.05.2026, 17:51:01
x86_64
30.21 Mb
MD5: 27984d3ffdcf053ee47568383898e568
Updated: 25.05.2026, 17:51:24
Использование в проекте

Мы используем cookies для персонализации сайта и его более удобного использования. Вы можете запретить cookies в настройках браузера.

Пожалуйста ознакомьтесь с политикой использования cookies.