llama.cpp строит b7492 до последней версии b9060, содержит уязвимость использования после освобождения в llama-server, затрагивающую шесть конечных точек токенизации (/tokenize, /detokenize, /infill, /apply-template, /rerank и /anthropic/count_tokens), которые обходят очередь задач и получают доступ к ctx_server.vocab непосредственно в рабочих потоках HTTP. Злоумышленники могут воспользоваться состоянием гонки «время проверки-время использования», когда основной поток уничтожает и освобождает словарный запас после снятия блокировки синхронизации, но до того, как обработчик завершит его использование, что приводит к сбою или потенциальному выполнению кода, когда настроен --sleep-idle-секунды.
Показать оригинальное описание (EN)
llama.cpp builds b7492 through the latest b9060 contains a use-after-free vulnerability in llama-server affecting six tokenization endpoints (/tokenize, /detokenize, /infill, /apply-template, /rerank, and /anthropic/count_tokens) that bypass the task queue and access ctx_server.vocab directly on HTTP worker threads. Attackers can exploit a time-of-check-time-of-use race condition where the main thread destroys and frees vocab after the synchronization lock is released but before the handler finishes using it, causing a crash or potential code execution when --sleep-idle-seconds is configured.
Характеристики атаки
Последствия
Строка CVSS v4.0