非影资讯
面向安全从业者的中英双语安全研究与漏洞情报精选。

llama.cpp:C/C++ 实现的高性能开源 LLM 推理引擎

摘要

llama.cpp:基于 GGML 的无依赖 C/C++ 大模型推理引擎,支持 1.5–8 bit 量化与 Apple Silicon、CUDA、Vulkan、CPU 等后端,是本地大模型工具链的核心底座。

为什么值得关注

作为离线部署与私有化大模型的核心底层架构,为安全研究、内网脱机测试与防止敏感数据出境的 AI 安全实战环境提供了强力支撑。
发布时间
收录时间

原文 ↗

相关内容

返回