local-model-infra

最佳 llama.cpp 替代品

llama.cpp 是 GGUF 本地推理的基础栈,支撑大量桌面与服务端运行器。

访问 llama.cpp

工具详情

基础信息

属性详情
发布时间2023
发布公司ggerganov / community
发布国家国际社区
国家/区域限制本地运行

价格

属性详情
计费模式open-source
免费档
起步价$0/mo
方案 1Open Source: Free

功能清单

功能详情
操作系统平台macOS / Windows / Linux
模型管理界面 (新增了 Web UI 管理页面)https://github.com/ggml-org/llama.cpp/discussions/16938
本地推理
OpenAI 兼容 API
GPU 加速
代码向量化
多模型支持
Docker 支持
开源https://github.com/ggml-org/llama.cpp
可自托管
隐私模式
团队协作
使用场景高性能本地/边缘推理引擎,面向 GGUF 与定制构建

优缺点

优点

  • 极度可移植且高效
  • 许多本地工具的底层依赖
  • 提供 Server 模式做本地 API

缺点

  • 更底层,比 Ollama/LM Studio 更 DIY
  • UI 与打包很精简
  • 后端调优需要经验

免责声明:非金融或投资建议,仅供开发者工具对比与教育用途。信息可能变更,购买前请以厂商官网为准。