在本地设备上高效运行大语言模型的C++推理引擎
无需联网,在本地设备上运行大语言模型
支持Windows、macOS、Linux等多种操作系统
通过量化技术减少模型体积,提升推理速度
体积小、依赖少,适合边缘设备或嵌入式场景
从GitHub克隆仓库
编译项目(支持CMake)
下载量化模型文件
运行命令行推理
独立多模型事实核查API,适用于AI工作流程
AI技能库,支持多平台
快速构建、发布和盈利AI代理
拥有第二大脑的智能助手,支持讨论和知识管理