Ollama 是本地一键运行大模型的开源工具:下载即可在个人电脑上部署 Llama、Qwen、DeepSeek 等模型,提供命令行与 API 接口,是本地 AI 应用开发的热门底座。
AI Glossary
Ollama 是一个开源的本地大模型运行工具,让普通电脑也能一键部署和运行开源大模型(如 Llama、Qwen、DeepSeek、Mistral 等)。它把「下载模型、配置环境、启动服务」压缩为一条命令,大幅降低本地大模型的使用门槛。
Ollama 底层封装了模型下载、量化格式转换与推理引擎(llama.cpp 等)。用户通过命令拉取模型后,Ollama 以本地 HTTP 服务(默认 11434 端口)对外提供与 OpenAI 兼容的 API,开发者可直接替换接口使用,也可用内置 CLI 交互聊天。
本地运行效果取决于硬件(内存与显卡);个人电脑适合 7B~14B 参数的中小模型。Ollama 生态还包括 Modelfile 自定义、模型量化选择与集成开发工具,是本地 AI 时代的标志性工具之一。