项目简介
Ollama 把「下载权重、量化、配环境、跑推理」这一整套复杂流程压缩成了一条命令。ollama run qwen3 回车,模型就能在终端里和你对话。它极大降低了本地大模型的使用门槛,是当下本地 AI 生态的事实标准,Open WebUI、LobeChat 等主流界面都原生支持它。
亮点
- 极简体验:
ollama run 模型名即拉即用,像装 App 一样装模型 - 模型库丰富:Llama、Qwen、DeepSeek、Gemma、Phi 等主流开源模型全覆盖
- 自动适配硬件:自动检测显存并选择合适的量化版本
- OpenAI 兼容 API:本地起一个
11434端口,任何 OpenAI 客户端都能直接连 - 跨平台:macOS / Windows / Linux 全支持
适合谁用
- 想离线、隐私安全地使用大模型的任何人
- 玩本地模型但没有显卡调参精力的普通用户
- 需要本地推理 API 做开发的程序员
快速上手
# 安装后一条命令即可对话
ollama run deepseek-r1