Ollama

Ollama

Ollama 是一款在本地运行大语言模型的开源工具,支持 macOS、Linux 和 Windows。用户通过简单的命令行即可拉取并运行 Llama、DeepSeek、Qwen、Gemma 等模型,内置 OpenAI 兼容 API(默认 http://localhost:11434),是本地 AI 开发与集成的常用基座。 定价:开源免费。推荐指数:⭐ 4.7。

4.7
(23 评价)3.5k 浏览免费可用
Web
Ollama 是什么?

Ollama 是什么? 核心功能 值不值得用? 使用建议 适合谁用? Ollama 是一个在本地跑大语言模型的开源工具,支持 macOS、Linux 和 Windows。它的设计哲学就一个字:简。你只需要在终端里敲一行 ollama run llama3,它就会自动拉取模型并启动一个对话——不用配环境、不用下权重、不用懂推理框架。 对开发者来说,Ollama 更大的价值是它内置了一个 OpenAI 兼容的本地 API(默认跑在 http://localhost:11434),你手头基于 OpenAI SDK 的代码,把地址指过来就能调本地模型,几乎零改动。这也是为什么它成了很多本地 AI 项目的事实标准基座。 ollama run 即可拉取并启动对话。模型库里直接能拿到 Llama 3.3、DeepSeek-R1、Qwen 3、Gemma 3、Phi 等主流开源模型,无需自己去 Hugging Face 找权重。 Ollama 启动后自动在后台提供 API,格式兼容 OpenAI。开发者可以用现有的 SDK 直接调用本地模型做聊天、嵌入、补全,非常适合做隐私敏感或离线场景的原型。 支持 macOS、Linux、Windows,Windows 预览版已带内置 GPU 加速。模型库完整可用,含视觉模型,API 同样兼容 OpenAI。

  • 上手极简,一条命令就能用
  • 本地 API 兼容 OpenAI,集成成本几乎为零
  • 跨平台、支持 GPU 加速
  • 模型库丰富,社区活跃
  • 开源免费,可商用

优点

  • + 一条命令即可拉取运行模型,上手极简
  • + 内置 OpenAI 兼容 API,开发者集成成本低
  • + 支持 macOS / Linux / Windows(含 GPU 加速)
  • + 模型库丰富(DeepSeek-R1、Qwen、Llama、Gemma 等)
  • + 可搭配 LM Studio、Open WebUI 等生态工具

缺点

  • - 主要面向命令行,新手需要学习基础命令
  • - 大模型对本地硬件(显存/内存)要求较高
  • - 高级配置(多 GPU、并发)需一定经验

Ollama 是免费的吗?

Ollama 本身开源免费,可自由在本地安装使用;其云端增值服务(更大模型、并发等)为可选付费。

Ollama 支持哪些模型?

支持 Llama 3.3、DeepSeek-R1、Qwen 3、Gemma 3、Phi 等大量开源模型,均可通过模型库直接拉取。

Ollama 的 API 怎么用?

Ollama 启动后默认在 http://localhost:11434 提供 OpenAI 兼容 API,现有 OpenAI SDK 只需改 base_url 即可调用本地模型。

Ollama 和 LM Studio 有什么区别?

Ollama 以命令行和开发者工佛流为核心,轻量、适合集成;LM Studio 提供图形界面与模型商店。二者底层都能跑同类模型,常配合使用。

常见问题

用户评价