ollama
访问官网
Ollama
模型运行
本地运行AI
详情介绍
Ollama 是目前最流行的本地运行开源大模型工具,支持 macOS、Windows、Linux 三大平台。用户可以通过简单的命令行或 API 一键下载并运行 DeepSeek、Qwen、GLM、Llama、Mistral 等数百种开源模型,数据完全本地处理。Ollama 也是 Claude Code、OpenCode、Hermes Agent 等 AI 编程工具的默认本地模型后端。
🚀 最新动态(2026年)
- 最新版本 v0.32.9(2026-08-11):持续高频迭代,驱动性能与模型兼容性
- Cloud 服务上线:支持在云端运行模型,覆盖美国、欧洲、新加坡三个区域
- 生态扩展:成为 Claude Code、OpenCode、Hermes Agent 等工具的默认本地推理后端
- 模型库繁荣:支持数百种模型,GLM-5.2、DeepSeek-V4-Flash、Kimi-K3 等热门模型持续更新
⚡ 核心功能
- 一键运行模型:ollama run 命令即可下载并运行开源模型,无需配置
- 模型管理:pull、push、list、rm 等完整模型生命周期管理
- OpenAI 兼容 API:内置 REST API,兼容 OpenAI 格式,无缝对接现有应用
- Modelfile 定制:通过 Modelfile 自定义模型参数、提示词模板、系统消息
- 多平台支持:macOS、Windows、Linux 全覆盖,支持 GPU 加速
- Cloud 模式:在云端运行模型,可选区域部署
- 隐私保护:数据不用于训练,可完全离线运行
🎯 适用场景
- 本地 AI 开发:开发者快速在本地运行和测试开源模型
- AI 编程工具后端:作为 Claude Code、OpenCode 等工具的本地推理引擎
- 隐私敏感应用:数据不出本地,适合内网和保密场景
- 模型评估:快速切换不同模型进行对比和评估
💪 平台优势
- 极简操作:一条命令运行模型,零配置学习成本
- 生态庞大:最广泛的本地模型运行生态,支持数百种模型
- API 标准:OpenAI 兼容 API,无缝集成现有工具链
- 社区活跃:GitHub 上最热门的 LLM 工具之一,更新极其频繁
- 本地+云端:既支持本地离线运行,也提供云端服务