工具 · 第 2026-07-14

Ollama v0.32.0:本地运行转型智能工作

Ollama 发布 v0.32.0:直接运行 ollama 命令现在会启动一个交互式智能体,可以聊天、写代码、联网搜索并委派实际工作。本地模型运行时正式向智能体入口转型。

Ollama Releases2026-07-14值得跟踪

基础信息较完整,适合持续跟踪并等待更多验证。

AI 智能体端侧 AI推理与部署

版本脉络

这条信号已有后续

你正在读的是这条线上较早的一条,之后还有 1 条,最新的是「Ollama v0.32.4:Apple GPU 上的 Laguna 支持与推测解码草稿量化」。

  1. 2026-07-08Ollama v0.31.2:本地大模型运行时发布稳定版
  2. 2026-07-14Ollama v0.32.0:本地运行时转型智能体工作台当前
  3. 2026-07-25Ollama v0.32.4:Apple GPU 上的 Laguna 支持与推测解码草稿量化最新

从 v0.31.2 收尾的运行时稳健性,跨到「直接运行即进入交互式智能体」的形态转型。

记录

信号正文

Ollama 发布 v0.32.0,核心变化是一个新的交互式智能体体验:现在直接运行 ollama 命令,启动的不再是模型管理界面,而是一个能聊天、写代码、联网搜索并委派实际工作的智能体(横幅默认模型为 glm-5.2:cloud)。

配套变化都指向同一个方向:Codex App 集成更名为 ChatGPT(ollama launch chatgpt,可用 --restore 恢复原有配置),launch 菜单精简为最常用的集成项,而 CodeLlama、Qwen2.5(-coder)、Llama 3.x、Mistral、StarCoder 和基础版 DeepSeek-R1 这批旧一代模型在启动前会收到弃用警告。

这是 Ollama 定位的一次明确转向:从「把开源模型跑在本地的运行时」变成「智能体工作的入口」。值得注意的是默认横幅里的 glm-5.2:cloud 是云端模型——本地运行时主动拥抱本地/云混合,说明纯本地推理与云端能力的边界正在产品层面被重新划分。上一个稳定版 v0.31.2 还聚焦 iGPU 卸载这类底层可用性,两个版本相隔不到一周,转型节奏相当激进。具体变更请以原始版本说明为准。

为什么是现在

为什么重要

装机量巨大的本地运行时把默认入口从「跑模型」换成「用智能体」,意味着智能体交互正在成为 AI 工具的默认形态,而不再是附加功能;本地/云混合的默认配置也预示端侧与云端的分工进入新阶段。

背景

技术背景

Ollama 原本封装模型下载、GGUF 加载和本地服务接口。v0.32.0 在此之上叠加了智能体层:命令行入口直接对话、调用工具(写码/搜索/委派),并通过 launch 集成打通外部智能体应用(如 ChatGPT)。默认模型 glm-5.2:cloud 表明它的智能体体验采用本地运行时 + 云端模型的混合架构,而非强制纯本地。

按你的水平解读

让 AI 按你的水平解读这个信号

选择你的经验水平,AI 会现场生成一份为这个水平定制的解读。

关注人群

谁该关注

本地/端侧应用开发者AI 工具链与开发者体验工程师评估智能体工作流落地的团队
可能影响的领域
开发者工具端侧 AI智能体工作流

下一步

学习路径

  1. 升级到 v0.32.0,直接运行 ollama 体验智能体入口与旧版的差异。
  2. 结合「工具使用与函数调用」理解智能体委派工作的基本机制。
  3. 对照「模型选型与约束匹配」,理解为什么旧一代模型会被标记弃用、云模型成为默认。
  4. 用「智能体工作流设计」的框架评估:哪些日常任务适合从手动操作迁移到委派给本地智能体。

怎么学起

让 AI 生成一条学习路径

基于本页的相关知识和相关技能,AI 会现场生成一条从基础到应用的学习路径。

关系网络

在技术网络中的位置

当前技术与相邻技术、技能和背景知识的连接,点击节点可继续探索。

技术对比

对比另一项技术

选择另一项已发布技术,让 AI 现场生成一份相似点、差异点和适用场景的对比。

延伸思考

后续问题

  • 智能体模式下哪些操作会触碰本地文件系统和网络,权限边界如何配置?
  • 默认 glm-5.2:cloud 云模型时,哪些数据会离开本地设备,隐私敏感场景如何回退纯本地?
  • 被弃用警告的旧模型还能继续用多久,迁移路径是什么?

来源参考

Ollama Releases

Ollama开源社区2026-07-14
打开原始来源https://github.com/ollama/ollama/releases/tag/v0.32.0