Ollama v0.32.0:本地运行时转型智能体工作台
Ollama 发布 v0.32.0:直接运行 ollama 命令现在会启动一个交互式智能体,可以聊天、写代码、联网搜索并委派实际工作。本地模型运行时正式向智能体入口转型。
基础信息较完整,适合持续跟踪并等待更多验证。
版本脉络
这条信号已有后续
你正在读的是这条线上较早的一条,之后还有 1 条,最新的是「Ollama v0.32.4:Apple GPU 上的 Laguna 支持与推测解码草稿量化」。
- 2026-07-08Ollama v0.31.2:本地大模型运行时发布稳定版
- 2026-07-14Ollama v0.32.0:本地运行时转型智能体工作台当前
- 2026-07-25Ollama v0.32.4:Apple GPU 上的 Laguna 支持与推测解码草稿量化最新
从 v0.31.2 收尾的运行时稳健性,跨到「直接运行即进入交互式智能体」的形态转型。
记录
信号正文
Ollama 发布 v0.32.0,核心变化是一个新的交互式智能体体验:现在直接运行 ollama 命令,启动的不再是模型管理界面,而是一个能聊天、写代码、联网搜索并委派实际工作的智能体(横幅默认模型为 glm-5.2:cloud)。
配套变化都指向同一个方向:Codex App 集成更名为 ChatGPT(ollama launch chatgpt,可用 --restore 恢复原有配置),launch 菜单精简为最常用的集成项,而 CodeLlama、Qwen2.5(-coder)、Llama 3.x、Mistral、StarCoder 和基础版 DeepSeek-R1 这批旧一代模型在启动前会收到弃用警告。
这是 Ollama 定位的一次明确转向:从「把开源模型跑在本地的运行时」变成「智能体工作的入口」。值得注意的是默认横幅里的 glm-5.2:cloud 是云端模型——本地运行时主动拥抱本地/云混合,说明纯本地推理与云端能力的边界正在产品层面被重新划分。上一个稳定版 v0.31.2 还聚焦 iGPU 卸载这类底层可用性,两个版本相隔不到一周,转型节奏相当激进。具体变更请以原始版本说明为准。
为什么是现在
为什么重要
装机量巨大的本地运行时把默认入口从「跑模型」换成「用智能体」,意味着智能体交互正在成为 AI 工具的默认形态,而不再是附加功能;本地/云混合的默认配置也预示端侧与云端的分工进入新阶段。
背景
技术背景
Ollama 原本封装模型下载、GGUF 加载和本地服务接口。v0.32.0 在此之上叠加了智能体层:命令行入口直接对话、调用工具(写码/搜索/委派),并通过 launch 集成打通外部智能体应用(如 ChatGPT)。默认模型 glm-5.2:cloud 表明它的智能体体验采用本地运行时 + 云端模型的混合架构,而非强制纯本地。
关注人群
谁该关注
下一步
学习路径
- 升级到 v0.32.0,直接运行 ollama 体验智能体入口与旧版的差异。
- 结合「工具使用与函数调用」理解智能体委派工作的基本机制。
- 对照「模型选型与约束匹配」,理解为什么旧一代模型会被标记弃用、云模型成为默认。
- 用「智能体工作流设计」的框架评估:哪些日常任务适合从手动操作迁移到委派给本地智能体。
关系网络
在技术网络中的位置
当前技术与相邻技术、技能和背景知识的连接,点击节点可继续探索。
延伸思考
后续问题
- 智能体模式下哪些操作会触碰本地文件系统和网络,权限边界如何配置?
- 默认 glm-5.2:cloud 云模型时,哪些数据会离开本地设备,隐私敏感场景如何回退纯本地?
- 被弃用警告的旧模型还能继续用多久,迁移路径是什么?
来源参考