产品判断
AI 工具链选型与自建边界评估
在「自己搭一套」和「买现成的」之间划线:先判断哪一层工作是你必须拥有的,再比价格——顺序反过来就会买错。
产品策略工作流AI 智能体
这项技能能帮你做什么
当模型这一层的价差被抹平(供应商按同样的 API 费率计费),采购决策就不再是比单价,而是划分系统边界。
可操作的做法是把一个具体任务拆成两栏:
- 模型调用:提示词、上下文组装、模型选择、输出解析。
- 外壳(harness):任务上下文的接入(工单、diff、仓库)、可执行命令的白名单、组织策略与权限、日志与评测、用量与计费控制。
然后逐项问:这一项如果自己做,是不是我的竞争力?如果答案是否,它就是集成成本,而集成成本几乎总是被低估——它不随模型能力提升而变便宜。
三个常见的判断失误:
- 只比 token 单价。 价格是结论不是前提;外壳的年化人力成本通常远大于 token 支出。
- 低估控制面。 命令白名单、组织策略、审计这类要求往往是合规硬约束,自建方案要从零补齐。
- 忽略迁移成本。 自建外壳如果和某个供应商的接口耦合,换模型时的迁移成本要提前算进来。
这项能力和「模型选型与约束匹配」是一对:后者决定用哪个模型,前者决定模型之外的那一层归谁。
关系网络
在关系网络中的位置
这项技能相邻的技术信号与背景概念,点击节点可继续探索。
AI 工具链选型与自建边界评估
技术 · 17
- 纳维-斯托克斯之争:88 小时、3000 亿 token,和一个没回答的问题
- 90 亿个变异预先算好:把模型变成一份资源
- 以前替你否掉那个功能的是一周工期,现在它只要一小时
- 同一个集群多出 33 个点的利用率:变的只是分配顺序
- MCP 无状态之后:被少报的那一半,是网关终于读得懂智能体流量
- Cloudflare Computer:不给智能体一个容器,给它一台机器
- 开放模型生态半年报:点赞与下载,只有一个仓库同时上榜
- DeepSeek Harness 开源:连 Agent Loop 都能换掉
- Gemini 3.7 Flash:主力档三周一迭代,价格砍半
- 生产要持久、评估要轻量——把编排从运行时里拆出来
- Vercel Zero:一门把编译器输出的第一读者当成智能体的语言
- 微软 Agent Framework Harness 正式发布:智能体的运行时成了产品
- 一次 180 万美元的智能体账单:超预算 860%,五个月后才被发现
- LLM 0.32:一个命令行工具长成了智能体框架
- Copilot 与裸 API:为编码智能体的「外壳」付费,到底买到了什么
- Copilot 代码审查复盘:更好的工具让智能体更差,指令才是关键
- Gemini API Managed Agents 扩展:后台任务与远程 MCP 接入
用已发布信号练习
这项技能有助于评估的技术信号
背景概念