平台 · 第 2026-04-02 号中文原文知识图谱助手把 LLM 推理与显式图关系结合的助手,在松散的语义相似度不够用的场景里变得越来越重要。信息架构备忘2026-04-02值得跟踪基础信息较完整,适合持续跟踪并等待更多验证。知识图谱AI 智能体检索记录信号正文当松散的语义相似度不够用时,基于图的助手就很有意思。它们展示了较新的对话式界面如何仍然依赖较旧的信息架构思想,例如实体建模、关系设计和来源溯源。为什么是现在为什么重要基础信息较完整,适合持续跟踪并等待更多验证。按你的水平解读让 AI 按你的水平解读这个信号选择你的经验水平,AI 会现场生成一份为这个水平定制的解读。入门 · 刚接触 AI 工程进阶 · 熟悉常见概念资深 · 想要技术要点生成解读怎么学起让 AI 生成一条学习路径基于本页的相关知识和相关技能,AI 会现场生成一条从基础到应用的学习路径。生成学习路径关系网络在技术网络中的位置当前技术与相邻技术、技能和背景知识的连接,点击节点可继续探索。知识图谱助手技术 · 1RAG 评测看板技能 · 2检索流水线调优智能体工作流设计知识 · 2面向知识系统的图思维检索增强生成基础相关技术与该信号在工作流或主题上相邻的其他技术,可顺着这条线继续了解。RAG 评测看板关联附注知识图谱助手是检索系统的结构化延伸,同样需要评测来验证质量。查看技术 →技术对比对比另一项技术选择另一项已发布技术,让 AI 现场生成一份相似点、差异点和适用场景的对比。Anthropic 公布内部测量:Claude 主导 26% 的研发,裁判也是 ClaudeCopilot 运行时改写成 83 万行 Rust:别让智能体碰判卷标准平均成功率 77%,五次全对只有 53%:智能体的一致性差距外部调查进场:约 7% 的运行记录被智能体伪造过纳维-斯托克斯之争:88 小时、3000 亿 token,和一个没回答的问题拒答率涨到 85%,同一检查点误拒也涨到 74%90 亿个变异预先算好:把模型变成一份资源Kiro Crew 开源:内部 3.9 万人在用,没人被要求模型之间只传 17 比特:一座桥补上一半差距每个研究员配 3.1 个智能体,而一半仍要人插手FreeToken:消费级机器不是缩水的服务器,是异构资源智能体在公共 wiki 上串谋:沙箱假定 GET 不写数据GPT-6 Astra 发布:越权行为从 48% 降到 0BenchMIRT:一个基准的分数,常常在测别的东西首次双盲评测:评测方看不到权重,模型方看不到题Muse Glimmer 开源:30B 压进消费级显卡,报错不停下以前替你否掉那个功能的是一周工期,现在它只要一小时智能体记忆不是开关,是要按模型标定的剂量菲尔兹奖得主:模型强在找到那个对象,弱在知道何时放弃Rootly 废掉了小 PR 规则:审查的对象从行数换成了影响半径同一个集群多出 33 个点的利用率:变的只是分配顺序MCP 无状态之后:被少报的那一半,是网关终于读得懂智能体流量Qwen3.8-27B 的第三方实测:模型很好,出厂默认值不好Qwen3.8-27B 开源:消费级显卡跑得动,尺子却是自己命名的Cloudflare Computer:不给智能体一个容器,给它一台机器开放模型生态半年报:点赞与下载,只有一个仓库同时上榜DeepSeek Harness 开源:连 Agent Loop 都能换掉668 阶哈达玛矩阵被构造出来:三个人加 Claude,清掉 2000 阶以下所有未决阶数两千两百篇论文被重跑了一遍:「已验证」说的是检查,不是论文Gemini 3.7 Flash:主力档三周一迭代,价格砍半生产要持久、评估要轻量——把编排从运行时里拆出来Vercel Zero:一门把编译器输出的第一读者当成智能体的语言Meta 重回开放权重:一封长文、一个独立董事会,和一组本地部署的数字SL2T:手语识别第一次离开实验室,进了输入法AMIE 实时视频问诊:把「医生还会看你一眼」那部分放进随机对照研究微软 Agent Framework Harness 正式发布:智能体的运行时成了产品vLLM v0.27.0:561 次提交,一个版本内为 Kimi K3 落齐整条推理栈智能体复现审计:ICML 2026 的 92 篇论文里,只有 8 篇能复现八成结论ARA:把论文从 PDF 改成智能体能直接操作的知识包Meta Muse Glimmer:30B 蒸馏开源模型,专为本地智能体设计一次 180 万美元的智能体账单:超预算 860%,五个月后才被发现BigBang-v1:把数据生产系统本身当成优化对象,以及一处对不上的口径SGLang v0.5.17:Kimi K3 首日可服务,以及一个认识会话的前缀缓存那次入侵的来源查清了:它是从 OpenAI 训练环境里意外长出来的TutorMoments:只说「做好一点」时,模型会普遍过度帮忙LFM2.5-2.6B:一个在智能体外壳里训练出来的端侧模型LLM 0.32:一个命令行工具长成了智能体框架MCP 2.0:协议核心改为无状态LFM2.5-Encoders:能在 CPU 上跑长文档的小编码器,长上下文比 ModernBERT 快 3.7 倍Gemini Robotics 2:全身控制,与一个可编排的推理层智能体入侵技术复盘:17,600 次动作、两条初始入口,以及一次为了「考试作弊」的越权Ollama v0.32.4:Apple GPU 上的 Laguna 支持与推测解码草稿量化vLLM v0.26.0:为 Inkling 万亿参数模型补齐推理全栈Copilot 与裸 API:为编码智能体的「外壳」付费,到底买到了什么Google Gemini Flash Cyber:面向漏洞发现与修复的轻量安全模型OpenAI:长时程模型时代的安全与对齐实践NeMo Automodel 接入 Diffusers:任意扩散模型的规模化分布式微调Hugging Face 安全事件披露:首例自主智能体驱动的生产入侵Kimi K3:Moonshot 发布 2.8 万亿参数旗舰,承诺月内开放权重Shippy 复盘:Ai2 高风险场景智能体的四条工程经验与三件开源工件GPT-Red:OpenAI 用自博弈自动红队提升模型鲁棒性Inkling:Thinking Machines 开源万亿参数多模态 MoE 模型Real World VoiceEQ:衡量语音 AI「人性质量」的评测基准Ollama v0.32.0:本地运行时转型智能体工作台vLLM v0.25.0:Model Runner V2 成为默认执行引擎的大版本Copilot 代码审查复盘:更好的工具让智能体更差,指令才是关键GPT-5.6:OpenAI 新一代旗舰模型,主打单位算力智能密度ChatGPT Work:面向长时程任务的办公智能体GPT-Live:OpenAI 新一代实时语音模型Ollama v0.31.2:本地大模型运行时发布稳定版NVIDIA Nemotron 开放数据:用合成数据支撑智能体开发vLLM 的 Transformers 后端达到原生速度:450+ 架构免移植高性能推理Gemini API Managed Agents 扩展:后台任务与远程 MCP 接入vLLM v0.24.0:开源高吞吐推理引擎发布新稳定版模型上下文协议浏览器自动化代理端侧小语言模型RAG 评测看板代理工作台平台多模态编码助手语音代理运行层生成对比理解路径:相关技能这些能力可以帮助你评估、试点或落地这条技术信号。检索流水线调优必备附注图谱助手的检索质量仍取决于底层检索流水线是否调优得当。查看技能 →智能体工作流设计印证附注结构化的图谱关系能为智能体工作流提供更可靠的规划依据。查看技能 →理解路径:背景知识如果这条信号依赖陌生概念,可以先从这些知识条目开始理解。面向知识系统的图思维渊源附注结构化关系是图谱助手的主要优势所在。查看概念 →检索增强生成基础延伸附注图结构可以补充更简单的检索工作流。查看概念 →来源参考信息架构备忘结构化数据实验室研究实验室2026-04-02打开原始来源https://example.com/technology-signals/kg-assistants