主题聚合
检索
搜索、依据接地和上下文组装的工作流。
订阅此话题
更新自动送达RSS 订阅源把这个订阅源加进任何 RSS 阅读器,「检索」下新发布的技术信号会自动送达,无需账号。
已发布技术信号
4 条智能体记忆不是开关,是要按模型标定的剂量
IBM Research 把 ALTK-Evolve 铺到八个模型上评测:智能体从自己的历史轨迹里蒸馏出可复用的行为指引,推理时注入回上下文,不更新任何权重、不需要人工标注。结论反直觉——同一套指引在不同模型上的最佳用量完全不同,而决定用量的不是参数规模:745B 的 GLM-5 一分没涨,117B 的 gpt-oss-120b 用最省的策略涨了 16.1 个点,代价只有 5% 的 token。
LFM2.5-Encoders:能在 CPU 上跑长文档的小编码器,长上下文比 ModernBERT 快 3.7 倍
Liquid AI 发布两个开源编码器 LFM2.5-Encoder-230M 与 350M:在 GLUE、SuperGLUE 和多语任务上追平更大的编码器,支持 8,192 token 上下文,长上下文场景下在 CPU 上比 ModernBERT-base 快约 3.7 倍。它针对的是被生成式模型遮住的那一半生产负载——意图路由、策略检查、PII 识别、文本分类,这些任务整天在跑、大多跑在 CPU 上,且输入越来越长。
RAG 评测看板
轻量评测看板正在让团队更容易在发布前检查检索质量、答案可信度和回归风险。
知识图谱助手
把 LLM 推理与显式图关系结合的助手,在松散的语义相似度不够用的场景里变得越来越重要。
相关技能
1 项背景知识
2 条图谱关联
来自 /network 的直接邻居技术 · 延伸平均成功率 77%,五次全对只有 53%:智能体的一致性差距技术 · 借助90 亿个变异预先算好:把模型变成一份资源技能 · 印证模型与输出评估技能 · 印证智能体工作流设计技能 · 必备智能体可观测性与评测运维知识 · 印证长时程智能体的记忆与上下文管理知识 · 印证评估闭环知识 · 释义完成判定与验收信号知识 · 印证模型选型与约束匹配技术 · 印证开放模型生态半年报:点赞与下载,只有一个仓库同时上榜技术 · 渊源Vercel Zero:一门把编译器输出的第一读者当成智能体的语言技术 · 印证ARA:把论文从 PDF 改成智能体能直接操作的知识包技术 · 关联SGLang v0.5.17:Kimi K3 首日可服务,以及一个认识会话的前缀缓存技术 · 延伸LFM2.5-2.6B:一个在智能体外壳里训练出来的端侧模型技能 · 必备端侧模型部署与硬件适配技能 · 借助推理服务容量规划技能 · 必备模型与推理引擎的支持路径知识 · 释义交互系统中的延迟权衡