每日简报 · 2026-08-27
周四 · arXiv / 一线公司博客 / Hacker News · 生成于 2026-08-27 09:00 AEST
📄 arXiv 论文
提出经验记忆与工作记忆分层的循环架构,用进度状态引导技能检索,而非死记历史;对长程agent记忆分层设计参考价值高。
2026-08-25 · cs.AI cs.CL · Zhaochen Yu、Yingcheng Wu、Zhenfei Yin等 ·
原文
指出单流强化学习中轨迹中心化会带偏优势估计,提出流对齐的改进方案;异步agent训练infra优化,自建RL管线可借鉴。
2026-08-25 · cs.AI · Kai Ruan、Jinghao Lin、Qianshan Wei等 ·
原文
用并行浏览器沙箱规模化产出像素级网页操作轨迹,缓解网页agent训练数据稀缺;环境规模化思路可用于自建浏览器agent。
2026-08-25 · cs.CL · Fei Tang、Huawen Shen、Zhiqiong Lu等 ·
原文
在纵向分割的知识图谱上做跨机构联邦式多跳问答,不集中数据也能推理;企业数据孤岛场景,和日常agent工程关联较弱。
2026-08-25 · cs.AI · Md Saikat Islam Khan Bappy、Oshani Seneviratne ·
原文
发现长文档分析中检索到的信息未必真正改变模型最终判断,存在检索与使用的鸿沟;提醒评估agent别只看召回率要看决策是否变了。
2026-08-25 · cs.CL cs.AI · Miao Liu、Zhizhe Liu ·
原文
🏢 一线公司博客
今天该板块没有可报的内容(今天没有符合条件的内容)。
🔥 Hacker News 高分
今天该板块没有可报的内容(今天没有符合条件的内容)。
💬 Talks 引子
召回了不等于用上了,agent记忆该怎么分层
i5揭示检索到信息未必影响判断,i1用工作记忆-经验记忆分层来定位真正需要的技能,两者合起来是agent记忆设计的一体两面。