每日简报 · 2026-08-27

周四 · arXiv / 一线公司博客 / Hacker News · 生成于 2026-08-27 09:00 AEST

📄 arXiv 论文

Recursive Experiential-Working Memory Evolution for Long-Horizon Agent Harnesses
提出经验记忆与工作记忆分层的循环架构,用进度状态引导技能检索,而非死记历史;对长程agent记忆分层设计参考价值高。
2026-08-25 · cs.AI cs.CL · Zhaochen Yu、Yingcheng Wu、Zhenfei Yin等 · 原文
SPO++: Stream-Aligned Policy Optimization for Asynchronous Agentic RL
指出单流强化学习中轨迹中心化会带偏优势估计,提出流对齐的改进方案;异步agent训练infra优化,自建RL管线可借鉴。
2026-08-25 · cs.AI · Kai Ruan、Jinghao Lin、Qianshan Wei等 · 原文
BrowserForge: Scaling Web Episode via Parallel Browser Sandboxes
用并行浏览器沙箱规模化产出像素级网页操作轨迹,缓解网页agent训练数据稀缺;环境规模化思路可用于自建浏览器agent。
2026-08-25 · cs.CL · Fei Tang、Huawen Shen、Zhiqiong Lu等 · 原文
FedV-KGQA: Multi-Hop Question Answering over Vertically Partitioned Knowledge Graphs
在纵向分割的知识图谱上做跨机构联邦式多跳问答,不集中数据也能推理;企业数据孤岛场景,和日常agent工程关联较弱。
2026-08-25 · cs.AI · Md Saikat Islam Khan Bappy、Oshani Seneviratne · 原文
Reading Is Not Using: Retrieval, Judgment, and the Design of AI Financial Research Workflows
发现长文档分析中检索到的信息未必真正改变模型最终判断,存在检索与使用的鸿沟;提醒评估agent别只看召回率要看决策是否变了。
2026-08-25 · cs.CL cs.AI · Miao Liu、Zhizhe Liu · 原文

🏢 一线公司博客

今天该板块没有可报的内容(今天没有符合条件的内容)。

🔥 Hacker News 高分

今天该板块没有可报的内容(今天没有符合条件的内容)。

💬 Talks 引子

召回了不等于用上了,agent记忆该怎么分层

i5揭示检索到信息未必影响判断,i1用工作记忆-经验记忆分层来定位真正需要的技能,两者合起来是agent记忆设计的一体两面。

引子来自:Recursive Experiential-Working Memory · Reading Is Not Using: Retrieval, Judgm