📬 Daily Digest

今日推送

2026年05月06日 · 星期三
📄 arXiv 10
📕 小红书 10
关键词:LLM Agent · Agent · Skill · Skill Learning · Skill Retrieval · Skill Refinement · Skill Evolution · openclaw
  📄 arXiv 论文   📕 小红书笔记
Agent openclaw
2026-05-05
💡 一句话总结 提出MEMTIER三层记忆架构,专为OpenClaw代理运行时设计,解决长时间运行自主AI代理的记忆一致性问题。
📋 详细解读
论文解读论文针对长时间运行自主AI代理的内存一致性问题,提出MEMTIER三层记忆架构,专为OpenClaw代理运行时设计。该架构引入结构化情景JSONL存储和五信号记忆分层机制。核心创新在于识别并解决扁平文件内存系统的四种复合失效模式,使工具执行成功率在72小时运行窗口内保持稳定。实验表明该架构能有效缓解记忆退化问题,为开源OpenClaw平台提供可靠的记忆管理方案。
Skill Retrieval
❤️ 166
💡 内容总结 Nous Research推出Hermes Agent的Kanban多Agent调度系统,6列状态看板管理任务流转,支持CLI和dashboard
LLM Agent Agent Skill
2026-05-05
💡 一句话总结 提出SkCC框架实现跨框架LLM代理的可移植安全技能编译,解决不同代理框架对提示格式敏感导致的性能差异。
📋 详细解读
论文解读论文针对LLM代理技能在不同框架间的可移植性问题,提出SkCC可移植安全技能编译框架。SKILL.md已成为封装代理能力的实际标准,但不同框架对格式敏感性导致高达40%的性能差异。核心创新包括格式感知编译和跨框架安全验证,使技能以单一格式存在但能适配多种框架。该工作弥合了技能规范与实际部署间的鸿沟,提升了代理生态系统的互操作性。
Skill Learning
❤️ 640
💡 内容总结 开源4个学术研究Skill组成的流水线,覆盖研究→写作→审稿→复现全流程,包含deep-research、academic-paper等工具
Agent Skill
2026-05-05
💡 一句话总结 构建基于技能的AI代理流水线自动化美国国会图书馆主题索引,实现模块化、可扩展的编目技能编排。
📋 详细解读
论文解读论文针对图书馆编目中最耗时的环节——主题索引,提出模块化技能代理流水线。使用国会图书馆主题标题(LCSH)进行自动化主题编码,将索引过程分解为分析作品主题性、选择受控词汇术语、编码为MARC21字段等技能模块。核心创新在于技能驱动的任务分解与编排,使系统能够像专业馆员一样执行复杂的索引决策。该工作展示了技能架构在专业领域知识工作自动化中的应用潜力。
openclaw
💡 内容总结 OpenClaw Data Analysis Skill实现数据自动化分析,从预处理到报告生成全流程覆盖,提升效率
Agent
2026-05-04
💡 一句话总结 提出Pact编排语言为代理生态系统提供正确性保障,支持开放多方的协议设计。
📋 详细解读
论文解读论文针对代理生态系统中的协议设计与正确性保证问题,提出Pact编排式编程语言。大型语言模型驱动的代理在开放、多方环境中代表用户执行任务,与不受信任的对手交互并管理私密信息。传统编排式编程假设参与者合作,无法处理恶意行为。核心创新在于引入行为契约机制,使协议设计能在存在恶意参与者的场景下保证代理行为的正确性和安全性。
Skill Learning
❤️ 49
💡 内容总结 系统整理科研相关Skills合集,涵盖文献查找、数据分析、学术写作、PPT制作、LaTeX等完整工具流
LLM Agent Agent
2026-05-04
💡 一句话总结 提出MAGE框架通过影子记忆保护LLM代理免受长期威胁,防御扩展用户-代理-环境交互中的恶意攻击。
📋 详细解读
论文解读论文针对LLM代理在扩展交互中面临的长期威胁问题,提出MAGE影子记忆防护框架。代理执行复杂现实任务时,攻击者可通过多轮交互诱导追求单轮设置下不可能的恶意目标。核心创新在于引入影子记忆机制,独立于主会话记忆追踪异常行为模式,在攻击演化为危害前进行拦截。该工作为LLM代理在关键领域的长期部署提供安全保障。
Skill Learning
❤️ 76
💡 内容总结 南京大学等团队提出NSI方法,让Agent从交互轨迹中归纳可复用的程序化技能,已被ICML录用
Agent
2026-05-05
💡 一句话总结 提出ROME框架通过红队编排多代理演化增强代理安全判断能力,覆盖欺骗性和模糊轨迹评估。
📋 详细解读
论文解读论文针对现有安全基准过度强调显式风险的问题,提出ROME红队编排多代理演化框架。工具使用代理系统在Web、应用、操作系统和事务环境中部署,但现有基准可能高估模型判断欺骗性或模糊轨迹的能力。核心创新在于构建对抗性演化场景,系统性地测试代理在复杂、隐蔽威胁下的安全决策能力,为代理安全评估提供更全面的测试覆盖。
Skill
❤️ 15
💡 内容总结 开源Claude和Codex辩论Skill,实现PRD自动生成,包含Host、Proposer、Reviewer三个角色协作
Agent
2026-05-05
💡 一句话总结 通过电路分析揭示代理记忆失败机制,追踪Qwen-3家族跨规模模型的内部记忆计算。
📋 详细解读
论文解读论文针对代理记忆失败难以诊断的问题,通过内部特征电路追踪揭示记忆失败机制。代理可生成流畅响应却在跨会话提取、保留或检索信息时失败,传统外部管道无法解释内部计算过程。核心创新在于跨Qwen-3家族(0.6B-14B)和两个记忆任务系统地追踪内部电路,识别write-manage-read各阶段的计算实现,为代理记忆诊断提供可解释性基础。
Skill Retrieval
❤️ 145
💡 内容总结 阿里ROLL团队分享Agentic RL的苦涩教训,开源iFlow-ROME模型和ALE全栈生态,含ROLL训练框架等
Agent
2026-05-05
💡 一句话总结 提出代理推荐框架自动化多智能体系统工作流构建,解决手动组合规划、代理选择和执行图创建的繁琐流程。
📋 详细解读
论文解读论文针对当前多智能体系统(MAS)创建依赖大量手动工作的问题,提出基于代理推荐的自动化工作流构建框架。用户意图可被用于设计和构建相关应用系列,但现有方法需要手动组合规划、选择代理和创建执行图。核心创新在于将代理推荐融入工作流自动化,使系统能理解用户意图并智能组装多代理协作流程,显著提升MAS开发效率。
Skill
❤️ 110
💡 内容总结 TAAC2026-CLI工具作为Skill使用,自动分析训练曲线判断checkpoint价值,支持Agent批量提交调参实验
Agent Skill
2026-05-05
💡 一句话总结 提出Experience-RAG Skill代理导向可插拔检索编排层,实现异构任务的自适应检索策略编排。
📋 详细解读
论文解读论文针对RAG系统中固定检索流程无法适配异构任务的局限,提出Experience-RAG Skill可插拔检索编排层。该层位于代理与检索器池之间,通过经验驱动的策略编排支持事实问答、多跳推理、科学验证等不同检索偏好。核心创新在于将检索策略视为可学习、可组合的技能,使代理能根据任务需求动态选择最优检索路径,提升检索系统的适应性与准确性。
Skill Retrieval
❤️ 172
💡 内容总结 Agentic-RL-Search-R1复现心得,基于veRL框架用GRPO训练模型学会主动搜索,用标签区分推理和搜索流程
Agent
2026-05-04
💡 一句话总结 系统调研代理AI系统的机密计算威胁,分析MCP和A2A等协议引入的敏感信息暴露风险。
📋 详细解读
论文解读论文系统调研代理AI系统中机密计算的威胁景观。LLM驱动代理通过MCP和A2A等协议规划、调用工具、维护持久记忆和委托任务,引入与独立模型推理本质上不同的威胁面。代理积累敏感上下文、持有凭证,在单一主体无法完全控制的管道中运行,易受提示注入攻击。核心贡献在于全面分类代理特定威胁,为构建安全机密计算方案奠定基础。
Skill Learning
❤️ 60
💡 内容总结 分享Skills Agent学习进度,实现用快速模型分类选择合适Skill,支持plan/replan和RAG深度问答