📬 Daily Digest

今日推送

2026年06月04日 · 星期四
📄 arXiv 10
📕 小红书 10
关键词:LLM Agent · skill learning · skill retrieval · skill refinement · skill evolution · openclaw
  📄 arXiv 论文   📕 小红书笔记
skill learning
2026-06-03
💡 一句话总结 提出技能增强的测试时共演化框架,使LLM代理能够在交互中持续学习技能。
📋 详细解读
论文解读论文聚焦于LLM代理的持续学习问题,提出技能增强的测试时共演化框架。与传统依赖静态参数和离散技能检索的方法不同,该框架允许代理在推理时持续内化测试时反馈。核心创新在于将技能学习扩展到测试时阶段,实现类似人类学习者的持续适应能力。实验表明该方法在动态交互环境中显著优于基线系统。
skill learning
❤️ 72
💡 内容总结 梳理Skill自进化从经验总结到Skill Bank再到可管理可优化外部策略记忆的发展脉络
skill learning
2026-06-02
💡 一句话总结 SocialCoach系统利用LLM实现个性化社交技能学习,通过强化学习代理辅导。
📋 详细解读
论文解读论文针对社交技能培训中专家稀缺的挑战,设计了SocialCoach个性化学习系统。核心工作是构建基于LLM的代理辅导框架,通过强化学习方法实现规模化的社交技能训练。创新包括个性化学习路径生成和实践场景模拟,能同时训练谈判、领导力等多种社交技能。实验验证了系统在可扩展性和学习效果上的优势。
skill evolution
❤️ 4
💡 内容总结 深度解读微软SkillOpt,将自进化Agent技能优化类比为梯度下降的工程化思路
LLM Agent
2026-06-03
💡 一句话总结 引入参数记忆机制,使LLM代理能够从经验中学习而不仅仅是记忆。
📋 详细解读
论文解读论文指出现有记忆增强型代理仅能在提示空间中存储信息,模型参数保持冻结,导致无法真正从经验学习。核心贡献是提出参数记忆机制,将过去经验转化为可学习的参数化能力。创新点在于实现代理从被动查询到主动学习的转变,使丢弃的上下文信息不再永久丢失。实验证明参数记忆显著提升了代理从经验中学习的能力。
LLM Agent
❤️ 4
💡 内容总结 综述LLM Agent认知外化统一框架,涵盖Memory、Skills、Protocols和Harness四大维度
LLM Agent
2026-06-03
💡 一句话总结 研究多迭代体验学习中LLM代理的能力崩溃问题,提出自我演化的持续学习方法。
📋 详细解读
论文解读论文针对经验内化中的持续学习挑战,揭示了现有方法在多迭代场景下的能力崩溃问题。研究分析了单次迭代和多迭代学习方法的效果差异,识别出导致能力退化的关键因素。核心创新是提出面向自我演化代理的持续学习方案,在多迭代训练中保持能力稳定性。实验验证了该方法能有效防止能力崩溃并提升整体性能。
skill retrieval
❤️ 62
💡 内容总结 用Codex搭建Zotero科研工作流,自动从RSS和PubMed收文献并自动归档分类
skill learning skill retrieval
2026-06-03
💡 一句话总结 基于状态动态检索的在线技能学习方法,提升网络代理的技能复用能力。
📋 详细解读
论文解读论文研究网络代理的在线技能学习问题,提出基于状态的动态检索方法。核心创新是突破传统任务级技能复用局限,根据中间状态动态检索相关技能。方法允许代理从先前任务轨迹中持续归纳技能并即时复用于未来任务。实验表明该方法显著提升了跨任务技能复用的灵活性和效率。
skill evolution
❤️ 65
💡 内容总结 中科院与智源提出SkillPyramid框架,为Agent构建分层技能树实现经验复用和进化
LLM Agent
2026-06-03
💡 一句话总结 Parthenon Law框架实现法律代理的自我演化能力,解决可审计性等部署挑战。
📋 详细解读
论文解读论文针对法律领域LLM代理部署面临的三大障碍,提出自我演化的法律代理框架。核心工作是设计适应法律垂直领域的代理架构,而非通用框架。创新点在于构建可审计的工作流程,解决法律文档处理的可审查性需求。贡献包括大规模评估证据和针对法律场景定制的代理架构,为可靠部署奠定基础。
skill learning
❤️ 47
💡 内容总结 DeepMind发布Science Skills开源工具包,集成30+科学数据库的AI Agent技能集
LLM Agent
2026-06-02
💡 一句话总结 研究记忆深度与网络拓扑对LLM代理共识形成的影响及交互效应。
📋 详细解读
论文解读论文探索LLM代理应记住多少信息以及多代理系统应如何连接以达成共识。通过在432次模拟中变化记忆深度和网络拓扑,揭示了记忆对协调影响的符号反转效应。核心发现是更长记忆会减慢达成共识的时间,拓扑结构与记忆存在显著交互。实验为代理记忆和网络设计提供理论指导。
skill retrieval
❤️ 6
💡 内容总结 上交论文SkillPager解决技能文档调用时的上下文冗余,实现技能内部精准检索
LLM Agent
2026-06-03
💡 一句话总结 Agent Planning Benchmark诊断框架,专门评估LLM代理的规划能力。
📋 详细解读
论文解读论文指出现有代理评估仅报告端到端成功率,难以诊断规划缺陷。核心工作是设计规划特定的诊断基准,将规划能力与执行能力解耦。创新在于提供细粒度评估工具,识别代理在目标分解、工具选择、约束推理和可行性判断上的具体不足。实验证明该诊断框架能有效定位规划能力短板。
skill learning
❤️ 28
💡 内容总结 推荐Skills Manager统一管理多平台AI技能的工具,支持Claude Code、Codex等十五个工具
LLM Agent
2026-06-03
💡 一句话总结 系统研究LLM代理中的内存污染攻击,识别四个写入通道和九个风险向量。
📋 详细解读
论文解读论文针对持久记忆引入的安全风险,对LLM代理的内存污染攻击进行系统研究。核心工作是识别四个内存写入通道和九个风险向量,揭示单次对抗写入的长期影响机制。创新在于全面评估内存安全威胁,为防御策略提供理论基础。分析表明现有系统缺乏对内存污染的有效防护机制。
LLM Agent
❤️ 4
💡 内容总结 从LLM底层逻辑出发,详解Token机制与Agent Skill的关系,打通AI认知链路
LLM Agent
2026-06-03
💡 一句话总结 DMAIC启发的代理系统结合策略制定与执行,提升工业异常检测可靠性。
📋 详细解读
论文解读论文针对高风险工业场景中LLM代理的可靠部署挑战,设计DMAIC启发的代理架构。核心工作是将策略制定与执行解耦,通过结构化流程提升决策质量。创新在于强调工业异常检测中的策略公式化而非仅依赖执行。实验验证了该方法在制造质量、安全和效率指标上的改进。
skill learning
❤️ 14
💡 内容总结 三种方法制作Skill让AI记住工作流,包括skill-creator、任务复盘和SKILL.md编写