| 📄 arXiv 论文 | 📕 小红书笔记 |
|---|---|
|
2026-04-21
💡 一句话总结
提出企业AI代理的四轴决策对齐框架,分解评估高风险长时域决策中的不同失败模式。
📋 详细解读论文解读论文针对企业长时域代理的高风险决策场景(如贷款审批、临床审查),指出传统单一任务成功标量混淆了不同失败模式的问题。核心创新是提出四轴决策对齐框架,将代理行为分解为四个维度进行评估。揭示了现有评估方法的局限性,为企业代理系统的可靠部署提供更精细的评估标准。
|
❤️ 43
💡 内容总结
Graph of Skills框架解决千级技能库检索难题,通过技能依赖感知机制实现高效精准的Skill Retrieval
|
|
2026-04-21
💡 一句话总结
提出Mesh Memory Protocol,为多Agent LLM系统提供跨会话的语义共享基础设施。
📋 详细解读论文解读论文聚焦多Agent LLM系统在长周期任务(如数天或数周的数据生成、产品决策)中的协作问题。核心创新是提出Mesh Memory Protocol,让Agent能够共享、评估和整合彼此的认知输出,支持跨会话的知识传递和实时协调。解决了多Agent系统中信息不一致和知识断层的核心挑战。
|
❤️ 64
💡 内容总结
港中文团队开源OpenGame框架,提出Game Skill创新概念,包含Template Skill和Debug Skill实现游戏开发的端到端Agent能力
|
|
2026-04-21
💡 一句话总结
提出自进化终端代理框架,通过观测上下文压缩解决多轮交互中token成本二次增长问题。
📋 详细解读论文解读论文研究长时域、多轮终端代理任务中原始环境反馈的冗余问题。核心创新在于提出观测上下文压缩方法,将环境反馈高效压缩存储,避免重复保留导致的token成本二次增长。实验表明该方法能显著降低交互成本,同时保持决策质量,对提升终端代理的实际部署效率具有重要意义。
|
❤️ 1330
💡 内容总结
Huashu Design Skill开源项目逆向解决Claude Design痛点,免费适配所有Agent,发布4小时GitHub获600+ star
|
|
2026-04-20
💡 一句话总结
识别并形式化工具集成Agent中的Trust Gap问题,揭示对抗环境中工具被攻击利用的风险。
📋 详细解读论文解读论文发现当前Agent评估仅关注正常设置下的能力,未考虑工具可能被攻击者操纵的场景。核心创新是识别Trust Gap问题——Agent被评估的是性能而非怀疑能力。形式化了当工具提供错误信息时Agent面临的攻击面,为安全Agent系统的评估和设计提供了新的安全视角。
|
❤️ 26
💡 内容总结
字节Seed和人大高瓴联合推出Agent-World训练框架,通过环境规模+诊断闭环实现Agent能力Scale
|
|
2026-04-21
💡 一句话总结
提出ClawNet人机共生代理网络架构,支持跨用户自主协作,超越单用户任务自动化的局限。
📋 详细解读论文解读论文指出当前AI Agent框架仅服务单一用户,无法支持人类通过社交和组织关系进行的协作工作。核心创新是提出ClawNet架构,让Agent能够代表用户与他人进行协商、协作和委托。解决了多用户场景下Agent基础设施缺失的问题,为组织级AI协作奠定基础。
|
❤️ 13
💡 内容总结
Andrej Karpathy开源的Claude Code实用Skill项目,GitHub 6.9万星,解决AI编程常见问题
|
|
2026-04-21
💡 一句话总结
提出Cyber Defense Benchmark,用于评估LLM Agent在安全运营中进行威胁狩猎的能力。
📋 详细解读论文解读论文针对LLM Agent在网络安全运营中的威胁狩猎任务,构建包含106个真实攻击流程的基准测试。核心创新在于模拟SOC分析师工作场景,让Agent在无引导情况下从原始Windows事件日志中识别恶意事件时间戳。填补了LLM Agent在实战型网络安全任务中评估的空白。
|
❤️ 25
💡 内容总结
AI编程工作流踩坑经验分享,从人肉协调器到Master Skill演进,最终实现orchestrator+sub-agents架构
|
|
2026-04-21
💡 一句话总结
将异常检测集成到Agentic AI中,用于老年人活动中的主动风险管理,特别是跌倒预防。
📋 详细解读论文解读论文针对老年人跌倒这一持续性危害,提出将异常检测与Agentic AI结合的主动风险管理方法。核心创新在于利用Agent的目标导向性、前瞻性和自主决策能力,构建能够主动识别和预防活动风险的智能系统。弥补了现有跌倒预测和检测系统无法作为通用解决方案的不足。
|
|
|
2026-04-21
💡 一句话总结
通过辩证对齐方法解决多Agent框架中演员-观察者角色导致的对称性问题,提升Agent自反思可靠性。
📋 详细解读论文解读论文发现多Agent框架中角色分配虽然能利用领域专家知识进行自反思和互相审查,但同时会引入观察者偏差。核心创新是提出辩证对齐方法,通过结构化的观点对立减少角色扮演带来的认知偏差。为提升多Agent系统的可靠性和决策质量提供了新思路。
|
|
|
2026-04-21
💡 一句话总结
设计AI代理执行环境以保护用户数据安全,分析提示注入等攻击向量并提出防护方案。
📋 详细解读论文解读论文聚焦AI代理访问用户敏感数据(个人和财务信息)的安全风险问题。核心创新在于识别并分析对抗性提示注入等攻击手段,提出针对性的防护执行环境设计。强调用户对AI代理共享私有数据的信任问题,为安全Agent系统的构建提供重要参考。
|
|
|
2026-04-21
💡 一句话总结
提出基于代理的多模态艺术检索框架A-MAR,解决艺术品理解中的可解释性和证据 grounding 问题。
📋 详细解读论文解读论文针对艺术品理解需要多步推理视觉内容及文化历史上下文的需求,提出A-MAR框架。核心创新在于采用Agent架构进行显式证据检索,而非依赖隐式推理和内部知识。解决了现有视觉语言模型在艺术品解释中可解释性不足的问题,为多模态Agent在专业领域应用提供新范式。
|
|