| 📄 arXiv 论文 (今日休息) | 📕 小红书笔记 |
|---|---|
|
—
|
|
|
—
|
❤️ 74
💡 内容总结
提出Agentic Evolution新框架,通过训练无关的方式实现Agent的自我改进与元学习,用于优化开放任务和推理基准
|
|
—
|
❤️ 70
💡 内容总结
发布SKILLSBENCH基准测试集,包含86个跨领域任务,评估LLM Agent使用Skills的效果,发现有监督Skills能显著提升性能
|
|
—
|
|
|
—
|
|
|
—
|
|
|
—
|
|
|
—
|
|
|
—
|
|
|
—
|
|