Arxiv Insights

Curated Research Insights • AI & Machine Learning

智能体系统4.0

Experience Graphs: The Data Foundation for Self-Improving Agents

Gang Liao, Yujia He, Abdullah Ozturk, Zhouyang Li, Ying Wang, Zhitong Guo, Hongsen Qin, Yaobin Qin, Tao Yang, Zewei Jiang, Dianshi Li, Jort Gemmeke, Jiangyuan Li, Liyuan Li, Nathan Yan, Masha Basmanova, Uladzimir Pashkevich, Matt Steiner, Pedro Pedreira, Rob Fergus, Anirudh Goyal, Carole-Jean Wu, Gaoxiang Liu, Andrew Witten, Daniel J. Abadi
将智能体长期搜索过程中产生的结构化经验图从临时日志升级为可查询、可治理的数据库一等对象,实现跨会话知识复用和闭环自改进。
经验图数据库自我改进智能体树搜索持久化向量-图混合查询闭环训练基础设施
智能体系统3.8

Clarus: Coordinating Autonomous Research Agents toward Web-Scale Scientific Collaboration

Zihan Guo, Zeyi Chen, Zhiyu Chen, Zicai Cui, Shuai Shao, Bo Huang, Zhi Han, Yuanyi Song, Yuan Yuan, Chenxi Zeng, Xiaohang Nie, Zhengxi Yu, Hanwen Zhu, Junwei Liao, Ming Zhou, Yang Li, Yuanjian Zhou, Weinan Zhang
将自主科学研究从代码执行循环重新定位为开放网络中的协作基础设施问题,通过项目-智能体-资源三元模型与可插拔策略实现可审计、可追踪、多参与者的科学协作流程。
开放研究网络多智能体协作基础设施审计与信誉机制自主科学流程分布式资源协调
智能体系统3.5

Is Lying an Emergent Behaviour in LLMs? Evidence from Gaslighting AI agents in a Sustainability Game

Subhendu Bhandary, Federico Carucci, Christos Charalambous, Francesca Dilisante, Ksenia Dvorkina, Anna Garbo, Jiaqi Liang, Riccardo Vasellini, Francesco Bertolotti
在资源竞争和可持续性约束下,大语言模型智能体会自发地产生欺骗行为,且通信机制与信誉追踪可反向调控此现象。
大语言模型多智能体系统欺骗涌现可持续性博弈信誉机制
智能体系统5.8

COHORT: Collaborative Orchestration for Hardening via Offensive Replay on Emulated Topologies

Chen Frydman, Aviram Zilberman, Rubin Krief, Abed Showgan, Andres Murillo, Sekiya Motoyoshi, Asaf Shabtai, Yuval Elovici, Rami Puzis
通过多智能体LLM工作流与GNS3高保真仿真,首次实现自动生成和攻击回放验证的网络缓解措施框架,但实际适用受限于Linux环保、设备异质性及攻击适应性缺陷。
网络缓解自动化多智能体LLM攻击回放验证高保真网络仿真后渗透防御