学术成果 / 7

让知识积累,
让探索 持续向前。

每篇论文都是持续探索的阶段性成果:理解交互机制,构建开放系统,让智能走向更加丰富的世界。

2024
智能体社会

OASIS:支持百万智能体的开放社会交互仿真

OASIS: Open Agent Social Interaction Simulations with One Million Agents

Ziyi Yang*, Zaibin Zhang*, Zirui Zheng, Yuxian Jiang, Ziyue Gan, Zhiyu Wang, et al.

5,000+ GitHub 星标
2024
智能体社会

PsySafe:基于心理学的多智能体系统安全攻击、防御与评估框架

PsySafe: A Comprehensive Framework for Psychological-based Attack, Defense, and Evaluation of Multi-agent System Safety

Zaibin Zhang*, Yongting Zhang*, Lijun Li, Hongzhi Gao, Lijun Wang, Huchuan Lu, Feng Zhao, Yu Qiao, Jing Shao

杰出论文奖
计算语言学协会年会(ACL)
2026
空间智能

Think3D:以空间思考,实现空间推理

Think3D: Thinking with Space for Spatial Reasoning

Zaibin Zhang*, Yuhan Wu*, Lianjie Jia*, Yifan Wang, Zhongbo Zhang, Yijiang Li, Binghao Ran, Fuxi Zhang, Zhuohan Sun, Zhenfei Yin, Lijun Wang, Huchuan Lu

200+ GitHub 星标
2026
具身策略

MA-VLA:面向协作与组合泛化的多机械臂视觉语言动作模型

MA-VLA: Multi-Arm Vision-Language-Action Model for Collaboration and Compositional Generalization

Zaibin Zhang*, Junlan Xiao*, Zhongbo Zhang*, Yifan Wang, Li Kang, Yiran Qin, Changxing Xia, Heng Zhou, Talas Fu, Enshen Zhou, Ruimao Zhang, Zhenfei Yin, Huchuan Lu, Lijun Wang

ECCV 2026
欧洲计算机视觉会议(ECCV)
2026
具身策略

Attention-DP3:通过几何对齐的注意力条件实现物体空间感知的三维扩散策略

Attention-DP3: Spatially Object-aware 3D Diffusion Policy via Geometry-aligned Attentional Conditioning

Changbo Yan*, Zhongbo Zhang*, Zaibin Zhang*, Yifan Wang, Lijun Wang, Huchuan Lu

ECCV 2026
欧洲计算机视觉会议(ECCV)
2026
自我进化

CoMAS:通过交互奖励实现多智能体系统协同进化

CoMAS: Co-Evolving Multi-Agent Systems via Interaction Rewards

Xiangyuan Xue, Yifan Zhou, Guibin Zhang, Zaibin Zhang, Yijiang Li, Chen Zhang, Zhenfei Yin, Philip Torr, Wanli Ouyang, Lei Bai

ICLR 2026
国际学习表征会议(ICLR)
2026
数字智能体

大语言模型智能体强化学习研究综述

The Landscape of Agentic Reinforcement Learning for LLMs: A Survey

Guibin Zhang, Hejia Geng, Xiaohang Yu, Zhenfei Yin, Zaibin Zhang, et al.

TMLR 2026
机器学习研究汇刊(TMLR)

* 表示共同贡献。本页展示代表性成果,完整论文列表请参阅创始人的学术主页。