Skip to main content

Agent 架构设计12

2026

arXiv: 2606.23449 (Technical Report); 源码分析基于 GitHub main 分支

AOHP 源码深度解读:Agent-Native OS 的架构实现与安全机制

AOHP: An Open-Source OS-Level Agent Harness for Personalized, Efficient and Secure Interaction

Shanhui Zhao (Tsinghua), Jiacheng Liu (Peking), Guohong Liu (Tsinghua) et al.
2026

arXiv 2606.12344

Claw-SWE-Bench:让通用 Agent 框架在编程任务上可比较

Claw-SWE-Bench: A Benchmark for Evaluating OpenClaw-style Agent Harnesses on Coding Tasks

Mengyu Zheng, Kai Han, Boxun Li et al.
2026

arXiv 2605.22781

DeltaBox:面向 AI Agent 的毫秒级沙箱状态快照与回滚

DeltaBox: Scaling Stateful AI Agents with Millisecond-Level Sandbox Checkpoint/Rollback

Yunpeng Dong, Jingkai He, Yuze Hou et al.
2026

arXiv 2026

SPDDWL:用交互式定理证明器做 LLM 受验证软件项目生成

Trustworthy Software Project Generation: a Case Study with an Interactive Theorem Prover

Jian Fang, Yingfei Xiong
2026

arXiv

Qualixar OS:AI Agent 编排的通用操作系统

Qualixar OS: A Universal Operating System for AI Agent Orchestration

Varun Pratap Bhardwaj
2026

arXiv

形式化智能体AI系统的安全性与功能性属性

Formalizing the Safety, Security, and Functional Properties of Agentic AI Systems

Edoardo Allegrini, Ananth Shreekumar, Z. Berkay Celik
2025

ICML 2025 (arXiv 2503.22738)

用一个 Agent 守护另一个 Agent:ShieldAgent 的形式化安全防护

ShieldAgent: Shielding Agents via Verifiable Safety Policy Reasoning

Zhaorun Chen, Mintong Kang, Bo Li
2026

Codebase Analysis

DeerFlow 架构解剖:它不是一个聊天壳,而是一套可拼装的 Agent Runtime

DeerFlow Architecture Analysis: A Composable Agent Runtime

DeerFlow Contributors
2026

arXiv 2603.22928

Agentic AI 的攻击面:工具、RAG 与自主性的系统安全地图

SoK: The Attack Surface of Agentic AI -- Tools, and Autonomy

Ali Dehghantanha, Sajad Homayoun
2026

Codebase Analysis

Claw 系列智能体洞察:六个项目的架构、安全与扩展性对比

Claw Agent Family Insights: A Comparative Study of Architecture, Security, and Extensibility

Bin Fang
2026

Preprints.org

Skills Are the New Apps — 论 Skill OS 的必然崛起

Skills Are the New Apps – Now It's Time for Skill OS

Le Chen, Zichang Wang, Wenxin Zheng et al.
2026

arXiv

Agent Behavioral Contracts:为 AI Agent 带来设计契约

Agent Behavioral Contracts: Formal Specification and Runtime Enforcement for Reliable Autonomous AI Agents

Varun Pratap Bhardwaj

Agent 规范与安全14

2026

Survey

形式化验证与 AI Agent 结合:工作分类与总结

Formal Verification Meets AI Agents: A Survey and Taxonomy

2026

arXiv 2603.11088

Agentic AI 的攻击与防御全景:系统性综述

The Attack and Defense Landscape of Agentic AI: A Comprehensive Survey

Juhee Kim, Xiaoyuan Liu, Zhun Wang et al.
2026

ICLR 2026

PropagandaAI:大语言模型的语义偏移分析与黑盒审计框架

PropagandaAI: An Analysis of Semantic Divergence in Large Language Models

Nay Myat Min, Long H. Pham, Yige Li et al.
2026

arXiv (Position Paper)

LLM Agent 安全需要一个「Intent-to-Execution」端到端正确性定义

Securing LLM Agents Need Intent-to-Execution Integrity

Wenjie Qu, Ming Xu, Peiran Wang et al.
2026

arXiv

形式化 LLM Agent 安全:情境感知的四维框架

A Framework for Formalizing LLM Agent Security

Vincent Siu, Jingxuan He, Kyle Montgomery et al.
2026

arXiv 2605.13044

SEFZ:无需攻击即可发现的 Agent Skill 规范违规

No Attack Required: Semantic Fuzzing for Specification Violations in Agent Skills

Ying Li, Hongbo Wen, Yanju Chen et al.
2026

ICML 2026 (PMLR 306)

三思而后行:Thought-Aligner 与 Agent 行为安全思维矫正

Think Twice Before You Act: Enhancing Agent Behavioral Safety with Thought Correction

Changyue Jiang, Wenqi Zhang, Xudong Pan et al.
2026

arXiv

ClawGuard:OpenClaw 安全威胁与全生命周期防御架构

Uncovering Security Threats and Architecting Defenses in Autonomous Agents: A Case Study of OpenClaw

Zonghao Ying, Xiao Yang, Siyang Wu et al.
2026

arXiv

Agent-Sentry:通过执行溯源约束 LLM Agent

Agent-Sentry: Bounding LLM Agents via Execution Provenance

Rohan Sequeira, Stavros Damianakis, Umar Iqbal et al.
2025

arXiv:2510.11203

TraceAegis: 用溯源分析守护 Agent —— 层次化行为异常检测的实践

TraceAegis: Securing LLM-Based Agents via Hierarchical and Behavioral Anomaly Detection

Jiahao Liu, Bonan Ruan, Xianglin Yang et al.
2026

arXiv:2604.04989

SkillAttack: 通过攻击路径细化对 Agent Skills 进行自动化红队测试

SkillAttack: Automated Red Teaming of Agent Skills through Attack Path Refinement

Zenghao Duan, Yuxin Tian, Zhiyi Yin et al.
2026

arXiv 2604.01438

「安全」的大模型,不安全的 Agent:CLAWSAFETY 基准测试揭示的现实

ClawSafety: "Safe" LLMs, Unsafe Agents

Bowen Wei, Yunbei Zhang, Jinhao Pan et al.
2025

arXiv 2510.12985

SENTINEL:用时态逻辑评估具身智能体的物理安全

SENTINEL: A Multi-Level Formal Framework for Safety Evaluation of Foundation Model-based Embodied Agents

Simon Sinong Zhan, Philip Wang, Justin Liu et al.
2026

ICSE 2026 (IEEE/ACM International Conference on Software Engineering)

AgentSpec:用 DSL 在运行时管住 LLM Agent 的安全边界

AgentSpec: Customizable Runtime Enforcement for Safe and Reliable LLM Agents

Haoyu Wang, Christopher M. Poskitt, Jun Sun

形式化验证11

2014

arXiv

HyperLTL 与 HyperCTL*:能表达安全策略的时序逻辑

Temporal Logics for Hyperproperties

Michael R. Clarkson, Bernd Finkbeiner, Masoud Koleini et al.
2019

ICML 2019

CoqGym: 通过与证明助手交互学习定理证明

Learning to Prove Theorems via Interacting with Proof Assistants

Kaiyu Yang, Jia Deng
2026

ACM Transactions on Software Engineering and Methodology (TOSEM)

自动化构建可信软件:三叉戟研究路线图

Automatically Engineering Trusted Software: A Research Roadmap

Yuriy Brun, Saikat Chakraborty, Claire Le Goues et al.
2010

Computer Science Review (Elsevier)

线性时序逻辑符号模型检测:从理论到实践的完整剖析

Linear Temporal Logic Symbolic Model Checking

Kristin Y. Rozier
2025

arXiv

概率模型检验:应用与趋势

Probabilistic Model Checking: Applications and Trends

Marta Kwiatkowska, Gethin Norman, David Parker
2026

arXiv

FM-Agent:用 LLM 把形式化验证 Scale 到大厂级别代码库

FM-Agent: Scaling Formal Methods to Large Systems via LLM-Based Hoare-Style Reasoning

Haoran Ding, Zhaoguo Wang, Haibo Chen
2026

arXiv 2026

意图形式化:AI代理时代可靠编程的重大挑战

Intent Formalization: A Grand Challenge for Reliable Coding in the Age of AI Agents

Shuvendu K. Lahiri
2025

CAV 2025

The Vampire Diary:Vampire 作为面向软件验证的统一推理平台

The Vampire Diary

Filip Bártek, Ahmed Bhayat, Robin Coutelier et al.
2025

CAV 2025

Lean-SMT:给 Lean 接上一台会出证明的 SMT 引擎

Lean-SMT: An SMT tactic for discharging proof goals in Lean

Abdalrhman Mohamed, Tomaz Mascarenhas, Harun Khan et al.
2026

USENIX FAST '26

SpecFS:把文件系统从“写代码”变成“写规范”

Sharpen the Spec, Cut the Code: A Case for Generative File System with SYSSPEC

Qingyuan Liu, Mo Zou, Hengbin Zhang et al.
2026

J. ACM

ProofWright:用 AI Agent 给 LLM 生成的 CUDA 代码做形式化验证

ProofWright: Towards Agentic Formal Verification of CUDA

Bodhisatwa Chatterjee, Drew Zagieboylo, Sana Damani et al.

LLM 驱动的系统设计4

2025

arXiv

大VLM驱动的VLA模型:机器人操作的范式革新

Large VLM-based Vision-Language-Action Models for Robotic Manipulation: A Survey

Rui Shao, Wei Li, Lingsen Zhang et al.
2025

IJRR 2025 / arXiv 2312.07843

机器人学中的基础模型:应用、挑战与未来

Foundation Models in Robotics: Applications, Challenges, and the Future

Roya Firoozi, Johnathan Tucker, Stephen Tian et al.
2025

arXiv 2507.10087

基础模型驱动机器人学:综合性综述

Foundation Model Driven Robotics: A Comprehensive Review

Muhammad Tayyab Khan, Ammar Waheed
2025

arXiv

VLA模型解剖学:从模块到里程碑与挑战

An Anatomy of Vision-Language-Action Models: From Modules to Milestones and Challenges

Chao Xu, Suyu Zhang, Yang Liu et al.

具身智能29

2026

ICML 2026

混淆图谱:用欺骗探针在 RLVR 中追踪诚实如何涌现

The Obfuscation Atlas: Mapping Where Honesty Emerges in RLVR with Deception Probes

Mohammad Taufeeque, Stefan Heimersheim, Adam Gleave et al.
2025

arXiv

具身AI世界模型综述:三维分类框架与前沿挑战

A Comprehensive Survey on World Models for Embodied AI

Xinqing Li, Xin He, Le Zhang et al.
2021

IEEE TNNLS / arXiv 2108.11544

视觉语言导航:综述与分类体系

Vision-Language Navigation: A Survey and Taxonomy

Wansen Wu, Tao Chang, Xinmeng Li et al.
2025

arXiv

VLA模型赋能真实世界机器人:全栈综述

Vision-Language-Action Models for Robotics: A Review Towards Real-World Applications

Kento Kawaharazuka, Jihoon Oh, Jun Yamada et al.
2025

arXiv 2506.20966

VLA 后训练与人类运动学习的平行类比

Parallels Between VLA Model Post-Training and Human Motor Learning

Tian-Yu Xiang, Ao-Qun Jin, Xiao-Hu Zhou et al.
2024

IEEE TNNLS / arXiv 2405.14093

面向具身 AI 的视觉-语言-动作模型综述

A Survey on Vision-Language-Action Models for Embodied AI

Yueen Ma, Zixing Song, Yuzheng Zhuang et al.
2025

arXiv

Vision-Language-Action模型:概念、进展、应用与挑战

Vision-Language-Action (VLA) Models: Concepts, Progress, Applications and Challenges

Ranjan Sapkota, Yang Cao, Konstantinos I. Roumeliotis et al.
2025

arXiv 2506.24044

自动驾驶中的 VLA 模型综述

A Survey on Vision-Language-Action Models for Autonomous Driving

Sicong Jiang, Zilin Huang, Kangan Qian et al.
2025

arXiv 2507.01925 / PKU-PsiBot

VLA 模型综述:动作 Token 化视角

A Survey on Vision-Language-Action Models: An Action Tokenization Perspective

Yifan Zhong, Fengshuo Bai, Shaofei Cai et al.
2025

arXiv 2502.06851(已撤回)

Vision-Language-Action 模型调研:一份被撤回的 AI 生成综述

Survey on Vision-Language-Action Models

Adilzhan Adilkhanov, Amir Yelenov, Assylkhan Seitzhanov et al.
2025

arXiv (Accepted to IJCAS)

SE(3)-等变机器人学习与控制教程综述

SE(3)-Equivariant Robot Learning and Control: A Tutorial Survey

Joohwan Seo, Soochul Yoo, Junwoo Chang et al.
2025

arXiv

Pure VLA模型综述:自回归、扩散与强化学习的融合之路

Pure Vision-Language-Action (VLA) Models: A Comprehensive Survey

Dapeng Zhang, Jing Sun, Chenghui Hu et al.
2025

arXiv

具身AI时代的物理仿真器:导航与操作综述

A Survey of Robotic Navigation and Manipulation with Physics Simulators in the Era of Embodied AI

Wong Lik Hang Kenny, Xueyang Kang, Kaixin Bai et al.
2025

arXiv

Neural Brain:神经科学启发的具身智能体框架

Neural Brain: A Neuroscience-inspired Framework for Embodied Agents

Jian Liu, Xiongtao Shi, Thai Duy Nguyen et al.
2025

arXiv

多模态目标导向导航:推理域视角综述

Multimodal Perception for Goal-oriented Navigation: A Survey

I-Tak Ieong, Hao Tang
2025

arXiv

多模态融合与视觉语言模型:机器人视觉综述

Multimodal Fusion and Vision-Language Models: A Survey for Robot Vision

Xiaofeng Han, Shunpeng Chen, Zenghuang Fu et al.
2025

Science Robotics

基于学习的动力学模型综述:机器人操作中的状态表示与控制

A Review of Learning-based Dynamics Models for Robotic Manipulation

Bo Ai, Stephen Tian, Haochen Shi et al.
2025

arXiv 2508.10399

大模型赋能具身智能:决策与学习综述

Large Model Empowered Embodied AI: A Survey on Decision-Making and Embodied Learning

Wenlong Liang, Rui Zhou, Yang Ma et al.
2025

Blog Post

ICLR 2026 VLA 研究现状:从爆发式增长到基准饱和的反思

State of VLA Research at ICLR 2026

Moritz Reuss
2025

arXiv 2503.03464

生成式人工智能在机器人操作中的全面综述

Generative Artificial Intelligence in Robotic Manipulation: A Survey

Kun Zhang, Peng Yun, Jun Cen et al.
2024

arXiv 2408.11537

面向物体中心机器人操作的具身学习综述

A Survey of Embodied Learning for Object-Centric Robotic Manipulation

Ying Zheng, Lei Yao, Yuejiao Su et al.
2025

arXiv 2502.15336

探索具身多模态大模型:发展、数据集与未来方向

Exploring Embodied Multimodal Large Models: Development, Datasets, and Future Directions

Shoubin Chen, Zehao Wu, Kai Zhang et al.
2025

arXiv

具身智能工业机器人:知识驱动的技术框架

Embodied Intelligent Industrial Robotics: Concepts and Techniques

Chaoran Zhang, Chenhao Zhang, Zhaobo Xu et al.
2025

Annual Review / arXiv 2408.03539

深度强化学习在机器人中的真实世界成功

Deep Reinforcement Learning for Robotics: A Survey of Real-World Successes

Chen Tang, Ben Abbatematteo, Jiaheng Hu et al.
2025

arXiv

扩散模型在机器人操作中的应用综述

Diffusion Models for Robotic Manipulation: A Survey

Rosa Wolf, Yitian Shi, Sheng Liu et al.
2025

arXiv

基于模仿学习的灵巧操作综述

Dexterous Manipulation through Imitation Learning: A Survey

Shan An, Ziyu Meng, Chao Tang et al.
2024

中国信息通信研究院 (CAICT)

具身智能发展报告(2024):从技术突破到产业落地

具身智能发展报告 (2024 年) — 中国信息通信研究院

中国信息通信研究院, 北京人形机器人创新中心有限公司
2024

IEEE/ASME TMech / arXiv 2407.06886

对齐数字空间与物理世界:具身人工智能全面综述

Aligning Cyber Space with Physical World: A Comprehensive Survey on Embodied AI

Yang Liu, Weixing Chen, Yongjie Bai et al.
2026

arXiv 2605.00080

机器人学习中的世界模型:一份全面的综述

World Model for Robot Learning: A Comprehensive Survey

Bohan Hou, Gen Li, Jindou Jia et al.

其他27

2026

NDSS

SAGA:面向 AI Agentic 系统的可扩展安全治理架构

SAGA: A Security Architecture for Governing AI Agentic Systems

Georgios Syros, Anshuman Suri, Jacob Ginesin et al.
2026

arXiv 2605.23904

SkillOpt:将 Agent 技能文档当作可训练外部状态

SkillOpt: Executive Strategy for Self-Evolving Agent Skills

Yifan Yang, Ziyang Gong, Weiquan Huang et al.
2026

arXiv

自改进 Agent 系统全景:从基础模型到脚手架的统一分类体系

Self-Improvements in Modern Agentic Systems: A Survey

Zhe Ren, Yimeng Chen, Dandan Guo et al.
2026

arXiv 2512.23738

Agent-C:为 LLM Agent 执行时序安全约束

Enforcing Temporal Constraints for LLM Agents

Adharsh Kamath, Sishen Zhang, Calvin Xu et al.
2026

arXiv

认知防火墙:面向 LLM 安全的主动式零信任多门框架

Cognitive Firewall: A Proactive, Zero-Trust, Multi-Gate Framework for LLM Safety

Michele Guida, Ruslan Shikhhamzayev, Sindhuja Penchala et al.
2026

IEEE S&P 2026

AI Agent 数据访问权限的自动化管理

Towards Automating Data Access Permissions in AI Agents

Yuhao Wu, Ke Yang, Franziska Roesner et al.
2026

arXiv 2607.01640

AgentFlow: 基于 Agent 依赖图的 Agent 程序静态分析框架

AgentFlow: Building Agent Dependency Graphs for Static Analysis of Agent Programs

Shenao Wang (HUST), Xinyi Hou (HUST), Yanjie Zhao (HUST) et al.
2026

arXiv (NVIDIA)

Polar:将任意 Agent Harness 作为黑盒进行大规模强化学习

Polar: Agentic RL on Any Harness at Scale

Binfeng Xu, Hao Zhang, Shaokun Zhang et al.
2026

arXiv 2607.01120

下一代 Agentic RL 系统使自进化 Agent 成为可能

Next-Generation Agentic Reinforcement Learning Systems Enable Self-Evolving Agents

Ran Yan, Wei Fu, Jiale Li et al.
2026

arXiv preprint (2026)

超性质引导的部分可观测多智能体强化学习

HyPOLE: Hyperproperty-Guided Multi-Agent Reinforcement Learning under Partial Observation

Arshia Rafieioskouei, Tzu-Han Hsu, Matthew Lucas et al.
2026

arXiv preprint (Tencent HY LLM Frontier)

Harness Handbook:让演化的 Agent Harness 可读、可导航、可编辑

Harness Handbook: Making Evolving Agent Harnesses Readable, Navigable, and Editable

Ruhan Wang, Yucheng Shi, Zongxia Li et al.
2026

ICML 2026 (PMLR 306)

自动机条件化的协作多智能体强化学习

Automata-Conditioned Cooperative Multi-Agent Reinforcement Learning

Beyazit Yalcinkaya, Marcell Vazquez-Chanlatte, Ameesh Shah et al.
2026

arXiv 2606.25189

ActPlane: 基于 eBPF 的 OS 级 Agent 策略可编程执行框架

ActPlane: Programmable OS-Level Policy Enforcement for Agent Harnesses

Yusheng Zheng (UC Santa Cruz), Yuchen Zhang (Virginia Tech), Tong Yu (eunomia-bpf) et al.
2026

ICLR 2025

让 AI 自己设计 AI:ADAS 与 Meta Agent Search

Automated Design of Agentic Systems

Shengran Hu, Cong Lu, Jeff Clune
2026

arXiv

ZipRL:让 Agent 自己学会何时压缩、压缩多少

ZipRL: Adaptive Multi-Turn Context Compression with Hindsight Response Replay

Zhexin Hu, Li Wang, Xiaohan Wang et al.
2026

arXiv 2606.23525

Self-Compacting Language Model Agents:让 Agent 自己决定何时压缩上下文

Self-Compacting Language Model Agents

Tianjian Li, Jingyu Zhang, William Jurayj et al.
2026

arXiv 2604.14228

深入 Claude Code:当代与未来 AI Agent 系统的设计空间

Dive into Claude Code: The Design Space of Today's and Future AI Agent Systems

Jiacheng Liu, Xiaohan Zhao, Xinyi Shang et al.
2026

GitHub (colbymchenry/codegraph)

CodeGraph 源码深度解析:面向 AI 编程助手的语义代码知识图谱

CodeGraph: A Semantic Code Knowledge Graph for AI Coding Assistants

Colby McHenry
2025

arXiv 2505.24832

语言模型到底记住了多少?—— 用信息论重新定义记忆

How much do language models memorize?

John X. Morris, Chawin Sitawarin, Chuan Guo et al.
2016

ICML 2016

异步方法深度强化学习:A3C 的诞生

Asynchronous Methods for Deep Reinforcement Learning

Volodymyr Mnih, Adrià Puigdomènech Badia, Mehdi Mirza et al.
2025

arXiv 2508.02736

AgentSight: 基于 eBPF 的 AI Agent 系统级可观测性框架

AgentSight: System-Level Observability for AI Agents Using eBPF

Yusheng Zheng (UC Santa Cruz), Yanpeng Hu (ShanghaiTech University), Tong Yu (eunomia-bpf Community) et al.
2026

GitHub Open Source

GenericAgent 架构解析:极简自进化 Agent 框架的设计哲学

GenericAgent: A Minimalist Self-Evolving Agent Framework

lsdefine
2026

GitHub Open Source

Pi Agent Harness 架构解析:一个可自扩展的 AI 编码 Agent 框架

Pi: A Self-Extensible AI Coding Agent Framework

Mario Zechner
2026

源码分析报告

Claw 系列智能体深度架构对比:从单体到沙箱的六种范式

Claw Agent Ecosystem: A Deep Architectural Comparison

EulerClaw Team
2026

Nous Research / GitHub

Hermes Agent 架构深度解析:自进化的AI代理框架

Hermes Agent - Self-Improving AI Agent Framework

Nous Research
2026

ICLR 2026 (Oral)

GEPA:用反思式提示进化超越强化学习

GEPA: Reflective Prompt Evolution Can Outperform Reinforcement Learning

Lakshya A Agrawal, Shangyin Tan, Dilara Soylu et al.
2025

arXiv 2505.24832

语言模型到底记住了多少?

How much do language models memorize?

John X. Morris, Chawin Sitawarin, Chuan Guo et al.