← 首页|学术|Agentic Transaction: Towards ACID-Compliant Agent Systems
cs.DB, cs.AI, cs.CL, cs.LG · 2608.13900 · 2026/08/14

Agentic Transaction: Towards ACID-Compliant Agent Systems

Sun, Zhaoyan, Wang, Xiaoxiao, Li, Guoliang
TL;DR:把经典 ACID 事务语义重解释为 agent 执行的四个保障:语义原子性/一致性/隔离性/持久性,用探索-执行-验证循环、事务技能中枢、置信发散验证、语义依赖感知隔离落地,在广泛 benchmark 上比 SOTA(含 Claude Code)高 10.6%。

🎯 问题

agent 从对话助手演进为在持久环境上执行长程多步任务的自治系统,面临数据库系统早就解决的挑战:可靠执行、结果一致、安全并发、状态持久化。

🔬 方法

提出 agentic transaction 概念与 ACID-compliant agent 系统框架,把 ACID 四属性重解释为 agent 语义保证;实例化为数据 agent:探索-执行-验证循环 + 事务技能中枢 + 基于置信发散的验证 + 语义依赖感知隔离 + 事务感知语义状态管理。
章节结构(全文标题提取):
1. Introduction
2. Agentic Transaction
3. Experiments
4. Open Problems

📊 结果

在多个常用 benchmark 上比最强基线 agent(包括 Claude Code)平均高 10.6%,验证语义事务对模型不确定性下可靠执行的增益。

💡 与研究方向关联

给 agent 系统套上数据库的事务性脚手架——长程可靠执行的原则性基础,对应 agent 架构的可靠性维度,也是 agent 规模化落地前的关键工程方向。

📝 原文摘要

▶ 原文摘要 Abstract
Large language model (LLM) agents are evolving from conversational assistants into autonomous systems that execute long-horizon tasks through reasoning, tool use, code generation, and workspace manipulation. As agents increasingly operate over persistent environments and multi-step workflows, they face challenges analogous to those addressed by transactional database systems: reliable execution, consistent outcomes, safe concurrency, and durable state management. We introduce the concept of an agentic transaction and propose an ACID-compliant agent system framework that reinterprets the classical ACID properties for agent execution through four semantic guarantees: Semantic Atomicity, Semantic Consistency, Semantic Isolation, and Semantic Durability. Together, these properties provide a principled foundation for building reliable agent systems despite model uncertainty and dynamic execution environments. To instantiate this framework, we develop an ACID-compliant data agent that realizes these guarantees through transactional exploration-execution-validation cycles, transactional skill hubs, confidence divergence-based validation, semantic dependency-aware isolation, and transaction-aware semantic state management. Experimental results on widely used benchmarks show that our system achieves a 10.6% improvement over state-of-the-art agents, including Claude Code. This work opens a broader research agenda on extending transactional principles and system architectures toward building trustworthy, scalable, and self-evolving AI agent systems.
Deep Read · 2026-08-18高松灯 / Agent 日报
ACIDAgent ReliabilityTransactionAgent System