当 Agent 的上下文也有了“查询优化器”,矩阵起源论文ContextPipe入选数据库顶会VLDB 2026 Workshop

由矩阵起源与清华大学联合完成的论文 ContextPipe: Database-Inspired Context Assembly for Long-Horizon Agents,正式入选VLDB 2026 ADS/DATAI联合Workshop。

该论文是矩阵起源团队与清华大学联合完成的研究成果。其核心思想是借鉴数据库查询执行与优化机制,对长周期Agent的上下文进行规划、组装和反馈优化,让上下文管理更加高效、稳定和可追踪。

关于VLDB和ADS/DATAI Workshop

VLDB全称为International Conference on Very Large Data Bases,是数据库与数据管理领域最具影响力的国际学术会议之一。第52届VLDB 2026于2026年8月31日至9月4日在美国波士顿举行。

ADS/DATAI是首届Agentic Data Systems Workshop与第三届Data-Centric AI Workshop的联合研讨会,主要讨论AI Agent与数据系统结合过程中出现的新问题,包括长周期任务、数据工作流、系统可靠性、成本优化、评测和治理等。

在这里插入图片描述

用数据库查询优化器思路解决Agent上下文问题

Agent执行长周期任务时,会不断积累对话、工具调用结果、文件内容、错误信息和中间状态。每次调用模型前,运行时都需要确定哪些信息应该进入上下文、以什么顺序组织,以及何时压缩历史内容。如果只是持续追加,Token消耗会不断增加,重要信息也容易被大量历史内容淹没。

ContextPipe认为,上下文组装与数据库查询执行有相似的系统结构。数据库面对一次查询时,不会把全部数据直接交给执行引擎,而是根据查询目标、统计信息、资源预算和缓存情况选择执行计划。ContextPipe用同样的思路处理Agent上下文,根据当前任务选择需要的信息,并在上下文窗口、Token成本、响应时间和Prompt Cache之间进行权衡。

论文将这一过程划分为Plan、Bind、Optimize、Execute和Feedback五个阶段。系统先描述本次模型调用需要哪些上下文,再绑定对话、文件、工具结果和记忆等数据源,随后生成可执行的上下文计划,完成模型调用,并记录实际的Token消耗、延迟和执行结果。

ContextPipe还引入了结构化的数据源目录、可感知缓存的优化器和类似数据库EXPLAIN ANALYZE的执行追踪。每次模型调用使用了哪些上下文、为何采用当前组织方式,以及执行过程中发生了什么,都可以被记录和回放。这为Agent的调试、审计和持续优化提供了基础。

评测显示,与追加式上下文策略相比,ContextPipe将总Token使用量降低31%,LLM调用次数降低23%,整体响应时间降低9%。

我们将在后续文章进行论文解读,详细介绍ContextPipe的架构设计、优化机制和实验结果。

Astra Harness的底层原理

ContextPipe研究的上下文规划、执行追踪和反馈优化,也是矩阵起源自研的 Astra Agent Runtime 的底层原理。

Astra面向企业级生产环境中的Agent运行需求,负责上下文组装、状态管理、工具调用、错误恢复和执行审计。矩阵起源正在把数据库领域积累的系统技术用于Agent基础设施建设,提升Agent执行长周期任务时的效率、稳定性和可管理性。

9月4日VLDB2026 波士顿现场预告

美国东部时间2026年9月4日11:55至12:10,张祖羽博士和田丰博士将在VLDB 2026 ADS/DATAI Workshop现场介绍ContextPipe。

  • 演讲人:张祖羽博士、田丰博士
  • 演讲题目:ContextPipe: Database-Inspired Context Assembly for Long-Horizon Agents
  • 地点:The Westin Boston Seaport District,Commonwealth A
  • 北京时间:9月4日23:55至9月5日00:10

欢迎关注Agent Runtime、Context Engineering和Agentic Data Systems的朋友到现场交流。

内容概要:本文围绕视觉大模型在医学影像辅助诊断中的应用展开探讨,旨在解决传统医学影像诊断中存在的误诊率高、读片效率低、医生工作负荷重等问题。文章系统阐述了视觉大模型在处理速度、识别精度和医疗资源均衡方面的显著优势,并提出“七横四纵”的技术架构体系,涵盖感知层、网络层、基础层、框架层、模型层、应用层、交互层以及标准规范、安全保障、运行管理、法规政策四大支撑体系。在此基础上,提出了包括健全工作机制、更新终端设备、整合影像数据、统筹系统建设、加强培训推广在内的五大建设路径,推动视觉大模型在医疗影像领域的深度融合与产业化落地。; 适合人群:从事医疗信息化、人工智能技术研发的研究人员,医疗机构管理者,医学影像专业从业人员,以及关注AI+医疗融合发展的政策制定者和技术开发者。; 使用场景及目标:①构建智能化医学影像诊断系统,提升诊断的时效性与准确性;②实现跨机构影像数据共享与结果互认,推动优质医疗资源下沉基层;③支持远程诊断、智能报告生成、早期筛查预警、个性化治疗推荐等临床应用场景;④为智慧医院和医联体建设提供技术支撑。; 阅读建议:此资源兼具技术架构设计与实践路径规划,适合结合实际医疗场景深入研读,建议重点关注模型训练、数据治理、系统集成与伦理合规等方面的实施方案,并在科研或项目实践中加以验证与优化。
本资源提供珠江流域一级、二级和三级流域矢量范围及DEM高程数据,包括1个一级流域、14个二级流域和29个三级流域,配套可编辑MXD工程文件、标准Shapefile矢量文件以及标准成图TIF文件,可用于珠江流域水文地理、水资源管理及自然灾害等相关研究。 数据以不同等级流域边界为核心,系统反映珠江流域各级流域单元的空间层级与分布格局。标准Shapefile文件支持流域边界的空间查询、分级统计、属性编辑及专题制图;配套DEM数据能够反映珠江流域地形高程及地势变化,可用于高程、坡度、坡向和地形起伏度等分析。 资源提供可编辑MXD工程文件,已完成流域及DEM图层组织、符号配置、标注和地图版式设置。用户可在ArcGIS中直接打开并根据研究需求调整图层、符号、标注及地图布局,也可叠加河流、降水、土地利用、人口及灾害数据开展综合空间分析。 该数据可广泛应用于珠江流域水文分析、水资源管理、洪涝与干旱灾害研究、地形分析、生态环境评价及流域综合管理等领域,可为不同尺度下的流域划分、地形特征分析及自然地理空间关联研究提供基础数据。 同时提供标准成图TIF文件,可直接用于科研论文、项目报告、专题地图及教学展示。整体数据具有流域层级清晰、空间范围完整、DEM数据配套、格式规范等特点,可为珠江流域相关科研与GIS空间分析提供基础数据支撑。
该数据集支持配电网计划外停电的风险分析模拟。它是基于对五位领域专家的结构化调查构建的,分两个阶段收集: 1.最佳最差方法(BWM)成对比较,其中每位专家对严重性、发生率和检测对于优先考虑停机原因的重要性进行排名(经典的FMEA标准)。 2.对每个停电原因对其他停电原因的影响程度进行语言(模糊)评估(例如,变压器故障可能会在其他地方引发瞬态故障),加上每个原因的当前激活水平。第二部分提供模糊认知图(FCM)网络仿真。 下面的六张表可以让你重现:聚合标准权重(BWM)、每个原因的加权风险优先级(RPN)和完整的FCM传播模拟,以及建立在同一网络之上的几种多标准排名方法(模糊TOPSIS、模糊MARCOS、SERA、MEREC)。 表:标准 |列|数据类型|描述| |--------|----------------|--------------| |索引|整数(0-2)|标准的位置,在其他地方(在BWM_Experts中)用于通过数字而不是名称来引用它。0=严重性,1=发生率,2=检测。| |名称|文本|用于优先考虑停机原因的FMEA风格标准的名称:"严重性"(后果有多严重)、"发生率"(原因发生的频率)或"检测"(在导致停机之前很难发现)。| 表:BWM_专家 |列|数据类型|描述| |---|---|---| |Expert_ID|文本|调查对象的匿名标识符,例如Expert_1。.专家_5。共调查了5名专家。| |该专家认为对于确定停机原因的优先级最重要的标准的最佳标准索引|整数(0-2)|索引(见标准表)。| |最佳标准名称|文本|最重要("最佳")标准的名称,为可读性而详细说明。| |更糟_标准_指数|整数(0-2)|该专家认为最不重要的标准的指数。
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值