夜雨聆风学习资料网

ARTICLE · 1115961

NDBC2026论坛 | 《软件学报》专刊“多模态数据管理及融合技术”报告

NDBC2026论坛 | 《软件学报》专刊“多模态数据管理及融合技术”报告

多模态数据的爆发式增长正在深刻重塑数据管理领域技术。文本、图像、音频、视频、图结构与向量等异构模态数据的统一建模、融合分析与高效检索,已成为学术界与产业界共同关注的核心议题。NDBC 2026大会期间,《软件学报》专刊“多模态数据管理及融合技术”报告论坛将在上海圣诺亚皇冠假日酒店诺亚会议室6举办,时间为2026年10月17日(周六)14:00–17:30。本论坛邀请《软件学报》“多模态数据管理及融合技术”专刊中来自全国顶尖高校的论文投稿团队分享最新研究进展,并特邀领域知名专家学者现场点评指导。

论坛亮点抢先看

嘉宾阵容:

专刊编辑:彭智勇教授(武汉大学)、崔斌教授(北京大学)、高晓沨教授(上海交通大学);

责任专家:杨晓春教授(东北大学,CCF数据库专委副主任);

点评专家:王晓阳教授(复旦大学)、卢卫教授(中国人民大学)、李瑞远教授(重庆大学)。

研究主题:

论坛聚焦多模态数据管理最新研究方向,围绕多模态高效检索与融合分析、异构多源数据统一组织、协同存储与智能索引优化等前沿议题展开,贯通底层存储、索引与检索系统到工业质检、科技情报分析、智慧医疗等上层行业应用,全面展现多模态数据管理领域的研究脉络与发展趋势。

论坛报告:

来自东北大学、国防科技大学、北京大学、浙江大学、上海交通大学、哈尔滨工业大学、北京航空航天大学、南京航空航天大学、武汉大学、华东师范大学等多所高校的研究团队与到会专家共同分享最新研究进展:探讨多模态数据管理的新兴技术,及在真实产业场景中的落地融合。

论坛主席

开幕致辞

主席简介:

彭智勇,武汉大学计算机学院教授、博士生导师,大数据研究院副院长,日本京都大学博士,享受国务院政府特殊津贴,CCF 会士。提出对象代理数据库模型并研制具有自主知识产权的对象代理数据库管理系统 TOTEM,出《PostgreSQL 数据库内核分析》、《对象代理数据库系统原理》等著作;主持国家自然科学基金重点项目、国家 863 数据库重大专项课题、国家重点研发计划课题等,曾获中创软件人才奖、国防科工委科技进步一等奖、教育部科技进步二等奖。

开幕致辞

主席简介:

崔斌,北京大学博雅特聘教授、计算机学院副院长、数据科学与工程研究所所长,长江学者特聘教授,IEEE Fellow,CCF 会士。主要研究方向为 AI 系统、大模型训练推理、数据库系统与大数据管理分析,已发表 CCF A 类学术论文 200 余篇。主持国家自然科学基金重点项目、国家重点研发计划课题等十余项国家级项目;担任/曾担任 CCF 理事、数据库专委会副主任,VLDB 理事会理事,DSE 期刊主编,IEEE TKDE、VLDB Journal 等期刊编委,VLDB 2024 大会主席。曾获微软青年教授奖、CCF 青年科学家奖、教育部自然科学二等奖、电子学会科技进步一等奖。

主持人

主席简介:

高晓沨,上海交通大学计算机学院长聘教授、院长助理,全国五一劳动奖章、国家级青年人才获得者,任CCF 分布式计算与系统专委会副主任。长期从事数据工程、网络优化等研究,发表CCF-A/B区论文200余篇,荣获12次国际会议最佳论文奖。主持科研项目40项,任科技部重点研发计划项目首席科学家,自然科学基金重点项目负责人等,获中国产学研合作创新与促进奖(2023)、CCF-华为数据库创新研究计划评审第一名(2020,年度最高奖)、CCF-腾讯“犀牛鸟基金卓越奖”(2021,年度最高奖)以及“犀牛鸟基金优秀奖”(2018)。

论坛议程

参会嘉宾

开幕致辞

专家简介:

杨晓春,东北大学国家示范性软件学院院长,二级教授,国家级高层次人才,科技部中青年科技创新领军人才,国家优秀青年科学基金获得者,教育部新世纪优秀人才,兴辽计划特聘教授,国家重点研发专项项目首席科学家,获宝钢优秀教师奖。现为中国计算机学会杰出会员、CCF数据库专委会副主任,《Data Science and Engineering》副主编,《软件学报》《电子学报》编委。长期从事数据管理与分析领域的教学科研工作,主要研究方向包括大数据管理与知识工程、数据库理论与系统、多模态数据融合、数据隐私保护与智能推荐系统。

点评专家

专家简介:

王晓阳,复旦大学特聘教授,CCF、中国人工智能学会会士。于美国南加州大学获博士学位,曾任美国佛蒙特大学终身职正教授、Dorothean讲席教授及美国国家科学基金会(NSF)项目主管,前复旦大学计算机学院、软件学院院长。主要研究方向为大数据分析、数据安全,主持国家重点研发计划项目、NSFC重点项目等20余项,曾任Springer DSE期刊主编、 ICDE 2012及 CIKM 2014大会主席,获美国NSF CAREER Award。

点评专家

专家简介:

卢卫,中国人民大学吴玉章特聘教授,信息学院副院长,CCF 数据库专委执行委员。主要研究方向为数据库基础理论、分布式数据库系统与数据治理,在 SIGMOD、VLDB、 VLDB Journal 等国际知名会议和期刊发表论文 60 余篇;主持国家重点研发计划课题、国家自然科学基金面上项目等多个项目,多项研究成果落地于实际数据库产品。曾获 CCF 优秀博士学位论文奖、北京市高等教育教学成果一等奖、深圳市科技进步一等奖、首届华为云难题“火花奖”。

点评专家

专家简介:

李瑞远,重庆大学计算机学院副教授,重庆大学最受学生欢迎的老师,中国电子学会优博,曾经担任京东城市时空数据组机构负责人,主持研发京东城市时空数据引擎 JUST并应用于雄安块数据平台等多个国家级项目。加入京东之前,在微软亚洲研究院城市计算组实习4年。发表论文50余篇(含CCF A类30余篇),申请专利40余项(含中国专利优秀奖1项)。因在时空数据挖掘方面的贡献,获2024年CCF自然科学三等奖,以及2025年空间数据智能新星学者奖。

报告简介

报告一:SigRAG:面向多模态长文档的语义信息增益检索增强生成

论文作者:宁新禹 袁欣宇 王千阁 张岩峰 王国栋 于戈(东北大学)

报告简介:

多模态检索增强生成(MRAG)为复杂文档理解与问答提供外部证据支持,但现有方法多以页面为基本检索单元,难以利用长文档内部的层次结构与内容关联。本报告介绍一种基于语义信息增益的多模态检索增强生成方法 SigRAG,将文档中不同粒度的多模态内容组织为具有层次结构和语义关联的文档语义图,并通过语义信息增益动态评估候选内容对当前查询的新增信息贡献。

报告二:细粒度种子质量感知的无监督多模态实体对齐方法

论文作者:赵润豪 周仲憬 曾维新 李正品 张文涛 唐九阳 赵翔(国防科技大学、北京大学)

报告简介:

多模态实体对齐是实现跨源多模态知识融合的核心任务。针对现有无监督方法伪种子筛选过于粗粒度、后续训练过度同质化的问题,本文提出细粒度种子质量感知的即插即用增强框架 FGQP:通过多模态特征融合与聚类采样生成均衡的高精度初始伪种子,结合排序间距、模态一致性与图结构支持度建立多维度连续置信度评估,将伪种子划分不同质量等级并实施差异化训练,设计软负样本对比损失以抑制伪阴性效应。

报告三:基于资源感知层次化LSM树的端边云协同时空数据存储与查询方法

论文作者:徐子轩 房子荃 李忠根 朱轶凡 高洪 高云君(浙江大学、中兴通讯)

报告简介:

时空轨迹数据持续激增,对存储系统的写入吞吐与查询延迟提出严峻挑战。针对现有时空数据管理系统在边缘侧高频写入、低延迟查询及异构资源适配方面的不足,提出基于资源感知层次 LSM 树的端边云协同时空数据存储与查询方法STLSM,将 LSM 树层级映射至端、边、云三层,实现分层存储与跨层查询,支持时间范围、空间范围、时空范围及 KNN 四类查询,提出资源感知动态 Compaction 策略。

报告四:基于多模态数据融合的汽车装配制造质量异常检测方法

论文作者:罗旸 张兆祥 李知恒 贾永泉 陈贵海(上海交通大学、蔚来汽车)

报告简介:

针对汽车装配制造场景多模态数据融合不足、异常样本稀疏、工艺语义与时序信号难以深度适配的行业痛点,本文提出基于多模态数据融合的质量异常检测方法SRPCGN:设计文本引导频域重构模块提纯时序信号特征,通过时序驱动工艺校准机制实现动态传感数据与静态工艺文本的语义对齐,并依托双模关联图聚合模块挖掘产线多点位隐性批次关联特征。

报告五:WISE:面向多模态数据管理的负载感知强化学习索引优化方法

论文作者:燕钰 张钰琦 程思佳 王宏志(哈尔滨工业大学)

报告简介:

多模态数据管理系统需同时支持结构化属性过滤、全文检索和高维向量近邻搜索,不同类型索引在查询性能、存储开销和更新维护成本之间存在复杂权衡。针对动态多模态工作负载下索引策略优化研究相对缺乏的问题,本文首次提出面向多模态数据管理的负载感知强化学习索引优化方法 WISE:统一建模结构化索引、全文索引、向量近邻索引和复合索引,将索引策略选择建模为受资源约束的组合优化问题,并设计基于PPO 的工作负载感知策略优化器实现索引组合自适应优化。

报告六:面向智能体记忆的时效性感知向量检索方法

论文作者:刘宇恒 李书缘 王宇翔 周子慕 童咏

昕(北京航空航天大学、香港城市大学)

报告简介:随着大语言模型智能体应用于跨会话、长周期任务,智能体记忆系统需要从持续增长的历史记录中准确召回与当前决策相关的信息。针对记忆价值随时间和上下文演化持续衰减、传统时间窗口过滤难以兼顾相关性与时效性的问题,本报告介绍一种时效性感知近似近邻检索方法,将语义相似度与连续衰减的时效性融合为统一得分,并基于向量图索引设计动态分桶框架。

报告七:LongDocAware:结构因果感知的多模态长文档检索增强生成框架

论文作者:吴文隆 朱旗 温荷川 戴敔航 王昊奋 李丕绩 李博涵(南京航空航天大学、同济大学)

报告简介:

多模态检索增强生成(MM-RAG)是长文档问答的重要技术路径,但长文档中的有效证据往往跨页面、跨模态分布,且相互间存在结构依赖。针对固定粒度分块易割裂证据链、一次性 Top-K 检索造成“召回淹没”的问题,本报告提出LongDocAware(LDA)框架:Agentic-Chunk 综合章节层级与图文锚点自适应构造检索单元以保留文档结构;顺序增强嵌入(OEE)联合编码语义、位置与跨模态关联,完成候选粗召回;借鉴结构因果模型(SCM)构建证据依赖图,按拓扑顺序迭代核验候选并补全缺失节点,形成完整且相互支持的证据链。

报告八:面向跨模态哈希检索的模态不平衡自适应调节方法

论文作者:李玥潼 杨晓春 李铁英 王斌 李发明(东北大学)

报告简介:

跨模态哈希检索把图像和文本映射成哈希码实现检索。以往方法默认图文对齐能提高双方表征质量,但研究发现两模态承载的信息量不对等,对齐反而降低表征质量:由于文本特征远少于图像,图像中文本不具备的特征在对齐中得不到优化而被抹去,拉低检索精度。本文提出有效秩指标衡量模态能承载的判别信息,并据此设计自适应调节方法 AMM:以图文有效秩之比作为失衡信号,抬高文本承载的信息量并动态调节对齐强度,使图像在对齐中保住更多独有特征。

报告九:基于统一多模数据库的学术科技情报分析系统

论文作者:刘雪涛 刘泽鹏 王胜 彭智勇(武汉大学)

报告简介:

复杂学术问题的分析需要综合利用论文属性、引文关系、文档内容和语义向量等多模数据。针对现有系统多模数据分散访问、难以统一查询与融合分析的问题,本文介绍一种基于统一多模数据库的科技文献分析系统,将文献数据统一建模为关系、图、文档和向量四类模型,支持跨模型统一查询与协同执行,并通过多智能体协同流程生成具有多模证据支撑和可追溯性的分析报告。

报告十:连接视觉与感知:基于图约束的多模态舌象分析指令数据生成

论文作者:陈春良 钱天文 王新宇 王晓玲(华东师范大学)

报告简介:

舌诊具有便捷、低成本和非侵入等特点,在家庭健康监测与早期筛查中具有应用价值。针对现有舌诊多模态数据中图像与文本语义对齐不足、诊断推理信息缺失等问题,本研究提出一种基于图约束的指令数据合成方法,将数据生成建模为约束子图采样过程,通过图结构关联舌象视觉特征与诊断证据,无需人工参与便可构建具有不同推理难度层次的训练指令数据,并在此基础上构建舌诊推理评测基准。

NDBC2026信息

第43届CCF中国数据库学术会议(NDBC 2026)将于2026年10月16日至18日在上海市举行。本届大会由中国计算机学会(CCF)主办,CCF数据库专业委员会和华东师范大学承办。

本届大会将主要关注数据库领域所面临的新挑战、新问题和新方向,着力反映我国数据库技术研究的最新进展,为科研院所、科技企业的数据库研究、开发和应用相关人员搭建交流平台。大会期间将设立多个技术论坛,并继续开设“系统演示”主题,新增海报展示环节。届时还将邀请国内外数据库领域著名专家到会作专题报告。

网站以及注册信息

酒店住宿预定

相关学习资料