ChinaMM 2026 收官日精彩回顾!!
ChinaMM 2026 收官日精彩回顾!!
精彩概要
专题论坛:人工智能与艺术创作(AIART)
专题论坛:多模态世界模型辅助的具身智能和低空经济
专题论坛:开放场景下多模态智能视觉信息处理
专题论坛:媒体质量评价与感知优化
专题论坛:视觉编码及处理前沿
专题论坛:微视觉计算
专题论坛:智能多媒体通信与网络传输
专题论坛:多模态大模型高效部署关键技术
专题论坛:非理想场景下的多模态智能:鲁棒感知、复杂推理与融合应用
专题论坛:面向具身智能的数据生成及安全治理技术研究
专题论坛:多媒体内容安全与隐私保护青年论坛
专题论坛:多模态情感理解与分析
专题论坛:触觉与具身感知
专题论坛:多模态食品科学智能
论坛回顾
01
专题论坛:人工智能与艺术创作AIART
人工智能与艺术创作(AIART)专题论坛由北京工业大学牟伦田副教授、北京大学高峰研究员和中国传媒大学程皓楠研究员组织,邀请了马思伟、袁晓如、张克俊、金枝、宋利、叶龙、覃京燕7名专家。本专题论坛围绕“人机共生共创共情”主题,旨在探索智能艺术的理论根基、计算方法与审美实践。北京大学马思伟教授详细介绍了全链路与沉浸可交互的生成式AI艺术内容创作路径与应用实践;北京大学袁晓如教授围绕人机协同的历史文化溯源计算及可视化在人文分析中的关键作用进行了详细分享;浙江大学张克俊教授探讨了智能时代下从视觉到听觉的多视角交互范式变革;中山大学金枝教授就兼顾人类视觉美学与机器视觉性能的人机双元驱动图像增强进行了详细介绍;上海交通大学宋利教授深入阐述了共情数字人的“情感认知建模—多模态协同表达—具身自然交互”整体技术框架;中国传媒大学叶龙教授详细介绍了沉浸式3D音视频技术与文化遗产修复传承深度融合;北京科技大学覃京燕教授分享了融合“允执厥中”东方哲学思想的具身社会智能与绿色AI可持续设计。本专题论坛使听众深入了解了人工智能与艺术创作交叉领域的技术发展路径与应用实践。
左右滑动查看更多
02
专题论坛:多模态世界模型辅助的具身智能和低空经济
多模态世界模型辅助的具身智能和低空经济专题论坛由香港中文大学(深圳)李镇副教授、中国科学技术大学杨勋教授和中山大学李冠彬教授组织,邀请了冯春梅、范略、郑心湖、王文冠4名专家。本专题论坛聚焦多模态感知与理解、具身智能关键技术、低空无人系统智能化以及世界模型最新进展等议题。同济大学冯春梅副教授围绕大模型时代的联邦智能研究,详细介绍了参数高效适配、异构表示学习、联邦迁移及医疗AI可信推理等相关研究工作;中国科学院自动化研究所范略助理研究员详细分享了世界模型从4D几何表观刻画向物理内涵基座模型演进的技术发展路径,并介绍了视频世界模型全方位评测方法;香港科技大学(广州)郑心湖副教授围绕面向空地多智能体协同的世界模型,分享了UniT统一几何学习框架与PraxisWorld物体系世界-行动模型等研究工作;浙江大学王文冠研究员详细介绍了面向三维空间智能的视觉基座模型的无位姿三维表示与2D-3D协同优化范式。本专题论坛旨在增强听众对多模态世界模型辅助具身智能与低空经济领域的关注及其技术理解。
左右滑动查看更多
03
专题论坛:开放场景下多模态智能视觉信息处理
开放场景下多模态智能视觉信息处理专题论坛由哈尔滨工业大学李文瑞副教授、山东大学张聪教授、大连理工大学刘晋源副教授和哈尔滨工业大学范晓鹏教授组织,邵天甲、丛润民、洪晓鹏、举雅琨、赵睿5名专家进行专题报告。本专题论坛聚焦智能视觉、图像处理、多模态信息融合与高维信号分析等前沿方向。浙江大学邵天甲副教授围绕Gaussian+X 双尺度三维真实感表达,分享了超高速高保真绘制、实时重建与少样本室内场景重建等研究工作;山东大学丛润民教授详细介绍了条件受限环境下的多模态智能感知与预训练大模型应用现状;哈尔滨工业大学洪晓鹏教授围绕多模态目标建模与感知,详细介绍了模态中介协同、文图协同应用及模型更新适配等前沿进展;中国海洋大学举雅琨教授就水下光度立体高精度三维感知及表面精细结构恢复进行了详细介绍;南洋理工大学赵睿博士后研究员将围绕运动分析与影像重建这两个脉冲相机的基础视觉任务,介绍了脉冲视觉的开源框架与社区SpikeCV,并对脉冲视觉领域的未来发展方向进行展望。本专题论坛旨在探讨面向人工智能快速发展背景下复杂环境感知与理解中的关键问题。
左右滑动查看更多
04
专题论坛:媒体质量评价与感知优化
媒体质量评价与感知优化专题论坛由宁波大学姜求平教授、上海交通大学张维夏副研究员和中山大学王志华副教授组织,邀请了方玉明、徐迈、李雷达、付莹、闵雄阔5名专家。本专题论坛围绕“视觉质量评价与优化”这一前沿主题,从人类视觉感知建模、图像与视频质量评价、计算美学、感知驱动优化以及大模型时代的视觉生成与理解等方向展开研讨。江西财经大学方玉明教授就VR视觉质量体验质量评价中的主客观评价数据库与方法进行了详细介绍;北京航空航天大学徐迈教授围绕通往沉浸式媒体体验的全景视频智能处理技术,分享了视觉注意模型、感知失真度量及压缩增强等研究工作;西安电子科技大学李雷达教授探讨了细粒度视觉质量评价的主要特点、研究进展,以及在相机画质调试、图像美学推荐等领域的应用;北京理工大学付莹教授详细介绍了利用传感器无损高位宽特性的RAW域图像去噪与极端光照环境增强等方法;上海交通大学闵雄阔副教授聚焦生成式内容质量评价研究,分享了涵盖图像/视频/音视频生成、编辑及人像生成的评估最新进展。本专题论坛旨在梳理关键技术路径与核心挑战,分析新范式与发展趋势,促进理论与应用融合。
左右滑动查看更多
05
专题论坛:视觉编码及处理前沿
视觉编码及处理前沿专题论坛由天津大学雷建军教授、山东大学李帅教授、天津大学彭勃副教授和山东大学高艳博副教授组织,邀请了虞露、田永鸿、白慧慧、刘贤明、戴玉超5名专家。本专题论坛围绕空间视频表征、神经形态感知、内容自适应编码、分布式数据协同及智能三维视觉等前沿方向展开深入研讨。浙江大学虞露教授详细介绍了空间视频的多模态统一表征建模、时空相关性挖掘、高效编码机制及三维场景重建等智能应用;北京大学田永鸿教授围绕“神经形态视觉+脉冲神经网络”感算融合架构在超高速感知成像、大规模SNN及感算一体仪器上的前沿进展进行了详细介绍;北京交通大学白慧慧教授针对自然图像与屏幕内容两类典型视觉数据,介绍了基于粒度动态分配与基于区域结构分离的自适应编码机制;哈尔滨工业大学刘贤明教授分享了从集中式数据压缩到分布式数据协同的全生命周期治理方案;西北工业大学戴玉超教授详细介绍了复杂动态场景3D/4D重建、非常规传感器几何建模及大模型安全等智能三维视觉技术前沿进展。本专题论坛围绕视觉编码及处理前沿技术,深入研讨其在当前人工智能和大模型领域的技术瓶颈与发展方向。
左右滑动查看更多
06
专题论坛:微视觉计算
微视觉计算专题论坛由大湾区大学余梓彤副教授、北京科技大学邹博超副教授和合肥工业大学郭丹教授组织,邀请了山世光、李甲、秦杰、刘羽、刘鑫、王运涛6名专家。本专题论坛聚焦捕获与解码微弱视觉信号(如微表情、微姿态、隐蔽生理信号及微小病变/缺陷),旨在攻克微弱信号表征受限、泛化能力不足及多模态表达有限等关键瓶颈。中国科学院计算技术研究所山世光研究员详细介绍了视线估计与跟踪技术及其在孤独症谱系障碍(ASD)辅助诊断中的应用;北京航空航天大学李甲教授针对深空深海等极端环境下的微弱目标视觉计算任务,详细介绍了边缘检测、属性感知与稀疏样本迁移等研究进展;南京航空航天大学秦杰教授面向伪装场景的视觉理解与生成任务,分享了特征建模、效率协同及可控扩散生成等研究工作;合肥工业大学刘羽教授详细分享了可见光、红外及医学影像等场景下的视觉弱小目标分割与表征增强方法;上海交通大学刘鑫副教授详细介绍了基于微姿态、微表情及远程生理信号等细微信号的可信情感计算研究进展;清华大学王运涛副研究员围绕非接触式面部脉搏波(rPPG)鲁棒重建技术及其在端侧健康监测中的应用进行了详细介绍。本专题论坛旨在探讨检测和解码微弱视觉信号的前沿技术方法与应用。
左右滑动查看更多
07
专题论坛:智能多媒体通信与网络传输
智能多媒体通信与网络传输专题论坛由北京大学马思伟教授、国家超级计算济南中心潘景山教授、北京大学张嘉琪副研究员和北京大学李田法工程师组织,邀请了Alexandr Dvorkovich、毛琪、Alexander V. Ivchenko、柏园超、陈浩5名专家。本专题论坛围绕视频编码技术发展历程、生成模型赋能视觉压缩、人工智能驱动的视频编解码优化、智能视频传输与网络协同以及医学影像高保真压缩等前沿方向展开深入研讨。俄罗斯科学院/莫斯科物理技术学院Alexandr Dvorkovich教授围绕视频压缩技术,详细梳理了从H.261到H.267的发展历程与未来AI编码趋势;中国传媒大学毛琪教授围绕生成模型赋能视觉压缩,分享了基于视频扩散先验的超低码率时序稳定编码与端侧部署;莫斯科电子与数学研究所Alexander V. Ivchenko副教授介绍了人工智能在视频编解码中的应用趋势与前沿进展;哈尔滨工业大学柏园超副研究员围绕医学影像高保真压缩技术,详细分享了可伸缩有损-残差联合编码与轻量化三维自回归扫描等研究工作;南京大学陈浩特聘研究员详细介绍了卫星/水下/远洋等极低带宽弱网环境下的编码-传输智能视频优化与产业落地。本专题论坛展望了下一代互联网、智慧医疗、智能终端及沉浸式多媒体等领域的技术路径与应用发展。
左右滑动查看更多
08
专题论坛:多模态大模型高效部署关键技术
多模态大模型高效部署关键技术专题论坛由中国科学技术大学李礼教授和南洋理工大学高长生博士后组织,邀请了丁贵广、王欢、张宇伦、程正雪、余伟浩5名专家。本专题论坛围绕端侧大模型轻量化、高效人工智能范式、多模态视觉特征编码、推理优化及记忆机制等关键技术展开深入研讨。清华大学丁贵广教授详细介绍了深度学习主干网络重参数化及多模态大模型预填充与解码阶段的推理优化等前沿进展;西湖大学王欢助理教授分享了高效人工智能从“后处理”范式向“效率原生”范式演进的全新路径;上海交通大学张宇伦副教授面向端侧的大模型轻量化技术,详细阐述了结构重设计、剪枝、量化与蒸馏等研究方法;上海交通大学程正雪助理研究员围绕多模态大模型时代的视觉特征编码,分享了VTC编解码器与AITISA特征编码标准等研究工作;北京大学深圳研究生院余伟浩助理教授就启发自认知科学的人工海马网络(AHN)记忆机制及其在长程任务加速与视频生成中的应用进行了详细介绍。本专题论坛使听众深入了解了多模态大模型高效部署领域的技术创新及应用落地。
左右滑动查看更多
09
专题论坛:非理想场景下的多模态智能:鲁棒感知、复杂推理与融合应用
非理想场景下的多模态智能:鲁棒感知、复杂推理与融合应用专题论坛由江南大学吴小俊教授、安徽工业大学陈哲教授、郑州大学胡世哲研究员和哈尔滨工业大学(深圳)文杰教授组织,邀请了彭宇新、鲁继文、刘新旺、彭玺、张长青、胡鹏、唐厂7名专家。本专题论坛围绕鲁棒感知、统一融合、复杂推理、视觉生成及医学应用等热点问题展开研讨。北京大学彭宇新教授详细介绍了细粒度图像分类大模型、细粒度空间推理与占用预测、细粒度美学理解、细粒度运动分析等方法的主要研究进展;清华大学鲁继文教授详细分享了视觉内容智能生成近年来的主要研究进展,包括图像视频超分、点云数据补全、长程文生视频、多模内容合成等研究工作;国防科技大学刘新旺教授分享了课题组在基于自监督学习的防御方法、重要性驱动的随机采样防御方法等的最新研究工作;四川大学彭玺教授从评测基准与推理算法两个维度介绍了团队的最新研究进展,探讨了复杂推理场景下模型能力的评测方法、非完美思维的表现形式及其应对策略;天津大学张长青教授就迈向统一的多模态数据融合理论、方法与应用进行了详细介绍;四川大学胡鹏教授详细分享了面向低质感知的鲁棒多模态学习与不确定性量化可信推理等研究工作;华中科技大学唐厂教授聚焦多模态融合方法,详细介绍了其在医学诊断中的关键应用。本专题论坛望通过跨方向、跨层次的学术分享,系统探讨了当前多模态智能的发展脉络。
左右滑动查看更多
10
专题论坛:面向具身智能的数据生成及安全治理技术研究
面向具身智能的数据生成及安全治理技术研究专题论坛由中国科学技术大学陈志波教授和清华大学高宸助理研究员组织,邀请了陈雪锦、殷赵霞、于灵云、金鑫4名专家。本专题论坛围绕高保真可交互具身数据生成与数据全生命周期安全治理两大核心议题展开深入研讨。中国科学技术大学陈雪锦教授面向空间推理的结构化数据生成,详细介绍了三维场景重构、空间推理多模态数据生成与时空推理模型训练等研究工作;华东师范大学殷赵霞教授从“数据-算法-数据”链路出发,分享了课题组在数据与模型攻防领域的最新研究进展;中国科学技术大学于灵云副研究员面向视觉生成式人工智能安全,详细介绍了主动干扰与语义水印数据保护、AIGC伪造检测以及概念擦除与价值观对齐等研究工作;宁波东方理工大学金鑫助理教授分享了世界模型技术在具身数据生成领域的应用与思考。本专题论坛梳理了近年来在具身数据生成、仿真环境构建、数据溯源与内容安全等领域的前沿成果。
左右滑动查看更多
11
专题论坛:多媒体内容安全与隐私保护青年论坛
多媒体内容安全与隐私保护青年论坛由南京理工大学舒祥波教授和四川大学胡鹏教授组织,邀请了张新鹏、刘哲理、赫然、童咏昕4名专家。本专题论坛围绕模型确权、生成溯源、数据交易流通、伪造鉴别及联邦计算等关键技术展开深入探讨。上海大学张新鹏教授围绕深度学习模型水印与AIGC内容溯源,详细介绍了从判别式到生成式模型水印的发展与挑战;南开大学刘哲理教授分享了可信数据空间构建技术领域的数据胶囊理论体系与赋能数据安全交易流通新思路;中国科学院自动化研究所赫然研究员围绕生成式内容鉴别与安全,梳理了高效图像生成、视觉内容鉴别取证与模型安全等研究工作;北京航空航天大学童咏昕教授分享了联邦RAG、联邦向量数据检索及“虎符”开源平台应用,探讨了联邦智能计算从大数据到大模型的范式转变。本专题论坛探讨了视觉安全与隐私领域的挑战、机遇、发展趋势和未来方向。
左右滑动查看更多
12
专题论坛:多模态情感理解与分析
多模态情感理解与分析专题论坛由上海交通大学刘鑫副教授、同济大学连政副教授和西安交通大学史金钢副教授组织,邀请了叶茫、赵妍妍、郭丹、麦思杰、李勇、余梓彤、刘峰7名专家。本专题论坛围绕微动作捕获、多模态鲁棒融合、心理学可解释性及大模型共情对话等核心议题展开深入研讨。武汉大学叶茫教授分享了多模态大模型的情感推理增强领域的EmoLLM、SEPM及EMO-R3框架等研究工作;哈尔滨工业大学赵妍妍教授结合“巧板”陪伴大模型与“工小星”AI辅导员,介绍了面向人机共情的多模态情感对话技术及应用;合肥工业大学郭丹教授详细介绍了微动作驱动的情感分析任务中的运动放大、微行为感知及群体交互分析等研究工作;华南师范大学麦思杰教授围绕低质量模态鲁棒处理框架及多模态大语言模型校正机制进行了详细介绍;东南大学李勇副教授以共情智能为题,详细分享了从面部原语到多模态协同的跨域面部动作单元检测与层次化解耦蒸馏方法;大湾区大学余梓彤副教授详细介绍了介绍基于面部视频的非接触式生命体征监测的基础模型和方法;上海交通大学刘峰助理研究员围绕基于心理学可解释的抑郁、焦虑表情识别技术,分享了emoLDAnet与OCC-PAD-LDA转化模型等研究工作。本专题论坛共同探讨了多模态情感理解的前沿进展、技术瓶颈与应用前景。
左右滑动查看更多
13
专题论坛:触觉与具身感知
触觉与具身感知专题论坛由大连理工大学刘倩教授、福州大学赵铁松教授和南京邮电大学陈鸣锴副教授组织,邀请了孙晓颖、刘阳、付先平、李成林、谢燕楠5名专家。本专题论坛以“视触觉融合信号处理技术”为核心,聚焦微形变稀疏编码、低延时边缘计算、具身智能操作系统及柔性感知等前沿方向。吉林大学孙晓颖教授详细介绍了纹理触觉信息的虚拟再现与感知方法中的机理模型、计算方法及多媒体终端再现机制等;中山大学刘阳副教授详细介绍了基于 Agentic工作流的自进化具身智能体操作系统PhyAgentOS,及其系统架构设计、协议化接口规范及异构本体适配方法;大连海事大学付先平教授围绕偏振、图像、多光谱、传感器与 SLAM 等水下机器人多模态感知技术进行了详细介绍;上海交通大学李成林教授分享了团队在沉浸式全景视频信号的表示及传输领域的最新进展及未来展望;南京邮电大学谢燕楠教授围绕柔性自驱动力学传感器设计及应用,介绍了针对人体能量的新型柔性能源收集技术及其自驱动传感器等研究工作。本专题论坛帮助听众了解触觉与具身感知领域的前沿技术及应用。
左右滑动查看更多
14
专题论坛:多模态食品科学智能
多模态食品科学智能专题论坛由中国科学院计算技术研究所闵巍庆副研究员、中国疾控中心营养与健康所房玥晖副研究员、江南大学翟齐啸教授和博世夏丽娟博士组织,谢云飞、马培华、张大川、靳昊、闵巍庆5名专家进行了专题分享。本论坛围绕食品科学智能新范式,聚焦异构多模态数据融合、风味分子生成、基因组大数据挖掘及个性化营养干预等前沿方向展开深入研讨。江南大学谢云飞教授详细介绍了人工智能在食品安全与质量控制中的应用,分享了多物理场传感在线监测与智能化生产决策等研究工作;中国农业科学院农产品加工研究所马培华研究员分享了智能传感与高通量筛选、AI驱动的多模态分析与物理机理模型,以及“设计-实验-分析-验证”闭环工作流等研究工作;新加坡国立大学张大川助理教授介绍了食物气味分子图谱赋能生成式香气设计、关键气味图谱KFO-Atlas与变分自编码香气配方生成等研究进展;内蒙古农业大学靳昊博士后分享了全球最大的乳酸菌基因组数据库 iLABdb,介绍了基于基因组大数据挖掘的功能基因多样性分析等研究内容;中国科学院计算技术研究所闵巍庆副研究员详细介绍了面向个性化餐后血糖调控的统一框架,分享了机遇生理感知的血糖预测模型与基于 LLM 的餐食优化智能体等研究工作。本专题论坛分享了AI for Science 在食品安全与营养健康领域的最新研究进展与创新应用。
左右滑动查看更多
往期回顾
1. 【大会倒计时1天】ChinaMM 2026明日盛大开幕!!
2. 【大会倒计时 2 天】重磅!吴枫院士将在2026中国多媒体大会作题为“面向精准医疗的新型成像技术”的主旨报告!
3. 【大会倒计时 2 天】2026中国多媒体大会开幕在即,温馨提示助您轻松赴会!
4. 【大会倒计时3天】腾讯成为ChinaMM 2026铂金合作单位
5. 【大会倒计时3天】快手成为ChinaMM 2026金牌合作单位
6. 【大会倒计时3天】英博云成为ChinaMM 2026金牌合作单位
7. 【大会倒计时4天】ChinaMM 2026参会群已开放,期待与您相聚山西太原!
8.【大会倒计时5天】重磅!陈钱教授将在2026中国多媒体大会作题为“计算光学显微成像”的主旨报告!
9. ChinaMM 2026专题论坛 | 大模型时代科研审美与研究范式
10.【倒计时 6 天】ChinaMM 2026会议详细日程公布!点击查看→






























































