ChinaMM 2026 首日精彩回顾!!
ChinaMM 2026 首日精彩回顾!!
精彩概要
专题论坛:多模态统一编码表征学习
专题论坛:类人智能体与社会仿真
专题论坛:世界模型与具身智能
专题论坛:端侧智能影像技术
专题论坛:社会智能驱动的认知计算
专题论坛:流式视频理解与生成
专题论坛:大模型时代科研审美与研究范式
女性菁英论坛:她力量·多媒体女性菁英成长对话论坛
专题论坛:多模态大模型智能多媒体应用(铂金合作-腾讯冠名)
专题论坛:模型互联:迈向开放协作的智能新形态
专题论坛:新一代多模态智能:从认知到预判的能力跃迁
专题论坛:面向具身的视频感知
专题论坛:多媒体可信人工智能理论基础
专题论坛:音频跨媒体智能发展与应用
论坛回顾
01
专题论坛:多模态统一编码表征学习
多模态统一编码表征学习专题论坛由中山大学李冠彬教授、清华大学深圳国际研究生院邓维建助理教授组织。本场报告邀请了王井东、叶齐祥、侯淇彬、杨思蓓、魏朋旭5名专家,从世界模型、物理世界表征、多模态大模型表征学习、统一表征空间、表征空间结构优化学习等方面展开。百度王井东博士针对世界模型表达世界及预测未来的主流方案,分享了表征学习及表征生成方面的前沿进展;中国科学院大学叶齐祥教授介绍了近五年的视觉表征模型研究进展,探讨了将物理规律嵌入视觉表征模型的编码方法;南开大学侯淇彬副教授围绕视觉语言对齐问题、动态token压缩以及视频精细化理解进行了详细介绍;中山大学杨思蓓副教授详细介绍了统一表征空间的三个核心要素及其支撑视觉理解与生成的统一建模方法;中山大学魏朋旭副教授系统介绍了离散几何拓扑优化的开普勒编码本、连续自组织学习等潜空间表征学习机制。本论坛使听众深入了解多模态统一表征学习的最新进展、关键技术与发展趋势。
左右滑动查看更多
02
专题论坛:类人智能体与社会仿真
类人智能体与社会仿真专题论坛,由上海交通大学翟广涛教授、中国传媒大学叶龙教授和程皓楠研究员组织,邀请了陶建华、钟方威、谢洪涛、张三义、胡斐5名专家。本专题论坛聚焦“用自然科学方法解决社会科学问题”核心思想,旨在梳理类人智能体与社会仿真领域的研究成果与应用瓶颈,探讨自然科学方法与社会科学研究的融合路径。清华大学陶建华教授详细介绍了异构模型集成与多智能体协调领域的研究进展;北京师范大学钟方威副教授分享了基于心智、动机与环境三个维度构建类人认知的自主智能体关键技术;中国科学技术大学谢洪涛教授深入分享了多模态大模型中的视觉语义表征高效感知、区域定位与深度推理等研究内容;中国传媒大学张三义副教授围绕基于众商计算的类人智能体仿真与推演进行了详细介绍;眸深智能胡斐博士详细介绍了通用具身大脑赋能产业升级及应用落地。本专题论坛增强了听众对类人智能体与社会仿真领域的关注度及其技术理解。
左右滑动查看更多
03
专题论坛:世界模型与具身智能
世界模型与具身智能专题论坛,由清华大学刘永进教授、哈尔滨工业大学范晓鹏教授、上海交通大学易冉副教授和哈尔滨工业大学万照麟副研究员组织,邀请了蒋树强、张兆翔、李坤、李良斌4名专家。本专题论坛聚焦具身智能与世界模型前沿方向,围绕智能体环境认知与自我认知机制、4D世界模型构建、生成式世界建模及三维动态场景理解与虚实融合等关键问题展开深入探讨。中国科学院大学蒋树强教授系统分享了具身智能中的自我模型与世界模型领域的研究进展;中国科学院自动化研究所张兆翔研究员详细介绍了4D世界模型的基座构建、垂直应用到综合评测等研究内容;天津大学李坤教授详细介绍了面向虚实融合的动态人群三维运动重建与生成领域的相关工作;英博数科李良斌博士分享了面向GPU集群碎片化、多集群协同难、运维复杂度指数级上升等实际挑战。本专题论坛使听众深入了解世界模型与具身智能领域及其技术发展。
左右滑动查看更多
04
专题论坛:端侧智能影像技术
端侧智能影像技术专题论坛,由北京师范大学黄华教授和王立志教授组织,邀请了范益波、王诗淇、潘金山、亓鲁4名专家。本专题论坛围绕端侧影像技术开展专题研讨,旨在梳理智能影像端侧技术的研究现状与发展趋势,促进算法、芯片、系统等多学科交叉融合。复旦大学范益波教授详细介绍了视觉无损的毫秒级低延迟浅压缩视频编解码处理器的研究工作;香港城市大学王诗淇教授深入分享了面向端侧智能影像的高效编码方法与感知质量评估研究进展;南京理工大学潘金山教授系统分享了面向保真度与真实感权衡的可控生成式图像视频复原方法;武汉大学亓鲁教授就基于全景数据的具身空间智能研究进行了详细介绍。本专题论坛增强了听众对端侧智能影像技术领域研究现状及其技术进展的理解。
左右滑动查看更多
05
专题论坛:社会智能驱动的认知计算
社会智能驱动的认知计算专题论坛,由华为田奇首席科学家、天津大学王岚君研究员、中国科学技术大学姚涵涛特任研究员和天津大学刘婧副教授组织,特邀严钢、胡延庆、李阿明、桑基韬、封雪5位专家进行报告。本专题论坛旨在以社会智能为核心驱动力,探讨认知计算、复杂系统建模与群体智能的交叉应用。同济大学严钢教授详细分享了基于智能体的复杂网络系统推断与预测领域的研究进展;南方科技大学胡延庆教授详细介绍了集群对抗中因协同效应引发的胜负相变规律;北京大学李阿明研究员深入分享了复杂网络上群体博弈的涌现机理与控制策略;北京交通大学桑基韬教授围绕从外部工作流补偿走向内化训练的模型原生GUI Agent演进进行了详细介绍;北京通用人工智能研究院封雪研究员就基于心理认知机制与心智推断的认知驱动社会化交互进行了详细介绍;天津大学王岚君研究员分享了基于社会模拟器的群体认知计算框架及其在多媒体任务中的应用进展。本专题论坛使听众深入理解了社会智能驱动认知计算方向的研究现状与技术发展。
左右滑动查看更多
06
专题论坛:流式视频理解与生成
流式视频理解与生成专题论坛由合肥工业大学鲍秉坤教授、南开大学侯淇彬副教授和中国科学院自动化研究所钱胜胜研究员组织,邀请了郑伟诗、杨易、李泽超、齐晓娟4名专家。本专题论坛围绕在线时序推理与主动响应机制、理解与生成的协同统一等前沿议题展开深入研讨。中山大学郑伟诗教授就基于空间语义约束的移动机器人视觉言语自主导航进行了详细介绍;浙江大学杨易教授详细分享了基于分层架构与统一协议实现通用具身智能的研究进展;南京理工大学李泽超教授深入分享了结合图像理解与生成技术的多模态内容分析及应用;香港大学齐晓娟副教授围绕从在线感知到长程生成的流式视觉智能进行了详细介绍。本专题论坛使听众深入了解流式视频理解与生成领域的技术发展。
左右滑动查看更多
07
专题论坛:大模型时代科研审美与研究范式
大模型时代科研审美与研究范式专题论坛由北京工业大学王博岳教授、军事科学院军事智能研究院王思为助理研究员、国防科技大学刘新旺教授和北京工业大学尹宝才教授组织,邀请了赵耀、秦兵、兰旭光、景丽萍、余国先5名专家。本专题论坛聚焦大模型时代下科研范式的演进与科研审美的重塑,旨在引导青年学者建立兼具深度与广度的学术追求并产出高质量成果。北京交通大学赵耀教授分享了构建以真问题和原创能力为导向的大模型时代科研范式;哈尔滨工业大学秦兵教授围绕“问题的基础性与方法的简洁性”分享了如何确立大模型时代的科研品味;西安交通大学兰旭光教授分享了大模型时代AI方向的科研选题原则及具身智能实践;北京交通大学景丽萍教授详细介绍了智能心理健康的动态测评与叙事干预领域的研究工作;山东大学余国先教授围绕基础模型驱动的科学智能(AI for Science)范式及其在生物医学领域的应用进行了详细介绍。本专题论坛增强了听众对大模型时代科研审美与研究范式领域的关注度及其技术理解。
左右滑动查看更多
08
女性菁英论坛:她力量·多媒体女性菁英成长对话论坛
她力量·多媒体女性菁英成长对话论坛由合肥工业大学鲍秉坤教授、北京大学刘家瑛教授、太原理工大学赵涓涓教授和太原科技大学王安红教授组织,邀请了哈尔滨工业大学姚鸿勋教授、中国科学院自动化研究所董晶研究员、中国科学院计算技术研究所许倩倩研究员、复旦大学陈静静副教授以及北京大学仉尚航研究员5名分享嘉宾。本论坛凝聚了多媒体领域女性科技力量,以圆桌对话、经验分享与开放交流的形式,围绕高校女教师、女研究员及青年学者在学术起步、职业发展、科研创新、团队建设与平衡调适等关键议题上的困惑与挑战,论坛嘉宾结合自身经验与参会青年女性科研工作者深入交流,帮助大家明确方向、拓展学术网络,以期推动更多女性在多媒体及交叉学科领域发光发亮。本论坛为促进多媒体领域女性科研人员的成长互助与学术网络建设注入了积极活力。
左右滑动查看更多
09
专题论坛:多模态大模型智能多媒体应用(铂金合作-腾讯冠名)
多模态大模型智能多媒体应用专题论坛,由铂金合作单位腾讯冠名,由南京理工大学谢国森教授、中国科学院自动化研究所杨小汕研究员、南京理工大学舒祥波教授和南京理工大学李泽超教授组织,邀请了徐常胜、王耀威、韩军功、王鹏、严明、Jwong Wang 6名专家,本专题论坛旨在共同探讨多模态大模型的发展趋势与未来方向。中国科学院自动化研究所徐常胜研究员就开放世界多模态大模型在多模态数据关联及跨域小样本迁移中的研究进行了详细介绍;哈尔滨工业大学(深圳)王耀威教授以“鹏城·大圣”多模态系列基础模型为例,分享了其在低空经济与城市态势感知等领域的应用落地;清华大学韩军功教授详细介绍了多模态智能从离身感知向具身认知演进的过程与关键技术;西北工业大学王鹏教授分享了多模态大模型“幻觉”现象的抑制路径与从概率拟合迈向可信推理的相关研究进展;阿里巴巴通义实验室严明博士分享了通义多模态多端GUI智能体Mobile-Agent技术体系及端云协同应用;腾讯Jwong Wang高级研究员介绍了基于多模态内容生成的智能视觉理解、增强和编辑云服务大模型等应用场景。本专题论坛使听众深入了解了多模态大模型智能多媒体应用领域的技术进展。
左右滑动查看更多
10
专题论坛:模型互联:迈向开放协作的智能新形态
模型互联:迈向开放协作的智能新形态专题论坛由暨南大学龙赛琴教授组织,邀请了李哲涛、陈益强、吴帆、田淑娟4名专家。本专题论坛围绕模型互联的理论内涵、关键技术、体系架构与应用价值展开深入研讨。暨南大学李哲涛教授详细介绍了通过构建标准化消息通路打破“模型孤岛”的模型互联网新范式;中国科学院计算技术研究所陈益强研究员就AI模联网在打破医疗数据孤岛、驱动多智能体协同及赋能未来医疗新场景中的应用进行了详细介绍;上海交通大学吴帆教授系统分享了突破云侧集中式学习范式瓶颈的大小模型端云协同智能计算研究;湘潭大学田淑娟教授就跨网络节点异构模型的演进脉络及安全协作体系进行了详细介绍。本专题论坛使听众深入了解开放、动态、安全、可扩展的智能协作体系的研究进展。
左右滑动查看更多
11
专题论坛:新一代多模态智能:从认知到预判的能力跃迁
新一代多模态智能:从认知到预判的能力跃迁专题论坛,由厦门大学孙晓帅教授、纪家沂副教授、张岩工程师和张声传副教授组织,邀请了张盛平、丁恒辉、张铭津、马云山、郑侠武5名专家。本专题论坛围绕认知、生成与预判能力的协同发展展开系统性交流,旨在探讨新一代智能系统在开放与复杂真实场景中的关键技术、应用潜力与核心挑战。哈尔滨工业大学张盛平教授详细介绍了基于生成式大模型与3D高斯的可控超写实虚拟数字人驱动技术的研究进展;复旦大学丁恒辉研究员围绕多模态视频理解与可控视频生成的最新进展进行了详细介绍;西安电子科技大学张铭津教授分享了融合光谱、几何与语义信息的红外场景三维重建与目标检测一体化框架等研究工作;新加坡管理大学马云山助理教授就多模态大语言模型在开放世界未来事件预测中的技术潜力进行了详细介绍;厦门大学郑侠武副教授系统梳理了长视频检索推理与视频生成加速的高效多模态方案。本专题论坛使听众深入了解了新一代多模态智能领域的研究现状及技术发展。
左右滑动查看更多
12
专题论坛:面向具身的视频感知
面向具身的视频感知专题论坛由南京理工大学严锐教授和南京理工大学李泽超教授组织,邀请了李冠彬、王利民、吴庆耀、舒祥波4名专家。本专题论坛围绕“面向具身的视频理解与生成”主题,旨在探讨视频驱动具身智能发展的关键技术与未来趋势。中山大学李冠彬教授详细介绍了面向具身智能的流式视频理解,包括多上下文复用推理、层级事件记忆建模与实时检索增强等研究工作;南京大学王利民教授系统梳理了通用视频理解大模型体系及其在长视频与流式视频领域的最新研究进展;华南理工大学吴庆耀教授分享了手物交互视频生成、第一人称视频世界模型及具身智能范式演进等研究内容;南京理工大学舒祥波教授围绕视觉重建补全、长短期思维链路径规划与动态反思机制,详细介绍了融合类人思维的具身视觉导航研究进展。本专题论坛使听众深入了解了面向具身的视频感知领域研究现状及技术进展。
左右滑动查看更多
13
专题论坛:多媒体可信人工智能理论基础
多媒体可信人工智能理论基础专题论坛由中国科学院大学杨智勇副教授、南京大学赵鹏副教授、中国科学院计算技术研究所包世龙特别研究助理和国防科技大学侯臣平教授组织,邀请了操晓春、崔鹏、刘祥龙、刘日升、韩波、李涛6名专家。本专题论坛聚焦可信性的数学刻画、泛化与鲁棒性机理、因果与不确定性建模、对齐与可验证推理等核心问题。中山大学操晓春教授详细介绍了智能体决策归因安全问题中的可解释归因、训练增强与异常监控修复等研究内容;清华大学崔鹏副教授围绕因果智能驱动世界模型的建构与演进进行了详细介绍;北京航空航天大学刘祥龙教授分享了人工智能攻防演练及具身智能物理世界物理对抗反演生成方法;大连理工大学刘日升教授针对多模态信息融合的优化计算理论及感知应用进行了详细介绍;香港浸会大学韩波副教授分享了探索可信基础模型的系统化路径,包括评测数据集、反学习微调与主动推理等;联想AI技术中心李涛算法研究员围绕多智能体系统的可信与高效实践,分享了智能体系统可信、高效评估的技术探索与企业落地思考。本专题论坛对促进多媒体可信人工智能理论基础的学术交流与产业应用具有重要意义。
左右滑动查看更多
14
专题论坛:音频跨媒体智能发展与应用
音频跨媒体智能发展与应用专题论坛由浙江大学吴飞教授、浙江大学杨易教授、哈尔滨工业大学(深圳)俞俊教授和浙江大学赵洲教授组织,邀请了凌震华、李军锋、钱彦旻、张家俊4名专家。本专题论坛聚焦多模态融合、音频生成与理解、大模型计算及语言声学等核心方向展开深度研讨。中国科学技术大学凌震华教授详细介绍了人脸驱动话者转换、属性编辑及配音生成等融合多模态信息的可控语音生成技术;中国科学院声学研究所李军锋研究员分享了复杂场景下视听融合的空间协同感知技术与应用进展;上海交通大学钱彦旻教授分享了听觉认知与计算声学实验室在面向ASMR的语音与音频生成上的最新进展;中国科学院自动化研究所张家俊研究员围绕提升推理效率与交互轮次的语音词元无损压缩算法进行了详细介绍;浙江大学赵洲教授详细介绍了跨模态语音生成中的基准评测、实时因果声码器、DiT加速,以及口语对话交互中的奖励建模、后训练优化及端到端智能体等研究进展。本专题论坛使听众深入了解了音频跨媒体智能领域的核心技术瓶颈及前沿发展趋势。
左右滑动查看更多
往期回顾
1. 【大会倒计时1天】ChinaMM 2026明日盛大开幕!!
2. 【大会倒计时 2 天】重磅!吴枫院士将在2026中国多媒体大会作题为“面向精准医疗的新型成像技术”的主旨报告!
3. 【大会倒计时 2 天】2026中国多媒体大会开幕在即,温馨提示助您轻松赴会!
4. 【大会倒计时3天】腾讯成为ChinaMM 2026铂金合作单位
5. 【大会倒计时3天】快手成为ChinaMM 2026金牌合作单位
6. 【大会倒计时3天】英博云成为ChinaMM 2026金牌合作单位
7. 【大会倒计时4天】ChinaMM 2026参会群已开放,期待与您相聚山西太原!
8.【大会倒计时5天】重磅!陈钱教授将在2026中国多媒体大会作题为“计算光学显微成像”的主旨报告!
9. ChinaMM 2026专题论坛 | 大模型时代科研审美与研究范式
10.【倒计时 6 天】ChinaMM 2026会议详细日程公布!点击查看→


























































