ChinaMM 2026 开幕日精彩回顾!!

ChinaMM 2026 开幕日精彩回顾!!







精彩概要





    大会开幕式

      主旨报告:《生成式媒体网络》

        主旨报告:《面向精准医疗的新型成像技术》

          主旨报告:《人工智能生成的视觉艺术内容:从创作到美学推理》

            主旨报告:《面向具身智能的生成式模型:进展与趋势》

              主旨报告:《体用一如:类脑为体,具身为用》

                主旨报告:《以人为中心的可信视觉智能》

                  主旨报告:《细粒度家族:迈向更细、更深、更快的视觉感知》

                    主旨报告:《多模态人工智能:感知、生成与决策》

                      主旨报告:《计算光学显微成像》

                        主旨报告:《机器视觉空间计算技术及应用》



                          开幕式精彩回顾

                          大会开幕式由大会主席、中国图像图形学会多媒体专委会主任、北京师范大学黄华教授主持,中国工程院院士、中国科学技术大学吴枫教授,太原理工大学党委书记沈兴全教授和山西省教育厅李金碧一级巡视员热情致辞。吴枫院士在致辞中表示,中国多媒体大会作为国内多媒体领域的权威学术盛会,通过主题报告和学术论坛展示前沿成果,深化产学研交流合作,对推动我国多媒体技术创新发展具有重要意义。沈兴全教授向莅临龙城太原的各位专家表示欢迎,并表示本次大会汇聚了全国信息化、多媒体等领域专家学者,是一场高水平的学术交流盛会。李金碧一级巡视员祝贺大会召开,并表示中国多媒体大会是我国多媒体领域集学术研讨、技术攻关与人才交流于一体的权威平台,为我国新一代信息技术自立自强培育了大批骨干力量。

                          黄华教授主持开幕式

                          吴枫教授致辞

                          沈兴全教授致辞

                          李金碧一级巡视员致辞

                               程序委员会主席、CSIG多媒体专委会副主任、北京大学马思伟教授介绍了大会投稿情况、会议日程、主旨报告等。大会最后举行了中国多媒体大会十周年纪念活动。中国工程院院士、北京大学高文教授作视频致辞,充分肯定大会在记录技术演进、培育专业人才、推动我国多媒体研究快速发展方面发挥的重要作用。随后,与会嘉宾共同观看十周年回顾视频,历届大会核心组织人员(2017—2026年)登台合影,铭记发展足迹,共启未来新程。

                          马思伟教授介绍大会日程

                          高文教授视频致辞

                          20172026年历届中国多媒体大会组委会代表合影

                          参会人员合影留念



                          主旨报告回顾

                          开幕式后大会进入主旨报告环节,中国多媒体大会非常荣幸地邀请到了张文军院士,吴枫院士,陈长汶教授,朱文武教授,熊辉教授,高新波教授、彭宇新教授、姜育刚教授、季向阳教授、陈钱教授作大会主旨报告。各位专家分享领域前沿技术,多角度、多层次的为参会者提供了丰富的学术盛宴。

                          主旨报告《生成式媒体网络》

                          中国工程院院士、上海交通大学张文军教授作主旨报告。报告从传统媒体通信技术的瓶颈切入,回顾了生成式人工智能如何深刻重塑媒体的制作、传输与呈现形态。报告指出智能视频通信的核心是使接收端能够可靠可控生成视频信息,介绍了生成式媒体表征与通信的新范式及双流驱动的媒体表征形态,阐述了如何在可靠性边界内引入生成自由度,利用生成模型释放前所未有的视觉表达能力与通信效用,以构建可变、可控、兼容的新一代媒体网络体系。报告最后结合团队近期在超低码率媒体编码与传输领域的探索与实践,分享了相关技术的演进路径。

                          主旨报告《面向精准医疗的新型成像技术》

                          中国工程院院士、中国科学技术大学吴枫教授作主旨报告。报告指出当前精准诊疗面临“看得见但看不准”“看得清但看不全”“技术先进难落地”等瓶颈,如何统筹高端成像设备研制和新型成像技术开发,是实现生命全景信息可视化、推动生命医学实现重大突破的核心路径。报告介绍了人工智能研究院正在建设国内领先、世界一流的多模态、跨尺度、多组学成像设施集群,围绕高端成像设备研发、精准诊疗等方向进行系统布局,阐述了在三维分子病理成像、空间转录组成像、空间代谢组成像、全数字 PET 成像等方面取得的关键突破及产业化落地情况,实现了结合AI智能分析,为重大疾病精准诊疗提供全套自主可控的国产成像技术支撑。

                          主旨报告《人工智能生成的视觉艺术内容:从创作到美学推理》

                          欧洲科学院院士、香港理工大学陈长汶教授作主旨报告。报告指出AI生成的真正艺术必须具有对抗性,需要通过创造不可计算、不可预测的感官体验。围绕人工智能生成视觉艺术内容的现状与新兴解决方案,报告介绍了基于多模态大模型(MLLM)的美学推理与审美判断,以及MLLM在进行审美推理时容易产生幻觉这一关键挑战。为应对艺术解读具备主观意见和缺乏依据的局限性,报告介绍了基线算法ArtCoT及其在人工智能艺术辅导和生成艺术的奖励模型等领域的应用,并指出构建个性化美学模型仍是人工智能生成艺术领域的开放挑战。

                          主旨报告《面向具身智能的生成式模型:进展与趋势》

                          国家级领军人才、清华大学朱文武教授作主旨报告。报告以面向具身智能的生成式模型为题,首先介绍了具身智能、世界模型及生成式世界模型的基本概念与发展脉络。为应对智能体与动态开放环境交互复杂性这一重大挑战,为解决环境感知与具身认知自演化机理这一科学问题,报告介绍了理解—生成一体化的生成式世界模型,旨在构建具有时空一致性、物理一致性、动作可行性与交互自演化的生成式世界模型。报告最后介绍了自主具身智能研究范式,并探讨其学术前沿与未来研究方向。

                          主旨报告《体用一如:类脑为体,具身为用》

                          国家级领军人才、香港科技大学(广州)协理副校长熊辉教授作主旨报告。报告指出当前具身智能正从技术验证迈向产业落地,但受制于数据稀缺、感知盲区、能耗过高和泛化不足四大瓶颈。本报告阐述了“类人化”技术路线,从数据、感知、认知到行为实现系统性突破:数据层,融合互联网视频与肌电信号,兼顾精度与实时性;感知层,仿生事件相机与主动空间记忆突破视野限制;认知层,开源类脑 VLA架构 NeuroVLA 以极低功耗与超短延迟在真实机器人部署;行为层,生成式强化学习实现多模态毫秒级推理。报告介绍了全球首个一站式具身智能开源平台 AlphaBrain,并系统阐述了该技术体系的构建逻辑与未来图景。

                          主旨报告《以人为中心的可信视觉智能》

                          国家级领军人才、西安电子科技大学校长高新波教授作主旨报告。报告面向计算机视觉从感知理解走向高自主决策与物理执行的新阶段,系统梳理了以人为中心的可信视觉智能的发展现状与核心概念。针对视觉智能系统在隐私保护、公平性、鲁棒性、透明性与安全性等方面面临的现实风险,报告强调人作为数据主体、认知参与者与最终控制者的多重角色,介绍了以“物理-信息-认知”三元空间融合为主线的统一框架。报告围绕“分析对象关注于人、模型设计服务于人、系统应用受控于人”三个方面介绍了团队近年来取得的初步研究成果,并探讨了以人为中心的可信视觉智能的未来发展趋势。

                          主旨报告《细粒度家族:迈向更细、更深、更快的视觉感知》

                          国家级领军人才、北京大学彭宇新教授作主旨报告。报告指出当前多模态大模型在通用任务上表现出色,但缺乏细粒度感知能力,如何提高视觉感知的精度、深度与速度,是多模态大模型急需解决的关键问题。本报告首先阐释了“细粒度家族”的定义,涵盖类别、空间、时间三个感知维度,并分析现有大模型在每个维度上面临的挑战。针对上述挑战,本报告分享了团队在基于细粒度树的分层图像分类、多模态大模型细粒度视觉感知、细粒度图像 token 剪枝、细粒度美学照片重构、细粒度动作质量评价等方面的最新研究进展。最后,介绍了团队在细粒度视觉内容理解与生成技术上的落地应用。

                          主旨报告《多模态人工智能:感知、生成与决策》

                          国家级领军人才、复旦大学副校长姜育刚教授作主旨报告。报告指出多模态人工智能通过整合视觉、文本、声音等多种信号,能够准确地捕捉环境信息、理解物体关联,并对未来进行预测,进而支撑具身智能体在物理世界的高精度作业,被认为是通往强人工智能的关键技术。本报告详细介绍了团队在感知、生成、决策等多模态人工智能核心方向上的最新研究进展,并展望未来发展趋势。

                          主旨报告《计算光学显微成像》

                          国家级领军人才、中北大学校长陈钱教授作主旨报告。报告指出光学显微成像是"向极微观深入、不断突破人类认知边界"不可替代的基本科学手段,发展兼具"动态、无标记、三维成像"为特征的新型计算光学显微镜,已成为更深层次探索微观世界、解析生命本质与实现精准医疗所急需的前沿科学仪器。本报告围绕显微成像由"二维定性""三维定量"、由"衍射受限""高速超分辨"跨越的核心瓶颈,分享了在"非干涉定量相位显微成像与计算光学三维层析超分辨"方向取得一系列突破,介绍了首台非干涉多模态定量相位显微镜SCscope 与非干涉活细胞三维层析超分辨显微镜等新型计算光学显微镜系列产品,团队研究工作有力推动了我国显微科学仪器从跟跑到并跑、再到创新引领的跨越。

                          主旨报告《机器视觉空间计算技术及应用》

                          国家级领军人才、清华大学季向阳教授作主旨报告。报告围绕人工智能在生成式 AI、多模态与大模型等领域的前沿技术突破,指出机器视觉产业规模庞大且具有重大的战略与国防意义,是人工智能领域核心发展方向之一。报告首先阐述机器视觉空间计算技术的历史沿革与前沿发展,随后介绍如何通过系列视觉位姿估计创新技术推进高精度、鲁棒与强泛化的视觉空间计算,探讨面向场景空间交互的视觉重建与理解技术,并一步探讨视觉空间计算技术在工业、航空航天等领域的应用现状与趋势。





                          往期回顾





                          1. ChinaMM 2026 首日精彩回顾!!



                          2. 【大会倒计时1天】ChinaMM 2026明日盛大开幕!!



                          3. 【大会倒计时 天】重磅!吴枫院士将在2026中国多媒体大会作题为“面向精准医疗的新型成像技术”的主旨报告!



                          4. 【大会倒计时 天】2026中国多媒体大会开幕在即,温馨提示助您轻松赴会!



                          5. 【大会倒计时3天】腾讯成为ChinaMM 2026铂金合作单位



                          6. 【大会倒计时3天】快手成为ChinaMM 2026金牌合作单位



                          7. 【大会倒计时3天】英博云成为ChinaMM 2026金牌合作单位



                          8. 【大会倒计时4天】ChinaMM 2026参会群已开放,期待与您相聚山西太原!



                          9.【大会倒计时5天】重磅!陈钱教授将在2026中国多媒体大会作题为“计算光学显微成像”的主旨报告!



                          10. ChinaMM 2026专题论坛 大模型时代科研审美与研究范式