【预告】CCF-MM走进高校@走进北京信息科技大学
【预告】CCF-MM走进高校@走进北京信息科技大学
CCF-MM走进高校系列活动
CCF@U:
CCF-MM走进北京信息科技大学
时间:2026年08月19日 9:00-12:00
地点:北京信息科技大学(沙河校区)图书馆六层勤信讲堂(601)
|
时间 |
活动安排 |
|
9:00-9:10 |
开场介绍 |
|
9:10-9:50 |
特邀讲者:胡卫明 中国科学院自动化研究所 报告题目:视觉-语言跨模态预训练与匹配 |
|
9:50-10:30 |
特邀讲者:白慧慧 北京交通大学 报告题目:语义引导的零样本图像识别 |
|
10:30-11:10 |
特邀讲者:李泽超 南京理工大学 报告题目:稳健多模态视觉认知:从精准感知到反思型智能体 |
|
11:10-11:50 |
特邀讲者:刘帅奇 河北大学 报告题目:遥感图像智能解析及应用 |
CCF MM
中国计算机学会多媒体技术专业委员会(缩写 CCF MM)成立于1994年,现有执行委员(即2020年正式委员)500人,常务委员20人,资深委员4人,委员覆盖国内90余家单位,委员中本领域国家级人才100余人,企业委员近20家,已成为国内多媒体技术领域具有活力和凝聚力的学术组织,2004年、2017年、2023年、2025年被评为CCF优秀专委。多媒体技术的研究领域包括:多媒体信息处理;多媒体数据压缩编码;多媒体内容分析与检索技术;多媒体交互与集成;多媒体通信与网络;多媒体内容安全;多媒体系统与虚拟现实等。当前,多媒体技术呈现出与计算机体系结构、计算机网络、人机交互、信息安全、社会网络等多学科交叉融合的发展趋势。专委会希望成为多媒体技术领域国内与国际、学术界与产业界、业内专家与广大科研人员交流合作的桥梁,通过专委的工作,推动本学科的建设和发展,促进青年人才的成长,并承担多媒体技术相关教育、知识的普及等社会服务。
报告嘉宾
报告题目:视觉-语言跨模态预训练与匹配
报告简介:图像-文本检索的主流预训练方法通常采用双流编码结构,然而提升双流编码器的准确性颇具挑战性。提出了一种基于视觉-语言错误建模方法,对双流编码器注入详细的图像-文本关联信息。利用大语言模型生成含局部错误的图像语言描述,构建高质量负样本用于训练双流编码器。通过双编码器依据图像信息检测并修正文本错误,实现对图像与文本细粒度特征的强化提取,并使文本特征与全局及局部视觉特征实现关联。进一步提出了一种基于对比局部排序蒸馏的预训练方法,将更准确但计算复杂度更高的联合预训练模型中的困难图像-文本对排序能力蒸馏至双流编码模型,提升了双编码模型的匹配能力。实验结果表明,提出的方法在图像-文本检索任务上超越了现有最优的双流编码方法,并显著增强了对局部文本语义的判别性。
嘉宾简介:胡卫明,中国科学院自动化研究所多模态人工智能系统全国重点实验室特聘核心骨干研究员、博士生导师、视频内容安全研究团队负责人、多模态超级智能安全北京市重点实验室主任,国家杰出青年科学基金获得者、中组部万人计划科技创新领军人才入选者、科技部中青年科技创新领军人才入选者、人社部百千万人才工程国家级人选、国家有突出贡献中青年专家、享受国务院政府特殊津贴、国家信息安全重点专项项目首席专家,IEEE Trans. on PAMI、ACM Trans. on PML和IEEE Trans. on Cybernetics的Associate Editors。目前研究方向为视觉内容理解与网络多媒体敏感内容识别等,主持了国家自然科学基金重点项目、国家863重点专项项目、目标导向类课题等四十余项科研项目。已在PAMI、IJCV等国际刊物、国内一级刊物以及NIPS、ICCV等重要国际学术会议上发表论文400余篇,获授权发明专利100余项。带领团队完成的敏感多媒体识别等技术实际应用于二百余家企事业单位,已在实战发挥作用,取得了显著的经济效益和社会效益。以第一完成人获国家自然科学二等奖、北京市科学技术(技术发明类)一等奖、北京市发明专利一等奖和吴文俊人工智能科学技术一等奖。
报告题目:语义引导的零样本图像识别
报告简介:零样本图像识别技术在人工智能和计算机视觉领域展现出巨大的潜力,其科学意义和应用价值日益凸显。作为图像识别领域的前沿技术,零样本学习打破了传统识别方法仅能识别已知类别的局限,为识别未知类别开辟了新的路径,从而能够有效应对快速变化的现实世界中不断涌现的新事物。在属性等语义信息的引导下,零样本图像识别利用语义-视觉空间的交互实现已知类到未知类的知识迁移,从而能够识别出之前未见过的类别。然而,基于语义引导的零样本图像识别在实际应用中仍然面临不少挑战。例如,样本实例和属性信息的多样性可能导致语义-视觉关系的构建不够准确,以及部件与整体语义整合的不足,这些都可能削弱模型的鉴别能力和迁移能力,进而影响分类识别的准确率。本报告将重点介绍我们课题组针对上述问题的最新研究工作。
嘉宾简介:白慧慧,北京交通大学教授、博士生导师,国家级高层次人才。主要研究方向是图像视频编码和增强等。已发表包括IEEE汇刊及CCF A类会议论文100余篇。获国际专利授权3项、国家发明专利授权20余项。主持国家自然科学基金重点项目/企业联合基金项目、北京市自然科学基金项目等。获北京市自然科学一等奖、北京市科技进步二等奖、中国电子学会青年科学家奖、中国产学研合作创新成果奖二等奖等。
报告题目:稳健多模态视觉认知:从精准感知到反思型智能体
报告简介:构建鲁棒的多模态人工智能,关键在于将静态的底层感知升华为具备结构化认知与自我反思的动态推理系统。本报告以此为主线梳理了我们的系列研究。首先,为打造精确的视觉感知引擎,提出了CTNet解决复杂场景的像素混淆,并通过奇异值微调(SVF)与VRP-SAM框架,以极低代价和参考提示实现开放世界泛化,沉淀出强大的“视觉专家”底座。然而,多模态大模型(MLLM)常因缺乏对细粒度视觉属性与对象关系的精准描述而产生幻觉。进而提出了EDC框架,调用前述“视觉专家”精细提取目标属性并转化为高质量图文描述,大幅提升了MLLM的视觉信息认知。最后,针对大模型在推理时总是“从零开始”且易重复犯错的痛点,我们开发了ViLoMem双流记忆框架,分别编码逻辑错误与视觉感知陷阱。该研究实现了从精确感知引擎到消除多模态认知幻觉,最终演进为具备语义记忆与持续学习能力的交互式反思智能体的技术跨越。
嘉宾简介:李泽超,南京理工大学计算机科学与工程学院/人工智能学院/软件学院教授、院长,研究兴趣主要是多模态智能分析、计算机视觉等。主持国家杰出青年科学基金、新一代人工智能国家科技重大专项课题、国家自然科学基金联合基金重点项目等;入选国家“万人计划”青年拔尖人才,在IEEE TPAMI、IJCV和CCF A类会议发表论文60余篇;第一完成人获得2024年度江苏省科技进步一等奖,第二完成人获得2022年度中国电子学会自然科学一等奖和2020年度江苏省科学技术一等奖,第三完成人获得2017年度江苏省科学技术一等奖等;担任IEEE TPAMI、TCSVT、TMM等期刊编委,曾担任IEEE TNNLS、Information Science等期刊编委。
报告题目:遥感图像智能解析及应用
报告简介:本报告围绕遥感图像智能解析,以“感知-认知-理解”为研究主线,从“像素-区域-图像”三个层次,系统介绍了课题组在遥感图像去噪、融合、目标检测及分割等方面的研究进展。针对SAR图像相干斑点噪声抑制、多光谱与高光谱图像融合、以及复杂场景下舰船目标检测和图像分割中的问题,提出了一系列基于深度学习的算法,并在多个公开和真实数据集上验证了有效性。研究旨在构建遥感图像智能解析框架,推动其在实际应用中的发展。未来将在人工智能与遥感大数据融合方向持续深入探索。
嘉宾简介:刘帅奇,工学博士,河北大学教授。毕业于北京交通大学信息所,加拿大渥太华大学访问学者(2016-2017年),中科院自动化所博士后(2020-2023)。荣获宝钢优秀教师奖,入选全球前2%顶尖科学家榜单(World's Top 2% Scientists)、河北省高等学校青年拔尖人才、保定市新时代好青年和南通市江海英才。研究方向为计算机视觉和多维信号处理,先后主持参与各类项目45项,其中国家级项目4项、省部级项目5项、厅局级重点项目3项,横向项目27。近年来在包括IEEE TGARS、IEEE JSTARS和PR等国内外权威期刊上发表论文90余篇,包括80余篇SCI检索期刊论文,入选ESI高被引论文4篇。曾获ICCVIT 2025最佳论文奖1项、ICIVIS 2023最佳论文奖1项。获授权发明专利8项、实用新型专利1项,获河北省地球物理学会科技进步奖二等奖1项、获2024年第二季度“Wiley威立中国高贡献作者奖”。曾任CCF YOCSEF保定主席(2022-2023年),现为CSIG交通视频专委会副秘书长、CCF CV委员、CCF/CSIG MM委员、兵器装备工程学报编委、河北大学学报(自然科学版)青年编委和火箭军工程大学学报青年编委。
论坛主席
梁旭,工学博士,北京信息科技大学计算机学院教授、学校教务处处长,省级教学名师。长期从事制造业信息化、计算机集成制造系统研究,针对工业机器人、智能集成制造系统开发中的具身智能技术方案、应用集成部署等问题进行了系统研究和成功实践,研究成果在中国石油、国家管网、渤海装备等大型能源及制造业企业成功落地应用,支撑企业数智化转型。发表人工智能、机器智能领域顶级学术期刊、会议论文等30余篇、申请发明专利10件,主持省部级和企业重点研发课题20余项。
邹智元,工学博士,北京信息科技大学计算机学院副教授、硕士生导师、软件工程教研室主任,江苏省“双创人才”、姑苏创新创业领军人才、苏州工业园区科技领军人才,兼任中国计算机学会企智会技术委员、具身智能灵巧操作北京市重点实验室副主任、中国林科院数字木材创新研发中心主任。长期从事具身智能、计算机视觉、图像理解算法研究,具有坚实的信息融合、模式识别理论基础,以及丰富的软件工程技术背景和项目管理经验,发表SCI一区、二区等期刊论文、CCF-A/B类等会议论文20余篇,申请国家发明专利15件、授权5件,软著50余项。
宋文凤,工学博士,毕业于北京航空航天大学虚拟现实全国重点实验室,现任北京信息科技大学副教授。研究方向为智慧医疗、医学仿真。承担国家级项目两项,北京市自然基金两项。获得北京航空航天大学优秀博士论文,多次获得北京市优秀毕设指导教师。获得仿真学会创新技术奖一项。发表TPAMI,IJCV,TMM,TVCG,CVPR, ICCV等顶级期刊会议论文20余篇。担任CCF高等教育专委会委员、CCF智能体图形学专委会委员、CCF三维计算机视觉专委会委员。
北京信息科技大学计算机学院
北京信息科技大学计算机学院前身为1978年建立的北京大学第二分校和1985年成立的北京信息工程学院。2008年,学校在原北京信息工程学院计算科学与工程系、基础二部计算机应用教研室,原北京机械工业学院计算机与自动化系,原北京信息科技大学计算中心基础上,成立计算机学院。北京朝阳区北四环中路35号(健翔桥校区)为学院的曾经所在地。
学院现有计算机科学与技术、软件工程、网络工程、数据科学与大数据技术、信息安全5个本科专业,在校本科生1791人。学院现有计算机科学与技术和网络空间安全两个一级学术学位授权学科,以及电子信息(计算机技术、人工智能、网络与信息安全方向)专业学位授权点,全日制硕士研究生560人。2025年开始招生电子信息专业博士学位-智能信息处理技术与应用方向博士研究生。原计算机应用技术二级学科为北京市重点建设学科。学院拥有网络文化与数字传播北京市重点实验室以及与其他高校和科研机构联合建立的北京材料基因工程高精尖创新中心、北京区块链与隐私计算高精尖创新中心和国家经济安全预警工程北京实验室。
学院现有教职工151人,其中专任教师128人。建立了一支以学科带头人、研究方向带头人、青年学术骨干和研究生为梯队的学科队伍,通过引进高级人才,挖掘学科潜力,充分发挥多学科交叉和跨领域应用的综合优势,以及与产业界紧密结合的优势,取得了丰硕的教学与科研成果。
具身智能灵巧操作北京市重点实验室是全国首个以灵巧操作为核心、聚焦末端执行器系统级创新的北京市重点实验室。我校由计算机学院梁旭教授牵头负责共建。在梁旭老师的带领下,实验室将紧扣国家战略与首都产业布局,聚焦高精度感知灵巧手、大规模多模态数据集、智能造物大模型、灵巧操作集成系统及场景应用四大核心方向,集中攻克高自由度精密控制、多模态感知融合、虚实场景迁移、跨域技能泛化等“卡脖子”技术,研制自主可控、性能领先的灵巧操作装备,系统性提升我国具身智能末端操作专业能力,筑牢产业高质量发展技术根基。
会场路线图
地址:北京信息科技大学(沙河校区)图书馆六层勤信讲堂(601)
报名参会
本期CCF-MM走进高校活动的地点是北京信息科技大学计算机学院。本次会议不收取注册费,食宿差旅自理。
联系人
邹智元
联系电话:18810322564(同微信)














