【视频生成的“智”与“情”】真正的视频智能不止于生成画面,更在于触动人心。论坛将汇聚技术专家与创意实践者,共同追问:如何在效率与温度、写实与写意之间找到平衡,让视频生成技术不仅更聪明,也更懂我们。诚邀你一同走进这场关于未来影像的深度对话。
论坛简介
2024年,“情智兼备的数字人与机器人的研究”入选中国科协十大前沿科学问题第1位。受此启发,本次论坛以视频生成的“智”与“情”为主题,探讨智能算法如何理解世界,以及如何在理性计算中注入情感的温度。“智”指向多模态大模型、物理仿真与时空建模的技术突破,是真实感的基石;“情”则关乎叙事节奏、审美意象与共情能力的塑造,是感染力的源泉。我们相信,真正的视频智能不止于生成画面,更在于触动人心。论坛将汇聚技术专家与创意实践者,共同追问:如何在效率与温度、写实与写意之间找到平衡,让视频生成技术不仅更聪明,也更懂我们。诚邀你一同走进这场关于未来影像的深度对话。
日程安排
顺序 | 主题 | 主讲嘉宾 | 单位 |
1 | 情智兼备的多智能体内容生成与社交模拟 | 刘武 | 中国科学技术大学 |
2 | 多智能体协作的长时序视频生成:从规则可控到叙事共情 | 户保田 | 哈尔滨工业大学(深圳) |
3 | 视觉生成与理解如何走向协同统一 | 袁粒 | 北京大学 |
4 | 视频生成中的物理感知与视听情感表达 | 亓帆 | 内蒙古大学 |
5 | 从视频生成到认知影响:面向认知安全的多模态内容计算 | 折栋宇 | 中关村实验室 |
6 | Panel环节 | 杨巨峰 | 南开大学 |
刘武 | 中国科学技术大学 | ||
户保田 | 哈尔滨工业大学(深圳) | ||
袁粒 | 北京大学 | ||
亓帆 | 内蒙古大学 | ||
折栋宇 | 中关村实验室 |
论坛主席:
南开大学教授
南开大学科研部副部长、计算机学院教授,数据与智能系统安全教育部重点实验室副主任,中国情感计算大会(CCAC 2025)程序主席,国际情感计算汇刊(IEEE TAFFC)编委。已发表PIEEE/PAMI/CVPR等CCF A类论文60余篇,主持国基金重点项目和中科协战略咨询项目(结题优秀),参与提出的“情智兼备数字人与机器人的研究”被遴选为2024年中国科协十大前沿科学问题第1位。
论坛讲者:
中国科学技术大学特任教授
中国科学技术大学特任教授,入选国家级青年人才计划,主持重点研发计划和基金委区域联合重点项目等。在重要国际会议和期刊上发表论文100余篇,曾获得IEEE T-MM、IEEE MM和 IEEE ICME等最佳论文奖,以及CAAI吴文俊人工智能科技进步特等奖、天津市科技进步特等奖、ACM中国新星奖、中科院优秀博士论文奖、中科院院长特别奖等,入选了《麻省理工科技评论》亚太区“35岁以下科技创新35人”,中关村论坛-Al100青年先锋,并担任了IEEE T-MM和Pattern Recognition Associate Editor, IEEE ICME 2022和ACM MM Asia2021技术委员会主席,2026年中国多媒体大会技术委员会主席,IET Fellow评审委员会委员等。
报告题目|情智兼备的多智能体内容生成与社交模拟
报告摘要|多模态大模型驱动的多智能体技术快速发展,为构建具备情感理解、认知推理和自主交互能力的智能体提供了全新范式。本报告聚焦“情智兼备”的多智能体内容生成与社交模拟,面向大规模社交网络中个体行为多样化、群体行为规模化和社交行为复杂化三大挑战,介绍融合认知智能与情感智能的个体多样化生成、群体大规模协同和社会动态化演化三类动态模拟引擎,探索如何实现拟人化数字人视频生成、大规模用户社交行为,构建复杂社交网络动态链接结构,进行高效信息交互与深度认知行为分析,并面向交互服务、信息传播、热点预测等重点场景开展应用。
哈尔滨工业大学(深圳)教授
哈尔滨工业大学(深圳)/深圳河套学院 教授,深圳河套学院AI训练平台负责人,基金委优青,基金委新一代人工智能创新研究群体青年学术骨干,2025年度吴文俊人工智能科技进步特等奖获得者,中国中文信息学会大模型与生成专委会秘书长。发表学术论文100余篇。自主研发了“立知”系列大模型,通过工信部自主研发认证和国家网信办备案,相关研究成果被公开下载1.5亿次。与华为、招商银行、中国电信等单位共建联合实验室、承担多项校企合作科研项目,相关成果在多家头部企业落地应用。曾任IJCNLP-AACL2023程序委员会联合主席,担任Neural Networks期刊编委。
报告题目|多智能体协作的长时序视频生成:从规则可控到叙事共情
报告摘要|当前主流视频生成模型普遍存在时序断裂、叙事逻辑碎片化等问题,难以兼顾内容的逻辑性与感染力,无法支撑复杂、连贯、有人文温度的视频创作。针对该痛点,我们跳出传统端到端生成范式,聚焦智能体协同生成核心路径,构建分层式视频智能体创作体系。依托团队在智能体任务规划、长时序记忆迭代、自主试错优化的系列研究积累,通过脚本拆解智能体、时序调度智能体、内容校验智能体的协同协作,实现长镜头、多场景、连贯叙事的视频自动生成,解决视频生成之“智”的可控性难题;同时基于情景记忆迭代与叙事理解能力,让生成内容匹配场景氛围与叙事情绪,补齐视频生成之“情”的表达短板。本报告将系统分享智能体视频生成的架构设计、核心技术突破与落地实践,剖析长时序生成的关键瓶颈,探讨通过智能体进化实现视频内容“逻辑可控、情感可感”的新一代生成范式。
北京大学深圳研究生院助理教授、研究员
北京大学深圳研究生院助理教授、研究员、博导,入选国家高层次青年人才计划,主持新一代人工智能国家科技重大专项和多项国自然基金等。获2025年广东省卓越人工智能—科技进步一等奖(2/10),入选2026年MIT TR35名单, 研究方向为多模态机器学习,以第一&通讯作者在国际期刊和顶会上发表论文50余篇,包括Nature Computational Science、Nature Communications、TPAMI/CVPR/ICLR/ICML等,研究工作被引两万余次,代表性应用工作包括ChatExcel、Open-Sora Plan视频生成(GitHub万星)开源计划。
报告题目|视觉生成与理解如何走向协同统一
报告摘要|先进的视觉生成和理解模型往往被视为两个独立架构,这不仅增加了系统的冗余,也忽略了认知心理学中“感知”与“创造”之间深刻的内在联系。本报告将深入探讨如何构建一个协同统一的视觉大模型体系,将视觉生成和理解模型重新表述为自编码器框架,通过这种视角,生成与理解被转化为信息的压缩与重建过程,从而在底层架构上实现了任务的解耦与形式的统一;同时报告也将探讨一个核心科学问题:理解是否真的能促进生成,将展示从深度分析到路径演进的最新发现,揭示理解能力如何为生成任务提供更强的语义约束和结构先验,并讨论实现这种“互惠互利”所面临的挑战与未来方向。
内蒙古大学骏马计划A3研究员
内蒙古大学计算机学院骏马计划A3研究员,博导,国家高层次青年人才,长期致力于多模态理解、AI安全及跨模态生成等领域的前沿研究,一作/通讯发表CCF-A类期刊会议/JCR-1区期刊(TPAMI/CVPR/ICML等)二十余篇,曾获天津市科学技术进步一等奖,中国多媒体大会最佳论文奖。近四年主持国家自然科学基金重点项目子课题、面上项目和青年项目各1项,以及内蒙古自治区科技领军人才团队培育专项。担任CCF多媒体专委会委员,CSIG情感计算与理解专业委员会委员,CCF Yocsef天津候任副主席。
报告题目|视频生成中的物理感知与视听情感表达
报告摘要|随着生成式模型和视听学习技术的发展,视频生成在视觉质量与时序连贯性等方面取得了较大进展,研究重点也逐步拓展至生成内容的物理合理性与情感表现力。本报告围绕物理感知与视听情感表达展开:在物理层面,关注生成内容中的运动、交互与状态变化是否符合基本物理规律;在情感层面,讨论模型如何理解情感意图,以及音乐如何参与情感表达。在此基础上,本报告将进一步讨论三维空间表示以及人物生成自然性等未来研究方向。
中关村实验室助理研究员
中关村实验室助理研究员,博士毕业于清华大学计算机系。主要研究方向为多模态内容理解与生成、情感计算等。在CVPR, ICCV, AAAI, ACM MM, TMM等顶级会议和期刊上发表多篇论文。
报告题目|从视频生成到认知影响:面向认知安全的多模态内容计算
报告摘要|视频是承载信息、表达情感并影响认知的重要媒介。近年来,生成模型的发展不断提升视频内容的逼真度、表现力与可控性,也使生成内容与受众感知和判断之间的关系成为值得关注的问题。本次报告将围绕视频生成、情感感知与认知影响,介绍相关研究进展并分享工作,进一步讨论视频生成给认知安全带来的新问题。最后,对相关领域的未来发展方向进行展望。
欢迎参加CNCC2026
CNCC是一个宏观论述技术趋势的大会,具有规格高、规模大、内容丰富等特点,会议形式包括大会特邀报告、大会论坛、专题论坛、特色活动及展览。大会汇聚两院院士、国内外顶尖学者、知名企业家等亲临大会,展望前沿趋势,分享创新成果。ACM、IEEE CS、IPSJ、KIISE等国际计算机组织的代表也多次获邀现场参加这一盛会。CNCC2026将于10月21-24日在四川省成都市举办,大会主题是“数聚驱动,智算未来”,欢迎各界前来参会。
点击“阅读原文”,加入CCF。
