学术交流

学术交流

当前位置: 首页 >> 合作交流 >> 学术交流 >> 正文

从多模态大模型到具身智能的发展启发

发布时间:2025年09月11日 文章作者: 浏览:5次
字体: 【大】 【中】 【小】

报告人:宋井宽 教授

时间:2025年9月13日17:00-18:00

地点:安徽工业大学秀山校区图书馆一楼报告厅

报告对象:全校感兴趣师生

报告人简介:宋井宽,同济大学计算机学院教授,国家“青年特聘专家”,主要研究方向为多媒体理解。他在多媒体、计算机视觉、人工智能等领域的重要会议和期刊发表论文180余篇,谷歌学术引用17000余次;同时担任国际SCI期刊IEEE TMM、ACM TOMM等编委,担任多个期刊的评审和多个国际顶级会议(MM'18-'24, IJCAI'18-'24)的领域主席,并主持自然科学基金委重点、科技部重点研发课题等多项国家级项目。。

报告内容简介:多模态大模型是指在统一的框架下,集成了多种不同类型数据处理能力的大型神经网络模型。这些模型能够处理图像、文本、音频等不同的数据模态,并在这些模态之间进行有效的交互和信息整合。ChatGPT及其变种的问世展现了大型语言模型(LLM)及MLLM的突破,不仅激发了对大模型在各行各业应用的无限想象,也将“具身智能”推到了聚光灯下,引发了对机器如何更自然地与人类及环境互动的深入探讨。具身人工智能(Embodied AI)对于实现通用人工智能(AGI)至关重要,并且是连接网络空间和物理世界的各种应用基础。本报告梳理了从多模态大模型到具身智能的发展历程,提出了针对具身智能中目前挑战的一些思考。


下一条:本能、进化、创意—— “学习基因” 带来的新质 AI 能力