李昀烛,北京大学信息科学技术学院2013级本科校友,美国哥伦比亚大学计算机科学系助理教授。2017年获北京大学计算机科学学士学位,于麻省理工学院计算机科学与人工智能实验室(CSAIL)获硕士、博士学位;博士毕业后曾在斯坦福大学视觉与学习实验室从事博士后研究,与李飞飞、吴佳俊等合作,后任伊利诺伊大学厄巴纳-香槟分校计算机科学系助理教授。其研究主要聚焦机器人技术、计算机视觉和机器学习的交叉领域。相关研究成果已应用于可变形物体操控、软体物理仿真及具身智能交互等领域,成果已发表于Nature、Science、Nature Electronics、Science Robotics以及ICLR、NeurIPS、CoRL、RSS、ICRA等国际顶级学术期刊与会议,其研究曾获得国际基础科学大会(ICBS)前沿科学奖、ICRA最佳论文奖、CoRL最佳系统论文奖、AAAI New Faculty Highlights及Amazon Research Award等多项学术奖励。
他以统一视觉词元和语言模型打通图像、视频的理解与生成,推动多模态智能从“看懂”走向“创作”。
于力军,北京大学信息科学技术学院2015级本科校友,Google DeepMind高级研究科学家(Staff Research Scientist),从事Gemini大模型相关研究。2019年毕业于北京大学,获计算机科学与技术学士学位及经济学学士学位,后赴卡内基梅隆大学计算机学院语言技术研究所深造,获语言技术硕士、博士学位。参与研发了VideoPoet、MAGVIT-v2及W.A.L.T等领先的多模态与视频生成模型,相关研究成果曾获ICML2024最佳论文奖(Best Paper Award),并担任NeurIPS、ICLR、CVPR等国际顶尖学术会议的领域主席(Area Chair)。