约书亚·本吉奥 1964 年出生于法国,在加拿大麦吉尔大学获得博士学位,后在蒙特利尔大学任教,并于 1993 年创立 LISA 实验室,该实验室在 2017 年发展为 Mila 魁北克人工智能研究所。他是加拿大深度学习学派的领军人物,最重要的贡献集中在「让神经网络学会表示语言与序列」:2003 年他发表神经概率语言模型,第一次用分布式词向量与神经网络做语言建模,被广泛视为现代词嵌入与大语言模型的思想源头之一;他还推动了循环神经网络、去噪自编码器与生成模型等方向的发展。2014 年,他与两名学生提出注意力机制,解决了长句翻译的信息瓶颈,这一机制后来成为 Transformer 的核心组件;同年他还与 Ian Goodfellow 等合著了生成对抗网络论文。2018 年他与杰弗里·辛顿、杨立昆共同获得图灵奖。近年他把研究重心转向 AI 安全与治理,参与发起《蒙特利尔负责任人工智能宣言》,2025 年主持发布首份《国际人工智能安全报告》。他目前担任 Mila 科学总监,并继续在蒙特利尔大学任教。