刚刚，ICCV最佳论文出炉，朱俊彦团队用砖块积木摘得桂冠

ICCV 2025会议概况 - 国际计算机视觉大会ICCV于10月22日揭晓年度奖项，该会议是全球计算机视觉三大顶会之一，每两年举办一次[2][5] - 本届会议共收到11,239份有效投稿，最终录用2,699篇论文，录用率为24%，论文数量相比上一届有大幅增长[5] 最佳论文奖：BrickGPT - 最佳论文奖由卡耐基梅隆大学获得，论文标题为《Generating Physically Stable and Buildable Brick Structures from Text》，由知名学者朱俊彦带领团队完成[3][7][9] - 该论文提出了BrickGPT，是首个能够根据文本提示生成物理稳定的相互连接积木装配模型的方法[11] - 研究团队构建了包含47,000多个积木结构的大规模数据集StableText2Brick，并训练了自回归大型语言模型来预测下一块积木[13] - 方法引入了有效性检查和基于物理约束的回滚机制，实验结果显示其有效性达100%，稳定性达98.8%，平均积木稳定性为0.996，全面优于基线模型[20][22] 最佳论文提名奖 - 同样来自卡耐基梅隆大学的论文《Spatially-Varying Autofocus》获得最佳论文提名奖，该研究突破了传统镜头成像规律，能够构建可任意调整景深的计算镜头[24][26] 最佳学生论文奖 - 最佳学生论文奖由以色列理工学院的《FlowEdit: Inversion-Free Text-Based Editing Using Pre-Trained Flow Models》获得，该论文提出了一种无需反演的新型图像编辑方法[27][28][30] - FlowEdit通过构建常微分方程直接在源图像分布与目标图像分布间建立映射路径，实现了更低的传输成本和更高保真度的编辑，在Stable Diffusion 3和FLUX模型上取得SOTA效果[32][34] 最佳学生论文提名奖 - 德州大学奥斯汀分校的《RayZer: A Self-supervised Large View Synthesis Model》获得最佳学生论文提名奖，该模型在训练时无需任何3D监督信息即可学习3D感知能力[36][38] Helmholtz Prize（测试方法奖） - 该奖项表彰在计算机视觉基准测试中的贡献，获奖论文包括Ross Girshick的《Fast R-CNN》和何恺明等人的《Delving Deep into Rectifiers: Surpassing Human-Level Performance on ImageNet Classification》[39][41] - 《Fast R-CNN》提出了用于目标检测的快速区域卷积网络，显著提升了训练和测试速度[39] - 何恺明等人的论文引入了PReLU激活函数和He初始化方法，并首次在ImageNet上达到超越人类水平的分类性能[41] Everingham Prize（严谨评估奖） - 该奖项表彰对社区有重大贡献的研究者，获奖团队包括人体3D模型SMPL的团队和VQA数据集团队[44][46] - SMPL模型以参数化方式精准表示人体姿态与形状，被广泛应用于动画、虚拟人及生成式AI中[44] - VQA数据集结合了图像理解与自然语言问答，推动了多模态AI在视觉理解和语言推理方向的研究[46] 研究者个人奖项 - Significant Researcher Award授予David Forsyth和Michal Irani，表彰其研究显著推动了计算机视觉领域进展[48][53] - Azriel Rosenfeld终身成就奖授予Rama Chellappa，表彰其在人脸识别、运动分析、3D建模等领域的奠基性贡献[54][57]