Ultralytics 参加 CVPR 2025 的重点亮点
和我们一起回顾 Ultralytics 参加 CVPR 2025 的经历,从展位亮点到现实中的计算机视觉应用案例,以及在纳什维尔的难忘时刻。

上周,也就是 6 月 11 日至 15 日,Ultralytics 团队亲临田纳西州纳什维尔,参加 CVPR 2025——IEEE/CVF 计算机视觉与模式识别会议。这是计算机视觉和 AI 研究领域每年最重要的活动之一。
本届会议在 Music City Center 举行,吸引了来自世界各地的 12,000 多名参会者。从学术研究人员和工程师,到行业领袖和开发者,现场汇聚了众多不断突破视觉 AI 边界的人士。
CVPR 2025 尤其聚焦于前沿研究,并围绕多个主题展开讨论,从计算机视觉中的深度学习和多模态学习,到生成式 AI 模型、基础模型,以及自动驾驶和 3D 场景理解等现实应用。

图 1. 田纳西州纳什维尔的 CVPR 2025。
对 Ultralytics 来说,CVPR 2025 期间的一周主要用于与计算机视觉社区交流、分享演示,并了解我们的 Ultralytics YOLO 模型如何应用于各行各业。在 1512 号展位,我们展示了最新的视觉 AI 解决方案,与数百名访客讨论实际应用场景,并亲眼见证我们的工作如何推动机器人、零售、研究等多个领域的创新。
现在,让我们一起回顾活动中一些最精彩的时刻,重点了解其中的关键收获、交流和社区互动。
了解纳什维尔 CVPR 2025#
CVPR 于 1983 年首次举办,并于 1985 年获得 IEEE 的正式支持。多年来,它已发展成为计算机视觉和模式识别领域最具影响力的会议之一,汇聚了全球各地的研究人员、工程师和创新者。自 2012 年起,该会议由计算机视觉基金会(CVF)共同主办。该非营利组织支持计算机视觉研究的开放获取,并在活动组织中发挥着重要作用。
CVPR 每年举办一次,如今已因其深厚的技术内涵以及对整个领域发展方向的塑造作用而闻名,从早期的目标识别突破,到如今视觉 AI 和深度学习领域的进展,均有其身影。本届会议共收到超过 13,000 篇论文投稿,比去年增加了 13%。在仅 22% 的录用率下,会议延续了重点展示高影响力研究的传统。
下面快速了解 CVPR 2025 上最突出的几个主要研究主题:
- **3D 场景理解与神经渲染:**研究人员正在探索如何利用多视角或传感器输入,以三维方式重建和表示世界,从而推动机器人、增强现实和仿真等应用的发展。
- 使用生成式 AI**进行图像和视频合成:**该领域专注于根据文本提示或草图等少量输入创建高质量视觉内容,为创意媒体和交互式系统提供新一代工具。
- **多模态学习与视觉语言模型:**这些模型融合视觉数据和语言数据,以提升理解、推理和交流能力,为构建更通用、更具适应性的 AI 系统铺平道路。
在 Music City Center 为 CVPR 做准备#
会议正式开始前,我们的团队抵达纳什维尔,为 CVPR 2025 做好一切准备。
我们花了一天时间在 Music City Center 进行布置,1512 号展位成为我们连续三天进行演示、交流和社区建设的基地。我们带着设备抵达后,拆箱并安装硬件、配置实时 YOLO 演示,还仔细安排了展位布局,确保一切都能在快节奏的展会环境中顺利运行。
现场逐渐挤满了搬运设备、测试演示和搭建展位的人。看着这一切逐步成形,我们再次感受到 CVPR 真正具有全球性和协作性。
高效完成下午的工作后,团队转换节奏,前往纳什维尔市中心探索。我们自然不会错过百老汇大道,那里每间酒吧和餐厅都飘出现场乡村音乐。
团队中的一些人买了牛仔靴(我们中有几个人还是第一次买),晚上则以当地经典美食 Hattie B’s 的辣鸡收尾。这是工作与乐趣的完美结合。展位准备就绪,团队也恢复了活力,准备迎接 CVPR 2025 的精彩内容。
关于计算机视觉和 AI 研究的交流#
展会第一天,Ultralytics 团队到场并准备就绪。我们的数字内容经理 Nuvola Ladi、活动经理 Zinnia Pourdad和机器学习工程师 Francesco Mattioli于上午 9 点前抵达 Music City Center。完成最后的布置检查并准备好演示后,我们已准备好在展会开门时迎接参会者。
上午 10 点,参会人群开始涌入,展区的气氛立即活跃起来。我们的展位很快挤满了访客,Ultralytics 周边产品,尤其是托特包和贴纸,在几分钟内就被拿光了。这是一个有趣的破冰方式,帮助我们开启交流并吸引更多人前来。

图 2. Nuvola Ladi、Zinnia Pourdad和 Francesco Mattioli在 1512 号展位。
一整天,我们都有机会与从事各种项目的研究人员、工程师和开发者交流。大家对我们的实时 YOLO 演示非常感兴趣,我们也了解到机器人、医疗保健、制造业、零售等领域的应用场景。看到我们的模型被广泛应用,从早期学术研究到已部署的企业系统,令人深受鼓舞。
我们还与 AI 领域的合作伙伴重新取得联系,其中包括 Intel OpenVINO 和 Sony Semiconductor Solutions 的团队。与其他创新者同场交流,让我们更加深刻地认识到,视觉 AI 领域始终充满协作,并且发展迅速。
临近一天结束时,团队前往 Printers Alley 欣赏现场乡村音乐并放松身心。在展区度过了充满交流和非凡活力的一天后,这是结束 CVPR 2025 首日行程的完美方式。

图 3. 团队有机会探索 Printers Alley。
纳什维尔计算机视觉会议的第二天#
CVPR 2025 的第二天延续了第一天的热烈气氛。1512 号展位全天保持活跃,回访的访客和新参会者纷纷前来进一步了解我们的 Ultralytics YOLO 模型,并分享他们自己的工作。
例如,当天最令人难忘的时刻之一就是 Intel Robodog 到访。看到先进硬件与实用视觉模型协同运行,真实体现了本次活动的精神。

图 4. Intel Robodog 到访 1512 号展位的团队。
晚上稍晚些时候,我们的团队参加了由 Intel 主办的 After.CVPR() Developer Meetup。这是一个轻松且充满协作氛围的交流空间,汇聚了来自整个 AI 生态系统的工程师、研究人员和开发者。
聚会现场有实时演示和富有意义的交流,一直持续到深夜。活动期间,Francesco Mattioli 展示了一个由 Ultralytics 和 OpenVINO 联合完成的演示,介绍了如何将我们的模型集成到高效的推理流水线中。
他演示了如何将 Ultralytics YOLO11 等模型导出为 OpenVINO 格式,从而在 Intel 硬件上实现更快速、更优化的推理。该演示展示了对中央处理单元(CPUs)、图形处理单元(GPUs)和神经处理单元(NPUs)的支持,吸引了众多从事边缘 AI 和实时应用的团队关注。

图 5. After.CVPR() Developer Meetup 一瞥。
CVPR 上计算机视觉应用中的深度学习#
即使在 CVPR 2025 的最后一天,Music City Center 依然充满活力。参会者仍在探索各个展位、进行深入交流,并充分利用他们在会议上的时间。
当天的亮点之一是参观海报展示环节,这是 CVPR 分享研究成果的核心方式之一。与传统的舞台演讲不同,海报展示更加轻松且具有互动性。
每位研究人员都会搭建一张大型印刷海报,总结自己的工作,并站在附近进行讲解、回答问题,与前来参观的人讨论研究成果。这是在短时间内了解广泛主题的好方法,也为参会者和展示者之间进行真正的交流创造了空间。
我们看到了各种各样的海报,内容涵盖从视觉语言模型和 3D 场景理解,到 AI 在机器人和医疗保健领域的现实应用。这些环节让我们更深入地了解了整个领域正在探索的最新理念,也让我们有机会直接与这些理念背后的研究人员交流。
随着活动接近尾声,我们离开时比以往任何时候都更有动力。这一周充满了学习、协作以及视觉 AI 领域切实的发展势头,我们很期待将这些洞察带入下一阶段的工作。
要点总结#
CVPR 2025 是充满学习、分享和交流的精彩一周。从前沿研究到亲手操作的演示和富有成效的交流,本次会议展现了视觉 AI 发展之快,也展现了其背后社区的影响力和支持性。
看到 Ultralytics YOLO 模型在如此众多的现实应用和研究应用中运行,令人深受鼓舞。最重要的是,CVPR 2025 清楚地表明,计算机视觉正处于 AI 创新的核心,而未来还有更多可能等待我们探索。
加入我们的社区,通过我们的 GitHub 代码仓库深入探索视觉 AI。在我们的解决方案页面了解零售领域的 AI和制造业中的计算机视觉等创新。查看我们的许可方案,今天就开启你的 AI 之旅!









