以全球生产规模部署
借助全球可用性、广泛的导出支持,以及经 Ultralytics 生态系统验证的使用量,将训练好的模型投入生产。
在浏览器中测试模型
每个已训练模型都包含内置的 Predict 选项卡功能。上传图像或打开摄像头,边界框会立即显示。
部署到全球 42 个区域
将你的模型部署到美洲、欧洲、亚太地区和中东的专用端点。每个端点都有自己的 URL、自动缩放以及针对请求、延迟、错误和日志的监控。
根据流量自动扩缩容
专用端点会在流量激增时扩容,在空闲时缩容至零。
- 默认缩容至零:端点未收到请求时不会产生费用。
- 无速率限制:专用端点没有吞吐量上限。
- 可配置资源:选择 CPU(1-8 个核心)和内存(1-32 GB),以匹配你的工作负载。
20 种导出格式。你的模型,适用于任何环境。
Ultralytics Platform 支持云端和边缘部署,以实现高性能。所有 Ultralytics YOLO 模型均经过原生优化,可在各种环境中高效运行,即使在计算资源有限的边缘设备上,也能提供高精度、可靠性能和良好兼容性。
全面监控生产环境中的一切
从部署仪表板跟踪端点请求、延迟、错误和日志。付费专用端点还提供实时预测统计数据以及你可以检查并保存到数据集的临时示例。
- 请求、延迟和错误:24 小时 HTTP 流量、流量加权的 P95 延迟以及超过 5% 的错误率警报。
- 健康检查和日志:具有自动重试功能的实时端点健康状况,以及用于快速诊断问题的严重性过滤日志。
- 临时示例:检查付费专用端点上的抽样预测。示例保留在端点内存中;将有用的图像保存到数据集中以保留它们。
- 预测统计:类别计数、置信度、推理时间和空间热图(模型任务支持时)。当服务实例被替换时,统计数据会重置。
尝试 YOLO26 推理
拖放图像以查看实时目标检测结果
了解如何部署!
观看如何测试训练好的模型、将其部署到全局端点,并监控请求、延迟和实时预测。
探索行业解决方案
了解各团队如何在生产环境中应用 Ultralytics 计算机视觉。

用于航拍影像的计算机视觉

航空航天中的计算机视觉


机器人计算机视觉

物流计算机视觉

零售计算机视觉

医疗领域的计算机视觉

制造业中的计算机视觉

汽车行业中的计算机视觉

农业中的计算机视觉

用于航拍影像的计算机视觉

航空航天中的计算机视觉


机器人计算机视觉

物流计算机视觉

零售计算机视觉

医疗领域的计算机视觉

制造业中的计算机视觉

汽车行业中的计算机视觉

农业中的计算机视觉

用于航拍影像的计算机视觉

航空航天中的计算机视觉


机器人计算机视觉

物流计算机视觉

零售计算机视觉

医疗领域的计算机视觉

制造业中的计算机视觉

汽车行业中的计算机视觉

农业中的计算机视觉
常见问题
可以。每个模型都可以同时部署到多个区域。你的计划决定可用端点的总数:免费版为 3 个,Pro 为 10 个,Enterprise 为无限个。这样,你就能通过每个区域中的低延迟端点为全球用户提供服务。
专用端点根据 CPU、内存和请求量计费。默认启用缩容至零后,你只需为活跃推理时间付费。端点未收到请求时不会产生费用。共享推理已包含在你的平台计划中。
共享推理运行在跨 3 个区域的多租户服务上,速率限制为每分钟 20 个请求。它最适合开发和快速测试。专用端点是单租户服务,可部署到 43 个区域中的任意区域,没有速率限制,延迟稳定且资源可配置,专为可扩展的生产工作负载而构建。
专用端点部署通常需要一到两分钟。这包括容器配置、启动以及用于验证服务是否就绪的初始健康检查。端点准备就绪后,会立即开始接受推理请求。







