Triển khai các model thị giác máy tính trên 42 khu vực toàn cầu
Đưa các model đã train của bạn từ thử nghiệm trên trình duyệt đến các production endpoint chỉ trong vài cú click với tính năng auto-scaling, real-time monitoring và 20 format export.

Triển khai ở quy mô sản xuất toàn cầu
Đưa các model đã được huấn luyện vào sản xuất với khả năng sẵn sàng trên toàn thế giới, hỗ trợ xuất khẩu rộng rãi và khối lượng sử dụng đã được chứng minh bởi hệ sinh thái Ultralytics.

Triển khai tới 42 khu vực trên toàn thế giới
Triển khai các model của bạn đến các endpoint chuyên dụng trên khắp châu Mỹ, châu Âu, châu Á - Thái Bình Dương và Trung Đông. Mỗi endpoint đều có URL, tính năng tự động mở rộng và giám sát riêng.

Tính năng tự động mở rộng (auto-scaling) phù hợp với lưu lượng truy cập của bạn
Các endpoint chuyên dụng sẽ tự động mở rộng khi lưu lượng truy cập tăng vọt và thu nhỏ về không khi ở trạng thái nhàn rỗi.
- Tự động thu nhỏ về không theo mặc định: Không tốn chi phí khi endpoint của bạn không nhận yêu cầu.
- Không giới hạn tốc độ (rate limit): Các endpoint chuyên dụng không có giới hạn thông lượng.
- Tài nguyên có thể cấu hình: Chọn CPU (1-8 nhân) và bộ nhớ (1-32 GB) để phù hợp với khối lượng công việc của bạn.

20 format export. Model của bạn. Mọi môi trường.
Ultralytics Platform hỗ trợ triển khai trên đám mây và biên (edge) để đạt hiệu suất cao. Tất cả các model YOLO của Ultralytics đều được tối ưu hóa nguyên bản để chạy hiệu quả trên nhiều môi trường, mang lại độ chính xác cao, hiệu suất đáng tin cậy và khả năng tương thích ngay cả trên các thiết bị biên có tài nguyên tính toán hạn chế.

Giám sát mọi thứ trong môi trường production
Khả năng hiển thị toàn diện theo thời gian thực về hiệu suất của các model. Khi model của bạn đã hoạt động trực tuyến, bảng điều khiển triển khai cung cấp cái nhìn tổng quan tập trung về mọi endpoint đang chạy, cùng với các số liệu và bộ công cụ bạn cần để tối ưu hóa và giữ cho các framework của mình vận hành ổn định.
- Khối lượng yêu cầu: Tổng số yêu cầu trên tất cả các endpoint trong 24 giờ qua.
- Độ trễ P95: Thời gian phản hồi ở phân vị thứ 95 để theo dõi hiệu suất trong các trường hợp sử dụng thực tế.
- Tỷ lệ lỗi: Cảnh báo rõ ràng khi tỷ lệ lỗi vượt quá 5%, với nhật ký được lọc theo mức độ nghiêm trọng để chẩn đoán sự cố nhanh chóng.
- Kiểm tra tình trạng: Giám sát endpoint trực tiếp với tính năng tự động thử lại. Độ trễ được hiển thị cho mỗi lần kiểm tra.

Tích hợp trong vài phút
Mỗi endpoint được triển khai đều đi kèm với các ví dụ code tự động tạo bằng Python, JavaScript và cURL, đã được điền sẵn URL endpoint và API key thực tế của bạn. Hãy sao chép, dán và bắt đầu gửi các yêu cầu suy luận từ bất kỳ ứng dụng nào.
Kiểm tra model của bạn trên trình duyệt
Mỗi model đã được huấn luyện đều bao gồm chức năng tab Predict tích hợp sẵn. Hãy tải lên một hình ảnh hoặc mở camera của bạn; các khung bao (bounding box) sẽ xuất hiện ngay lập tức.

Thử nghiệm suy luận YOLO26
Kéo và thả hình ảnh để xem phát hiện đối tượng theo thời gian thực
Thả hình ảnh vào đây
hoặc nhấp để duyệt
Hỗ trợ JPEG, PNG, WebP, AVIF, HEIC, JP2, TIFF, BMP và hơn thế nữa (tối đa 10MB)
import requests
# Replace with your deployment URL and API key
url = "https://your-deployment-url.run.app/predict"
api_key = "YOUR_API_KEY"
# Optional inference parameters (conf, iou, imgsz)
args = {"conf": 0.25, "iou": 0.7, "imgsz": 640}
with open("image.jpg", "rb") as f:
response = requests.post(
url,
headers={"Authorization": f"Bearer {api_key}"},
data=args,
files={"file": f},
)
print(response.json())Tìm hiểu cách triển khai!
Xem cách kiểm tra một model đã được huấn luyện, triển khai nó đến một endpoint toàn cầu và giám sát hiệu suất.
Khám phá các giải pháp trong ngành
Xem cách các đội ngũ ứng dụng thị giác máy tính của Ultralytics trong môi trường sản xuất.

AI trong ngành Robot

AI trong Logistics

AI trong ngành Bán lẻ

AI trong chăm sóc sức khỏe

AI trong sản xuất

AI trong Ô tô

AI trong Nông nghiệp

AI trong ngành Robot

AI trong Logistics

AI trong ngành Bán lẻ

AI trong chăm sóc sức khỏe

AI trong sản xuất

AI trong Ô tô

AI trong Nông nghiệp

AI trong ngành Robot

AI trong Logistics

AI trong ngành Bán lẻ

AI trong chăm sóc sức khỏe

AI trong sản xuất

AI trong Ô tô

AI trong Nông nghiệp
Các câu hỏi thường gặp
Có. Mỗi model có thể được triển khai tới nhiều khu vực cùng một lúc. Gói của bạn xác định tổng số endpoint khả dụng: 3 cho Free, 10 cho Pro và không giới hạn cho Enterprise. Điều này cho phép bạn phục vụ người dùng trên toàn cầu với các endpoint độ trễ thấp ở mỗi khu vực.
Các endpoint chuyên dụng được tính phí dựa trên CPU, bộ nhớ và lưu lượng yêu cầu. Với tính năng scale-to-zero được bật mặc định, bạn chỉ trả tiền cho thời gian suy luận thực tế. Không có chi phí khi endpoint của bạn không nhận được yêu cầu nào. Suy luận chia sẻ được bao gồm trong gói nền tảng của bạn.
Suy luận chia sẻ chạy trên dịch vụ đa người dùng (multi-tenant) tại 3 khu vực và bị giới hạn tốc độ ở mức 20 yêu cầu mỗi phút. Nó phù hợp nhất cho việc phát triển và thử nghiệm nhanh. Các endpoint chuyên dụng là các dịch vụ đơn người dùng (single-tenant) được triển khai tới bất kỳ khu vực nào trong số 43 khu vực mà không bị giới hạn tốc độ, độ trễ ổn định và tài nguyên có thể cấu hình, được xây dựng cho các khối lượng công việc sản xuất có thể mở rộng.
Việc triển khai endpoint chuyên dụng thường mất từ một đến hai phút. Điều này bao gồm việc cấp phát container, khởi động và kiểm tra sức khỏe ban đầu để xác thực dịch vụ đã sẵn sàng. Khi endpoint đã sẵn sàng, nó bắt đầu chấp nhận các yêu cầu suy luận ngay lập tức.
Triển khai model là quá trình làm cho một model thị giác máy tính đã huấn luyện sẵn sàng để nhận và xử lý dữ liệu thực tế. Sau khi triển khai, các ứng dụng thị giác máy tính có thể gửi hình ảnh và khung hình video đến model thông qua API và nhận dự đoán, cho phép thực hiện mọi thứ từ kiểm tra chất lượng tự động đến phát hiện đối tượng thời gian thực trong các hệ thống sản xuất. Trên Ultralytics Platform, triển khai được tích hợp trực tiếp vào quy trình huấn luyện end-to-end. Khi model của bạn đã được huấn luyện, bạn có thể kiểm tra nó trong trình duyệt, triển khai tới endpoint chuyên dụng ở bất kỳ 43 khu vực toàn cầu nào và giám sát hiệu suất của nó, tất cả từ cùng một không gian làm việc.
Bắt đầu triển khai ngay hôm nay!
Đưa các model đã huấn luyện của bạn vào môi trường production trên 42 khu vực toàn cầu với khả năng tự động mở rộng (auto-scaling) và giám sát thời gian thực.