Ultralytics YOLO27:
Vision AI

OpenAI o1: Dòng model OpenAI mới dành cho suy luận AI

Tìm hiểu về các model OpenAI o1 mới ra mắt và những điểm đặc biệt của chúng. Đồng thời khám phá cách chúng hoạt động và tác động của chúng đến tương lai của AI.

ABAbirami Vina11 min read
OpenAI o1, một dòng model OpenAI mới dành cho suy luận AI

Cộng đồng AI đã xôn xao với những đồn đoán về bước tiến tiếp theo của các model GPT của OpenAI, trong đó nhiều người gọi đây là “Project Strawberry”. Lý do là nếu bạn prompt GPT-4o bằng cách hỏi có bao nhiêu chữ R trong từ "strawberry", model sẽ trả lời rằng từ "strawberry" có hai chữ R. Điều này có vẻ kỳ lạ khi xét đến sức mạnh của GPT-4o. Tuy nhiên, model được xây dựng để xử lý hàm ý thay vì các từ ngữ chính xác. Có tin đồn rằng model tiếp theo sẽ hướng đến việc giải quyết vấn đề này. Sam Altman càng làm dấy lên những đồn đoán khi đăng ảnh dâu tây trên tài khoản X (trước đây có tên là Twitter) của mình.

Với thông báo mới nhất của OpenAI vào thứ Năm, ngày 12 tháng 9, cuối cùng chúng ta đã có câu trả lời cho những đồn đoán này! OpenAI o1, một dòng model AI mới được thiết kế để chậm lại và suy nghĩ trước khi phản hồi, đã được phát hành. Điều thú vị là OpenAI o1 có khả năng suy luận tốt hơn và trả lời chính xác câu hỏi về dâu tây! Trong bài viết này, chúng ta sẽ thảo luận OpenAI o1 là gì, cách hoạt động, nơi có thể sử dụng và ý nghĩa của model này đối với tương lai của AI. Hãy bắt đầu!

Ví dụ về việc prompt OpenAI o1 về dâu tây

Hình 1. Ví dụ về việc prompt OpenAI o1 về dâu tây.

Những tiến bộ mới trong AI của OpenAI#

Vào tháng 7 năm 2024, các lãnh đạo OpenAI chia sẻ rằng hoạt động nghiên cứu của OpenAI đang tiến gần đến năng lực giải quyết vấn đề ở cấp độ con người, được gọi là cấp độ 2 của AI. Rõ ràng cấp độ này tập trung vào khả năng suy luận, khi OpenAI giới thiệu dòng model mới OpenAI o1 với khả năng suy nghĩ trước khi trả lời. OpenAI o1 là một LLM (mô hình ngôn ngữ lớn), một model AI hiểu và tạo ra văn bản giống con người bằng cách học các quy luật từ khối lượng dữ liệu ngôn ngữ khổng lồ. Model này được thiết kế để xử lý các vấn đề phức tạp đòi hỏi suy luận chuyên sâu.

Quan điểm của OpenAI về các giai đoạn phát triển của AI

Hình 2. Quan điểm của OpenAI về các giai đoạn phát triển của AI.

Model đã được huấn luyện bằng học tăng cường, một kỹ thuật trong đó model học cách đưa ra quyết định tốt hơn thông qua thử và sai bằng cách nhận phần thưởng hoặc hình phạt cho các hành động của mình. Thuật toán học tăng cường giúp model suy nghĩ hiệu quả hơn bằng cách tuân theo chuỗi suy nghĩ. OpenAI cũng chia sẻ rằng hiệu năng của o1 tiếp tục được cải thiện khi sử dụng nhiều học tăng cường hơn trong quá trình huấn luyện và dành nhiều thời gian hơn để "suy nghĩ" khi giải quyết vấn đề, cho thấy cả việc huấn luyện kéo dài lẫn quá trình xử lý có cân nhắc đều giúp nâng cao năng lực của model.

Mặc dù OpenAI o1 là một bước tiến đáng kể trong suy luận phức tạp, đây vẫn là một model ở giai đoạn đầu và thiếu một số tính năng giúp ChatGPT trở nên hữu ích, chẳng hạn như duyệt web hoặc tải tệp và hình ảnh lên. Với nhiều tác vụ thông thường, GPT-4o hiện có thể vẫn mạnh hơn. Tuy nhiên, OpenAI o1 đánh dấu một bước tiến lớn trong khả năng xử lý suy luận phức tạp của AI, đó là lý do OpenAI bắt đầu một dòng mới và đặt tên là OpenAI o1.

Các model OpenAI mới nâng cao khả năng suy luận AI như thế nào#

OpenAI o1 có thể được sử dụng cho các tác vụ như giải mã mật mã, giải bài tập lập trình, trả lời bài toán, giải ô chữ, thậm chí xử lý các chủ đề phức tạp trong khoa học, an toànchăm sóc sức khỏe. Như một lời gợi nhắc thú vị đến tên mã của dự án, OpenAI đã thể hiện kỹ năng suy luận của model bằng cách phá một mật mã tiết lộ thông điệp "THERE ARE THREE R’S IN STRAWBERRY."

Ngoài việc giải mật mã, OpenAI o1 cũng thành thạo lập trình. Model hoạt động tốt trong các thử thách lập trình cạnh tranh như trên Codeforces, một nền tảng nơi các lập trình viên giải quyết những bài toán mã hóa phức tạp trong điều kiện giới hạn thời gian. Trong các thử thách này, model đạt mức Elo cao (một hệ thống tính điểm đo lường cấp độ kỹ năng dựa trên thành tích so với các đối thủ khác) và vượt qua các model trước đây. Model cũng xuất sắc trong toán học và thể hiện tốt ở các kỳ thi như Kỳ thi Toán học Mời tuyển Hoa Kỳ (AIME).

Đánh giá năng lực lập trình của o1

Hình 3. Đánh giá năng lực lập trình của o1.

Những tiến bộ này đưa OpenAI o1 trở thành một bản nâng cấp đáng kể so với các model trước đây như GPT-4o. Model mở ra những khả năng mới cho AI trong các lĩnh vực như kinh doanh, phát triển, nghiên cứuchăm sóc sức khỏe. Ví dụ, trong nghiên cứu di truyền học, OpenAI o1 có thể nhanh chóng xem xét một số lượng lớn bài báo nghiên cứu, chọn ra các phát hiện quan trọng và mối liên hệ giữa các dấu ấn di truyền với bệnh tật. Model hiểu ngôn ngữ khoa học phức tạp và có thể tóm tắt những điểm quan trọng, giúp các nhà nghiên cứu tập trung vào thông tin phù hợp nhất.

Tìm hiểu sâu hơn về chuỗi suy nghĩ#

Trước đó, chúng ta đã thấy OpenAI o1 giới thiệu một quy trình suy luận "Chain of Thought". Quy trình này cho phép model xử lý các vấn đề phức tạp theo cách tương tự các chiến lược nhận thức của con người. Model có thể chia nhỏ thách thức thành các bước nhỏ, dễ quản lý hơn và liên tục tinh chỉnh cách tiếp cận. Không giống các model trước đây vốn dựa vào nhận dạng mẫu tức thời, o1 tối ưu hóa quá trình ra quyết định bằng cách khám phá nhiều hướng suy luận, học hỏi từ cả thành công lẫn sai lầm thông qua học tăng cường.

OpenAI đã quyết định ẩn các chuỗi suy nghĩ thô này khỏi người dùng, thay vào đó cung cấp các bản tóm tắt giúp hiểu được quá trình suy luận của model mà không tiết lộ từng bước. Quyết định này giúp ngăn chặn việc lạm dụng quy trình suy nghĩ của model, đồng thời vẫn cho phép các nhà phát triển giám sát và tinh chỉnh tính an toàn cũng như sự liên kết của AI. Bằng cách quan sát các chuỗi suy nghĩ ẩn ở bên trong, các nhà phát triển có thể đảm bảo o1 tuân thủ các hướng dẫn đạo đức và tránh hành vi gây hại.

Đánh giá OpenAI o1#

OpenAI o1 cho thấy những cải thiện lớn so với GPT-4o trong một số benchmark kiểm tra khả năng suy luận và giải quyết vấn đề. Trong Kỳ thi Toán học Mời tuyển Hoa Kỳ (AIME) 2024, một kỳ thi toán đầy thách thức dành cho những học sinh trung học hàng đầu, o1 đạt độ chính xác 74% với chỉ một mẫu cho mỗi bài toán, so với 12% của GPT-4o. Khi lấy đồng thuận trên 64 mẫu, độ chính xác tăng lên 83%, và bằng phương pháp xếp hạng lại được tinh chỉnh với 1.000 mẫu, model đạt 93%, nằm trong nhóm 500 học sinh hàng đầu trên toàn quốc.

Ngoài toán học, o1 cũng đạt kết quả đặc biệt tốt trên các benchmark kiểm tra kiến thức khoa học, như GPQA Diamond, bao quát các câu hỏi cấp độ tiến sĩ trong vật lýsinh học cùng hóa học. Đáng chú ý, o1 đã vượt qua các chuyên gia con người có bằng tiến sĩ trong bài kiểm tra này, trở thành model AI đầu tiên làm được điều đó. Model cũng vượt GPT-4o ở 54 trên 57 hạng mục trong benchmark MMLU, vốn kiểm tra mức độ hiểu biết trên nhiều chủ đề đa dạng, bao gồm lịch sử, luật và khoa học.

Đánh giá OpenAI o1

Hình 4. Đánh giá OpenAI o1.

Trải nghiệm thực tế với OpenAI o1#

OpenAI đã giới thiệu hai model AI mới trong dòng o1: o1-preview và o1-mini. Model o1-preview được thiết kế để suy nghĩ sâu hơn trước khi phản hồi, nổi bật trong các tác vụ suy luận phức tạp về khoa học, lập trình và toán học. Model này cung cấp năng lực giải quyết vấn đề nâng cao cho người dùng xử lý các dự án đầy thách thức. Ngược lại, o1-mini là một model nhỏ hơn, nhanh hơn và tiết kiệm chi phí hơn, được tối ưu riêng cho suy luận STEM, đặc biệt là toán học và lập trình. Mặc dù có thể sở hữu lượng kiến thức thế giới ít toàn diện hơn, o1-mini gần đạt hiệu năng của o1-preview trong các đánh giá quan trọng như cuộc thi toán AIME và các thử thách lập trình Codeforces, với chi phí thấp hơn 80%.

So sánh các model OpenAI

Hình 5. So sánh các model OpenAI.

Bạn có thể dùng thử các model này thông qua nhiều nền tảng OpenAI. Người dùng ChatGPT Plus và Team có thể truy cập cả o1-preview lẫn o1-mini thông qua trình chọn model, trực tiếp trải nghiệm năng lực suy luận nâng cao trong ChatGPT. Các nhà phát triển có quyền truy cập API usage tier 5 có thể bắt đầu tạo prototype với các model này, dù một số tính năng nâng cao vẫn đang được phát triển. OpenAI cũng dự định sớm cung cấp o1-mini cho tất cả người dùng ChatGPT Free. Bằng cách khám phá các model này, bạn có thể trực tiếp trải nghiệm những tiến bộ trong suy luận AI và chọn model phù hợp nhất với nhu cầu của mình.

Những cân nhắc về AI có đạo đức của OpenAI#

OpenAI đã tập trung vào đạo đức và an toàn trong quá trình phát triển dòng model o1. Trước khi phát hành các model o1-preview và o1-mini, OpenAI đã tiến hành những đánh giá kỹ lưỡng, bao gồm các bài kiểm tra bên ngoài và kiểm tra nội bộ về những rủi ro như nội dung bị cấm, hallucination và thiên kiến. Các model được thiết kế với năng lực suy luận nâng cao để hiểu và tuân thủ các quy tắc an toàn tốt hơn.

OpenAI cũng triển khai các biện pháp bảo vệ như blocklist và bộ phân loại an toàn để quản lý rủi ro. Model o1 có mức xếp hạng rủi ro tổng thể trung bình. Model có rủi ro thấp trong các lĩnh vực như an ninh mạng và tính tự chủ của model, đồng thời có rủi ro trung bình trong các lĩnh vực như nội dung CBRN (hóa học, sinh học, phóng xạ và hạt nhân) và thuyết phục. Nhóm Tư vấn An toàn và Hội đồng của OpenAI đã xem xét các biện pháp an toàn này để đảm bảo model an toàn và có đạo đức khi sử dụng.

Bảng điểm OpenAI o1

Hình 6. Bảng điểm OpenAI o1.

Từ lời đồn đến hiện thực: OpenAI o1 bước lên sân khấu#

OpenAI o1 là một bước tiến lớn trong suy luận AI, biến một số lời đồn ban đầu thành hiện thực. Không giống GPT-4o, dòng o1 suy nghĩ sâu hơn bằng cách sử dụng phương pháp "Chain of Thought", chia các vấn đề phức tạp thành những bước nhỏ hơn để đưa ra phản hồi tốt hơn. Hiện đang được cung cấp dưới dạng bản preview ban đầu trong ChatGPT và API, OpenAI dự định bổ sung các tính năng như duyệt web và tải tệp cũng như hình ảnh lên. OpenAI cũng chia sẻ rằng họ sẽ tiếp tục phát triển và phát hành các model trong dòng GPT song song với dòng OpenAI o1 mới. Khi AI tiếp tục phát triển, những tiến bộ như thế này đang mở đường cho các hệ thống AI mạnh mẽ, trực quan và linh hoạt hơn, có thể hỗ trợ và thấu hiểu nhu cầu của con người tốt hơn.

Hãy cập nhật những tin tức mới nhất về AI bằng cách tham gia cộng đồng của chúng tôi! Truy cập repository GitHub của chúng tôi để xem cách chúng tôi đang tiên phong phát triển các giải pháp AI trong những lĩnh vực như sản xuấtchăm sóc sức khỏe. 🚀

Explore solutions

Thị giác máy tính cho hình ảnh trên không

Thị giác máy tính cho hình ảnh trên không

Biến đổi hình ảnh từ máyδ bay không người lái và ảnh chụp trên không thành thông tin chi tiết thời gian thực cho nông nghiệp, nuôi trồng thủy sản, giám sát môi trường, bảo tồn và phân tích không gian địa lý với Ultralytics YOLO.
Tìm hiểu thêm
Thị giác máy tính trong hàng không vũ trụ

Thị giác máy tính trong hàng không vũ trụ

Mang thị giác AI đến với hoạt động giám sát trên không bằng các model Ultralytics YOLO. Cung cấp sức mạnh cho máy bay không người lái, quy trình hàng không vũ trụ, bảo tồn môi trường & ngành công nghiệp địa không gian với các giải pháp thị giác máy tính.
Tìm hiểu thêm

Bảo vệ mọi địa điểm bằng các model Ultralytics YOLO. Thị giác AI cung cấp sức mạnh cho việc giám sát chu vi, phát hiện mối đe dọa, nhận diện biển số xe và an toàn nơi làm việc.
Tìm hiểu thêm
Thị giác máy tính trong robotics

Thị giác máy tính trong robotics

Nâng cao năng lực cho máy móc thông minh hơn với các model Ultralytics YOLO. Vision AI trong robotics hỗ trợ điều hướng tự động, nhận thức, theo dõi đối tượng và điều khiển theo thời gian thực.
Tìm hiểu thêm
Thị giác máy tính trong logistics

Thị giác máy tính trong logistics

Tinh gọn logistics với các model Ultralytics YOLO. Vision AI hỗ trợ kiểm tra kiện hàng, phân loại, theo dõi phương tiện và giám sát an toàn kho theo thời gian thực.
Tìm hiểu thêm
Thị giác máy tính trong bán lẻ

Thị giác máy tính trong bán lẻ

Định hình lại ngành bán lẻ với các model Ultralytics YOLO. Vision AI hỗ trợ tracking hàng tồn kho, giám sát kệ hàng, quản lý hàng đợi và cung cấp insight khách hàng thông minh hơn.
Tìm hiểu thêm
Computer vision trong healthcare

Computer vision trong healthcare

Xây dựng các giải pháp healthcare với các model Ultralytics YOLO. Vision AI trong healthcare thúc đẩy chẩn đoán hình ảnh nhanh hơn, chẩn đoán thông minh hơn và giám sát bệnh nhân.
Tìm hiểu thêm
Computer vision trong sản xuất

Computer vision trong sản xuất

Tối ưu hóa sản xuất với các model Ultralytics YOLO. Vision AI thúc đẩy kiểm soát chất lượng, phát hiện lỗi, tuân thủ PPE và tự động hóa dây chuyền lắp ráp.
Tìm hiểu thêm
Computer vision trong ngành ô tô

Computer vision trong ngành ô tô

Ứng dụng computer vision trong ngành ô tô với các model Ultralytics YOLO. Vision AI nâng cao an toàn đường bộ, hỗ trợ người lái và tự động hóa phương tiện để tạo nên những tuyến đường thông minh hơn.
Tìm hiểu thêm
Computer vision trong nông nghiệp

Computer vision trong nông nghiệp

Đưa vision AI vào nông nghiệp thông minh với các model Ultralytics YOLO. Thúc đẩy giám sát cây trồng, theo dõi vật nuôi và canh tác chính xác để đạt năng suất cao hơn, thông minh hơn.
Tìm hiểu thêm
Thị giác máy tính cho hình ảnh trên không

Thị giác máy tính cho hình ảnh trên không

Biến đổi hình ảnh từ máyδ bay không người lái và ảnh chụp trên không thành thông tin chi tiết thời gian thực cho nông nghiệp, nuôi trồng thủy sản, giám sát môi trường, bảo tồn và phân tích không gian địa lý với Ultralytics YOLO.
Tìm hiểu thêm
Thị giác máy tính trong hàng không vũ trụ

Thị giác máy tính trong hàng không vũ trụ

Mang thị giác AI đến với hoạt động giám sát trên không bằng các model Ultralytics YOLO. Cung cấp sức mạnh cho máy bay không người lái, quy trình hàng không vũ trụ, bảo tồn môi trường & ngành công nghiệp địa không gian với các giải pháp thị giác máy tính.
Tìm hiểu thêm

Bảo vệ mọi địa điểm bằng các model Ultralytics YOLO. Thị giác AI cung cấp sức mạnh cho việc giám sát chu vi, phát hiện mối đe dọa, nhận diện biển số xe và an toàn nơi làm việc.
Tìm hiểu thêm
Thị giác máy tính trong robotics

Thị giác máy tính trong robotics

Nâng cao năng lực cho máy móc thông minh hơn với các model Ultralytics YOLO. Vision AI trong robotics hỗ trợ điều hướng tự động, nhận thức, theo dõi đối tượng và điều khiển theo thời gian thực.
Tìm hiểu thêm
Thị giác máy tính trong logistics

Thị giác máy tính trong logistics

Tinh gọn logistics với các model Ultralytics YOLO. Vision AI hỗ trợ kiểm tra kiện hàng, phân loại, theo dõi phương tiện và giám sát an toàn kho theo thời gian thực.
Tìm hiểu thêm
Thị giác máy tính trong bán lẻ

Thị giác máy tính trong bán lẻ

Định hình lại ngành bán lẻ với các model Ultralytics YOLO. Vision AI hỗ trợ tracking hàng tồn kho, giám sát kệ hàng, quản lý hàng đợi và cung cấp insight khách hàng thông minh hơn.
Tìm hiểu thêm
Computer vision trong healthcare

Computer vision trong healthcare

Xây dựng các giải pháp healthcare với các model Ultralytics YOLO. Vision AI trong healthcare thúc đẩy chẩn đoán hình ảnh nhanh hơn, chẩn đoán thông minh hơn và giám sát bệnh nhân.
Tìm hiểu thêm
Computer vision trong sản xuất

Computer vision trong sản xuất

Tối ưu hóa sản xuất với các model Ultralytics YOLO. Vision AI thúc đẩy kiểm soát chất lượng, phát hiện lỗi, tuân thủ PPE và tự động hóa dây chuyền lắp ráp.
Tìm hiểu thêm
Computer vision trong ngành ô tô

Computer vision trong ngành ô tô

Ứng dụng computer vision trong ngành ô tô với các model Ultralytics YOLO. Vision AI nâng cao an toàn đường bộ, hỗ trợ người lái và tự động hóa phương tiện để tạo nên những tuyến đường thông minh hơn.
Tìm hiểu thêm
Computer vision trong nông nghiệp

Computer vision trong nông nghiệp

Đưa vision AI vào nông nghiệp thông minh với các model Ultralytics YOLO. Thúc đẩy giám sát cây trồng, theo dõi vật nuôi và canh tác chính xác để đạt năng suất cao hơn, thông minh hơn.
Tìm hiểu thêm
Thị giác máy tính cho hình ảnh trên không

Thị giác máy tính cho hình ảnh trên không

Biến đổi hình ảnh từ máyδ bay không người lái và ảnh chụp trên không thành thông tin chi tiết thời gian thực cho nông nghiệp, nuôi trồng thủy sản, giám sát môi trường, bảo tồn và phân tích không gian địa lý với Ultralytics YOLO.
Tìm hiểu thêm
Thị giác máy tính trong hàng không vũ trụ

Thị giác máy tính trong hàng không vũ trụ

Mang thị giác AI đến với hoạt động giám sát trên không bằng các model Ultralytics YOLO. Cung cấp sức mạnh cho máy bay không người lái, quy trình hàng không vũ trụ, bảo tồn môi trường & ngành công nghiệp địa không gian với các giải pháp thị giác máy tính.
Tìm hiểu thêm

Bảo vệ mọi địa điểm bằng các model Ultralytics YOLO. Thị giác AI cung cấp sức mạnh cho việc giám sát chu vi, phát hiện mối đe dọa, nhận diện biển số xe và an toàn nơi làm việc.
Tìm hiểu thêm
Thị giác máy tính trong robotics

Thị giác máy tính trong robotics

Nâng cao năng lực cho máy móc thông minh hơn với các model Ultralytics YOLO. Vision AI trong robotics hỗ trợ điều hướng tự động, nhận thức, theo dõi đối tượng và điều khiển theo thời gian thực.
Tìm hiểu thêm
Thị giác máy tính trong logistics

Thị giác máy tính trong logistics

Tinh gọn logistics với các model Ultralytics YOLO. Vision AI hỗ trợ kiểm tra kiện hàng, phân loại, theo dõi phương tiện và giám sát an toàn kho theo thời gian thực.
Tìm hiểu thêm
Thị giác máy tính trong bán lẻ

Thị giác máy tính trong bán lẻ

Định hình lại ngành bán lẻ với các model Ultralytics YOLO. Vision AI hỗ trợ tracking hàng tồn kho, giám sát kệ hàng, quản lý hàng đợi và cung cấp insight khách hàng thông minh hơn.
Tìm hiểu thêm
Computer vision trong healthcare

Computer vision trong healthcare

Xây dựng các giải pháp healthcare với các model Ultralytics YOLO. Vision AI trong healthcare thúc đẩy chẩn đoán hình ảnh nhanh hơn, chẩn đoán thông minh hơn và giám sát bệnh nhân.
Tìm hiểu thêm
Computer vision trong sản xuất

Computer vision trong sản xuất

Tối ưu hóa sản xuất với các model Ultralytics YOLO. Vision AI thúc đẩy kiểm soát chất lượng, phát hiện lỗi, tuân thủ PPE và tự động hóa dây chuyền lắp ráp.
Tìm hiểu thêm
Computer vision trong ngành ô tô

Computer vision trong ngành ô tô

Ứng dụng computer vision trong ngành ô tô với các model Ultralytics YOLO. Vision AI nâng cao an toàn đường bộ, hỗ trợ người lái và tự động hóa phương tiện để tạo nên những tuyến đường thông minh hơn.
Tìm hiểu thêm
Computer vision trong nông nghiệp

Computer vision trong nông nghiệp

Đưa vision AI vào nông nghiệp thông minh với các model Ultralytics YOLO. Thúc đẩy giám sát cây trồng, theo dõi vật nuôi và canh tác chính xác để đạt năng suất cao hơn, thông minh hơn.
Tìm hiểu thêm

Hãy cùng xây dựng tương lai của AI!

Bắt đầu hành trình của bạn với tương lai của machine learning