OpenAI o1: Mở ra kỷ nguyên mới của lý luận AI

Tháng Chín 13, 2024

Gã khổng lồ trí tuệ nhân tạo đẩy mạnh ranh giới với các mô hình giải quyết vấn đề nâng cao

Trong bước tiến đáng kể về trí tuệ nhân tạo, OpenAI đã giới thiệu những mô hình đầu tiên trong loạt 'o1' mang tính đột phá của mình. Những mô hình này được thiết kế để nâng cao khả năng suy luận của AI, cho phép chúng giải quyết các vấn đề phức tạp với hiệu quả chưa từng có.

OpenAI o1

Một mô hình mới trong lý luận AI

Dòng o1 đại diện cho sự thay đổi mô hình trong phát triển AI, ưu tiên cách tiếp cận thận trọng và chu đáo hơn để giải quyết vấn đề. Các mô hình này, tương tự như nhận thức của con người, được đào tạo để 'suy nghĩ' trước khi phản hồi, mô phỏng quá trình tinh chỉnh suy nghĩ, khám phá các chiến lược đa dạng và học hỏi từ các lỗi.

Hiệu suất vô song trong các miền phức tạp

Quá trình thử nghiệm nghiêm ngặt của OpenAI đã tiết lộ khả năng đáng chú ý của o1. Bản cập nhật mô hình sắp tới, hiện đang trong quá trình phát triển, chứng minh hiệu suất ngang bằng với các nghiên cứu sinh tiến sĩ trong các nhiệm vụ chuẩn đầy thử thách trong lĩnh vực vật lý, hóa học và sinh học. Ngoài ra, o1 còn thể hiện năng lực đặc biệt về toán học và mã hóa. Trong kỳ thi tuyển chọn cho Kỳ thi Olympic Toán quốc tế (IMO), mô hình GPT-4o hiện tại đạt tỷ lệ thành công 13%, trong khi mô hình o1 đạt điểm ấn tượng 83%. Hơn nữa, khả năng mã hóa của o1 đã được đánh giá trong các cuộc thi mã hóa cạnh tranh, nơi nó đạt đến phần trăm thứ 89.

Xem trước sớm với tiềm năng đầy hứa hẹn

Mặc dù o1-preview là phiên bản đầu tiên, nhưng nó vẫn thiếu một số tính năng giúp Chat thân thiện với người dùng, chẳng hạn như duyệt web, tải tệp lên và xử lý hình ảnh. Đối với nhiều tác vụ thông thường, GPT-4o vẫn là lựa chọn tốt hơn trong ngắn hạn.

Tuy nhiên, o1 biểu thị một bước tiến đáng kể trong khả năng xử lý các tác vụ lý luận phức tạp của AI, báo hiệu một cấp độ mới về khả năng của AI. Bước đột phá này đã thúc đẩy OpenAI thiết lập lại bộ đếm mô hình của mình, chỉ định loạt này là 'OpenAI o1'.

An toàn là mối quan tâm hàng đầu

OpenAI đã triển khai một phương pháp đào tạo an toàn mới tận dụng khả năng lý luận của o1 để đảm bảo tuân thủ các nguyên tắc về an toàn và liên kết. Bằng cách cho phép o1 lý luận về các quy tắc an toàn theo ngữ cảnh, nó có thể áp dụng chúng hiệu quả hơn.

OpenAI đo lường mức độ an toàn thông qua nhiều phương pháp khác nhau, bao gồm kiểm tra mức độ các mô hình chống lại các nỗ lực vượt qua các quy tắc an toàn, được gọi là 'bẻ khóa'. Trong một trong những bài kiểm tra bẻ khóa đầy thử thách nhất, GPT-4o đạt 22 điểm (trên thang điểm từ 0-100), trong khi mô hình xem trước o1 đạt điểm cao hơn đáng kể là 84.

Các biện pháp an toàn được tăng cường

Để bổ sung cho các khả năng nâng cao của các mô hình này, OpenAI đã củng cố các giao thức an toàn, quản trị nội bộ và hợp tác với các chính phủ liên bang. Các biện pháp này bao gồm thử nghiệm và đánh giá nghiêm ngặt bằng Khung chuẩn bị, nhóm đỏ tốt nhất trong lớp và các quy trình đánh giá cấp hội đồng quản trị, bao gồm cả sự giám sát của Ủy ban An toàn & Bảo mật của họ.

Hợp tác vì sự an toàn của AI

OpenAI đã chính thức ký kết thỏa thuận với Viện An toàn AI của Hoa Kỳ và Vương quốc Anh, cấp cho họ quyền truy cập sớm vào phiên bản nghiên cứu của mô hình o1. Nỗ lực hợp tác này nhằm mục đích thiết lập một quy trình mạnh mẽ để nghiên cứu, đánh giá và thử nghiệm các mô hình trong tương lai, cả trước và sau khi phát hành công khai.

Ứng dụng trong nhiều lĩnh vực khác nhau

Khả năng lập luận nâng cao của o1 có tiềm năng to lớn trong việc giải quyết các vấn đề phức tạp trên nhiều lĩnh vực, bao gồm khoa học, mã hóa, toán học và các lĩnh vực liên quan. Các nhà nghiên cứu chăm sóc sức khỏe có thể tận dụng o1 để chú thích dữ liệu giải trình tự tế bào, các nhà vật lý có thể tạo ra các công thức toán học phức tạp cho quang học lượng tử và các nhà phát triển trên mọi lĩnh vực có thể xây dựng và thực hiện quy trình làm việc nhiều bước.

OpenAI o1-mini: Một giải pháp thay thế tiết kiệm chi phí

Dòng o1 nổi trội trong việc tạo và gỡ lỗi mã phức tạp một cách chính xác. Để phục vụ cho các nhà phát triển đang tìm kiếm một giải pháp hiệu quả hơn, OpenAI cũng đã phát hành o1-mini, một mô hình suy luận nhanh hơn và giá cả phải chăng hơn, đặc biệt thành thạo trong các tác vụ mã hóa. Với chi phí thấp hơn 80% so với o1-preview, o1-mini cung cấp một tùy chọn hấp dẫn cho các ứng dụng yêu cầu khả năng suy luận mà không cần kiến ​​thức sâu rộng về thế giới.

Truy cập và khả dụng

Người dùng Chat Plus và Team có thể truy cập các mô hình o1 trong Chat kể từ hôm nay. Cả o1-preview và o1-mini đều có thể được chọn thủ công trong trình chọn mô hình. Ban đầu, giới hạn tốc độ hàng tuần sẽ là 30 tin nhắn cho o1-preview và 50 tin nhắn cho o1-mini. OpenAI đang tích cực nỗ lực để tăng giới hạn này và cho phép Chat tự động chọn mô hình phù hợp cho một lời nhắc nhất định.

Người dùng Chat Enterprise và Edu sẽ được truy cập vào cả hai mô hình vào tuần tới. Các nhà phát triển đủ điều kiện sử dụng API bậc 5 có thể bắt đầu tạo nguyên mẫu với cả hai mô hình trong API ngay hôm nay, với giới hạn tốc độ là 20 RPM. OpenAI có kế hoạch tăng giới hạn này sau khi thử nghiệm bổ sung.

OpenAI cũng có ý định mở rộng quyền truy cập o1-mini cho tất cả người dùng Chat Free.

Phát triển trong tương lai

Bản phát hành này đánh dấu bản xem trước sớm của các mô hình suy luận o1 trong Chat và API. OpenAI dự định giới thiệu tính năng duyệt, tải tệp và hình ảnh, cùng các tính năng khác để nâng cao tiện ích cho tất cả người dùng. Hơn nữa, họ cam kết tiếp tục phát triển và phát hành các mô hình trong cả dòng GPT và OpenAI o1.

Kết luận

Việc OpenAI giới thiệu dòng o1 đánh dấu một cột mốc đáng chú ý trong quá trình phát triển của trí tuệ nhân tạo. Bằng cách tập trung vào khả năng lý luận nâng cao và ưu tiên sự an toàn, OpenAI đang mở đường cho một tương lai mà AI có thể giải quyết những thách thức ngày càng phức tạp và đóng góp có ý nghĩa vào nhiều lĩnh vực nỗ lực khác nhau của con người.