OpenAI Structured Outputs: Cách mạng hóa độ tin cậy của API

Tháng Tám 8, 2024

OpenAI đã công bố một tính năng đột phá có tên là Structured Outputs, nhằm mục đích tăng cường độ tin cậy của các đầu ra mô hình API. Đổi mới này cho phép các nhà phát triển cung cấp các JSON Schema cụ thể, đảm bảo rằng các đầu ra do AI tạo ra luôn tuân thủ theo cấu trúc mong muốn.

Đầu ra có cấu trúc OpenAI

Giải quyết thách thức dữ liệu phi cấu trúc

Trong lĩnh vực ứng dụng AI, việc chuyển đổi dữ liệu phi cấu trúc thành các định dạng có cấu trúc là một trường hợp sử dụng then chốt. API của OpenAI đã đóng vai trò quan trọng trong việc xây dựng các trợ lý AI tinh vi có khả năng truy xuất dữ liệu, trả lời truy vấn và thực hiện hành động. Tuy nhiên, các nhà phát triển từ lâu đã vật lộn với những hạn chế của LLM trong việc tạo ra các đầu ra có cấu trúc một cách đáng tin cậy.

Đầu ra có cấu trúc giải quyết trực tiếp thách thức này bằng cách đào tạo các mô hình để hiểu rõ hơn các lược đồ phức tạp và hạn chế chúng phù hợp với các cấu trúc do nhà phát triển xác định. Điều này giúp loại bỏ nhu cầu giải pháp thay thế và cải thiện đáng kể độ tin cậy của kết quả do AI tạo ra.

Độ tin cậy vô song: gpt-4o-2024-08-06

Mô hình mới nhất của OpenAI, gpt-4o-2024-08-06, được trang bị Structured Outputs, tự hào đạt điểm 100% hoàn hảo trong các đánh giá về sự tuân thủ lược đồ JSON phức tạp. Điều này trái ngược hoàn toàn với điểm dưới 40% của mô hình tiền nhiệm, gpt-4-0613, cho thấy sự cải thiện đáng kể về độ tin cậy.

Tích hợp liền mạch dành cho nhà phát triển

OpenAI cung cấp hai cách riêng biệt để tận dụng Đầu ra có cấu trúc trong API:

  1. Gọi hàm: Nhà phát triển có thể kích hoạt Kết quả đầu ra có cấu trúc bằng cách đặt strict: true trong định nghĩa hàm của họ. Điều này áp dụng cho tất cả các kiểu máy tương thích với các công cụ, bao gồm gpt-4-0613, gpt-3.5-turbo-0613 và các phiên bản mới hơn.
  2. Định dạng phản hồi: Một tùy chọn mới, json_schema, được giới thiệu cho tham số reply_format, cho phép các nhà phát triển cung cấp trực tiếp Lược đồ JSON. Điều này đặc biệt có lợi khi mô hình phản hồi trực tiếp cho người dùng theo cách có cấu trúc và được hỗ trợ bởi các mô hình GPT-4o mới nhất.

Bảo vệ sự an toàn của người dùng

Ưu tiên sự an toàn, OpenAI đã thiết kế Structured Outputs để phù hợp với các giao thức an toàn hiện có. Mô hình vẫn giữ khả năng từ chối các yêu cầu không an toàn và giá trị chuỗi từ chối mới trong phản hồi API cho phép các nhà phát triển xác định các từ chối đó theo chương trình.

Trao quyền cho nhà phát triển với hỗ trợ SDK gốc

Python và Node SDK của OpenAI đã được cập nhật để hỗ trợ Structured Outputs gốc. Điều này giúp đơn giản hóa quy trình cho các nhà phát triển bằng cách tự động xử lý chuyển đổi lược đồ, hủy tuần tự hóa phản hồi và phân tích cú pháp từ chối.

Ứng dụng đa dạng: Khai phá tiềm năng

Kết quả đầu ra có cấu trúc tìm thấy các ứng dụng trong nhiều lĩnh vực khác nhau, chẳng hạn như tạo giao diện người dùng động, trích xuất dữ liệu có cấu trúc từ các nguồn phi cấu trúc và tách biệt hiệu quả các câu trả lời cuối cùng khỏi lý luận hỗ trợ. Những trường hợp sử dụng linh hoạt này chứng tỏ tiềm năng của tính năng này trong việc chuyển đổi hoạt động phát triển AI trên nhiều lĩnh vực.

Hậu trường: Sức mạnh của việc giải mã ràng buộc

Phương pháp của OpenAI kết hợp đào tạo mô hình với một kỹ thuật kỹ thuật xác định được gọi là giải mã ràng buộc. Bằng cách chuyển đổi JSON Schema được cung cấp thành ngữ pháp không ngữ cảnh (CFG), mô hình bị hạn chế trong việc tạo ra các mã thông báo tuân thủ các quy tắc của lược đồ. Ràng buộc động này đảm bảo tạo ra các đầu ra JSON hợp lệ, giảm thiểu lỗi.

Bước nhảy vọt về độ tin cậy của AI

Structured Outputs đại diện cho bước tiến đáng kể trong việc nâng cao độ tin cậy và khả năng sử dụng API của OpenAI. Bằng cách trao quyền cho các nhà phát triển khả năng kiểm soát chi tiết đối với các cấu trúc đầu ra, OpenAI đang mở đường cho một thế hệ ứng dụng AI mạnh mẽ và đáng tin cậy mới.