人工知能の巨人、問題解決モデルの強化で限界を押し上げる
OpenAI は、人工知能の大きな飛躍として、画期的な「o1」シリーズの最初のモデルを発表しました。これらのモデルは、AI の推論能力を高めるように設計されており、これまでにない効率で複雑な問題に取り組むことができます。

AI推論における新たなパラダイム
o1 シリーズは、AI 開発におけるパラダイム シフトを表しており、問題解決に対してより慎重で思慮深いアプローチを優先しています。人間の認知に似たこれらのモデルは、反応する前に「考える」ようにトレーニングされており、思考を洗練し、多様な戦略を模索し、エラーから学習するプロセスをシミュレートします。
複雑な領域における比類のないパフォーマンス
OpenAI の厳格なテストにより、o1 の優れた能力が明らかになりました。現在開発中の次のモデル アップデートでは、物理学、化学、生物学のさまざまな分野の難しいベンチマーク タスクで博士課程の学生と同等のパフォーマンスを発揮します。さらに、o1 は数学とコーディングにおいて並外れた能力を発揮します。国際数学オリンピック (IMO) の予選試験では、既存の GPT-4o モデルの合格率は 13% でしたが、o1 モデルは 83% という驚異的なスコアを獲得しました。さらに、o1 のコーディング能力は競争力のあるコーディング コンテストで評価され、89 パーセンタイルに達しました。
有望な可能性を秘めた早期プレビュー
o1-previewはまだ初期段階ですが、Webブラウジング、ファイルアップロード、画像処理など、Chatのユーザーフレンドリーな機能の一部が欠けています。多くの一般的なタスクにおいては、短期的にはGPT-4oの方がより優れた選択肢です。
それでも、o1 は複雑な推論タスクを処理する AI の能力の大きな進歩を意味し、AI の能力が新たなレベルに達することを告げています。この画期的な進歩により、OpenAI はモデル カウンターをリセットし、このシリーズを「OpenAI o1」と命名しました。
安全性を最優先
OpenAI は、o1 の推論機能を活用して安全性とアライメントのガイドラインの遵守を保証する、新しい安全性トレーニング アプローチを実装しました。o1 が状況に応じて安全ルールを推論できるようにすることで、より効果的にルールを適用できます。
OpenAIは、モデルが安全規則を迂回する試み(いわゆる「脱獄」)にどれだけ抵抗できるかをテストするなど、さまざまな方法で安全性を測定している。最も難しい脱獄テストの1つでは、 GPT-4o スコアは 22 (0 ~ 100 のスケール) でしたが、o1-preview モデルは大幅に高い 84 を獲得しました。
強化された安全対策
これらのモデルの強化された機能を補完するために、OpenAI は安全プロトコル、内部ガバナンス、連邦政府との連携を強化しました。これらの対策には、準備フレームワークを使用した厳格なテストと評価、クラス最高のレッドチーム、安全およびセキュリティ委員会による監督を含む取締役会レベルのレビュー プロセスが含まれます。
AIの安全性のためのコラボレーション
OpenAI は米国および英国の AI Safety Institute と正式な契約を締結し、o1 モデルの研究バージョンへの早期アクセスを許可しました。この共同作業の目的は、一般公開前と公開後の両方で、将来のモデルの研究、評価、テストのための堅牢なプロセスを確立することです。
多様な分野への応用
o1 の強化された推論機能は、科学、コーディング、数学、および関連分野を含むさまざまなドメインにわたる複雑な問題に取り組むための大きな可能性を秘めています。医療研究者は o1 を活用して細胞配列データに注釈を付けることができ、物理学者は量子光学のための複雑な数式を生成でき、あらゆる分野の開発者は複数ステップのワークフローを構築して実行できます。
OpenAI o1-mini: コスト効率の高い代替手段
o1シリーズは、複雑なコードを正確に生成しデバッグするのに優れています。より効率的なソリューションを求める開発者に応えるために、OpenAIは o1-miniは、コーディング タスクに特に適した、より高速で手頃な価格の推論モデルです。o80-preview よりも 1% 低いコストで、o1-mini は、広範な世界知識を必要とせずに推論機能を必要とするアプリケーションにとって魅力的なオプションを提供します。
アクセスと可用性
Chat PlusおよびTeamユーザーは、本日よりChatでo1モデルをご利用いただけます。o1-previewとo1-miniはどちらもモデルピッカーで手動で選択できます。当初、週あたりのレート制限はo1-previewで30件、o1-miniで50件です。OpenAIはこれらの制限を引き上げ、Chatが特定のプロンプトに対して適切なモデルを自動的に選択できるように積極的に取り組んでいます。
Chat EnterpriseおよびEduのユーザーは、来週から両モデルにアクセスできるようになります。API使用ティア5の要件を満たす開発者は、20 RPMのレート制限を条件に、本日よりAPIで両モデルのプロトタイプ作成を開始できます。OpenAIは、追加テストを経て、これらの制限を緩和する予定です。
OpenAI は、o1-mini のアクセスをすべての Chat Free ユーザーに拡張する予定です。
今後の展開
このリリースは、ChatとAPIにおけるo1推論モデルの早期プレビューとなります。OpenAIは、ブラウジング、ファイルと画像のアップロード、その他すべてのユーザーにとっての利便性向上のための機能を導入する予定です。さらに、GPTシリーズとOpenAI o1シリーズの両方において、モデルの継続的な開発とリリースに取り組んでいます。
結論
OpenAI による o1 シリーズの導入は、人工知能の進化における画期的な出来事です。推論機能の強化に重点を置き、安全性を優先することで、OpenAI は AI がますます複雑化する課題に取り組み、人間のさまざまな活動分野に有意義に貢献できる未来への道を切り開いています。