OpenAIは正式に GPT-4.1 GPT-4.1、GPT-4.1 mini、GPT-4.1 nanoで構成されるモデルファミリーは、APIプラットフォームを介して利用可能です。実世界におけるパフォーマンス向上を目指して設計されたこれらのモデルは、コーディング、命令追跡、ロングコンテキスト理解において大幅な改善を実現しながら、従来のモデルに比べて大幅に低いコストとレイテンシで動作します。
この発表は段階的な廃止に向けた決定的な動きを示している GPT-4.5 プレビューOpenAIは14年2025月4.1日を終了日と定めています。GPT-XNUMXは現在、同社の主力API専用モデルとして、優れたパフォーマンスと価格の両面で優位性を提供しています。

コーディング機能の再考
GPT-4.1は、SWE-bench Verifiedにおいて、これまでのすべてのGPTモデルを凌駕する性能を示し、タスクの54.6%を達成しました。これはGPT-21oと比べて4ポイントの飛躍です。このモデルは、特に大規模なコードファイルの編集や差分形式のパッチ生成において、実世界のソフトウェアエンジニアリングにおいて優れた性能を発揮します。
Aiderのpolyglotなどのベンチマークは、GPT-4.1の多言語コーディングタスクにおける優れた性能を実証しています。このモデルは、差分生成において52%以上の精度を達成し、GPT-4oのスコアを4.5倍にし、GPT-32,768を上回りました。開発者は、出力トークンの制限(最大XNUMXトークン)の拡張や、最適化されたプロンプト表示による反復サイクルの高速化も利用できます。
「GPT-4.1は、特にデバッグ、リファクタリング、リアルタイムコード生成において、エンジニアにとって画期的な体験を提供します」と、OpenAIのアルファパートナーのXNUMXつであるWindsurfの開発者は述べています。
より鋭い指示追従と応答忠実度
38.3%のスコアで ScaleGPT-10.5は、MultiChallengeベンチマークでGPT-4oより4.1%高い精度を記録し、ニュアンスのある複数ステップの指示の理解力の向上が際立っています。OpenAI独自の指示追従テストでは、ハードプロンプトで49.1%の精度を記録し、競合他社を大きく上回りました。
このモデルは、順序付けられた条件付きフォーマット固有の指示を解析して従うことができるため、税務コンプライアンス (Blue J で確認) やデータベース クエリ (Hex でのパフォーマンスで実証) などのエンタープライズ アプリケーションで非常に効果的です。
革命的なロングコンテキスト:最大1万トークン
GPT-4.1は、最大1万トークン(Reactコードベース4.1個分に相当する)という画期的なコンテキストウィンドウを導入します。OpenAI-MRCRやGraphwalksといった新たな評価手法により、GPT-4は膨大なドキュメントにわたる検索とマルチホップ推論の両方が可能であることが証明され、あらゆる状況とテストにおいてGPT-XNUMXoを上回る性能を発揮しました。
Thomson Reuters や Carlyle などのパートナーは、複雑な法的ワークフローから複数形式のファイルからの財務データの抽出まで、精度と文書分析において大きな進歩が報告されています。
「GPT-4.1により、最小限の監視で数十の文書にわたる法的契約を処理できるようになります」とトムソン・ロイターの担当者は述べています。
MiniとNano:速度とコストの限界を超えたパフォーマンス
- GPT-4.1 mini は GPT-4o のインテリジェンスに匹敵しますが、レイテンシをほぼ半分に短縮し、コストを 83% 削減します。
- GPT-4.1 nano はこれまでで最も高速かつ安価なモデルであり、分類やオートコンプリートタスクに最適で、MMLU で 80.1%、GPQA で 50.3% という優れたスコアを獲得しています。
これらのモデルにより、大規模な高パフォーマンスが実現され、最大 1 万のトークン コンテキストがサポートされ、大規模なプロンプトに対して 5 秒という高速な応答時間を実現します。
マルチモーダルと視覚的理解の強化
ビジュアルベンチマークでも大きな改善が見られました。MMMUやMathVistaなどのテストでは、GPT-4.1 miniとnanoはGPT-4oを上回り、GPT-4.5に匹敵する性能を示しました。これらのモデルは、教育、研究、分析といったユースケースにおいて極めて重要な、グラフ、数式、科学論文の解釈に優れています。
価格と出荷時期
GPT-4.1シリーズ全体がOpenAI APIで利用可能になりました。Batch APIも含め、50%割引でご利用いただけます。1万トークンあたりの価格の内訳は以下のとおりです。
| モデル | 入力 | キャッシュされた入力 | 出力 | ブレンド価格設定 |
|---|---|---|---|---|
| GPT-4.1 | $2.00 | $0.50 | $8.00 | $1.84 |
| GPT-4.1 ミニ | $0.40 | $0.10 | $1.60 | $0.42 |
| GPT-4.1ナノ | $0.10 |
プロンプト キャッシングの割引が 75% に増加し、開発者はパフォーマンスとコストの両方を最適化できるようになりました。
次は何ですか?
GPT-4.1のコード生成、長文脈推論、指示追従、そして視覚における改善により、OpenAIはより堅牢なエージェントアプリケーションへの道を切り開きます。同社は、GPT-4.5およびそれ以前のバージョンから得られた知見を、進化を続けるモデルスイートに継続的に取り入れていく予定です。
GPT-4.5 プレビューが終了するため、開発者はワークロードを GPT-4.1 に移行して、強化された機能と運用コストの削減のメリットを享受することが強く推奨されます。
「GPT-4.1は、私たちが待ち望んでいた実用的なAIの飛躍です」と、 Qodo「よりスマートで、より高速で、今日の開発者が直面している課題にさらに適合しています。」