OpenAI lance l'API GPT-4.1 avec des fonctionnalités révolutionnaires

15 avril 2025

OpenAI a officiellement lancé le GPT-4.1 Famille de modèles, comprenant GPT-4.1, GPT-4.1 mini et GPT-4.1 nano via sa plateforme API. Conçus pour des performances réelles, ces modèles offrent des améliorations significatives en matière de codage, de suivi des instructions et de compréhension du contexte long, tout en fonctionnant à un coût et une latence bien inférieurs à ceux des modèles précédents.

Ce lancement marque une décision décisive visant à éliminer progressivement Aperçu de GPT-4.5, avec OpenAI fixant une date de fin au 14 juillet 2025. GPT-4.1 est désormais le modèle phare de l'entreprise, basé uniquement sur API, offrant à la fois des performances supérieures et des avantages tarifaires.

GPT-4.1

Capacités de codage réinventées

GPT-4.1 surpasse tous les modèles GPT précédents sur SWE-bench Verified, réalisant 54.6 % des tâches, soit une amélioration de 21 points par rapport à GPT-4o. Ce modèle excelle en ingénierie logicielle concrète, notamment lors de l'édition de fichiers de code volumineux ou de la génération de correctifs au format diff.

Des benchmarks comme le modèle polyglotte d'Aider confirment les prouesses de GPT-4.1 dans les tâches de codage multilingue. Le modèle atteint une précision de plus de 52 % dans la génération de différences, doublant ainsi le score de GPT-4o et surpassant celui de GPT-4.5. Les développeurs peuvent également tirer parti des limites de jetons de sortie étendues (jusqu'à 32,768 XNUMX jetons) et utiliser des invites optimisées pour des cycles d'itération plus rapides.

« GPT-4.1 offre une expérience révolutionnaire pour les ingénieurs, notamment en matière de débogage, de refactorisation et de génération de code en temps réel », a déclaré un développeur de Windsurf, l'un des partenaires alpha d'OpenAI.

Suivi des instructions plus précis et fidélité des réponses

Avec un score de 38.3% sur ScaleLe benchmark MultiChallenge de GPT-10.5, supérieur de 4 % à celui de GPT-4.1o, se distingue par une meilleure compréhension des instructions nuancées et en plusieurs étapes. Lors des tests de suivi d'instructions d'OpenAI, il a enregistré une précision de 49.1 % sur les instructions difficiles, surpassant ainsi largement ses concurrents.

La capacité du modèle à analyser et à suivre des instructions ordonnées, conditionnelles et spécifiques au format le rend très efficace dans les applications d'entreprise telles que la conformité fiscale (comme on le voit avec Blue J) et l'interrogation de bases de données (comme en témoignent les performances chez Hex).

Contexte révolutionnaire long : jusqu'à 1 million de jetons

GPT-4.1 introduit une fenêtre contextuelle révolutionnaire pouvant atteindre un million de jetons, soit environ la taille de huit bases de code React complètes. Grâce à de nouvelles évaluations comme OpenAI-MRCR et Graphwalks, GPT-1 a démontré sa capacité à récupérer et à effectuer un raisonnement multi-sauts sur de vastes documents, surpassant GPT-4.1o dans tous les tests et positions.

Des partenaires comme Thomson Reuters et Carlyle signalent des gains majeurs en termes de précision et d'analyse de documents, depuis les flux de travail juridiques complexes jusqu'à l'extraction de données financières à partir de fichiers multiformats.

« GPT-4.1 nous permet de traiter des contrats juridiques sur des dizaines de documents avec une supervision minimale », a noté un représentant de Thomson Reuters.

Mini et Nano : des performances à la limite de la vitesse et du coût

  • GPT-4.1 mini correspond à l'intelligence de GPT-4o mais réduit la latence de près de moitié et réduit les coûts de 83 %.
  • GPT-4.1 nano est le modèle le plus rapide et le moins cher à ce jour, idéal pour les tâches de classification et de saisie semi-automatique, avec des scores impressionnants : 80.1 % sur MMLU et 50.3 % sur GPQA.

Ces modèles permettent des performances élevées à grande échelle, prenant en charge jusqu'à 1 million de contextes de jetons avec des temps de réponse aussi rapides que 5 secondes pour les invites volumineuses.

Compréhension multimodale et visuelle améliorée

Les benchmarks visuels montrent également des améliorations majeures. Lors de tests comme MMMU et MathVista, GPT-4.1 mini et nano surpassent GPT-4 et rivalisent même avec GPT-4.5. Ces modèles excellent dans l'interprétation de graphiques, de diagrammes mathématiques et d'articles scientifiques, essentiels pour l'éducation, la recherche et l'analyse.

Prix ​​et disponibilité

L'intégralité de la série GPT-4.1 est désormais disponible dans l'API OpenAI, y compris via l'API Batch, avec une remise supplémentaire de 50 %. Voici la répartition des prix par million de jetons :

Modèle Entrée Entrée mise en cache Sortie Tarification mixte
GPT-4.1 $2.00 $0.50 $8.00 $1.84
GPT-4.1 mini $0.40 $0.10 $1.60 $0.42
GPT-4.1 nano $0.10

Les remises sur la mise en cache rapide ont augmenté jusqu'à 75 %, permettant aux développeurs d'optimiser à la fois les performances et les coûts.

Quelle est la prochaine étape?

Grâce aux améliorations apportées par GPT-4.1 en matière de génération de code, de raisonnement en contexte long, de suivi des instructions et de vision, OpenAI ouvre la voie à des applications agentiques plus robustes. L'entreprise prévoit de continuer à intégrer les enseignements tirés de GPT-4.5 et des versions antérieures à sa suite de modèles en constante évolution.

Alors que la version préliminaire de GPT-4.5 touche à sa fin, les développeurs sont invités à migrer leurs charges de travail vers GPT-4.1 pour bénéficier de ses capacités améliorées et de ses coûts opérationnels réduits.

« GPT-4.1 est le saut pratique de l'IA que nous attendions », a déclaré un chef de produit chez Qodo« C'est plus intelligent, plus rapide et mieux adapté aux défis auxquels les développeurs sont confrontés aujourd'hui. »