OpenAI, 획기적인 기능을 갖춘 GPT-4.1 API 출시

15년 2025월 XNUMX일

OpenAI가 공식적으로 출시되었습니다. GPT-4.1 API 플랫폼을 통해 GPT-4.1, GPT-4.1 mini, GPT-4.1 nano로 구성된 모델 패밀리를 제공합니다. 실제 성능을 위해 설계된 이 모델은 코딩, 명령어 수행, 그리고 긴 맥락 이해 측면에서 상당한 개선을 제공하는 동시에 이전 모델보다 훨씬 낮은 비용과 지연 시간으로 작동합니다.

이번 발사는 단계적 폐지를 위한 결정적인 움직임을 의미합니다. GPT-4.5 미리보기OpenAI는 14년 2025월 4.1일을 서비스 종료일로 정했습니다. 현재 GPT-XNUMX은 OpenAI의 주력 API 전용 모델로 자리매김하여 뛰어난 성능과 가격 경쟁력을 모두 제공합니다.

GPT-4.1

재구성된 코딩 기능

GPT-4.1은 SWE-bench Verified에서 이전 GPT 모델들을 모두 능가하는 성능을 보이며, 작업 완료율 54.6%를 기록하여 GPT-21o보다 4%p 향상되었습니다. 이 모델은 실제 소프트웨어 엔지니어링, 특히 대용량 코드 파일을 편집하거나 diff 형식으로 패치를 생성할 때 탁월한 성능을 발휘합니다.

Aider의 다국어 지원과 같은 벤치마크는 GPT-4.1의 다국어 코딩 작업 능력을 입증합니다. 이 모델은 차이 생성에서 52% 이상의 정확도를 달성하여 GPT-4o의 점수를 두 배로 높이고 GPT-4.5를 능가했습니다. 개발자는 확장된 출력 토큰 제한(최대 32,768개 토큰)을 활용하고 최적화된 프롬프트를 사용하여 반복 주기를 단축할 수 있습니다.

OpenAI의 알파 파트너 중 하나인 Windsurf의 한 개발자는 "GPT-4.1은 특히 디버깅, 리팩토링, 실시간 코드 생성 측면에서 엔지니어에게 획기적인 경험을 제공합니다."라고 말했습니다.

더 날카로운 지시 따르기 및 응답 충실도

38.3%의 점수로 ScaleOpenAI의 MultiChallenge 벤치마크에서 GPT-10.5o보다 4% 높은 GPT-4.1은 미묘한 다단계 명령에 대한 이해도가 향상된 것이 특징입니다. OpenAI의 자체 명령 수행 테스트에서 하드 프롬프트에 대한 정확도는 49.1%로 경쟁사보다 훨씬 높았습니다.

이 모델은 순서화된, 조건부 및 형식별 지침을 구문 분석하고 따르는 기능을 갖추고 있어 세무 준수(Blue J에서 확인 가능) 및 데이터베이스 쿼리(Hex의 성능에서 입증 가능)와 같은 기업 애플리케이션에서 매우 효과적입니다.

혁신적인 긴 컨텍스트: 최대 1만 개의 토큰

GPT-4.1은 최대 1만 개의 토큰으로 구성된 획기적인 컨텍스트 윈도우를 제공합니다. 이는 React 코드베이스 4.1개 크기에 해당합니다. OpenAI-MRCR 및 Graphwalks와 같은 새로운 평가를 통해 GPT-4은 방대한 문서에서 검색 및 멀티홉 추론을 모두 수행할 수 있는 역량을 입증했으며, 모든 위치 및 테스트에서 GPT-XNUMXo를 능가했습니다.

Thomson Reuters와 Carlyle과 같은 파트너는 복잡한 법률 워크플로부터 다양한 형식의 파일에서 재무 데이터를 추출하는 것까지 정확성과 문서 분석 측면에서 큰 성과를 거두었다고 보고했습니다.

Thomson Reuters의 한 관계자는 "GPT-4.1을 사용하면 최소한의 감독으로 수십 개의 문서에 걸친 법적 계약을 처리할 수 있습니다."라고 밝혔습니다.

미니와 나노: 속도와 비용의 경계에서 최고의 성능

  • GPT-4.1 mini는 GPT-4o의 지능과 동일하지만 지연 시간을 거의 절반으로 줄이고 비용을 83% 절감합니다.
  • GPT-4.1 nano는 현재 가장 빠르고 저렴한 모델로, 분류 및 자동 완성 작업에 이상적이며, MMLU에서 80.1%, GPQA에서 50.3%라는 인상적인 점수를 기록했습니다.

이러한 모델은 대규모 프롬프트에 대해 최대 1초의 빠른 응답 시간을 제공하며 최대 5만 개의 토큰 컨텍스트를 지원하여 대규모 환경에서 고성능을 구현할 수 있습니다.

다중 모드 및 시각적 이해 향상

시각적 벤치마크에서도 상당한 개선이 나타났습니다. MMMU 및 MathVista와 같은 테스트에서 GPT-4.1 mini와 nano는 GPT-4o를 능가했으며, 심지어 GPT-4.5와도 견줄 만했습니다. 이 모델은 교육, 연구 및 분석 활용 사례에 필수적인 차트, 수학 다이어그램, 과학 논문 해석에 탁월합니다.

가격 및 가용성

GPT-4.1 시리즈 전체가 이제 OpenAI API에서 이용 가능하며, Batch API를 통해서도 50% 할인된 가격으로 제공됩니다. 토큰 1만 개당 가격은 다음과 같습니다.

모델 입력 캐시된 입력 산출 혼합 가격 책정
GPT-4.1 $2.00 $0.50 $8.00 $1.84
GPT-4.1 미니 $0.40 $0.10 $1.60 $0.42
GPT-4.1 나노 $0.10

즉각적인 캐싱 할인이 75%까지 증가하여 개발자는 성능과 비용을 모두 최적화할 수 있게 되었습니다.

무엇 향후 계획?

GPT-4.1은 코드 생성, 장문 추론, 명령어 추적, 비전 기능을 향상시켜 더욱 강력한 에이전트 기반 애플리케이션을 위한 기반을 마련했습니다. OpenAI는 GPT-4.5 및 이전 버전에서 얻은 학습 내용을 진화하는 모델에 지속적으로 통합할 계획입니다.

GPT-4.5 미리보기가 종료됨에 따라 개발자는 향상된 기능과 낮은 운영 비용의 이점을 누리기 위해 워크로드를 GPT-4.1로 마이그레이션하는 것이 좋습니다.

"GPT-4.1은 우리가 기다려온 실질적인 AI 도약입니다."라고 제품 관리자가 말했습니다. Qodo"더욱 스마트하고 빠르며 오늘날 개발자들이 직면한 과제에 더욱 부합합니다."