OpenAI השיקה רשמית את GPT-4.1 משפחת הדגמים, הכוללת GPT-4.1, GPT-4.1 mini ו-GPT-4.1 nano באמצעות פלטפורמת ה-API שלה. המודלים, שנועדו לביצועים בעולם האמיתי, מציעים שיפורים משמעותיים בקידוד, מעקב אחר הוראות והבנת הקשר ארוך, תוך שהם פועלים בשבריר מהעלות והשהייה של דגמים קודמים.
ההשקה מסמנת מהלך מכריע להפסקה תצוגה מקדימה של GPT-4.5, כאשר OpenAI קובע תאריך שקיעה ב-14 ביולי 2025. GPT-4.1 עומד כעת כדגם הדגל של החברה ל-API בלבד, המספק ביצועים מעולים וגם יתרונות תמחור.

יכולות קידוד שדמיינו מחדש
GPT-4.1 מתעלה על כל דגמי ה-GPT הקודמים ב-SWE-bench Verified, ומשלים 54.6% מהמשימות, זינוק של 21 נקודות על פני GPT-4o. המודל מצטיין בהנדסת תוכנה בעולם האמיתי, במיוחד בעת עריכת קובצי קוד גדולים או יצירת תיקונים בפורמט שונה.
אמות מידה כמו ה-polyglot של Aider מאשרים את יכולתו של GPT-4.1 במשימות קידוד רב-לשוניות, כאשר המודל משיג דיוק של למעלה מ-52% ביצירת הבדלים, מכפיל את הציון של GPT-4o ומנצח את GPT-4.5. מפתחים יכולים גם לנצל מגבלות מורחבות של אסימון פלט (עד 32,768 אסימונים) ולהשתמש בהנחיה אופטימלית למחזורי איטרציה מהירים יותר.
"GPT-4.1 מציע חוויה משנה משחק למהנדסים, במיוחד באיתור באגים, עיבוד מחדש ויצירת קוד בזמן אמת", אמר מפתח ב- Windsurf, אחד משותפי האלפא של OpenAI.
מעקב אחר הוראה חדה יותר ונאמנות תגובה
עם ציון של 38.3% על Scaleהמדד של MultiChallenge גבוה ב-10.5% מ-GPT-4o, GPT-4.1 בולט בזכות ההבנה המשופרת שלו של הוראות מרובות-שלביות. במבחני מעקב אחר הוראות של OpenAI, הוא רשם דיוק של 49.1% בהנחיות קשות, מה שגבר על המתחרים באופן משמעותי.
היכולת של המודל לנתח ולעקוב אחר הוראות מסודרות, מותנות וספציפיות לפורמט הופכת אותו ליעיל ביותר ביישומים ארגוניים כמו תאימות מס (כפי שניתן לראות ב-Blue J) ושאילתת מסד נתונים (כפי שמעידים ביצועים ב-Hex).
הקשר ארוך מהפכני: עד מיליון אסימונים
GPT-4.1 מציג חלון הקשר משנה משחק של עד מיליון אסימונים בגודל של שמונה בסיסי קוד מלאים של React. עם הערכות חדשות כמו OpenAI-MRCR ו-Graphwalks, GPT-1 הוכיחה יכולת שליפה והנמקה מרובה-הופ על פני מסמכים עצומים, תוך ביצועים טובים יותר מ-GPT-4.1o בכל התפקידים והבדיקות.
שותפים כמו Thomson Reuters ו-Carlyle מדווחים על רווחים גדולים בדיוק ובניתוח מסמכים, החל מזרימות עבודה משפטיות מורכבות ועד לחילוץ נתונים פיננסיים מקבצים מרובי פורמטים.
"GPT-4.1 מאפשר לנו לעבד חוזים משפטיים על פני עשרות מסמכים עם פיקוח מינימלי", ציין נציג מתומסון רויטרס.
מיני וננו: ביצועים בקצה המהירות והעלות
- GPT-4.1 mini תואם את האינטליגנציה של GPT-4o אך מקצץ את זמן האחזור כמעט בחצי ומצמצם את העלות ב-83%.
- GPT-4.1 nano הוא הדגם המהיר והזול ביותר עד כה, אידיאלי למשימות סיווג והשלמה אוטומטית, עם ציונים מרשימים: 80.1% ב-MMLU ו-50.3% ב-GPQA.
מודלים אלה מאפשרים ביצועים גבוהים בקנה מידה, תמיכה בעד מיליון הקשרים אסימונים עם זמני תגובה מהירים עד 1 שניות עבור הנחיות גדולות.
הבנה רב-מודאלית וויזואלית משופרת
מדדים חזותיים מראים גם שיפורים משמעותיים. במבחנים כמו MMMU ו- MathVista, GPT-4.1 mini וננו ניצחו את GPT-4o ואפילו מתחרה GPT-4.5. המודלים מצטיינים בפירוש תרשימים, דיאגרמות מתמטיות ומאמרים מדעיים, קריטיים עבור מקרי שימוש בחינוך, מחקר וניתוח.
תמחור וזמינות
כל סדרת ה-GPT-4.1 פעילה כעת ב-OpenAI API, כולל דרך ה-Batch API עם הנחה נוספת של 50%. להלן פירוט התמחור למיליון אסימונים:
| מספר סימוכין | קֶלֶט | קלט במטמון | תְפוּקָה | תמחור מעורב |
|---|---|---|---|---|
| GPT-4.1 | $2.00 | $0.50 | $8.00 | $1.84 |
| GPT-4.1 מיני | $0.40 | $0.10 | $1.60 | $0.42 |
| GPT-4.1 ננו | $0.10 |
הנחות שמירה מיידיות במטמון גדלו ל-75%, מה שמאפשר למפתחים לייעל הן את הביצועים והן את העלות.
מה הלאה?
עם השיפורים של GPT-4.1 ביצירת קוד, חשיבה ארוכת-הקשר, מעקב אחר הוראות וחזון, OpenAI סולל את הדרך ליישומים סוכנים חזקים יותר. החברה מתכננת להמשיך לשלב למידה מ-GPT-4.5 ואיטרציות קודמות בחבילת הדגמים המתפתחת שלה.
עם שקיעת ה-GPT-4.5 Preview, קוראים למפתחים להעביר את עומסי העבודה שלהם ל-GPT-4.1 כדי ליהנות מהיכולות המשופרות שלו ומהעלויות התפעוליות הנמוכות יותר.
"GPT-4.1 הוא קפיצת הבינה המלאכותית המעשית לה חיכינו", אמר מנהל מוצר ב Qodo. "זה חכם יותר, מהיר יותר ומתאים יותר לאתגרים שעומדים בפני מפתחים כיום."