OpenAI o3-mini: בינה מלאכותית מהירה וחכמה יותר עבור STEM ומפתחים

פבואר 5, 2025

OpenAI חשפה את o3-mini, הדגם האחרון בסדרת ההיגיון שלה, שנועד לספק ביצועים יוצאי דופן בתחומי STEM, הנדסת תוכנה ופתרון בעיות לוגי. מהדורה זו משפרת את נגישות הבינה המלאכותית על ידי שמירה על עלויות נמוכות תוך שיפור המהירות והדיוק בהשוואה לקודמתה, OpenAI o1-mini.

לאחר הוצגה בתצוגה מקדימה בדצמבר 2024, o3-mini זמין כעת רשמית בשירותי צ'אט ו-API. הוא מציע יכולת חשיבה גבוהה יותר, מה שהופך אותו לאידיאלי למשימות בתחומי המדע, הטכנולוגיה, ההנדסה והמתמטיקה (STEM). מפתחים יכולים למנף את קריאות הפונקציות, הפלט המובנה והודעות המפתחים שלו, מה שמבטיח גמישות רבה יותר ויישומים מוכנים לייצור.

תכונות משופרות ונגישות

אחד העדכונים הצפויים ביותר עם OpenAI o3-mini הוא התמיכה שלו ברמות מאמץ שונות של חשיבה, המאפשרת למשתמשים לייעל את המודל למהירות או למורכבות בהתבסס על הצרכים שלהם. מצבים אלה כוללים:

  • מאמץ נימוק נמוך: נותן עדיפות למהירות עם עלות חישוב מינימלית.
  • מאמץ נימוק בינוני: מאזן דיוק וזמן תגובה.
  • מאמץ הגיוני גבוה: ממקסם אינטליגנציה עבור משימות מורכבות.

בניגוד ל-OpenAI o1-mini, o3-mini מציג יכולות חיפוש מובנות, המאפשרות למשתמשים גישה למידע עדכני ממקורות אינטרנט רלוונטיים. בנוסף, הוא מגדיל פי שלושה את מגבלות ההודעות עבור משתמשי Chat Plus ו-Team, מ-50 ל-150 הודעות ביום, מה שמשפר את הנגישות עבור משתמשים תכופים.

לראשונה, OpenAI העמידה מודל חשיבה לרשות משתמשי צ'אט חינמיים, מה שמאפשר להם לחוות פתרון בעיות לוגי בסיוע בינה מלאכותית על ידי בחירת האפשרות "סיבה" בכותב ההודעות.

מדדי ביצועים: מעלים על דגמים קודמים

OpenAI o3-mini עולה על קודמו, o1-מיני, במגוון אמות מידה מדעיות ומתמטיות:

מתמטיקה וקידוד

  • נימוק מתמטי: מתאים ל-OpenAI o1 בדיוק תוך מתן זמני תגובה מהירים יותר.
  • מתמטיקה בתחרות (AIME 2024): מתעלה על o1-mini עם מאמץ חשיבה גבוה.
  • Codeforces תכנות תחרותי: משיג גבוה יותר אלו מבקיע על פני רמות מאמץ חשיבה.
  • הנדסת תוכנה (SWE-Bench): עולה על דגמים קודמים, ומדגים את התוצאות הטובות ביותר בפיתוח תוכנה בעזרת AI.

ידע מדעי מתקדם

  • שאלות מדעיות ברמת דוקטורט (GPQA Diamond): מצטיין בביולוגיה, כימיה ופיזיקה, משיג רמות ביצועים קרובות ל-OpenAI o1.
  • מתמטיקה ברמת מחקר (FrontierMath): עם שילוב כלי Python, o3-mini פותר בהצלחה מעל 32% מהבעיות, לרבות 28% מהבעיות המאתגרות ביותר (T3)..

ידע כללי והעדפה אנושית

  • הערכות מראות א עדיפות של 56% לתגובות o3-mini על פני o1-mini.
  • מפחית שגיאות גדולות ב-39%, שיפור האמינות ב-difficult שאלות מהעולם האמיתי.

שיפורי מהירות ויעילות

OpenAI o3-mini מספק תגובות מהיר ב-24% מ-o1-mini, הפחתה זמני תגובה ממוצעים מ-10.16 שניות ל-7.7 שניות. בבדיקות חביון, o3-mini שומרת על א זמן מהיר יותר ב-2,500ms עד האסימון הראשון, מה שמבטיח אינטראקציות מהירות וזורמות יותר.

שיפורי בטיחות ופיתוח בינה מלאכותית אתית

OpenAI שילבה טכניקות יישור דיוני כדי להבטיח ש-o3-mini ייצור תגובות בטוחות ומיושרות לאדם. בדיקות מקיפות גילו ש-o3-mini עולה באופן משמעותי על GPT-4o בהערכות אבטחה, מה שהופך אותו לאחד המודלים החזקים ביותר של OpenAI במניעת שימוש לרעה וניצול פריצת Jail.

באמצעות צוות אדום חיצוני והערכות בטיחות שיטתיות, OpenAI ממשיכה להפחית סיכונים תוך אופטימיזציה של אינטליגנציה של AI. כרטיס המערכת העדכני ביותר מספק תובנות לגבי הערכות תוכן אסורות ופרוטוקולי בטיחות.

מה הלאה עבור OpenAI?

עם o3-mini, OpenAI עשתה צעד משמעותי נוסף לקראת הפיכת חשיבה מתקדמת של AI לנגיש וחסכוני יותר. מודל זה מתיישב עם המשימה המתמשכת של החברה להפחית את התמחור לפי אסימון תוך שמירה על יכולות החשיבה ברמה הגבוהה ביותר.

ככל שהאימוץ בינה מלאכותית מתרחב, OpenAI נשארת מחויבת לדחיפת גבולות של מודלים חכמים, יעילים ובטוחים של AI, להבטיח שעסקים, מפתחים וסטודנטים יכולים למנף בינה מלאכותית לפתרון בעיות, חדשנות ומחקר.

החל מהיום, o3-mini זמין למשתמשי Chat Plus, Team ו-Pro, כאשר גישת Enterprise תושק בפברואר. גישת API מוענקת למפתחים נבחרים ברמות 3-5.

עבור אלה המעוניינים לרתום את הכוח של AI בפיתוח STEM ופיתוח תוכנה, OpenAI o3-mini מציגה קפיצת מדרגה מרגשת.