Back to Blog

בינה מלאכותית · 27 באוגוסט 2026

הציון המושלם: האם Claude Opus 5 באמת פיצח את המתמטיקה?

By Adi Krief

About This Guide

אנתרופיק שוברת שיאים עם ציון מושלם באולימפיאדה למתמטיקה, אבל מאחורי המספרים מסתתרים סיכוני אבטחה ותחרות מפתיעה מצד הקוד הפתוח.

תמיד שנאתי את השאלות האלה באולימפיאדה למתמטיקה. אלו שגורמות גם לדוקטורים להזיע. ביולי האחרון, מכונה פתרה את כולן. בלי להזיע.

ישבתי מול המסך עם בעיה לוגית שקיבלתי מחבר, מתכנת בכיר. הוא אמר לי: 'עדי, אם ה-AI פותרת את זה, אני פורש'. הזנתי את השאלה ל-Claude Opus 5, המודל שאנתרופיק שחררה בסוף יולי 2026. הוא לא רק ענה. הוא הסביר את הדרך בפירוט כזה, שהחבר שלי התחיל לעדכן את קורות החיים שלו. זה לא עוד שדרוג של מהירות; זהו זינוק ביכולת ההסקה (Reasoning) שמשנה את כללי המשחק, גם אם הוא מגיע עם כמה סימני אזהרה מדאיגים.

המספרים שלא משקרים (כמעט)

הבשורה הגדולה של Claude Opus 5 היא היכולת הלוגית שלו. לפי נתוני [IMO 2026 Leaderboard & Scores — July 2026 | BenchLM.ai](https://benchlm.ai/benchmarks/imo2026), המודל השיג ציון מושלם של 42 מתוך 42 באולימפיאדה הבינלאומית למתמטיקה. זהו הישג חסר תקדים שמעיד על יכולת 'חשיבה' עמוקה, ולא רק שליפת מידע. עם זאת, חשוב לזכור שמבחנים מבוקרים הם סביבה סטרילית. בעוד שבמדדי לוגיקה הוא מנצח, בבדיקות של סוכני תכנות אוטונומיים (Agentic coding) הביצועים שלו עומדים על כ-43.3% במדד Frontier-Bench, מה שמראה שיש עוד דרך לעבור עד להחלפה מלאה של מתכנתים אנושיים.

יותר שכל, פחות כסף

אנתרופיק בחרה באסטרטגיית תמחור אגרסיבית. Opus 5 הושק במחיר של 5 דולר למיליון טוקנים של קלט ו-25 דולר לפלט – מחיר זהה לקודמו (Opus 4.8), אך הוא מספק ביצועים הקרובים לאלו של מודל ה-Fable 5 היקר פי שניים. כפי שפורסם ב-[Claude Opus 5: Benchmarks, Pricing & Comparison (2026)](https://codersera.com/blog/claude-opus-5-launch-guide-2026), החידוש המעשי ביותר הוא ה-'Effort Toggle' – בורר מאמץ המאפשר למשתמשים לבחור בין רמות השקעה שונות (Low/Medium/High) כדי לאזן בין עלות לדיוק בכל שאילתה.

הצד האפל של האינטליגנציה

לצד ההתלהבות, דוחות בטיחות חושפים תמונה מורכבת. בבדיקות שערכה ממשלת בריטניה, Opus 5 הצליח לבצע התקפות סייבר על רשתות ארגוניות ב-8 מתוך 10 ניסיונות, כפי שדווח ב-[Claude Opus 5 Hacked Enterprise Networks in 8 of 10 Government Tests, Safety Card Shows](https://www.techtimes.com/articles/321549/20260725/claude-opus-5-hacked-enterprise-networks-8-10-government-tests-safety-card-shows.htm). בנוסף, המודל מתמודד עם תחרות עזה מצד Kimi K3, מודל קוד פתוח שמציג ביצועים דומים בעלות נמוכה משמעותית, מה שמעלה את השאלה האם המודלים הסגורים יצליחו לשמור על הדומיננטיות שלהם לאורך זמן.

שורה תחתונה: איך לעבוד עם זה?

אם אתם עוסקים בניתוח נתונים מורכב או פיתוח תוכנה, Opus 5 הוא כלי עבודה עוצמתי, במיוחד בזכות האינטגרציה שלו עם פרוטוקול MCP לעבודה עם סוכנים. ההמלצה שלי: השתמשו בבורר המאמץ (Effort Toggle) בחוכמה – אל תבזבזו 'High Effort' על משימות כתיבה פשוטות, אבל אל תתפשרו עליו כשאתם צריכים לפתור בעיות לוגיות שגורמות גם לכם להזיע.

What's New to Know

  • • ציון מושלם 42/42 באולימפיאדה הבינלאומית למתמטיקה (IMO 2026).
  • • בורר מאמץ (Effort Toggle) המאפשר שליטה על עלות מול דיוק.
  • • ביצועים ברמת Fable 5 במחיר של סדרת Opus ($5/$25).
  • • תמיכה מובנית בפרוטוקול MCP להפעלת סוכנים אוטונומיים.

Sources

Related Articles

Let's talk

Contact

Interested in a workshop, lecture, or consultation? I'd love to hear from you

The fastest way to reach me is via WhatsApp

Send me a message on WhatsApp

If you prefer, you can also leave your details in the form and I'll get back to you.

Want me to get back to you? Leave your details

WhatsApp

Prefer WhatsApp? I'd love to chat!

Open WhatsApp