מתמטיקה ומדעים · פתרון בעיות כמותיות

דירוג לפי איכות

1

Claude Fable 5

נבדק כמודל

מצב חשיבה · חלון הקשר 1,000K טוקנים · נמדד כמודל API, ללא ממשק צ'אט

תצורות נוספות:מצב מאמץ מרבימצב מאמץ גבוה מאודמצב מאמץ גבוהמצב מאמץ בינונימצב מאמץ נמוךמצב אצווה במחיר מופחתלא נכללות בציון
ציון התאמה
80.6
כיסוי נתונים 43%

כיסוי אפקטיבי: 100% ממשקל היכולות במקצוע נמדד בפועל.

עלות שימוש: קלט $10 · פלט $50 למיליון טוקנים

  • התוצאות הגבוהות ביותר שלו הן בחשיבה מופשטת וידע וחשיבה.
  • היתרון נשען בעיקר על LiveBench Reasoning, ARC-AGI-2.
  • כיסוי נתונים: 43% · רמת ביסוס: בינונית

הציון מחושב לפי החשיבות של כל יכולת ולפי הנתונים הזמינים עליה.

  • מתמטיקהמשקל 39%
    87.6 · 2 מבחנים
  • חשיבה מדעיתמשקל 17%
    85.9 · מבחן אחד
  • חשיבה מופשטתמשקל 13%
    88.2 · 2 מבחנים
  • ידע וחשיבהמשקל 13%
    84.3 · 3 מבחנים
  • עמידה בהוראותמשקל 9%
    75.8 · 2 מבחנים
  • ניתוח נתוניםמשקל 9%
    79.1 · 2 מבחנים
עד כמה ההמלצה מבוססתבינונית
כיסוי נתונים
43%
איכות המקורות
94%
יציבות התוצאה
67%
השוואה הוגנת
100%

מתמטיקה משקל 39%

כיסוי 37%
מבחן הערכהסטטוסציוןמשקלמקור
LiveBench
מדידה עצמאית · מתעדכןזיקה מסחרית מוצהרת
לוח עצמאי
79.51.00קישור למקור
LiveBench Mathematics
מדידה עצמאית · מתעדכן
לוח עצמאי
95.71.00קישור למקור

לא נמצאו תוצאות עבור: AIME 2026 · HMMT Feb 2026 · MATH Level 5 · MathVision · FrontierMath v2

חשיבה מדעית משקל 17%

כיסוי 28%
מבחן הערכהסטטוסציוןמשקלמקור
GPQA / GPQA Diamond
מדידה עצמאית · לוח השוואה
לוח עצמאי
85.90.85קישור למקור

לא נמצאו תוצאות עבור: SciCode · SuperGPQA · CritPt

חשיבה מופשטת משקל 13%

כיסוי 53%
מבחן הערכהסטטוסציוןמשקלמקור
LiveBench Reasoning
מדידה עצמאית · מתעדכן
לוח עצמאי
87.71.00קישור למקור
ARC-AGI-2
מדד משניזיקה מסחרית מוצהרת
לוח עצמאי
89.20.50קישור למקור

לא נמצאו תוצאות עבור: ARC-AGI-3 · ZeroBench

ידע וחשיבה משקל 13%

כיסוי 48%
מבחן הערכהסטטוסציוןמשקלמקור
LiveBench
מדידה עצמאית · מתעדכןזיקה מסחרית מוצהרת
לוח עצמאי
79.51.00קישור למקור
LiveBench Reasoning
מדידה עצמאית · מתעדכן
לוח עצמאי
87.71.00קישור למקור
GPQA / GPQA Diamond
מדידה עצמאית · לוח השוואה
לוח עצמאי
85.90.85קישור למקור

לא נמצאו תוצאות עבור: MMLU-Pro · Humanity's Last Exam (HLE) · SuperGPQA · MMLU-Redux

עמידה בהוראות משקל 9%

כיסוי 53%
מבחן הערכהסטטוסציוןמשקלמקור
LiveBench
מדידה עצמאית · מתעדכןזיקה מסחרית מוצהרת
לוח עצמאי
79.51.00קישור למקור
LiveBench Instruction Following
מדידה עצמאית · מתעדכן
לוח עצמאי
72.01.00קישור למקור

לא נמצאו תוצאות עבור: IFBench · IFEval · MAXIFE

ניתוח נתונים משקל 9%

כיסוי 70%
מבחן הערכהסטטוסציוןמשקלמקור
LiveBench
מדידה עצמאית · מתעדכןזיקה מסחרית מוצהרת
לוח עצמאי
79.51.00קישור למקור
LiveBench Data Analysis
מדידה עצמאית · מתעדכן
לוח עצמאי
78.71.00קישור למקור

לא נמצאו תוצאות עבור: CharXiv

2

Claude Sonnet 5

נבדק כמודל

מצב חשיבה · חלון הקשר 1,000K טוקנים · נמדד כמודל API, ללא ממשק צ'אט

תצורות נוספות:מצב מאמץ גבוה מאודמצב אצווה במחיר מופחתלא נכללות בציון
ציון התאמה
78.2
כיסוי נתונים 45%

כיסוי אפקטיבי: 100% ממשקל היכולות במקצוע נמדד בפועל.

עלות שימוש: קלט $2 · פלט $10 למיליון טוקנים

  • התוצאות הגבוהות ביותר שלו הן בידע וחשיבה וניתוח נתונים.
  • היתרון נשען בעיקר על LiveBench, LiveBench Reasoning.
  • כיסוי נתונים: 45% · רמת ביסוס: בינונית

הציון מחושב לפי החשיבות של כל יכולת ולפי הנתונים הזמינים עליה.

  • מתמטיקהמשקל 39%
    83.9 · 2 מבחנים
  • חשיבה מדעיתמשקל 17%
    90.5 · מבחן אחד
  • חשיבה מופשטתמשקל 13%
    88.7 · מבחן אחד
  • ידע וחשיבהמשקל 13%
    78.9 · 4 מבחנים
  • עמידה בהוראותמשקל 9%
    69.4 · 2 מבחנים
  • ניתוח נתוניםמשקל 9%
    77.3 · 3 מבחנים
עד כמה ההמלצה מבוססתבינונית
כיסוי נתונים
45%
איכות המקורות
95%
יציבות התוצאה
72%
השוואה הוגנת
94%

מתמטיקה משקל 39%

כיסוי 37%
מבחן הערכהסטטוסציוןמשקלמקור
LiveBench
מדידה עצמאית · מתעדכןזיקה מסחרית מוצהרת
לוח עצמאי
74.81.00קישור למקור
LiveBench Mathematics
מדידה עצמאית · מתעדכן
לוח עצמאי
92.91.00קישור למקור

לא נמצאו תוצאות עבור: AIME 2026 · HMMT Feb 2026 · MATH Level 5 · MathVision · FrontierMath v2

חשיבה מדעית משקל 17%

כיסוי 28%
מבחן הערכהסטטוסציוןמשקלמקור
GPQA / GPQA Diamond
מדידה עצמאית · לוח השוואה
לוח עצמאי
90.50.85קישור למקור

לא נמצאו תוצאות עבור: SciCode · SuperGPQA · CritPt

חשיבה מופשטת משקל 13%

כיסוי 35%
מבחן הערכהסטטוסציוןמשקלמקור
LiveBench Reasoning
מדידה עצמאית · מתעדכן
לוח עצמאי
88.71.00קישור למקור

לא נמצאו תוצאות עבור: ARC-AGI-3 · ARC-AGI-2 · ZeroBench

ידע וחשיבה משקל 13%

כיסוי 61%
מבחן הערכהסטטוסציוןמשקלמקור
LiveBench
מדידה עצמאית · מתעדכןזיקה מסחרית מוצהרת
לוח עצמאי
74.81.00קישור למקור
LiveBench Reasoning
מדידה עצמאית · מתעדכן
לוח עצמאי
88.71.00קישור למקור
GPQA / GPQA Diamond
מדידה עצמאית · לוח השוואה
לוח עצמאי
90.50.85קישור למקור
Humanity's Last Exam (HLE)
מדידה עצמאית · לוח השוואההערכה על ידי מודל אחרזיקה מסחרית מוצהרת
לפי דיווח היצרן
57.40.72קישור למקור

לא נמצאו תוצאות עבור: MMLU-Pro · SuperGPQA · MMLU-Redux

עמידה בהוראות משקל 9%

כיסוי 53%
מבחן הערכהסטטוסציוןמשקלמקור
LiveBench
מדידה עצמאית · מתעדכןזיקה מסחרית מוצהרת
לוח עצמאי
74.81.00קישור למקור
LiveBench Instruction Following
מדידה עצמאית · מתעדכן
לוח עצמאי
63.91.00קישור למקור

לא נמצאו תוצאות עבור: IFBench · IFEval · MAXIFE

ניתוח נתונים משקל 9%

כיסוי 96%
מבחן הערכהסטטוסציוןמשקלמקור
LiveBench
מדידה עצמאית · מתעדכןזיקה מסחרית מוצהרת
לוח עצמאי
74.81.00קישור למקור
LiveBench Data Analysis
מדידה עצמאית · מתעדכן
לוח עצמאי
71.71.00קישור למקור
CharXiv
מדידה עצמאית · לוח השוואה
לפי דיווח היצרן
88.30.72קישור למקור
3

Qwen3.5 397B

נבדק כמודל

מצב חשיבה · חלון הקשר 128K טוקנים · נמדד כמודל API, ללא ממשק צ'אט

ציון התאמה
78.1
עברית
70.8
מוצג בנפרד ואינו משפיע על ציון ההתאמה.
כיסוי נתונים 33%

כיסוי אפקטיבי: 87% ממשקל היכולות במקצוע נמדד בפועל.

עלות שימוש: קלט $0.6 · פלט $3.6 למיליון טוקנים

  • התוצאות הגבוהות ביותר שלו הן בחשיבה מדעית.
  • היתרון נשען בעיקר על GPQA / GPQA Diamond, SuperGPQA.
  • כיסוי נתונים: 33% · רמת ביסוס: בינונית

הציון מחושב לפי החשיבות של כל יכולת ולפי הנתונים הזמינים עליה.

  • מתמטיקהמשקל 39%
    90.1 · 3 מבחנים
  • חשיבה מדעיתמשקל 17%
    79.0 · 2 מבחנים
  • חשיבה מופשטתמשקל 13%
    לא נמדד במודל הזה
  • ידע וחשיבהמשקל 13%
    72.3 · 5 מבחנים
  • עמידה בהוראותמשקל 9%
    92.6 · מבחן אחד
  • ניתוח נתוניםמשקל 9%
    80.8 · מבחן אחד
עד כמה ההמלצה מבוססתבינונית
כיסוי נתונים
36%
איכות המקורות
91%
יציבות התוצאה
67%
השוואה הוגנת
61%

מתמטיקה משקל 39%

כיסוי 34%
מבחן הערכהסטטוסציוןמשקלמקור
AIME 2026
מדידה עצמאית · לוח השוואה
לפי דיווח היצרן
93.30.72קישור למקור
HMMT Feb 2026
מדידה עצמאית · לוח השוואה
לפי דיווח היצרן
87.90.72קישור למקור
MathVision
מדד משני
לפי דיווח היצרן
88.60.42קישור למקור

לא נמצאו תוצאות עבור: LiveBench · LiveBench Mathematics · MATH Level 5 · FrontierMath v2

חשיבה מדעית משקל 17%

כיסוי 52%
מבחן הערכהסטטוסציוןמשקלמקור
GPQA / GPQA Diamond
מדידה עצמאית · לוח השוואה
לוח עצמאי
86.40.85קישור למקור
SuperGPQA
מדידה עצמאית · לוח השוואה
לפי דיווח היצרן
70.40.72קישור למקור

לא נמצאו תוצאות עבור: SciCode · CritPt

ידע וחשיבה משקל 13%

כיסוי 58%
מבחן הערכהסטטוסציוןמשקלמקור
GPQA / GPQA Diamond
מדידה עצמאית · לוח השוואה
לוח עצמאי
86.40.85קישור למקור
MMLU-Pro
מדידה עצמאית · לוח השוואה
לפי דיווח היצרן
87.80.72קישור למקור
Humanity's Last Exam (HLE)
מדידה עצמאית · לוח השוואההערכה על ידי מודל אחרזיקה מסחרית מוצהרת
לפי דיווח היצרן
28.70.72קישור למקור
SuperGPQA
מדידה עצמאית · לוח השוואה
לפי דיווח היצרן
70.40.72קישור למקור
MMLU-Redux
מדד משני
לפי דיווח היצרן
94.90.42קישור למקור

לא נמצאו תוצאות עבור: LiveBench · LiveBench Reasoning

עמידה בהוראות משקל 9%

כיסוי 11%
מבחן הערכהסטטוסציוןמשקלמקור
IFEval
מדד משניזיקה מסחרית מוצהרת
לפי דיווח היצרן
92.60.42קישור למקור

לא נמצאו תוצאות עבור: LiveBench · LiveBench Instruction Following · IFBench · MAXIFE

ניתוח נתונים משקל 9%

כיסוי 25%
מבחן הערכהסטטוסציוןמשקלמקור
CharXiv
מדידה עצמאית · לוח השוואה
לפי דיווח היצרן
80.80.72קישור למקור

לא נמצאו תוצאות עבור: LiveBench · LiveBench Data Analysis

דירוג מלא

כל המודלים שנבדקו

הכיסוי מחושב על היכולות שנושאות את עיקר המשקל במשימה שנבחרה. מודל שנמדד בפחות מדדים מוצג עם הציון שלו ומסומן ככיסוי חלקי, ואינו נכנס לדירוג.

מודלציון התאמהכיסוי נתוניםעבריתרמת ביסוס
Claude Fable 580.639%בינונית
Claude Sonnet 578.238%בינונית
Qwen3.5 397B78.136%70.8בינונית
Claude Opus 4.777.340%בינונית
Claude Opus 4.676.552%גבוהה
GLM-5.274.855%גבוהה
Claude Sonnet 4.674.852%גבוהה
Qwen3.7 Max74.863%87.5מבוסס על מבחנים רב לשונייםגבוהה
Gemini 3.5 Flash74.545%94.7בינונית
Kimi K2.674.563%גבוהה
Qwen3.6 Plus74.568%84.7מבוסס על מבחנים רב לשונייםגבוהה
Claude Opus 4.574.363%85.7מבוסס על מבחנים רב לשונייםגבוהה
Claude Opus 4.874.049%87.6מבוסס על מבחנים רב לשונייםגבוהה
GPT-5.573.948%96.6בינונית
Kimi K2.7 Code72.736%בינונית
Qwen3.7 Plus72.438%85.7מבוסס על מבחנים רב לשונייםבינונית
Qwen3.6-27B72.261%גבוהה
MiniMax M372.236%בינונית
Gemini 3.1 Pro71.251%גבוהה
GPT-5.4 nano67.945%88.2בינונית
Kimi K2.567.940%82.3מבוסס על מבחנים רב לשונייםבינונית
GPT-5.4 mini66.045%93.6בינונית
GPT-6 Astraכיסוי חלקי, אינו מדורג83.719%נמוכה
DeepSeek V4 Pro 0813כיסוי חלקי, אינו מדורג73.032%בינונית
Claude Opus 5כיסוי חלקי, אינו מדורג73.729%91.1מבוסס על מבחנים רב לשונייםבינונית
GLM-5.1כיסוי חלקי, אינו מדורג75.226%58.5בינונית
Kimi K3כיסוי חלקי, אינו מדורג73.329%בינונית
Inkling-Smallכיסוי חלקי, אינו מדורג70.933%בינונית
GPT-5.6 Solכיסוי חלקי, אינו מדורג72.430%97.1בינונית
Ling 3.0 Flashכיסוי חלקי, אינו מדורג72.926%נמוכה
Gemini 3.7 Flashכיסוי חלקי, אינו מדורג75.122%96.0בינונית
GLM-5כיסוי חלקי, אינו מדורג68.434%83.1מבוסס על מבחנים רב לשונייםבינונית
Inklingכיסוי חלקי, אינו מדורג70.329%בינונית
Qwen3.8-27Bכיסוי חלקי, אינו מדורג72.524%בינונית
Qwen3.5-122B-A10Bכיסוי חלקי, אינו מדורג74.519%67.2נמוכה
Gemini 3.6 Flashכיסוי חלקי, אינו מדורג72.422%92.8בינונית
Claude Fable 5.1כיסוי חלקי, אינו מדורג76.216%נמוכה
GPT-5.6 Terraכיסוי חלקי, אינו מדורג68.030%97.1בינונית
Qwen3.5-27Bכיסוי חלקי, אינו מדורג73.819%82.2מבוסס על מבחנים רב לשונייםנמוכה
Qwen3.5-35B-A3Bכיסוי חלקי, אינו מדורג72.921%81.0מבוסס על מבחנים רב לשונייםנמוכה
GPT-5.2כיסוי חלקי, אינו מדורג68.926%93.9בינונית
Qwen3.8-Flash-Nextכיסוי חלקי, אינו מדורג69.824%בינונית
Grok 4.3כיסוי חלקי, אינו מדורג67.228%בינונית
GLM-5.3-Flashכיסוי חלקי, אינו מדורג71.820%61.3בינונית
Gemini 3 Proכיסוי חלקי, אינו מדורג71.017%74.7נמוכה
GPT-5.4כיסוי חלקי, אינו מדורג63.132%94.8בינונית
GPT-5.6 Lunaכיסוי חלקי, אינו מדורג63.830%95.1בינונית
DeepSeek-R1כיסוי חלקי, אינו מדורג69.618%נמוכה
Gemini 3.8 Flashכיסוי חלקי, אינו מדורג73.711%נמוכה
Gemini 2.5 Proכיסוי חלקי, אינו מדורג65.424%77.4בינונית
Kimi K2.5 (Reasoning)כיסוי חלקי, אינו מדורג73.99%נמוכה
Qwen 3.6 Max (preview)כיסוי חלקי, אינו מדורג65.124%נמוכה
Muse Spark 1.1כיסוי חלקי, אינו מדורג70.113%נמוכה
Muse Sparkכיסוי חלקי, אינו מדורג66.218%נמוכה
DeepSeek V3כיסוי חלקי, אינו מדורג64.521%נמוכה
Muse Glimmer 30Bכיסוי חלקי, אינו מדורג69.711%נמוכה
Hy3 Previewכיסוי חלקי, אינו מדורג72.57%נמוכה
MiniMax M2.7כיסוי חלקי, אינו מדורג72.27%53.6נמוכה
Gemini 3.5 Flash-Liteכיסוי חלקי, אינו מדורג62.922%בינונית
MiMo-V2-Flashכיסוי חלקי, אינו מדורג71.67%נמוכה
Muse Spark 1.2כיסוי חלקי, אינו מדורג68.811%נמוכה
Gemma 4 31Bכיסוי חלקי, אינו מדורג67.712%59.9נמוכה
Claude Opus 4.7 (Adaptive)כיסוי חלקי, אינו מדורג65.016%נמוכה
Gemini 3 Flashכיסוי חלקי, אינו מדורג65.214%74.0נמוכה
GLM-5.3כיסוי חלקי, אינו מדורג66.811%נמוכה
Trinity-Large-Thinkingכיסוי חלקי, אינו מדורג69.47%נמוכה
Gemma 4 26B A4Bכיסוי חלקי, אינו מדורג66.112%52.8נמוכה
Nemotron 3 Nano Omni 30B A3Bכיסוי חלקי, אינו מדורג63.514%נמוכה
Phi-4כיסוי חלקי, אינו מדורג62.316%נמוכה
Nemotron 3 Ultraכיסוי חלקי, אינו מדורג54.531%83.0מבוסס על מבחנים רב לשונייםבינונית
GLM-4.7כיסוי חלקי, אינו מדורג61.715%נמוכה
Grok 4.6כיסוי חלקי, אינו מדורג59.719%נמוכה
Trinity-Large-Previewכיסוי חלקי, אינו מדורג65.19%נמוכה
Nemotron 3.5 Lightning 30B A3B NVFP4כיסוי חלקי, אינו מדורג61.016%נמוכה
Mercury 2כיסוי חלקי, אינו מדורג62.612%נמוכה
Granite 4.2 8Bכיסוי חלקי, אינו מדורג61.214%נמוכה
DeepSeek R1 Distill Qwen 32Bכיסוי חלקי, אינו מדורג64.48%נמוכה
Grok 4.5כיסוי חלקי, אינו מדורג57.719%נמוכה
GLM-4.7-Flashכיסוי חלקי, אינו מדורג63.08%נמוכה
Exaone 4.0 32Bכיסוי חלקי, אינו מדורג66.82%נמוכה
Llama 4 Maverickכיסוי חלקי, אינו מדורג55.422%נמוכה
Llama 3.1 405Bכיסוי חלקי, אינו מדורג56.916%נמוכה
LFM2.5-8B-A1Bכיסוי חלקי, אינו מדורג61.26%נמוכה
Apodex 1.1כיסוי חלקי, אינו מדורג63.52%נמוכה
LFM2.5-2.6Bכיסוי חלקי, אינו מדורג63.90%נמוכה
MiMo-V2.5-Proכיסוי חלקי, אינו מדורג62.52%נמוכה
Command A+כיסוי חלקי, אינו מדורג62.60%נמוכה
Mistral Large 2כיסוי חלקי, אינו מדורג51.019%נמוכה
Llama 4 Scoutכיסוי חלקי, אינו מדורג49.522%נמוכה
Kimi K2כיסוי חלקי, אינו מדורג55.53%נמוכה
GPT-5 (high)כיסוי חלקי, אינו מדורג55.03%נמוכה
MiniMax M2.5כיסוי חלקי, אינו מדורג54.13%50.4נמוכה
GPT-5.1כיסוי חלקי, אינו מדורג51.86%72.7נמוכה
Grok 4כיסוי חלקי, אינו מדורג51.56%נמוכה
GLM-4.6כיסוי חלקי, אינו מדורג51.83%54.2נמוכה
Granite-4.0-1Bכיסוי חלקי, אינו מדורג49.08%נמוכה
DeepSeek V3.2כיסוי חלקי, אינו מדורג48.26%נמוכה
Gemini 2.5 Flashכיסוי חלקי, אינו מדורג44.96%71.8נמוכה
Granite-4.0-350Mכיסוי חלקי, אינו מדורג44.18%נמוכה
Claude Opus 4.5 Thinkingאין נתון0%נמוכה
Claude Opus 4.6 (Adaptive)אין נתון0%נמוכה
DeepSeek V3.1אין נתון0%נמוכה
DeepSeek V3.1 (Reasoning)אין נתון0%נמוכה
Exaone 4.0 1.2Bאין נתון0%נמוכה
GLM-4.5-Airאין נתון0%נמוכה
GLM-5-Turboאין נתון0%נמוכה
GLM-5V-Turboאין נתון0%נמוכה
GPT-5.3 Codexאין נתון0%נמוכה
Granite-4.0-H-1Bאין נתון0%נמוכה
Granite-4.0-H-350Mאין נתון0%נמוכה
Grok 4.1 Fastאין נתון0%נמוכה
Grok 4.1 Fast (Reasoning)אין נתון0%נמוכה
Grok 4 Fast (Reasoning)אין נתון0%נמוכה
Grok Code Fast 1אין נתון0%נמוכה
Hy3אין נתון0%נמוכה
K-Exaoneאין נתון0%נמוכה
Ling 2.6 Flashאין נתון0%נמוכה
MiMo-V2-Omniאין נתון0%נמוכה
MiMo-V2-Proאין נתון0%נמוכה
MiniMax M1 80kאין נתון0%נמוכה
Ministral 3 14Bאין נתון0%נמוכה
Ministral 3 14B (Reasoning)אין נתון0%נמוכה
Ministral 3 3B (Reasoning)אין נתון0%נמוכה
Ministral 3 8Bאין נתון0%נמוכה
Ministral 3 8B (Reasoning)אין נתון0%נמוכה
Mistral Large 3אין נתון0%נמוכה
Mistral Medium 3אין נתון0%נמוכה
Mistral Medium 3.5 128Bאין נתון0%נמוכה
Mistral Small 4אין נתון0%נמוכה
Nemotron 3 Nano 30Bאין נתון0%נמוכה
Nemotron 3 Super 100Bאין נתון0%נמוכה
Nemotron 3 Super 120B A12Bאין נתון0%נמוכה
Nemotron Ultra 253Bאין נתון0%נמוכה
Nova Proאין נתון0%נמוכה
Qwen3.5 397B (Reasoning)אין נתון0%נמוכה
Sarvam 105Bאין נתון0%נמוכה
Sarvam 30Bאין נתון0%נמוכה
Solar Pro 2אין נתון0%נמוכה
Step 3.5 Flashאין נתון0%נמוכה
Step 3.7 Flashאין נתון0%נמוכה

ציון העברית מוצג בנפרד ואינו משפיע על ציון ההתאמה או על סדר הדירוג. ערך חסר נשאר חסר במכוון, אנחנו לא מנחשים ולא ממלאים אותו בממוצע. ציון עברית שמבוסס על מבחנים רב לשוניים אינו תחליף למבחן עברית ייעודי.