מערכת שנבדקה
Command A+
נבדק כמודל APIמודל פתוחCohere
מודל פתוח של Cohere עם חלון הקשר של 128K טוקנים. מדד האיכות המרוכז של המקור עומד על 48.2.
ציונים לפי יכולת
שירות לקוחות אוטומטי
כיסוי 85%
85.0
טקסט ותמונה
כיסוי 52%
67.5
ניתוח נתונים
כיסוי 25%
52.7
הבנה חזותית
כיסוי 19%
52.7
קוד ופיתוח תוכנה
כיסוי 7%
12.0
מדדים
כל רשומות המדד (6)
שירות לקוחות אוטומטי
| מבחן הערכה | סטטוס | ציון | משקל | מקור |
|---|---|---|---|---|
| τ²-bench | מדד משני · בהסתייגותזיקה מסחרית מוצהרת לפי דיווח היצרן | 85.0 | 0.34 | קישור למקור |
טקסט ותמונה
| מבחן הערכה | סטטוס | ציון | משקל | מקור |
|---|---|---|---|---|
| MMMU-Pro | מדידה עצמאית · לוח השוואה לפי דיווח היצרן | 63.0 | 0.72 | קישור למקור |
| MMMU | מדד משני לפי דיווח היצרן | 75.1 | 0.42 | קישור למקור |
לא נמצאו תוצאות עבור: Humanity's Last Exam (HLE)
ניתוח נתונים
| מבחן הערכה | סטטוס | ציון | משקל | מקור |
|---|---|---|---|---|
| CharXiv | מדידה עצמאית · לוח השוואה לפי דיווח היצרן | 52.7 | 0.72 | קישור למקור |
לא נמצאו תוצאות עבור: LiveBench · LiveBench Data Analysis
הבנה חזותית
| מבחן הערכה | סטטוס | ציון | משקל | מקור |
|---|---|---|---|---|
| CharXiv | מדידה עצמאית · לוח השוואה לפי דיווח היצרן | 52.7 | 0.72 | קישור למקור |
לא נמצאו תוצאות עבור: ScreenSpot Pro · OfficeQA Pro · MathVision · ERQA · ZeroBench · VideoMMMU
קוד ופיתוח תוכנה
| מבחן הערכה | סטטוס | ציון | משקל | מקור |
|---|---|---|---|---|
| Aider Polyglot | מדידה עצמאית · מתעדכן לוח עצמאי | 12.0 | 1.00 | קישור למקור |
לא נמצאו תוצאות עבור: LiveBench · SWE-bench Verified · SWE-rebench · LiveCodeBench · LiveBench Coding · LiveBench Agentic Coding · MirrorCode · SWE-bench Pro · SciCode · CursorBench · SWE-bench Multilingual · Vibe Code Bench · NL2Repo · DeepSWE · FrontierCode 1.1 · ProgramBench
מערכות נוספות
להשוואה
Apodex 1.1Claude Fable 5Claude Opus 4.6Claude Opus 4.7Claude Opus 4.7 (Adaptive)Claude Opus 4.8Claude Opus 5Claude Sonnet 5DeepSeek V3.2DeepSeek V4 Flash Vision ExpDeepSeek V4 Pro 0813Gemini 3.1 Flash LiteGemini 3.5 FlashGemini 3.5 Flash-LiteGemini 3.6 FlashGemini 3.7 FlashGemini 3 ProGemma 4 31BGLM-5GLM-5.1GLM-5.2GLM-5.3GLM 5.3 FlashGLM-5-TurboGLM-5V-TurboGPT-5.4GPT-5.4 nanoGPT-5.5GPT-5.6 LunaGPT-5.6 SolGPT-5.6 TerraGrok 4Grok 4.1 Fast (Reasoning)Grok 4.3Grok 4.5Grok 4.6Grok 4 Fast (Reasoning)Grok Build 0.1Hy3InklingInkling-SmallKimi K2.6Kimi K2.5Kimi K2.5 (Reasoning)Kimi K2.7 CodeKimi K3Ling 3.0 FlashMiMo-V2.5-ProMiMo-V2-OmniMiMo-V2-ProMiniMax M2.5MiniMax M2.7MiniMax M3Ministral 3 14B (Reasoning)Mistral Medium 3.5Muse Glimmer 30BMuse SparkMuse Spark 1.1Muse Spark 1.2Nemotron 3.5 LightningNemotron 3 Nano 30BNemotron 3 UltraNova ProPhi-4Qwen3.5 397B (Reasoning)Qwen3.6 27BQwen3.6 PlusQwen3.7 FlashQwen3.7 MaxQwen3.7 PlusQwen3.8 2.4T A95BQwen3.8-27BQwen3.8 FlashQwen3.8-Flash-NextQwen3.8 MaxStep 3.5 FlashTrinity-Large-Preview
