מערכת שנבדקה
Grok 4.1 Fast (Reasoning)
נבדק כמודל APIמודל סגורxAI
מודל סגור של xAI עם חלון הקשר של 2,000K טוקנים. מדד האיכות המרוכז של המקור עומד על 60.1.
ציונים לפי יכולת
קוד ופיתוח תוכנה
כיסוי 4%
1.2
כתיבת קוד עצמאית
כיסוי 8%
1.2
מדדים
כל רשומות המדד (2)
קוד ופיתוח תוכנה
| מבחן הערכה | סטטוס | ציון | משקל | מקור |
|---|---|---|---|---|
| Vibe Code Bench | מדד משני לוח עצמאי | 1.2 | 0.50 | קישור למקור |
לא נמצאו תוצאות עבור: LiveBench · SWE-bench Verified · SWE-rebench · LiveCodeBench · Aider Polyglot · LiveBench Coding · LiveBench Agentic Coding · MirrorCode · SWE-bench Pro · SciCode · CursorBench · SWE-bench Multilingual · NL2Repo · DeepSWE · FrontierCode 1.1 · ProgramBench
כתיבת קוד עצמאית
| מבחן הערכה | סטטוס | ציון | משקל | מקור |
|---|---|---|---|---|
| Vibe Code Bench | מדד משני לוח עצמאי | 1.2 | 0.50 | קישור למקור |
לא נמצאו תוצאות עבור: LiveBench · Terminal-Bench 2.0 · Terminal-Bench 3.0 · LiveBench Agentic Coding · SWE-bench Pro · CursorBench · DeepSWE
מערכות נוספות
להשוואה
Apodex 1.1Claude Fable 5Claude Opus 4.6Claude Opus 4.7Claude Opus 4.7 (Adaptive)Claude Opus 4.8Claude Opus 5Claude Sonnet 5Command A+DeepSeek V3.2DeepSeek V4 Flash Vision ExpDeepSeek V4 Pro 0813Gemini 3.1 Flash LiteGemini 3.5 FlashGemini 3.5 Flash-LiteGemini 3.6 FlashGemini 3.7 FlashGemini 3 ProGemma 4 31BGLM-5GLM-5.1GLM-5.2GLM-5.3GLM 5.3 FlashGLM-5-TurboGLM-5V-TurboGPT-5.4GPT-5.4 nanoGPT-5.5GPT-5.6 LunaGPT-5.6 SolGPT-5.6 TerraGrok 4Grok 4.3Grok 4.5Grok 4.6Grok 4 Fast (Reasoning)Grok Build 0.1Hy3InklingInkling-SmallKimi K2.6Kimi K2.5Kimi K2.5 (Reasoning)Kimi K2.7 CodeKimi K3Ling 3.0 FlashMiMo-V2.5-ProMiMo-V2-OmniMiMo-V2-ProMiniMax M2.5MiniMax M2.7MiniMax M3Ministral 3 14B (Reasoning)Mistral Medium 3.5Muse Glimmer 30BMuse SparkMuse Spark 1.1Muse Spark 1.2Nemotron 3.5 LightningNemotron 3 Nano 30BNemotron 3 UltraNova ProPhi-4Qwen3.5 397B (Reasoning)Qwen3.6 27BQwen3.6 PlusQwen3.7 FlashQwen3.7 MaxQwen3.7 PlusQwen3.8 2.4T A95BQwen3.8-27BQwen3.8 FlashQwen3.8-Flash-NextQwen3.8 MaxStep 3.5 FlashTrinity-Large-Preview
