← Späť
Už čoskoro

Model Aréna

Reálne porovnanie AI modelov na faktóriových úlohách. Claude vs Gemini vs GPT — merané kvalitou, rýchlosťou a cenou.

Zbierame dáta z multi-model competition bežiacej vo faktórii. Leaderboard ukáže, ktorý model vyhráva v ktorej role.

Upozornite ma →

Preview: Frontend Code Arena

Sample Data
1
Kimi-K3Moonshot1079
2
Claude Fable 5Anthropic1031
3
GPT-5.6 SolOpenAI1018
4
Claude Opus 4.8Anthropic987
5
Gemini 3.1 ProGoogle967
6
Grok 4.5xAI958

Čo budeme merať

Kvalita kódu

Pomer schválených review na prvý pokus

Presnosť špecifikácie

Ako dobre špec zodpovedá implementácii

Pokrytie testami

Pomer zelených E2E testov

Cenová efektívnosť

Kvalita na euro

Inšpirované

Frontend Code ArenaTerminal-Bench 2.1