{"data":[{"id":"xiaomi/mimo-v2.5","canonical_slug":"xiaomi/mimo-v2.5-20260422","hugging_face_id":"XiaomiMiMo/MiMo-V2.5","name":"Xiaomi: MiMo-V2.5","created":1776874269,"description":"MiMo-V2.5 is a native omnimodal model by Xiaomi. It delivers Pro-level agentic performance at roughly half the inference cost, while surpassing MiMo-V2-Omni in multimodal perception across image and video understanding...","context_length":1050000,"architecture":{"modality":"text+image+audio+video->text","input_modalities":["text","audio","image","video"],"output_modalities":["text"],"tokenizer":"Other","instruct_type":null},"pricing":{"prompt":"0.00000014","completion":"0.00000028","input_cache_read":"0.0000000028"},"top_provider":{"context_length":1048576,"max_completion_tokens":131072,"is_moderated":false},"per_request_limits":null,"supported_parameters":["frequency_penalty","include_reasoning","logit_bias","logprobs","max_tokens","min_p","presence_penalty","reasoning","repetition_penalty","response_format","seed","stop","structured_outputs","temperature","tool_choice","tools","top_k","top_logprobs","top_p"],"default_parameters":{"temperature":1,"top_p":0.95,"top_k":null,"frequency_penalty":null,"presence_penalty":null,"repetition_penalty":null},"supported_voices":null,"knowledge_cutoff":null,"expiration_date":null,"links":{"details":"/api/v1/models/xiaomi/mimo-v2.5-20260422/endpoints"},"benchmarks":{"design_arena":[{"arena":"models","category":"3d","elo":1275,"win_rate":52.6,"rank":24},{"arena":"models","category":"asciiart","elo":1173,"win_rate":45.7,"rank":36},{"arena":"models","category":"codecategories","elo":1286,"win_rate":54.6,"rank":20},{"arena":"models","category":"dataviz","elo":1276,"win_rate":54.3,"rank":19},{"arena":"models","category":"gamedev","elo":1291,"win_rate":55.3,"rank":19},{"arena":"models","category":"svg","elo":1219,"win_rate":52.7,"rank":22},{"arena":"models","category":"uicomponent","elo":1294,"win_rate":55.3,"rank":18},{"arena":"models","category":"website","elo":1288,"win_rate":54.9,"rank":18}],"artificial_analysis":{"intelligence_index":37.2,"coding_index":56.8,"agentic_index":23.7}},"reasoning":{"mandatory":false}},{"id":"z-ai/glm-5.2","canonical_slug":"z-ai/glm-5.2-20260616","hugging_face_id":"zai-org/GLM-5.2","name":"Z.ai: GLM 5.2","created":1781631930,"description":"GLM 5.2 is a large-scale reasoning model from Z.ai. It supports text input and output with a 1M-token context window, and is suited for long-horizon agent workflows, project-level software engineering,...","context_length":1048576,"architecture":{"modality":"text->text","input_modalities":["text"],"output_modalities":["text"],"tokenizer":"Other","instruct_type":null},"pricing":{"prompt":"0.0000007826","completion":"0.0000024596","input_cache_read":"0.00000014534"},"top_provider":{"context_length":1048576,"max_completion_tokens":131072,"is_moderated":false},"per_request_limits":null,"supported_parameters":["frequency_penalty","include_reasoning","logit_bias","logprobs","max_tokens","min_p","parallel_tool_calls","presence_penalty","reasoning","reasoning_effort","repetition_penalty","response_format","seed","stop","structured_outputs","temperature","tool_choice","tools","top_k","top_logprobs","top_p"],"default_parameters":{"temperature":1,"top_p":0.95,"top_k":null,"frequency_penalty":null,"presence_penalty":null,"repetition_penalty":null},"supported_voices":null,"knowledge_cutoff":null,"expiration_date":null,"links":{"details":"/api/v1/models/z-ai/glm-5.2-20260616/endpoints"},"benchmarks":{"design_arena":[{"arena":"agents","category":"agenticgamedev","elo":1192,"win_rate":48.4,"rank":9},{"arena":"agents","category":"androidnative","elo":1235,"win_rate":54.6,"rank":11},{"arena":"agents","category":"fullstack","elo":1288,"win_rate":63.8,"rank":6},{"arena":"agents","category":"godotgamedev","elo":1142,"win_rate":40.1,"rank":18},{"arena":"agents","category":"htmlslides","elo":1203,"win_rate":51.4,"rank":10},{"arena":"agents","category":"mobileapps","elo":1237,"win_rate":54,"rank":9},{"arena":"agents","category":"python-pptxslides","elo":1187,"win_rate":47.1,"rank":10},{"arena":"agents","category":"webapps","elo":1274,"win_rate":57,"rank":6},{"arena":"models","category":"3d","elo":1355,"win_rate":61.7,"rank":3},{"arena":"models","category":"asciiart","elo":1234,"win_rate":50.4,"rank":12},{"arena":"models","category":"codecategories","elo":1341,"win_rate":60.9,"rank":2},{"arena":"models","category":"dataviz","elo":1306,"win_rate":57.5,"rank":9},{"arena":"models","category":"gamedev","elo":1350,"win_rate":60.8,"rank":2},{"arena":"models","category":"svg","elo":1257,"win_rate":55.3,"rank":10},{"arena":"models","category":"uicomponent","elo":1334,"win_rate":59.8,"rank":6},{"arena":"models","category":"website","elo":1338,"win_rate":60.8,"rank":2}],"artificial_analysis":{"intelligence_index":51.1,"coding_index":68.8,"agentic_index":43.1}},"reasoning":{"mandatory":false,"default_enabled":true,"supported_efforts":["xhigh","high"],"default_effort":"high"}},{"id":"nvidia/nemotron-3-ultra-550b-a55b:free","canonical_slug":"nvidia/nemotron-3-ultra-550b-a55b-20260604","hugging_face_id":"nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16","name":"NVIDIA: Nemotron 3 Ultra (free)","created":1780551208,"description":"NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it...","context_length":1000000,"architecture":{"modality":"text->text","input_modalities":["text"],"output_modalities":["text"],"tokenizer":"Other","instruct_type":null},"pricing":{"prompt":"0","completion":"0"},"top_provider":{"context_length":1000000,"max_completion_tokens":65536,"is_moderated":false},"per_request_limits":null,"supported_parameters":["include_reasoning","max_tokens","reasoning","reasoning_effort","seed","temperature","tool_choice","tools","top_p"],"default_parameters":{"temperature":1,"top_p":0.95,"top_k":null,"frequency_penalty":null,"presence_penalty":null,"repetition_penalty":null},"supported_voices":null,"knowledge_cutoff":null,"expiration_date":null,"links":{"details":"/api/v1/models/nvidia/nemotron-3-ultra-550b-a55b-20260604/endpoints"},"benchmarks":{"design_arena":[{"arena":"models","category":"3d","elo":1192,"win_rate":42.2,"rank":49},{"arena":"models","category":"asciiart","elo":1117,"win_rate":38,"rank":49},{"arena":"models","category":"codecategories","elo":1157,"win_rate":36.4,"rank":67},{"arena":"models","category":"dataviz","elo":1150,"win_rate":37.1,"rank":70},{"arena":"models","category":"gamedev","elo":1186,"win_rate":39,"rank":59},{"arena":"models","category":"svg","elo":1128,"win_rate":37.9,"rank":48},{"arena":"models","category":"uicomponent","elo":1182,"win_rate":39.7,"rank":58},{"arena":"models","category":"website","elo":1128,"win_rate":32.6,"rank":82}],"artificial_analysis":{"intelligence_index":37.8,"coding_index":49.3,"agentic_index":27.4}},"reasoning":{"mandatory":false,"default_enabled":true,"supports_max_tokens":true,"supported_efforts":["high","medium"],"default_effort":"high"}},{"id":"minimax/minimax-m3","canonical_slug":"minimax/minimax-m3-20260531","hugging_face_id":"MiniMaxAI/Minimax-M3","name":"MiniMax: MiniMax M3","created":1780245374,"description":"MiniMax-M3 is a multimodal foundation model from MiniMax. It supports text, image, and video inputs with text output, a 1M-token context window, and is suited for long-horizon agentic work, coding,...","context_length":1048576,"architecture":{"modality":"text+image+video->text","input_modalities":["text","image","video"],"output_modalities":["text"],"tokenizer":"Other","instruct_type":null},"pricing":{"prompt":"0.0000003","completion":"0.0000012","input_cache_read":"0.00000006"},"top_provider":{"context_length":524288,"max_completion_tokens":512000,"is_moderated":false},"per_request_limits":null,"supported_parameters":["frequency_penalty","include_reasoning","logit_bias","logprobs","max_tokens","min_p","presence_penalty","reasoning","repetition_penalty","response_format","seed","stop","structured_outputs","temperature","tool_choice","tools","top_k","top_logprobs","top_p"],"default_parameters":{"temperature":1,"top_p":0.95,"top_k":null,"frequency_penalty":null,"presence_penalty":null,"repetition_penalty":null},"supported_voices":null,"knowledge_cutoff":null,"expiration_date":null,"links":{"details":"/api/v1/models/minimax/minimax-m3-20260531/endpoints"},"benchmarks":{"design_arena":[{"arena":"agents","category":"agenticgamedev","elo":1211,"win_rate":53.7,"rank":6},{"arena":"agents","category":"androidnative","elo":1104,"win_rate":33.2,"rank":22},{"arena":"agents","category":"fullstack","elo":1250,"win_rate":53,"rank":10},{"arena":"agents","category":"mobileapps","elo":1256,"win_rate":56.3,"rank":5},{"arena":"agents","category":"webapps","elo":1262,"win_rate":52.4,"rank":11},{"arena":"models","category":"3d","elo":1282,"win_rate":55.1,"rank":23},{"arena":"models","category":"asciiart","elo":1197,"win_rate":47.7,"rank":22},{"arena":"models","category":"codecategories","elo":1287,"win_rate":54.8,"rank":19},{"arena":"models","category":"dataviz","elo":1276,"win_rate":55,"rank":20},{"arena":"models","category":"gamedev","elo":1280,"win_rate":51.5,"rank":23},{"arena":"models","category":"svg","elo":1226,"win_rate":51.6,"rank":19},{"arena":"models","category":"uicomponent","elo":1281,"win_rate":53.5,"rank":21},{"arena":"models","category":"website","elo":1286,"win_rate":54.9,"rank":19}],"artificial_analysis":{"intelligence_index":44.4,"coding_index":58.6,"agentic_index":35.4}},"reasoning":{"mandatory":false}},{"id":"deepseek/deepseek-v4-pro","canonical_slug":"deepseek/deepseek-v4-pro-20260423","hugging_face_id":"deepseek-ai/DeepSeek-V4-Pro","name":"DeepSeek: DeepSeek V4 Pro","created":1777000679,"description":"DeepSeek V4 Pro is a large-scale Mixture-of-Experts model from DeepSeek with 1.6T total parameters and 49B activated parameters, supporting a 1M-token context window. It is designed for advanced reasoning, coding,...","context_length":1048576,"architecture":{"modality":"text->text","input_modalities":["text"],"output_modalities":["text"],"tokenizer":"DeepSeek","instruct_type":null},"pricing":{"prompt":"0.000000435","completion":"0.00000087","input_cache_read":"0.000000003625"},"top_provider":{"context_length":1048576,"max_completion_tokens":384000,"is_moderated":false},"per_request_limits":null,"supported_parameters":["frequency_penalty","include_reasoning","logit_bias","logprobs","max_tokens","min_p","presence_penalty","reasoning","reasoning_effort","repetition_penalty","response_format","seed","stop","structured_outputs","temperature","tool_choice","tools","top_k","top_logprobs","top_p"],"default_parameters":{"temperature":1,"top_p":1,"top_k":null,"frequency_penalty":null,"presence_penalty":null,"repetition_penalty":null},"supported_voices":null,"knowledge_cutoff":null,"expiration_date":null,"links":{"details":"/api/v1/models/deepseek/deepseek-v4-pro-20260423/endpoints"},"benchmarks":{"design_arena":[{"arena":"agents","category":"fullstack","elo":948,"win_rate":22.1,"rank":33},{"arena":"agents","category":"godotgamedev","elo":1059,"win_rate":34,"rank":27},{"arena":"agents","category":"webapps","elo":1005,"win_rate":26.6,"rank":33},{"arena":"models","category":"3d","elo":1311,"win_rate":58.9,"rank":12},{"arena":"models","category":"asciiart","elo":1193,"win_rate":46.6,"rank":24},{"arena":"models","category":"codecategories","elo":1271,"win_rate":54.1,"rank":25},{"arena":"models","category":"dataviz","elo":1211,"win_rate":47.5,"rank":43},{"arena":"models","category":"gamedev","elo":1288,"win_rate":55.8,"rank":21},{"arena":"models","category":"svg","elo":1185,"win_rate":46.6,"rank":36},{"arena":"models","category":"uicomponent","elo":1261,"win_rate":51.9,"rank":30},{"arena":"models","category":"website","elo":1261,"win_rate":52.8,"rank":28}],"artificial_analysis":{"intelligence_index":44.3,"coding_index":59.4,"agentic_index":36.4}},"reasoning":{"mandatory":false,"supported_efforts":["xhigh","high"],"default_effort":"high"}},{"id":"deepseek/deepseek-v4-flash","canonical_slug":"deepseek/deepseek-v4-flash-20260423","hugging_face_id":"deepseek-ai/DeepSeek-V4-Flash","name":"DeepSeek: DeepSeek V4 Flash","created":1777000666,"description":"DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and...","context_length":1048576,"architecture":{"modality":"text->text","input_modalities":["text"],"output_modalities":["text"],"tokenizer":"DeepSeek","instruct_type":null},"pricing":{"prompt":"0.00000014","completion":"0.00000028","input_cache_read":"0.000000028"},"top_provider":{"context_length":1048575,"max_completion_tokens":null,"is_moderated":false},"per_request_limits":null,"supported_parameters":["frequency_penalty","include_reasoning","logit_bias","logprobs","max_tokens","min_p","presence_penalty","reasoning","reasoning_effort","repetition_penalty","response_format","seed","stop","structured_outputs","temperature","tool_choice","tools","top_k","top_logprobs","top_p"],"default_parameters":{"temperature":null,"top_p":null,"top_k":null,"frequency_penalty":null,"presence_penalty":null,"repetition_penalty":null},"supported_voices":null,"knowledge_cutoff":null,"expiration_date":null,"links":{"details":"/api/v1/models/deepseek/deepseek-v4-flash-20260423/endpoints"},"benchmarks":{"design_arena":[{"arena":"models","category":"3d","elo":1250,"win_rate":49.8,"rank":34},{"arena":"models","category":"asciiart","elo":1156,"win_rate":43.1,"rank":41},{"arena":"models","category":"codecategories","elo":1239,"win_rate":49.6,"rank":37},{"arena":"models","category":"dataviz","elo":1158,"win_rate":40.9,"rank":68},{"arena":"models","category":"gamedev","elo":1254,"win_rate":50.4,"rank":32},{"arena":"models","category":"svg","elo":1204,"win_rate":48.8,"rank":26},{"arena":"models","category":"uicomponent","elo":1203,"win_rate":45.2,"rank":50},{"arena":"models","category":"website","elo":1235,"win_rate":50,"rank":36}],"artificial_analysis":{"intelligence_index":40.3,"coding_index":56.2,"agentic_index":31.1}},"reasoning":{"mandatory":false,"supported_efforts":["xhigh","high"],"default_effort":"high"}},{"id":"anthropic/claude-opus-4.8","canonical_slug":"anthropic/claude-4.8-opus-20260528","hugging_face_id":null,"name":"Anthropic: Claude Opus 4.8","created":1779905091,"description":"Claude Opus 4.8 is Anthropic's most capable generally available model in the Opus family. It supports text, image, and file inputs with text output, with reasoning support and a 1M-token...","context_length":1000000,"architecture":{"modality":"text+image+file->text","input_modalities":["text","image","file"],"output_modalities":["text"],"tokenizer":"Claude","instruct_type":null},"pricing":{"prompt":"0.000005","completion":"0.000025","web_search":"0.01","input_cache_read":"0.0000005","input_cache_write":"0.00000625","input_cache_write_1h":"0.00001"},"top_provider":{"context_length":1000000,"max_completion_tokens":128000,"is_moderated":true},"per_request_limits":null,"supported_parameters":["include_reasoning","max_completion_tokens","max_tokens","reasoning","reasoning_effort","response_format","stop","structured_outputs","temperature","tool_choice","tools","verbosity"],"default_parameters":{"temperature":null,"top_p":null,"top_k":null,"frequency_penalty":null,"presence_penalty":null,"repetition_penalty":null},"supported_voices":null,"knowledge_cutoff":null,"expiration_date":null,"links":{"details":"/api/v1/models/anthropic/claude-4.8-opus-20260528/endpoints"},"benchmarks":{"design_arena":[{"arena":"agents","category":"agenticgamedev","elo":1264,"win_rate":61.2,"rank":2},{"arena":"agents","category":"agentichtmlslides","elo":1227,"win_rate":55.6,"rank":4},{"arena":"agents","category":"agenticslides","elo":1294,"win_rate":64.8,"rank":2},{"arena":"agents","category":"agenticslides(html)","elo":1230,"win_rate":56,"rank":4},{"arena":"agents","category":"agenticslides(python-pptx)","elo":1310,"win_rate":68.9,"rank":2},{"arena":"agents","category":"androidnative","elo":1342,"win_rate":67.9,"rank":1},{"arena":"agents","category":"fullstack","elo":1307,"win_rate":62.9,"rank":3},{"arena":"agents","category":"godotgamedev","elo":1234,"win_rate":52.5,"rank":7},{"arena":"agents","category":"htmlslides","elo":1235,"win_rate":57,"rank":3},{"arena":"agents","category":"mobileapps","elo":1281,"win_rate":58.7,"rank":1},{"arena":"agents","category":"pptxslides","elo":1306,"win_rate":67.9,"rank":2},{"arena":"agents","category":"python-pptxslides","elo":1298,"win_rate":65.9,"rank":3},{"arena":"agents","category":"webapps","elo":1281,"win_rate":53.7,"rank":5},{"arena":"models","category":"3d","elo":1274,"win_rate":55.5,"rank":26},{"arena":"models","category":"asciiart","elo":1303,"win_rate":62.5,"rank":5},{"arena":"models","category":"codecategories","elo":1270,"win_rate":54.3,"rank":26},{"arena":"models","category":"dataviz","elo":1269,"win_rate":54.8,"rank":22},{"arena":"models","category":"gamedev","elo":1302,"win_rate":55.1,"rank":16},{"arena":"models","category":"svg","elo":1226,"win_rate":53.5,"rank":18},{"arena":"models","category":"uicomponent","elo":1279,"win_rate":54.2,"rank":24},{"arena":"models","category":"website","elo":1269,"win_rate":54.2,"rank":27}],"artificial_analysis":{"intelligence_index":55.7,"coding_index":74.3,"agentic_index":47.2}},"reasoning":{"mandatory":false,"supported_efforts":["max","xhigh","high","medium","low"],"default_effort":"medium"}},{"id":"anthropic/claude-opus-4.7","canonical_slug":"anthropic/claude-4.7-opus-20260416","hugging_face_id":null,"name":"Anthropic: Claude Opus 4.7","created":1776351100,"description":"Opus 4.7 is the next generation of Anthropic's Opus family, built for long-running, asynchronous agents. Building on the coding and agentic strengths of Opus 4.6, it delivers stronger performance on...","context_length":1000000,"architecture":{"modality":"text+image+file->text","input_modalities":["text","image","file"],"output_modalities":["text"],"tokenizer":"Claude","instruct_type":null},"pricing":{"prompt":"0.000005","completion":"0.000025","web_search":"0.01","input_cache_read":"0.0000005","input_cache_write":"0.00000625","input_cache_write_1h":"0.00001"},"top_provider":{"context_length":1000000,"max_completion_tokens":128000,"is_moderated":true},"per_request_limits":null,"supported_parameters":["include_reasoning","max_completion_tokens","max_tokens","reasoning","reasoning_effort","response_format","stop","structured_outputs","tool_choice","tools","verbosity"],"default_parameters":{"temperature":null,"top_p":null,"top_k":null,"frequency_penalty":null,"presence_penalty":null,"repetition_penalty":null},"supported_voices":null,"knowledge_cutoff":null,"expiration_date":null,"links":{"details":"/api/v1/models/anthropic/claude-4.7-opus-20260416/endpoints"},"benchmarks":{"design_arena":[{"arena":"agents","category":"agenticgamedev","elo":1260,"win_rate":61.5,"rank":3},{"arena":"agents","category":"agentichtmlslides","elo":1243,"win_rate":58,"rank":3},{"arena":"agents","category":"agenticslides","elo":1334,"win_rate":64.7,"rank":1},{"arena":"agents","category":"agenticslides(html)","elo":1242,"win_rate":57.8,"rank":3},{"arena":"agents","category":"agenticslides(python-pptx)","elo":1331,"win_rate":65.2,"rank":1},{"arena":"agents","category":"androidnative","elo":1264,"win_rate":56,"rank":6},{"arena":"agents","category":"fullstack","elo":1503,"win_rate":80.1,"rank":1},{"arena":"agents","category":"godotgamedev","elo":1270,"win_rate":60.9,"rank":3},{"arena":"agents","category":"htmlslides","elo":1240,"win_rate":57.5,"rank":2},{"arena":"agents","category":"pptxslides","elo":1333,"win_rate":64.9,"rank":1},{"arena":"agents","category":"python-pptxslides","elo":1336,"win_rate":63.1,"rank":1},{"arena":"agents","category":"webapps","elo":1311,"win_rate":61.9,"rank":3},{"arena":"models","category":"3d","elo":1305,"win_rate":58.6,"rank":16},{"arena":"models","category":"asciiart","elo":1326,"win_rate":66.7,"rank":2},{"arena":"models","category":"codecategories","elo":1321,"win_rate":60.2,"rank":7},{"arena":"models","category":"dataviz","elo":1312,"win_rate":60.7,"rank":8},{"arena":"models","category":"gamedev","elo":1336,"win_rate":61.2,"rank":6},{"arena":"models","category":"svg","elo":1273,"win_rate":61.2,"rank":6},{"arena":"models","category":"uicomponent","elo":1342,"win_rate":62.5,"rank":3},{"arena":"models","category":"website","elo":1322,"win_rate":60,"rank":5}],"artificial_analysis":{"intelligence_index":53.5,"coding_index":73.6,"agentic_index":44.4}},"reasoning":{"mandatory":false,"supported_efforts":["max","xhigh","high","medium","low"],"default_effort":"medium"}},{"id":"moonshotai/kimi-k3","canonical_slug":"moonshotai/kimi-k3-20260715","hugging_face_id":null,"name":"MoonshotAI: Kimi K3","created":1784215858,"description":"Kimi K3 is a 2.8T parameter open-weight multimodal reasoning model from Moonshot AI. It is suited for complex coding, knowledge work, and long-horizon agentic workflows, and is particularly strong at...","context_length":1048576,"architecture":{"modality":"text+image->text","input_modalities":["text","image"],"output_modalities":["text"],"tokenizer":"Other","instruct_type":null},"pricing":{"prompt":"0.000003","completion":"0.000015","input_cache_read":"0.0000003"},"top_provider":{"context_length":1048576,"max_completion_tokens":null,"is_moderated":false},"per_request_limits":null,"supported_parameters":["frequency_penalty","include_reasoning","max_tokens","presence_penalty","reasoning","reasoning_effort","response_format","stop","structured_outputs","tool_choice","tools"],"default_parameters":{"temperature":null,"top_p":null,"top_k":null,"frequency_penalty":null,"presence_penalty":null,"repetition_penalty":null},"supported_voices":null,"knowledge_cutoff":null,"expiration_date":null,"links":{"details":"/api/v1/models/moonshotai/kimi-k3-20260715/endpoints"},"benchmarks":{"design_arena":[{"arena":"agents","category":"godotgamedev","elo":1199,"win_rate":48.5,"rank":11},{"arena":"agents","category":"python-pptxslides","elo":1282,"win_rate":57.7,"rank":4},{"arena":"agents","category":"webapps","elo":1312,"win_rate":60.1,"rank":2},{"arena":"models","category":"3d","elo":1447,"win_rate":71.2,"rank":1},{"arena":"models","category":"codecategories","elo":1406,"win_rate":67.4,"rank":1},{"arena":"models","category":"dataviz","elo":1360,"win_rate":63.5,"rank":2},{"arena":"models","category":"uicomponent","elo":1439,"win_rate":71.8,"rank":1},{"arena":"models","category":"website","elo":1373,"win_rate":63.6,"rank":1}],"artificial_analysis":{"intelligence_index":57.1,"coding_index":76.2,"agentic_index":50.1}},"reasoning":{"mandatory":false,"default_enabled":true,"supported_efforts":["max","high","low"],"default_effort":"max"}},{"id":"stepfun/step-3.7-flash","canonical_slug":"stepfun/step-3.7-flash-20260528","hugging_face_id":"stepfun-ai/Step-3.7-Flash","name":"StepFun: Step 3.7 Flash","created":1779985069,"description":"Step 3.7 Flash is StepFun's latest high-efficiency multimodal Mixture-of-Experts model. It pairs a 196B-parameter language backbone with a vision encoder for native image and video understanding, activating roughly 11B parameters...","context_length":262144,"architecture":{"modality":"text+image+video->text","input_modalities":["text","image","video"],"output_modalities":["text"],"tokenizer":"Other","instruct_type":null},"pricing":{"prompt":"0.0000002","completion":"0.00000115","input_cache_read":"0.00000004"},"top_provider":{"context_length":256000,"max_completion_tokens":256000,"is_moderated":false},"per_request_limits":null,"supported_parameters":["frequency_penalty","include_reasoning","logit_bias","logprobs","max_tokens","min_p","presence_penalty","reasoning","reasoning_effort","repetition_penalty","response_format","seed","stop","structured_outputs","temperature","tool_choice","tools","top_k","top_logprobs","top_p"],"default_parameters":{"temperature":null,"top_p":null,"top_k":null,"frequency_penalty":null,"presence_penalty":null,"repetition_penalty":null},"supported_voices":null,"knowledge_cutoff":null,"expiration_date":null,"links":{"details":"/api/v1/models/stepfun/step-3.7-flash-20260528/endpoints"},"benchmarks":{"design_arena":[{"arena":"models","category":"3d","elo":1180,"win_rate":42.2,"rank":54},{"arena":"models","category":"asciiart","elo":1198,"win_rate":47,"rank":21},{"arena":"models","category":"codecategories","elo":1201,"win_rate":44.6,"rank":52},{"arena":"models","category":"dataviz","elo":1198,"win_rate":45,"rank":52},{"arena":"models","category":"gamedev","elo":1200,"win_rate":41.2,"rank":48},{"arena":"models","category":"svg","elo":1121,"win_rate":39.6,"rank":50},{"arena":"models","category":"uicomponent","elo":1197,"win_rate":43,"rank":52},{"arena":"models","category":"website","elo":1209,"win_rate":46.1,"rank":51}],"artificial_analysis":{"intelligence_index":30.3,"coding_index":39.6,"agentic_index":21.5}},"reasoning":{"mandatory":true,"supported_efforts":["high","medium","low"],"default_effort":"medium"}},{"id":"xiaomi/mimo-v2.5-pro","canonical_slug":"xiaomi/mimo-v2.5-pro-20260422","hugging_face_id":"XiaomiMiMo/MiMo-V2.5-Pro","name":"Xiaomi: MiMo-V2.5-Pro","created":1776874273,"description":"MiMo-V2.5-Pro is Xiaomi’s flagship model, delivering strong performance in general agentic capabilities, complex software engineering, and long-horizon tasks, with top rankings on benchmarks such as ClawEval, GDPVal, and SWE-bench Pro....","context_length":1050000,"architecture":{"modality":"text->text","input_modalities":["text"],"output_modalities":["text"],"tokenizer":"Other","instruct_type":null},"pricing":{"prompt":"0.000000435","completion":"0.00000087","input_cache_read":"0.0000000036"},"top_provider":{"context_length":1048576,"max_completion_tokens":131072,"is_moderated":false},"per_request_limits":null,"supported_parameters":["frequency_penalty","include_reasoning","logit_bias","logprobs","max_tokens","min_p","presence_penalty","reasoning","repetition_penalty","response_format","seed","stop","structured_outputs","temperature","tool_choice","tools","top_k","top_logprobs","top_p"],"default_parameters":{"temperature":1,"top_p":0.95,"top_k":null,"frequency_penalty":null,"presence_penalty":null,"repetition_penalty":null},"supported_voices":null,"knowledge_cutoff":null,"expiration_date":null,"links":{"details":"/api/v1/models/xiaomi/mimo-v2.5-pro-20260422/endpoints"},"benchmarks":{"design_arena":[{"arena":"models","category":"3d","elo":1306,"win_rate":57,"rank":15},{"arena":"models","category":"asciiart","elo":1186,"win_rate":47.6,"rank":30},{"arena":"models","category":"codecategories","elo":1303,"win_rate":57,"rank":12},{"arena":"models","category":"dataviz","elo":1279,"win_rate":56.4,"rank":17},{"arena":"models","category":"gamedev","elo":1331,"win_rate":60.9,"rank":7},{"arena":"models","category":"svg","elo":1223,"win_rate":52.6,"rank":21},{"arena":"models","category":"uicomponent","elo":1282,"win_rate":54.2,"rank":20},{"arena":"models","category":"website","elo":1297,"win_rate":55.9,"rank":14}],"artificial_analysis":{"intelligence_index":42.2,"coding_index":60.2,"agentic_index":29.1}},"reasoning":{"mandatory":false}},{"id":"tencent/hy3","canonical_slug":"tencent/hy3-20260706","hugging_face_id":"tencent/Hy3","name":"Tencent: Hy3","created":1783344048,"description":"Hy3 is a 295B-parameter Mixture-of-Experts model from Tencent (21B active, 192 experts with top-8 routing) built for reasoning, agentic workflows, and real-world production use. It supports a configurable reasoning effort:...","context_length":262144,"architecture":{"modality":"text->text","input_modalities":["text"],"output_modalities":["text"],"tokenizer":"Other","instruct_type":null},"pricing":{"prompt":"0.00000014","completion":"0.00000058","input_cache_read":"0.000000035"},"top_provider":{"context_length":262144,"max_completion_tokens":262144,"is_moderated":false},"per_request_limits":null,"supported_parameters":["frequency_penalty","include_reasoning","logit_bias","max_completion_tokens","max_tokens","min_p","presence_penalty","reasoning","reasoning_effort","repetition_penalty","response_format","seed","stop","structured_outputs","temperature","tool_choice","tools","top_k","top_p"],"default_parameters":{"temperature":0.9,"top_p":1,"top_k":null,"frequency_penalty":null,"presence_penalty":null,"repetition_penalty":null},"supported_voices":null,"knowledge_cutoff":null,"expiration_date":null,"links":{"details":"/api/v1/models/tencent/hy3-20260706/endpoints"},"benchmarks":{"design_arena":[{"arena":"models","category":"3d","elo":1272,"win_rate":50.7,"rank":27},{"arena":"models","category":"codecategories","elo":1243,"win_rate":46.8,"rank":35},{"arena":"models","category":"dataviz","elo":1192,"win_rate":41.2,"rank":56},{"arena":"models","category":"gamedev","elo":1188,"win_rate":38.3,"rank":57},{"arena":"models","category":"uicomponent","elo":1238,"win_rate":46,"rank":37},{"arena":"models","category":"website","elo":1233,"win_rate":45.7,"rank":37}]},"reasoning":{"mandatory":false,"default_enabled":true,"supported_efforts":["high","low","none"],"default_effort":"high"}},{"id":"openai/gpt-5.4","canonical_slug":"openai/gpt-5.4-20260305","hugging_face_id":"","name":"OpenAI: GPT-5.4","created":1772734352,"description":"GPT-5.4 is OpenAI’s latest frontier model, unifying the Codex and GPT lines into a single system. It features a 1M+ token context window (922K input, 128K output) with support for...","context_length":1050000,"architecture":{"modality":"text+image+file->text","input_modalities":["text","image","file"],"output_modalities":["text"],"tokenizer":"GPT","instruct_type":null},"pricing":{"prompt":"0.0000025","completion":"0.000015","web_search":"0.01","input_cache_read":"0.00000025","overrides":[{"min_prompt_tokens":272000,"prompt":"0.000005","completion":"0.0000225","input_cache_read":"0.0000005"}]},"top_provider":{"context_length":1050000,"max_completion_tokens":128000,"is_moderated":false},"per_request_limits":null,"supported_parameters":["include_reasoning","max_completion_tokens","max_tokens","reasoning","reasoning_effort","response_format","seed","structured_outputs","tool_choice","tools"],"default_parameters":{"temperature":null,"top_p":null,"top_k":null,"frequency_penalty":null,"presence_penalty":null,"repetition_penalty":null},"supported_voices":null,"knowledge_cutoff":null,"expiration_date":null,"links":{"details":"/api/v1/models/openai/gpt-5.4-20260305/endpoints"},"benchmarks":{"design_arena":[{"arena":"models","category":"3d","elo":1161,"win_rate":42.3,"rank":59},{"arena":"models","category":"asciiart","elo":1240,"win_rate":55.5,"rank":11},{"arena":"models","category":"codecategories","elo":1245,"win_rate":52.6,"rank":34},{"arena":"models","category":"dataviz","elo":1267,"win_rate":56.3,"rank":23},{"arena":"models","category":"gamedev","elo":1298,"win_rate":57.8,"rank":17},{"arena":"models","category":"svg","elo":1243,"win_rate":57.8,"rank":13},{"arena":"models","category":"uicomponent","elo":1280,"win_rate":57.5,"rank":22},{"arena":"models","category":"website","elo":1247,"win_rate":52.6,"rank":33},{"arena":"agents","category":"androidnative","elo":1017,"win_rate":47.4,"rank":30},{"arena":"agents","category":"fullstack","elo":1075,"win_rate":40.8,"rank":29},{"arena":"agents","category":"godotgamedev","elo":1135,"win_rate":46.9,"rank":22},{"arena":"agents","category":"mobileapps","elo":1147,"win_rate":44.1,"rank":26},{"arena":"agents","category":"webapps","elo":1122,"win_rate":41.3,"rank":28}],"artificial_analysis":{"intelligence_index":51.4,"coding_index":71.1,"agentic_index":41.1}},"reasoning":{"mandatory":false,"default_enabled":false,"supported_efforts":["xhigh","high","medium","low","none"],"default_effort":"medium"}},{"id":"cohere/north-mini-code:free","canonical_slug":"cohere/north-mini-code-20260617","hugging_face_id":"CohereLabs/North-Mini-Code-1.0","name":"Cohere: North Mini Code (free)","created":1781723748,"description":"North Mini Code is Cohere's first agentic coding model and the debut of its North family. A sparse mixture-of-experts model with 30B total parameters and 3B active, it is optimized...","context_length":256000,"architecture":{"modality":"text->text","input_modalities":["text"],"output_modalities":["text"],"tokenizer":"Cohere","instruct_type":null},"pricing":{"prompt":"0","completion":"0"},"top_provider":{"context_length":256000,"max_completion_tokens":64000,"is_moderated":true},"per_request_limits":null,"supported_parameters":["frequency_penalty","include_reasoning","max_tokens","presence_penalty","reasoning","seed","stop","temperature","tool_choice","tools","top_k","top_p"],"default_parameters":{"temperature":null,"top_p":null,"top_k":null,"frequency_penalty":null,"presence_penalty":null,"repetition_penalty":null},"supported_voices":null,"knowledge_cutoff":null,"expiration_date":null,"links":{"details":"/api/v1/models/cohere/north-mini-code-20260617/endpoints"},"benchmarks":{"design_arena":[],"artificial_analysis":{"intelligence_index":19.8,"coding_index":36.5,"agentic_index":3.1}},"reasoning":{"mandatory":false}},{"id":"openai/gpt-5.6-sol","canonical_slug":"openai/gpt-5.6-sol-20260709","hugging_face_id":null,"name":"OpenAI: GPT-5.6 Sol","created":1783590850,"description":"GPT-5.6 Sol is the flagship model in OpenAI's GPT-5.6 series. It is suited for complex reasoning, coding, and agentic workflows, and is particularly strong at command-line and multi-step coding tasks...","context_length":1050000,"architecture":{"modality":"text+image+file->text","input_modalities":["file","image","text"],"output_modalities":["text"],"tokenizer":"GPT","instruct_type":null},"pricing":{"prompt":"0.000005","completion":"0.00003","web_search":"0.01","input_cache_read":"0.0000005","input_cache_write":"0.00000625","overrides":[{"min_prompt_tokens":272000,"prompt":"0.00001","completion":"0.000045","input_cache_read":"0.000001","input_cache_write":"0.0000125"}]},"top_provider":{"context_length":1050000,"max_completion_tokens":128000,"is_moderated":true},"per_request_limits":null,"supported_parameters":["include_reasoning","max_completion_tokens","max_tokens","reasoning","reasoning_effort","response_format","seed","structured_outputs","tool_choice","tools"],"default_parameters":{"temperature":null,"top_p":null,"top_k":null,"frequency_penalty":null,"presence_penalty":null,"repetition_penalty":null},"supported_voices":null,"knowledge_cutoff":"2026-02-16","expiration_date":null,"links":{"details":"/api/v1/models/openai/gpt-5.6-sol-20260709/endpoints"},"benchmarks":{"design_arena":[],"artificial_analysis":{"intelligence_index":58.9,"coding_index":77.4,"agentic_index":54}},"reasoning":{"mandatory":false,"default_enabled":true,"supported_efforts":["max","xhigh","high","medium","low","none"],"default_effort":"medium"}},{"id":"x-ai/grok-4.5","canonical_slug":"x-ai/grok-4.5-20260708","hugging_face_id":null,"name":"xAI: Grok 4.5","created":1783523154,"description":"Grok 4.5 is SpaceXAI's smartest model with frontier performance on coding, knowledge work, and STEM.","context_length":500000,"architecture":{"modality":"text+image+file->text","input_modalities":["text","image","file"],"output_modalities":["text"],"tokenizer":"Grok","instruct_type":null},"pricing":{"prompt":"0.000002","completion":"0.000006","web_search":"0.005","input_cache_read":"0.0000003","overrides":[{"min_prompt_tokens":200000,"prompt":"0.000004","completion":"0.000012","input_cache_read":"0.0000006"}]},"top_provider":{"context_length":500000,"max_completion_tokens":null,"is_moderated":false},"per_request_limits":null,"supported_parameters":["frequency_penalty","include_reasoning","logprobs","max_tokens","presence_penalty","reasoning","reasoning_effort","response_format","seed","stop","structured_outputs","temperature","tool_choice","tools","top_logprobs","top_p"],"default_parameters":{"temperature":null,"top_p":null,"top_k":null,"frequency_penalty":null,"presence_penalty":null,"repetition_penalty":null},"supported_voices":null,"knowledge_cutoff":null,"expiration_date":null,"links":{"details":"/api/v1/models/x-ai/grok-4.5-20260708/endpoints"},"benchmarks":{"design_arena":[{"arena":"agents","category":"agenticgamedev","elo":1225,"win_rate":53,"rank":5},{"arena":"agents","category":"androidnative","elo":1265,"win_rate":58,"rank":5},{"arena":"agents","category":"fullstack","elo":1304,"win_rate":61.6,"rank":4},{"arena":"agents","category":"godotgamedev","elo":1299,"win_rate":61.6,"rank":2},{"arena":"agents","category":"htmlslides","elo":1233,"win_rate":54.5,"rank":5},{"arena":"agents","category":"python-pptxslides","elo":1234,"win_rate":51.5,"rank":8},{"arena":"agents","category":"webapps","elo":1274,"win_rate":53.2,"rank":7},{"arena":"models","category":"3d","elo":1332,"win_rate":58.7,"rank":8},{"arena":"models","category":"codecategories","elo":1323,"win_rate":57.6,"rank":5},{"arena":"models","category":"dataviz","elo":1301,"win_rate":56.5,"rank":11},{"arena":"models","category":"gamedev","elo":1330,"win_rate":54.4,"rank":8},{"arena":"models","category":"uicomponent","elo":1331,"win_rate":56,"rank":7},{"arena":"models","category":"website","elo":1321,"win_rate":57.9,"rank":6}],"artificial_analysis":{"intelligence_index":53.8,"coding_index":72.4,"agentic_index":45.7}},"reasoning":{"mandatory":true,"default_enabled":true,"supported_efforts":["high","medium","low"],"default_effort":"high"}},{"id":"anthropic/claude-sonnet-5","canonical_slug":"anthropic/claude-sonnet-5-20260630","hugging_face_id":null,"name":"Anthropic: Claude Sonnet 5","created":1782843083,"description":"Sonnet 5 is Anthropic's most capable Sonnet-class model, with frontier performance across coding, agents, and professional work. It supports adaptive thinking with selectable reasoning effort levels (low, medium, high, max,...","context_length":1000000,"architecture":{"modality":"text+image+file->text","input_modalities":["text","image","file"],"output_modalities":["text"],"tokenizer":"Claude","instruct_type":null},"pricing":{"prompt":"0.000002","completion":"0.00001","web_search":"0.01","input_cache_read":"0.0000002","input_cache_write":"0.0000025","input_cache_write_1h":"0.000004"},"top_provider":{"context_length":1000000,"max_completion_tokens":128000,"is_moderated":true},"per_request_limits":null,"supported_parameters":["include_reasoning","max_completion_tokens","max_tokens","reasoning","reasoning_effort","response_format","stop","structured_outputs","tool_choice","tools","verbosity"],"default_parameters":{"temperature":null,"top_p":null,"top_k":null,"frequency_penalty":null,"presence_penalty":null,"repetition_penalty":null},"supported_voices":null,"knowledge_cutoff":null,"expiration_date":null,"links":{"details":"/api/v1/models/anthropic/claude-sonnet-5-20260630/endpoints"},"benchmarks":{"design_arena":[{"arena":"agents","category":"agenticgamedev","elo":1240,"win_rate":54.9,"rank":4},{"arena":"agents","category":"androidnative","elo":1256,"win_rate":55.8,"rank":8},{"arena":"agents","category":"fullstack","elo":1289,"win_rate":59.5,"rank":5},{"arena":"agents","category":"godotgamedev","elo":1239,"win_rate":53.5,"rank":5},{"arena":"agents","category":"htmlslides","elo":1233,"win_rate":53.9,"rank":4},{"arena":"agents","category":"python-pptxslides","elo":1252,"win_rate":55,"rank":6},{"arena":"agents","category":"webapps","elo":1303,"win_rate":57.1,"rank":4},{"arena":"models","category":"3d","elo":1321,"win_rate":57,"rank":9},{"arena":"models","category":"asciiart","elo":1230,"win_rate":51.2,"rank":14},{"arena":"models","category":"codecategories","elo":1312,"win_rate":56.8,"rank":8},{"arena":"models","category":"dataviz","elo":1281,"win_rate":54.4,"rank":15},{"arena":"models","category":"gamedev","elo":1345,"win_rate":59.9,"rank":3},{"arena":"models","category":"svg","elo":1240,"win_rate":53.9,"rank":14},{"arena":"models","category":"uicomponent","elo":1317,"win_rate":56.5,"rank":9},{"arena":"models","category":"website","elo":1314,"win_rate":57.6,"rank":8}],"artificial_analysis":{"intelligence_index":53.4,"coding_index":71.5,"agentic_index":46.7}},"reasoning":{"mandatory":false,"supported_efforts":["max","xhigh","high","medium","low"],"default_effort":"medium"}},{"id":"z-ai/glm-5","canonical_slug":"z-ai/glm-5-20260211","hugging_face_id":"zai-org/GLM-5","name":"Z.ai: GLM 5","created":1770829182,"description":"GLM-5 is Z.ai’s flagship open-source foundation model engineered for complex systems design and long-horizon agent workflows. Built for expert developers, it delivers production-grade performance on large-scale programming tasks, rivaling leading...","context_length":204800,"architecture":{"modality":"text->text","input_modalities":["text"],"output_modalities":["text"],"tokenizer":"Other","instruct_type":null},"pricing":{"prompt":"0.00000095","completion":"0.00000255","input_cache_read":"0.0000002"},"top_provider":{"context_length":204800,"max_completion_tokens":131072,"is_moderated":false},"per_request_limits":null,"supported_parameters":["frequency_penalty","include_reasoning","logit_bias","logprobs","max_tokens","min_p","presence_penalty","reasoning","repetition_penalty","response_format","seed","stop","structured_outputs","temperature","tool_choice","tools","top_k","top_logprobs","top_p"],"default_parameters":{"temperature":1,"top_p":0.95,"frequency_penalty":null},"supported_voices":null,"knowledge_cutoff":null,"expiration_date":null,"links":{"details":"/api/v1/models/z-ai/glm-5-20260211/endpoints"},"benchmarks":{"design_arena":[{"arena":"agents","category":"androidnative","elo":1224,"win_rate":59.6,"rank":12},{"arena":"agents","category":"fullstack","elo":1179,"win_rate":51.9,"rank":17},{"arena":"agents","category":"godotgamedev","elo":1144,"win_rate":46.7,"rank":17},{"arena":"agents","category":"htmlslides","elo":1171,"win_rate":44.4,"rank":14},{"arena":"agents","category":"mobileapps","elo":1214,"win_rate":52.5,"rank":14},{"arena":"models","category":"3d","elo":1289,"win_rate":56.4,"rank":22},{"arena":"models","category":"asciiart","elo":1189,"win_rate":48,"rank":28},{"arena":"models","category":"codecategories","elo":1279,"win_rate":55.5,"rank":22},{"arena":"models","category":"dataviz","elo":1262,"win_rate":53,"rank":26},{"arena":"models","category":"gamedev","elo":1292,"win_rate":57.4,"rank":18},{"arena":"models","category":"svg","elo":1216,"win_rate":54.4,"rank":23},{"arena":"models","category":"uicomponent","elo":1272,"win_rate":53.9,"rank":26},{"arena":"models","category":"website","elo":1275,"win_rate":55,"rank":24}]},"reasoning":{"mandatory":false,"default_enabled":true}},{"id":"google/gemini-3-flash-preview","canonical_slug":"google/gemini-3-flash-preview-20251217","hugging_face_id":"","name":"Google: Gemini 3 Flash Preview","created":1765987078,"description":"Gemini 3 Flash Preview is a high speed, high value thinking model designed for agentic workflows, multi turn chat, and coding assistance. It delivers near Pro level reasoning and tool...","context_length":1048576,"architecture":{"modality":"text+image+file+audio+video->text","input_modalities":["text","image","file","audio","video"],"output_modalities":["text"],"tokenizer":"Gemini","instruct_type":null},"pricing":{"prompt":"0.0000005","completion":"0.000003","image":"0.0000005","audio":"0.000001","input_audio_cache":"0.0000001","web_search":"0.014","internal_reasoning":"0.000003","input_cache_read":"0.00000005","input_cache_write":"0.00000008333333333333334"},"top_provider":{"context_length":1048576,"max_completion_tokens":65535,"is_moderated":false},"per_request_limits":null,"supported_parameters":["include_reasoning","max_tokens","reasoning","reasoning_effort","response_format","seed","stop","structured_outputs","temperature","tool_choice","tools","top_p"],"default_parameters":{"temperature":null,"top_p":null,"top_k":null,"frequency_penalty":null,"presence_penalty":null,"repetition_penalty":null},"supported_voices":null,"knowledge_cutoff":null,"expiration_date":null,"links":{"details":"/api/v1/models/google/gemini-3-flash-preview-20251217/endpoints"},"benchmarks":{"design_arena":[{"arena":"agents","category":"agenticslides","elo":1073,"win_rate":39.3,"rank":9},{"arena":"agents","category":"agenticslides(python-pptx)","elo":1075,"win_rate":39.3,"rank":9},{"arena":"agents","category":"androidnative","elo":1039,"win_rate":48,"rank":28},{"arena":"agents","category":"fullstack","elo":1120,"win_rate":47.1,"rank":21},{"arena":"agents","category":"godotgamedev","elo":1161,"win_rate":50.6,"rank":16},{"arena":"agents","category":"mobileapps","elo":1178,"win_rate":49.1,"rank":21},{"arena":"agents","category":"python-pptxslides","elo":1020,"win_rate":38.3,"rank":18},{"arena":"agents","category":"webapps","elo":1171,"win_rate":49.2,"rank":23},{"arena":"models","category":"3d","elo":1244,"win_rate":62.7,"rank":36},{"arena":"models","category":"codecategories","elo":1223,"win_rate":57.6,"rank":40},{"arena":"models","category":"gamedev","elo":1225,"win_rate":58.3,"rank":42},{"arena":"models","category":"website","elo":1223,"win_rate":57,"rank":40}]},"reasoning":{"mandatory":false,"supported_efforts":["high","medium","low","minimal"],"default_effort":"medium"}}],"total_count":19,"links":{"next":null}}