1 inclusionAI: Ling-2.6-flash 0.01 0.03 262.1k — 2 IBM: Granite 4.0 Micro 0.017 0.112 131.0k — 3 mistralai/mistral-nemo 0.019 0.03 131.1k 34.8B 4 inclusionAI: Ling 3.0 Flash 0.021 0.063 262.1k — 5 nex-agi/nex-n2-mini 0.025 0.1 262.1k 29.6B 6 OpenAI: GPT-5 Nano (batch) 0.025 0.2 400.0k — 7 Meta: Llama 3.2 1B Instruct 0.027 0.201 60.0k — 8 openai/gpt-oss-20b 0.03 0.13 131.1k 36.3B 9 Qwen: Qwen3.7 Flash 0.03 0.13 1.0M — 10 Inference.net: Schematron V2 Turbo 0.03 0.15 128.0k — 11 Amazon: Nova Micro 1.0 0.035 0.14 128.0k — 12 openai/gpt-oss-120b 0.037 0.17 131.1k 112.5B 13 Cohere: Command R7B (12-2024) 0.0375 0.15 128.0k — 14 Sao10K: Llama 3 8B Lunaris 0.04 0.05 8.2k — 15 DeepSeek: DeepSeek V4 Flash 0731 0.04 0.08 1.3M — 16 DeepSeek V4 Flash Latest 0.04 0.08 1.3M — 17 Inception: Mercury 2.5 Preview 0.04 0.15 260.0k — 18 Inception: Mercury 2.5 0.04 0.15 260.0k — 19 Google: Gemma 4 26B A4B 0.042 0.22 262.1k — 20 Tencent: Hy-MT2-1.8B 0.044 0.177 8.2k — 21 IBM: Granite 4.1 8B 0.05 0.1 131.1k — 22 NVIDIA: Nemotron 3 Nano 30B A3B 0.05 0.2 262.1k — 23 OpenAI: GPT-5 Nano 0.05 0.4 400.0k — 24 Google: Gemma 3 4B 0.05 0.1 131.1k — 25 Google: Gemma 3 12B 0.05 0.15 131.1k — 26 Mistral: Mistral Small 3 0.05 0.08 32.8k — 27 Meta: Llama 3.2 3B Instruct 0.05 0.33 131.1k — 28 Meta: Llama 3.1 8B Instruct 0.05 0.08 131.1k 11.3B 29 Google: Gemini 2.5 Flash Lite (batch) 0.05 0.2 1.0M — 30 OpenAI: GPT-4.1 Nano (batch) 0.05 0.2 1.0M — 31 OpenAI: gpt-oss-20b (batch) 0.05 0.2 131.1k — 32 Inference.net: Schematron V2 Small 0.05 0.23 128.0k — 33 Poolside: Laguna XS 2.1 0.06 0.12 262.1k — 34 Google: Gemma 3n 4B 0.06 0.12 32.8k — 35 Amazon: Nova Lite 1.0 0.06 0.24 300.0k — 36 MythoMax 13B 0.06 0.06 8.2k — 37 IBM: Granite 4.2 8B 0.06 0.25 131.1k — 38 inclusionAI: Ling 3.0 Flash Fin 0.06 0.18 262.1k — 39 inclusionAI: Ling 3.0 Flash VL 0.06 0.18 131.1k — 40 Z.ai: GLM 4.7 Flash 0.0605 0.4 200.0k —