P
PiazBench
Back to home

Cost

Compare input and output pricing across all AI models. Sorted by lowest input cost per million tokens.

RankModelScore
1
Google
Gemma 4 E4Bgoogle/gemma-4-e4b-non-reasoning
$0.02
2
Meta
Llama 3.1 Instruct 8Bmeta/llama-3-1-instruct-8b
$0.02
3
S
Sarvam 30Bsarvam/sarvam-30b
$0.03
4
I
Granite 4.2 3Bibm/granite-4-2-3b
$0.03
5
Alibaba
Qwen3.5 4Balibaba/qwen3-5-4b
$0.03
6
I
Granite 3.3 8Bibm/granite-3-3-8b-instruct
$0.03
7
Amazon
Nova Microaws/nova-micro
$0.04
8
NVIDIA
NVIDIA Nemotron Nano 9B V2nvidia/nvidia-nemotron-nano-9b-v2-reasoning
$0.04
9
M
HyperNova 60B 2605multiversecomputing/hypernova-60b
$0.04
10
S
Sarvam 105Bsarvam/sarvam-105b
$0.04
11
Meta
Llama 3 Instruct 8Bmeta/llama-3-instruct-8b
$0.04
12
S
Agnes 3.0 Flashagnes-ai/agnes-3-0-flash
$0.05
13
NVIDIA
NVIDIA Nemotron 3 Nano 30B A3Bnvidia/nvidia-nemotron-3-nano-30b-a3b-reasoning
$0.05
14
I
Granite 4.1 8Bibm/granite-4-1-8b
$0.05
15
OpenAI
GPT-5openai/gpt-5-nano-minimal
$0.05
16
Meta
Llama 2 Chat 7Bmeta/llama-2-chat-7b
$0.05
17
Alibaba
Qwen2.5alibaba/qwen-turbo
$0.05
18
OpenAI
gpt oss 20bopenai/gpt-oss-20b
$0.06
19
NVIDIA
Nemotron 3.5 Lightningnvidia/nemotron-3-5-lightning
$0.06
20
I
Granite 4.0 H Smallibm/granite-4-0-h-small
$0.06
21
I
Granite 4.2 8Bibm/granite-4-2-8b
$0.06
22
Amazon
Nova Liteaws/nova-lite
$0.06
23
T
Hy3tencent/hy3-preview
$0.06
24
Z
GLM 4.7 Flashzai/glm-4-7-flash
$0.07
25
I
Ling 3.0 Flashinclusionai/ling-3-0-flash
$0.07
26
NVIDIA
Nemotron 3 Nano Omni 30B A3B Rnvidia/nemotron-3-nano-omni-30b-a3b
$0.09
27
DeepSeek
DeepSeek V4 Flashdeepseek/deepseek-v4-flash-0420-non-reasoning
$0.09
28
Google
Gemma 4 12Bgoogle/gemma-4-12b
$0.10
29
Mistral
Ministral 3 3Bmistral/ministral-3-3b
$0.10
30
A
Olmo 3 7B Instructai2/olmo-3-7b-instruct
$0.10

255 models tested