Token 成本試算器 (Price Calculator)

依據每次請求之 Input / Output Token 數量與請求次數,精確試算並排名各供應商總成本。

View Nvidia Nemotron Nano 9B V2 Matrix

重要說明:下方輸入的 Input / Output Tokens 代表「每次請求 (Per Request)」的 Token 數量,總成本會自動乘以 Request Count(請求次數)。

Total Cost = ((Input Tokens × Input USD/1M + Output Tokens × Output USD/1M) / 1,000,000) × Request Count

常用試算情境預設:
最低總成本供應商
$0.2000
DeepInfra (deepinfra/nvidia/NVIDIA-Nemotron-Nano-9B-v2)
Highest Cost Provider
$0.4000
Fireworks AI (fireworks_ai/accounts/fireworks/models/nvidia-nemotron-nano-9b-v2)
最高與最低價差
$0.2000
Total workload difference
最高可節省比例
50.0%
Choosing lowest vs highest

Estimated Workload Cost by Provider (USD)

各供應商預估成本排名(僅列出具備完整 Input 與 Output 報價之方案)

若某供應商缺少 Input 或 Output 任一必要價格欄位,系統不會將其納入總成本排名,以避免不完整的成本比較。

RankProvider · LiteLLM IDInput / 1MOutput / 1MInput CostOutput CostTotal Costvs Cheapest
#1
DeepInfra· Standard · Global
deepinfra/nvidia/NVIDIA-Nemotron-Nano-9B-v2
$0.04$0.16$0.0400$0.1600$0.2000Cheapest
#2
Together AI· Standard · Global
together_ai/nvidia/NVIDIA-Nemotron-Nano-9B-v2
$0.06$0.25$0.0600$0.2500$0.3100+$0.1100 (save 35.5%)
#3
Fireworks AI· Standard · Global
fireworks_ai/accounts/fireworks/models/nvidia-nemotron-nano-9b-v2
$0.20$0.20$0.2000$0.2000$0.4000+$0.2000 (save 50.0%)