Token 成本試算器 (Price Calculator)

依據每次請求之 Input / Output Token 數量與請求次數,精確試算並排名各供應商總成本。

View Llama 3.1 70B Instruct Matrix

重要說明:下方輸入的 Input / Output Tokens 代表「每次請求 (Per Request)」的 Token 數量,總成本會自動乘以 Request Count(請求次數)。

Total Cost = ((Input Tokens × Input USD/1M + Output Tokens × Output USD/1M) / 1,000,000) × Request Count

常用試算情境預設:
最低總成本供應商
$0.8000
OpenRouter (openrouter/meta-llama/llama-3.1-70b-instruct)
Highest Cost Provider
$2.00
Perplexity (perplexity/llama-3.1-70b-instruct)
最高與最低價差
$1.20
Total workload difference
最高可節省比例
60.0%
Choosing lowest vs highest

Estimated Workload Cost by Provider (USD)

各供應商預估成本排名(僅列出具備完整 Input 與 Output 報價之方案)

若某供應商缺少 Input 或 Output 任一必要價格欄位,系統不會將其納入總成本排名,以避免不完整的成本比較。

RankProvider · LiteLLM IDInput / 1MOutput / 1MInput CostOutput CostTotal Costvs Cheapest
#1
OpenRouter· Standard · Global
openrouter/meta-llama/llama-3.1-70b-instruct
$0.40$0.40$0.4000$0.4000$0.8000Cheapest
#2
Weights & Biases (Weave)· Standard · Global
wandb/meta-llama/Llama-3.1-70B-Instruct
$0.80$0.80$0.8000$0.8000$1.60+$0.8000 (save 50.0%)
#3
Perplexity· Standard · Global
perplexity/llama-3.1-70b-instruct
$1.00$1.00$1.00$1.00$2.00+$1.20 (save 60.0%)
1 offerings excluded from cost ranking (missing required price fields or filtered out):
Google Vertex AI (Llama) (vertex_ai/meta/llama-3.1-70b-instruct-maas): Local / Free ($0.00) tier (toggle checkbox above to include)