LLM · USD / JPY

LLM API price reference

Reference official LLM API input, output, and cached-input prices by provider, billing unit, and condition. Quality and latency are not evaluated.

Anthropic

Claude Fable 5

input: $10 / 1M tokens

cached input: $1 / 1M tokens

output: $50 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

Claude Haiku 4.5

input: $1 / 1M tokens

cached input: $0.1 / 1M tokens

output: $5 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

Claude Opus 5

input: $5 / 1M tokens

cached input: $0.5 / 1M tokens

output: $25 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

Claude Sonnet 4.6

input: $3 / 1M tokens

cached input: $0.3 / 1M tokens

output: $15 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

Claude Sonnet 5

introductory

Introductory pricing through 2026-08-31

input: $2 / 1M tokens

cached input: $0.2 / 1M tokens

output: $10 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

Claude Sonnet 5

from-2026-09-01

Effective from 2026-09-01

input: $3 / 1M tokens

cached input: $0.3 / 1M tokens

output: $15 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

DeepSeek

DeepSeek-V4-Flash

input: $0.14 / 1M tokens

cached input: $0.0028 / 1M tokens

output: $0.28 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

DeepSeek-V4-Pro

input: $0.435 / 1M tokens

cached input: $0.003625 / 1M tokens

output: $0.87 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

Google Gemini

Gemini 2.5 Flash

input: $0.3 / 1M tokens

output: $2.5 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

Gemini 2.5 Flash-Lite

input: $0.1 / 1M tokens

output: $0.4 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

Gemini 2.5 Pro

up-to-200k

Prompt length up to 200,000 tokens

input: $1.25 / 1M tokens

output: $10 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

Gemini 2.5 Pro

over-200k

Prompt length over 200,000 tokens

input: $2.5 / 1M tokens

output: $15 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

Gemini 3.1 Pro Preview

up-to-200k

Prompt length up to 200,000 tokens

input: $2 / 1M tokens

cached input: $0.2 / 1M tokens

output: $12 / 1M tokens

Preview
Official pricing ↗

Last verified: 2026-07-28

Gemini 3.1 Pro Preview

over-200k

Prompt length over 200,000 tokens

input: $4 / 1M tokens

cached input: $0.4 / 1M tokens

output: $18 / 1M tokens

Preview
Official pricing ↗

Last verified: 2026-07-28

Gemini 3.5 Flash

input: $1.5 / 1M tokens

cached input: $0.15 / 1M tokens

output: $9 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

Gemini 3.5 Flash-Lite

input: $0.3 / 1M tokens

output: $2.5 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

Gemini 3.6 Flash

input: $1.5 / 1M tokens

cached input: $0.15 / 1M tokens

output: $7.5 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

Kimi

Kimi K2.6

input: $0.95 / 1M tokens

cached input: $0.16 / 1M tokens

output: $4 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-08-04

Kimi K3

input: $3 / 1M tokens

cached input: $0.3 / 1M tokens

output: $15 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-08-04

Mistral

Ministral 3 14B

input: $0.2 / 1M tokens

cached input: $0.02 / 1M tokens

output: $0.2 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-08-04

Ministral 3 3B

input: $0.1 / 1M tokens

cached input: $0.01 / 1M tokens

output: $0.1 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-08-04

Ministral 3 8B

input: $0.15 / 1M tokens

cached input: $0.015 / 1M tokens

output: $0.15 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-08-04

Mistral Large 3

input: $0.5 / 1M tokens

cached input: $0.05 / 1M tokens

output: $1.5 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-08-04

Mistral Medium 3.5

input: $1.5 / 1M tokens

cached input: $0.15 / 1M tokens

output: $7.5 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-08-04

Mistral Small 4

input: $0.15 / 1M tokens

cached input: $0.015 / 1M tokens

output: $0.6 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-08-04

OpenAI

GPT-4.1

input: $2 / 1M tokens

cached input: $0.5 / 1M tokens

output: $8 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

GPT-4o mini

input: $0.15 / 1M tokens

cached input: $0.075 / 1M tokens

output: $0.6 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

GPT-5.4

input: $2.5 / 1M tokens

cached input: $0.25 / 1M tokens

output: $15 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

GPT-5.4-mini

input: $0.75 / 1M tokens

cached input: $0.075 / 1M tokens

output: $4.5 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

GPT-5.4-nano

input: $0.2 / 1M tokens

cached input: $0.02 / 1M tokens

output: $1.25 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

GPT-5.6-luna

input: $1 / 1M tokens

cached input: $0.1 / 1M tokens

output: $6 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

GPT-5.6-sol

input: $5 / 1M tokens

cached input: $0.5 / 1M tokens

output: $30 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

GPT-5.6-terra

input: $2.5 / 1M tokens

cached input: $0.25 / 1M tokens

output: $15 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

PLaMo

PLaMo 3.0 Prime

Prices apply up to 128,000 tokens (Standard plan)

Official pricing is published in JPY only; no USD price exists, so this model is listed for reference and excluded from USD ranking and estimates. No cached-input pricing is offered.

Comparison only

input: ¥60 / 1M tokens

output: ¥250 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-08-04

Sakana AI

Fugu Ultra V1.1

Context up to 272,000 tokens

input: $5 / 1M tokens

cached input: $0.5 / 1M tokens

output: $30 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-08-04

Sakana Namazu V1.0

input: $0.95 / 1M tokens

cached input: $0.15 / 1M tokens

output: $4 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-08-04

xAI

Grok 4.20 (reasoning)

under-200k

Context length under 200,000 tokens

input: $1.25 / 1M tokens

cached input: $0.2 / 1M tokens

output: $2.5 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

Grok 4.20 (reasoning)

at-least-200k

Context length at least 200,000 tokens

input: $2.5 / 1M tokens

cached input: $0.4 / 1M tokens

output: $5 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

Grok 4.3

under-200k

Context length under 200,000 tokens

input: $1.25 / 1M tokens

cached input: $0.2 / 1M tokens

output: $2.5 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

Grok 4.3

at-least-200k

Context length at least 200,000 tokens

input: $2.5 / 1M tokens

cached input: $0.4 / 1M tokens

output: $5 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

Grok 4.5

under-200k

Context length under 200,000 tokens

input: $2 / 1M tokens

cached input: $0.3 / 1M tokens

output: $6 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

Grok 4.5

at-least-200k

Context length at least 200,000 tokens

input: $4 / 1M tokens

cached input: $0.6 / 1M tokens

output: $12 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

Grok Build 0.1

under-200k

Context length under 200,000 tokens

input: $1 / 1M tokens

cached input: $0.2 / 1M tokens

output: $2 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

Grok Build 0.1

at-least-200k

Context length at least 200,000 tokens

input: $2 / 1M tokens

cached input: $0.4 / 1M tokens

output: $4 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-07-28

Z.ai

GLM-4.5-Air

input: $0.2 / 1M tokens

cached input: $0.03 / 1M tokens

output: $1.1 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-08-04

GLM-4.7

input: $0.6 / 1M tokens

cached input: $0.11 / 1M tokens

output: $2.2 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-08-04

GLM-4.7-FlashX

input: $0.07 / 1M tokens

cached input: $0.01 / 1M tokens

output: $0.4 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-08-04

GLM-5

input: $1 / 1M tokens

cached input: $0.2 / 1M tokens

output: $3.2 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-08-04

GLM-5.2

input: $1.4 / 1M tokens

cached input: $0.26 / 1M tokens

output: $4.4 / 1M tokens

Verified
Official pricing ↗

Last verified: 2026-08-04

This table compares cost only. It does not evaluate quality, latency, or context length, and does not recommend the cheapest model.

Back to calculator