- Context
- 1M
- Input
- $0.3 /Mt· Cache Read $0.006 /Mt
- Output
- $1.2 /Mt
Explore pricing for our Model APIs and GPU resources. Find the right plan to match your needs with transparent rates and flexible options.
Batch inference is available at an introductory 50% discount on input and output tokens for supported models. Learn More
DeepSeek の高度な AI モデル。エンタープライズおよび研究用途向けに、最先端の推論能力と競争力のある価格を提供します。
DeepSeek の高度な AI モデル。エンタープライズおよび研究用途向けに、最先端の推論能力と競争力のある価格を提供します。
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| DeepSeek V4.1 Flash | 1M | $0.3 /Mt· Cache Read $0.006 /Mt | $1.2 /Mt | More |
| DeepSeek V4 Pro 0813 | 1M | $1.32 /Mt· Cache Read $0.044 /Mt | $3.96 /Mt | More |
| DeepSeek V4 Flash Vision Exp | 1M | $0.44 /Mt· Cache Read $0.028 /Mt | $1.32 /Mt | More |
| DeepSeek V4 Flash 0731 | 1M | $0.44 /Mt· Cache Read $0.028 /Mt | $1.32 /Mt | More |
| DeepSeek V4 Flash | 1M | $0.14 /Mt· Cache Read $0.028 /Mt | $0.28 /Mt | More |
| DeepSeek V4 Pro | 1M | $1.6 /Mt· Cache Read $0.135 /Mt | $3.2 /Mt | More |
| DeepSeek V3.2 | 160K | $0.269 /Mt· Cache Read $0.1345 /Mt | $0.4 /Mt | More |
| DeepSeek OCR 2 | 8K | $0.03 /Mt | $0.03 /Mt | More |
| DeepSeek V3.2 Exp | 160K | $0.27 /Mt | $0.41 /Mt | More |
| DeepSeek V3.1 Terminus | 128K | $0.27 /Mt· Cache Read $0.135 /Mt | $1 /Mt | More |
| DeepSeek V3.1 | 128K | $0.27 /Mt· Cache Read $0.135 /Mt | $1 /Mt | More |
| DeepSeek R1 0528 | 160K | $0.7 /Mt· Cache Read $0.35 /Mt | $2.5 /Mt | More |
| DeepSeek R1 Distill Llama 70B | 8K | $0.8 /Mt | $0.8 /Mt | More |
| DeepSeek R1 Turbo | 63K | $0.7 /Mt | $2.5 /Mt | More |
Meta の Llama モデル。多様なアプリケーション向けに設計されたオープンアーキテクチャにより、最先端の言語理解を提供します。
Meta の Llama モデル。多様なアプリケーション向けに設計されたオープンアーキテクチャにより、最先端の言語理解を提供します。
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Llama 3.1 8B Instruct | 16K | $0.02 /Mt | $0.05 /Mt | More |
| Llama 3.3 70B Instruct | 12K | $0.135 /Mt | $0.4 /Mt | More |
| Llama 4 Maverick Instruct | 1M | $0.27 /Mt | $0.85 /Mt | More |
| Llama 4 Scout Instruct | 128K | $0.18 /Mt | $0.59 /Mt | More |
Qwen シリーズモデル。軽量からエンタープライズグレードのソリューションまで、さまざまなパラメータサイズで効率的な言語処理を提供します。
Qwen シリーズモデル。軽量からエンタープライズグレードのソリューションまで、さまざまなパラメータサイズで効率的な言語処理を提供します。
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Qwen3.8 Flash | 977K | $0.15 /Mt· Cache Read $0.016 /Mt | $0.47 /Mt | More |
| Qwen3.8 27B | 977K | $0.42 /Mt· Cache Read $0.085 /Mt | $3 /Mt | More |
| Qwen3.8 2.4T A95B | 977K | $2 /Mt· Cache Read $0.25 /Mt | $6 /Mt | More |
| Qwen3.8 Max | 977K | $2 /Mt· Cache Read $0.25 /Mt | $6 /Mt | More |
| Qwen3.7 Max | 977K | $1.25 /Mt· Cache Read $0.25 /Mt | $3.75 /Mt | More |
| Qwen3.6 27B | 256K | $0.6 /Mt | $3.6 /Mt | More |
| Qwen3.5 27B | 256K | $0.3 /Mt | $2.4 /Mt | More |
| Qwen3.5 122B A10B | 256K | $0.4 /Mt | $3.2 /Mt | More |
| Qwen3.5 35B A3B | 256K | $0.25 /Mt | $2 /Mt | More |
| Qwen3.5 397B A17B | 256K | $0.6 /Mt | $3.6 /Mt | More |
| Qwen3 Coder Next | 256K | $0.2 /Mt | $1.5 /Mt | More |
| Qwen3 VL 235B A22B Thinking | 128K | $0.98 /Mt | $3.95 /Mt | More |
| Qwen3.6 35B A3B | 256K | $0.248 /Mt | $1.485 /Mt | More |
| Qwen3 Next 80B A3B Instruct | 128K | $0.15 /Mt | $1.5 /Mt | More |
| Qwen3 VL 235B A22B Instruct | 128K | $0.3 /Mt | $1.5 /Mt | More |
| Qwen3 Max | 256K | - | More | |
| Qwen3 Coder 480B A35B Instruct | 256K | $0.38 /Mt | $1.55 /Mt | More |
| Qwen3 Coder 30B A3B Instruct | 156K | $0.07 /Mt | $0.27 /Mt | More |
| Qwen3 235B A22B Thinking 2507 | 128K | $0.3 /Mt | $3 /Mt | More |
| Qwen3 235B A22B Instruct 2507 | 128K | $0.09 /Mt | $0.58 /Mt | More |
| Qwen2.5 72B Instruct | 31K | $0.38 /Mt | $0.4 /Mt | More |
| Qwen3 235B A22B | 40K | $0.2 /Mt | $0.8 /Mt | More |
| Qwen3 VL 30B A3B Instruct | 128K | $0.2 /Mt | $0.7 /Mt | More |
| Qwen3 Omni 30B A3B Thinking | 64K | - | More | |
| Qwen3 Omni 30B A3B Instruct | 64K | - | More | |
| Qwen MT Plus | 16K | $0.25 /Mt | $0.75 /Mt | More |
Baidu の ERNIE モデル。高度な中国語理解とマルチモーダル機能を提供し、競争力のある価格で中国語アプリケーション向けに最適化されています。
Baidu の ERNIE モデル。高度な中国語理解とマルチモーダル機能を提供し、競争力のある価格で中国語アプリケーション向けに最適化されています。
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| CoBuddy | 128K | $0.28 /Mt· Cache Read $0.07 /Mt | $1.13 /Mt | More |
| ERNIE 4.5 VL 424B A47B | 120K | $0.42 /Mt | $1.25 /Mt | More |
| ERNIE 4.5 21B A3B | 117K | $0.07 /Mt | $0.28 /Mt | More |
Google の Gemma モデル。さまざまな NLP タスクで優れた性能を発揮する高品質な言語処理を提供します。
Google の Gemma モデル。さまざまな NLP タスクで優れた性能を発揮する高品質な言語処理を提供します。
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Gemma 4 26B A4B | 256K | $0.13 /Mt | $0.4 /Mt | More |
| Gemma 4 31B | 256K | $0.14 /Mt | $0.4 /Mt | More |
| Gemma 3 27B | 96K | $0.119 /Mt | $0.2 /Mt | More |
清華大学の GLM シリーズモデル。高度な中国語理解および生成能力を備えています。
清華大学の GLM シリーズモデル。高度な中国語理解および生成能力を備えています。
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| GLM 5.3 Flash | 1M | $0.15 /Mt· Cache Read $0.03 /Mt | $0.5 /Mt | More |
| GLM 5.3 | 1M | $1.4 /Mt· Cache Read $0.26 /Mt | $4.4 /Mt | More |
| GLM 5.2 | 1M | $1.4 /Mt· Cache Read $0.26 /Mt | $4.4 /Mt | More |
| GLM 5.1 | 200K | $1.38 /Mt· Cache Read $0.26 /Mt | $4.4 /Mt | More |
| GLM 5 | 198K | $1 /Mt· Cache Read $0.2 /Mt | $3.2 /Mt | More |
| GLM 4.7 Flash | 195K | $0.07 /Mt· Cache Read $0.01 /Mt | $0.4 /Mt | More |
| GLM 4.7 | 200K | $0.6 /Mt· Cache Read $0.11 /Mt | $2.2 /Mt | More |
| AutoGLM Phone 9B Multilingual | 64K | $0.035 /Mt | $0.138 /Mt | More |
| GLM 4.6V | 128K | $0.3 /Mt· Cache Read $0.055 /Mt | $0.9 /Mt | More |
| GLM 4.6 | 200K | $0.55 /Mt· Cache Read $0.11 /Mt | $2.2 /Mt | More |
| GLM 4.5V | 64K | $0.6 /Mt· Cache Read $0.11 /Mt | $1.8 /Mt | More |
| GLM 4.5 Air | 128K | $0.13 /Mt· Cache Read $0.025 /Mt | $0.85 /Mt | More |
ストーリーテリング能力を強化し、クリエイティブおよびロールプレイ用途向けに最適化された専門的なファインチューニング済みモデル。
ストーリーテリング能力を強化し、クリエイティブおよびロールプレイ用途向けに最適化された専門的なファインチューニング済みモデル。
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Llama 3 8B Lunaris | 8K | $0.05 /Mt | $0.05 /Mt | More |
| Llama 3 8B Stheno V3.2 | 8K | $0.05 /Mt | $0.05 /Mt | More |
| Llama 3.1 70B Euryale V2.2 | 8K | $1.48 /Mt | $1.48 /Mt | More |
Mistral AI の効率的かつ強力な言語モデル。商用アプリケーションとオープンソースアプリケーションの両方に対応するよう設計されています。
Mistral AI の効率的かつ強力な言語モデル。商用アプリケーションとオープンソースアプリケーションの両方に対応するよう設計されています。
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Mistral Nemo | 59K | $0.04 /Mt | $0.17 /Mt | More |
Microsoft のモデルは、エンタープライズグレードのセキュリティを備えた最先端の多言語機能を提供し、Azure クラウドエコシステムにシームレスに統合されています。クロスプラットフォームのコラボレーションとビジネスインテリジェンス向けに最適化されており、これらのモデルは文書理解と生成に優れています。これは Microsoft 365 ワークフローにおける主要な強みです。
Microsoft のモデルは、エンタープライズグレードのセキュリティを備えた最先端の多言語機能を提供し、Azure クラウドエコシステムにシームレスに統合されています。クロスプラットフォームのコラボレーションとビジネスインテリジェンス向けに最適化されており、これらのモデルは文書理解と生成に優れています。これは Microsoft 365 ワークフローにおける主要な強みです。
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| WizardLM 2 8x22B | 64K | $0.62 /Mt | $0.62 /Mt | More |
--
--
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Ling 3.0 Flash Fin | 256K | Free | Free | More |
| Ling 3.0 Flash VL | 256K | Free | Free | More |
| Ling 3.0 Flash Sante | 256K | Free | Free | More |
| Ling 3.0 Flash | 256K | $0.06 /Mt· Cache Read $0.012 /Mt | $0.18 /Mt | More |
--
--
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Macaron V1 Venti | 1M | $0.825 /Mt· Cache Read $0.165 /Mt | $2.475 /Mt | More |
| Macaron V1 Tall | 256K | $0.2475 /Mt· Cache Read $0.044 /Mt | $1.43 /Mt | More |
Minimax AI の高度な言語モデル。カスタマーサービス、コンテンツ生成、クリエイティブアプリケーション向けに最適化された性能で、堅牢な会話型 AI 機能を提供し、強力な多言語サポートとエンタープライズ対応の拡張性を備えています。
Minimax AI の高度な言語モデル。カスタマーサービス、コンテンツ生成、クリエイティブアプリケーション向けに最適化された性能で、堅牢な会話型 AI 機能を提供し、強力な多言語サポートとエンタープライズ対応の拡張性を備えています。
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| MiniMax M3 | 977K | - | More | |
| MiniMax M2.7 | 200K | $0.3 /Mt· Cache Read $0.06 /Mt | $1.2 /Mt | More |
| MiniMax M2.5 Highspeed | 200K | $0.6 /Mt· Cache Read $0.03 /Mt | $2.4 /Mt | More |
| MiniMax M2.5 | 200K | $0.3 /Mt· Cache Read $0.03 /Mt | $1.2 /Mt | More |
| MiniMax M2.1 | 200K | $0.3 /Mt· Cache Read $0.03 /Mt | $1.2 /Mt | More |
| MiniMax M2 | 200K | $0.3 /Mt· Cache Read $0.03 /Mt | $1.2 /Mt | More |
| MiniMax M1 | 977K | $0.55 /Mt | $2.2 /Mt | More |
--
--
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Kimi K3 | 1M | $3 /Mt· Cache Read $0.3 /Mt | $15 /Mt | More |
| Kimi K2.7 Code | 256K | $0.95 /Mt· Cache Read $0.19 /Mt | $4 /Mt | More |
| Kimi K2.6 | 256K | $0.8 /Mt· Cache Read $0.16 /Mt | $3.4 /Mt | More |
| Kimi K2.5 | 256K | $0.6 /Mt· Cache Read $0.1 /Mt | $3 /Mt | More |
| Kimi K2 Thinking | 256K | $0.6 /Mt· Cache Read $0.15 /Mt | $2.5 /Mt | More |
| Kimi K2 Instruct 0905 | 256K | $0.6 /Mt | $2.5 /Mt | More |
| Kimi K2 Instruct | 128K | $0.57 /Mt | $2.3 /Mt | More |
--
--
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| NVIDIA Nemotron 3 Nano 30B A3B | 256K | $0.05 /Mt | $0.2 /Mt | More |
--
--
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| OpenAI GPT OSS 120B | 128K | $0.05 /Mt | $0.25 /Mt | More |
| OpenAI GPT OSS 20B | 128K | $0.04 /Mt | $0.15 /Mt | More |
--
--
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Step 3.7 Flash | 256K | $0.2 /Mt· Cache Read $0.04 /Mt | $1.15 /Mt | More |
--
--
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Hy4 Preview | 977K | $0.834 /Mt· Cache Read $0.042 /Mt | $2.501 /Mt | More |
| Hy3 | 256K | $0.14 /Mt· Cache Read $0.035 /Mt | $0.58 /Mt | More |
| Model Name | Context | Input |
|---|---|---|
qwen/qwen3-embedding-0.6b | 32K | $0.07 /Mt |
Qwen3 Embedding 8B | 32K | $0.07 /Mt |
BAAI:BGE-M3 | 8K | $0.01 /Mt |
Pricing may vary based on image dimensions, inference steps, and upscaling factors. Use thePricing Calculatorfor an estimate.
| API Name | Mode | Width&Height | Pricing |
|---|---|---|---|
Qwen-Image Edit | - | - | $0.02 /image |
Qwen-Image Text to Image | - | - | $0.02 /image |
ming image 0.1 design | Input | - | $0/Mt$1/Mt |
| Output | - | $0/Mt$1/Mt | |
ming image 0.1 design layer | Input | - | $0/Mt$1/Mt |
| Output | - | $0/Mt$1/Mt |
Pricing may vary based on the number of frames, chosen model, and inference steps. Use thePricing Calculatorfor an estimate.
| API Name | Mode | Duration | Resolution | Pricing |
|---|---|---|---|---|
Kling v3.0 Pro Image-to-Video | No Audio | - | $0.112 /s | |
| Audio | - | $0.168 /s | ||
Kling v3.0 Pro Text-to-Video | No Audio | - | $0.112 /s | |
| Audio | - | $0.168 /s | ||
Kling v3.0 Standard Image-to-Video | No Audio | - | $0.084 /s | |
| Audio | - | $0.126 /s | ||
Kling v3.0 Standard Text-to-Video | No Audio | - | $0.084 /s | |
| Audio | - | $0.126 /s | ||
Minimax Hailuo 2.3 Fast Image to Video | - | 6s | 768P | $0.19 /video |
| - | 10s | 768P | $0.32 /video | |
| - | 6s | 1080P | $0.33 /video | |
Minimax Hailuo 2.3 Image to Video | - | 6s | 768P | $0.28 /video |
| - | 10s | 768P | $0.56 /video | |
| - | 6s | 1080P | $0.49 /video | |
Minimax Hailuo 2.3 Text to Video | - | 6s | 768P | $0.28 /video |
| - | 10s | 768P | $0.56 /video | |
| - | 6s | 1080P | $0.49 /video | |
Wan 2.5 Image to Video | - | 5s | 480P | $0.25 /video |
| - | 10s | 480P | $0.50 /video | |
| - | 5s | 720P | $0.50 /video | |
| - | 10s | 720P | $1.00 /video | |
| - | 5s | 1080P | $0.75 /video | |
| - | 10s | 1080P | $1.50 /video | |
Wan 2.5 Text to Video | - | 5s | 480P | $0.25 /video |
| - | 10s | 480P | $0.50 /video | |
| - | 5s | 720P | $0.50 /video | |
| - | 10s | 720P | $1.00 /video | |
| - | 5s | 1080P | $0.75 /video | |
| - | 10s | 1080P | $1.50 /video | |
Wan 2.6 Image to Video | - | 5s | 720P | $0.50 /video |
| - | 10s | 720P | $1.00 /video | |
| - | 15s | 720P | $1.50 /video | |
| - | 5s | 1080P | $0.75 /video | |
| - | 10s | 1080P | $1.50 /video | |
| - | 15s | 1080P | $2.25 /video | |
Wan 2.6 Reference to Video | - | 5s | 720P | $0.50 /video |
| - | 10s | 720P | $1.00 /video | |
| - | 5s | 1080P | $0.75 /video | |
| - | 10s | 1080P | $1.50 /video | |
Wan 2.6 Text to Video | - | 5s | 720P | $0.50 /video |
| - | 10s | 720P | $1.00 /video | |
| - | 15s | 720P | $1.50 /video | |
| - | 5s | 1080P | $0.75 /video | |
| - | 10s | 1080P | $1.50 /video | |
| - | 15s | 1080P | $2.25 /video |
| API Name | Model | Steps | Pricing |
|---|---|---|---|
Image to Video | SVD-XT | 20 | $0.024 /video |
| SVD | 20 | $0.0134 /video |
| API Name | Mode | Pricing |
|---|---|---|
Fish Audio Text to Speech | - | $15 /1M characters |
Fish Audio Voice Cloning | - | $0.1 /voice |
MiniMax Voice-Cloning | - | $1.5 /voice |
Text to Speech | - | $15 /1M characters |
| API Name | Mode | Pricing |
|---|---|---|
| EXA | neuralSearch | $0.007/request |
| deepSearch | $0.012/request | |
| deepReasoningSearch | $0.015/request | |
| additional_result | $0.001/result (beyond 10 results) | |
| answer | $0.005/request | |
| contentText | $0.001/item | |
| contentHighlight | $0.001/item | |
| contentSummary | $0.001/item | |
| Tavily | basicSearch | $0.008/request |
| advancedSearch | $0.016/request | |
| basicExtract | $0.0016/url | |
| advancedExtract | $0.0032/url | |
| regularMapping | $0.0008/page | |
| instructedMapping | $0.0016/page | |
| Crawl | Extract + Mapping Cost |
200+ models, on-demand GPUs, and secure agent runtimes — unified under one API. Free to start, scales as you grow.