比較來自 29 個供應商的 2138 個模型價格
| 比較 | 供應商 | 模型 | 輸入價格 | 輸出價格 |
|---|---|---|---|---|
| 千问 | $0.2976 | — | ||
| 千问 | $0.2976 | — | ||
| 千问 | $0.1488 | — | ||
| 千问 | $0.2976 | — | ||
| 千问 | $0.119 | — | ||
| 千问 | $0.2232 | — | ||
| 千问 | $0.5952 | $2.38 | ||
| 千问 | $0.5952 | $2.38 | ||
| 千问 | $0.1488 | $0.4464 | ||
| 千问 | $0.2976 | $0.8927 | ||
| 千问 | $0.0744 | $0.1488 | ||
| 千问 | $0.2976 | $1.19 | ||
| 千问 | $0.5952 | $1.79 | ||
| 千问 | $0.2976 | $0.4464 | ||
| 千问 | $0.2976 | $0.4464 | ||
| 千问 | $0.1488 | $0.2976 | ||
| 千问 | $0.4464 | $1.34 | ||
| 千问 | $0.4773 | $1.43 | ||
| 千问 | $0.223 | $0.4461 | ||
| 千问 | $1.79 | $3.57 | ||
| 千问 | $1.34 | $4.02 | ||
| 千问 | $2.68 | $5.35 | ||
| 千问 | $2.98 | $2.98 | ||
| 千问 | $0.0000327 | — | ||
| 千问 | $0.0000327 | — | ||
| 千问 | $0.0000327 | — | ||
| 千问 | $0.0000491 | — | ||
| 千问 | $0.0000491 | — | ||
| 千问 | — | $0.000744 | ||
| 千问 | — | $0.000298 | ||
| 千问 | ≤32K$0.4464 32K–96K$0.5952 | $2.08 $2.38 | ||
| 千问 | ≤32K$0.119 32K–96K$0.1785 | $0.8927 $1.19 | ||
| 千问 | ≤32K$0.4464 32K–166K$0.5952 | $2.08 $2.38 | ||
| 千问 | ≤32K$0.4464 32K–166K$0.5952 | $2.08 $2.38 | ||
| 千问 | ≤32K$0.5952 32K–198K$0.8927 | $2.68 $3.27 | ||
| 千问 | ≤32K$0.8927 32K–200K$1.19 | $3.57 $4.17 | ||
| 千问 | $1.19 | $4.17 | ||
| 千问 | $2.38 | $8.33 | ||
| 千问 | $1.56 | $4.91 | ||
| 千问 | $0.119 | — | ||
| 千问 | $0.2232 | $0.6696 | ||
| 千问 | — | 1080P$0.2381 720P$0.1339 | ||
| 千问 | — | 1080P$0.2381 720P$0.1339 | ||
| 千问 | — | 1080P$0.2381 720P$0.1339 | ||
| 千问 | 1080P$0.2381 720P$0.1339 | — | ||
| 千问 | — | 1080P$0.1785 480P$0.067 720P$0.1339 | ||
| 千问 | — | 1080P$0.1785 480P$0.067 720P$0.1339 | ||
| 千问 | — | 1080P$0.1785 480P$0.067 720P$0.1339 | ||
| 千问 | — | $312.46 | ||
| 千问 | — | $0.0268 |
每百萬詞元 · 美元 · 來源: 官方定價頁面
Mistral OCR (25.05)(Google Vertex AI)目前提供最低的文字輸入價格,每百萬 Token 僅需 $0.0005。
在已追蹤的模型中,Auto Router(OpenRouter)支援最大的上下文視窗,達 2M。
大多數大型語言模型 API 分別對輸入 Token(您的提示詞和對話歷史)和輸出 Token(模型的回覆)收費。輸出 Token 的價格通常是輸入價格的 2–5 倍。許多供應商還提供批次折扣、提示詞快取及長上下文附加費等選項。
LLMRates.ai 追蹤來自 Anthropic, Google, OpenAI, AI21 Labs, AWS Bedrock, Azure AI, Cloudflare Workers AI, Cohere 等供應商的模型,涵蓋歐美及中文 AI 服務商。
價格直接從各供應商官方定價頁面抓取,每日更新。重大價格異動通常在 24 小時內同步更新。
提示詞快取可以儲存重複的提示詞前綴(如系統提示或大型文件),使模型無需在每次請求時重新處理。Anthropic 和 Google 等供應商對快取輸入 Token 提供標準價格 70–90% 的折扣,是生產應用中降低成本的重要方式。
gpt-realtime-1.5(OpenAI)的輸入價格為每百萬 Token $32,輸出價格為每百萬 Token $64。
Claude Sonnet 5 (from September 1, 2026)(Anthropic)的輸入價格為每百萬 Token $3,輸出價格為每百萬 Token $15。
Gemini Omni Flash Preview(Google)的輸入價格為每百萬 Token $1.5,輸出價格為每百萬 Token $9。
以下為主流模型中輸入價格最低的選項(美元,標準檔位,每百萬 Token):
AI Agent 以多步迴圈方式運行——每次迭代都會重新傳送累積的對話歷史、工具呼叫結果與執行計畫,因此 Token 費用會快速累加。建議優先選擇輸入價格低、工具呼叫能力強的模型。Anthropic 和 Google 的提示詞快取功能可將重複上下文的成本降低 70–90%。以下是兼具低價與工具支援的熱門模型:
推理模型(如 glm-4.5, glm-4.5-air, glm-4.6, glm-4.7)在回應前會進行內部思維鏈推理。由於推理 Token 需要額外算力,此類模型定價通常為標準模型的 5–20 倍。部分供應商會對推理過程中產生的思考 Token 單獨計費。