
按类别探索 AI 模型 API
文本与语言模型 API
面向助手、智能体和生产应用的对话、推理、编程及多模态语言模型。
106 个可用模型
比较模型 API 价格与能力
打开模型详情页,查看当前价格、端点、上下文限制及相关 API。
Anthropic
NEWclaude-sonnet-5-5
隆重推出 Claude Sonnet 5.5,这是 Claude 5.5 系列的第二款产品。它相比 Claude Sonnet 5 有了显著的提升,运行速度提升 30% 以上,而且大多数工作的成本降低高达 30%。
上下文 1M
按量计费
供应商 3省70%
输入$2$0.6/1M输出$10$3/1M缓存$0.06/1M
Anthropic
NEWclaude-opus-5-5
Anthropic 的 claude-opus-5-5 模型,支持文本、图像输入和文本输出。支持推理、工具调用。思考模式始终开启。
上下文 1M
按量计费
供应商 4省70%
输入$4$1.2/1M输出$20$6/1M缓存$0.06/1M
OpenAI
NEWgpt-6-luna
OpenAI 的 gpt-6-luna 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。支持 Responses API 工具调用。
上下文 1.1M
按量计费
供应商 3省50%
输入$0.1$0.05/1M输出$0.5$0.25/1M缓存$0.005/1M
OpenAI
NEWgpt-6-sol
OpenAI 的 gpt-6-sol 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。支持 Responses API 工具调用。
上下文 1.1M
按量计费
供应商 3省90%
输入$2$0.2/1M输出$10$1/1M缓存$0.02/1M
OpenAI
NEWgpt-6-astra
OpenAI 的 gpt-6-astra 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。支持 Responses API 工具调用。
上下文 1.1M
按量计费
供应商 4省90%
输入$10$1/1M输出$50$5/1M缓存$0.1/1M
gemini-3.8-flash
Google 的 gemini-3.8-flash 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 3省90%
输入$0.5$0.05/1M输出$3$0.3/1M缓存$0.005/1M
gemini-3.7-flash
Google 的 gemini-3.7-flash 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 3省90%
输入$0.75$0.075/1M输出$3.75$0.375/1M缓存$0.0075/1M
Anthropic
claude-fable-5-1
Anthropic 的 claude-fable-5-1 模型,支持文本、图像输入和文本输出。支持推理、工具调用。思考模式始终开启。
上下文 1M
按量计费
供应商 5省90%
输入$10$1/1M输出$50$5/1M缓存$0.025/1M
Anthropic
claude-opus-5
Anthropic 的 claude-opus-5 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 7省90%
输入$5$0.5/1M输出$25$2.5/1M缓存$0.05/1M
gemini-3.6-flash
Google 的 gemini-3.6-flash 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 3省90%
输入$1.5$0.15/1M输出$7$0.7/1M缓存$0.015/1M
OpenAI
gpt-5.6-sol
OpenAI 的 gpt-5.6-sol 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1.1M
按量计费
供应商 4省90%
输入$5$0.5/1M输出$30$3/1M缓存$0.05/1M
OpenAI
gpt-5.6-terra
OpenAI 的 gpt-5.6-terra 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1.1M
按量计费
供应商 4省90%
输入$2$0.2/1M输出$12$1.2/1M缓存$0.02/1M
OpenAI
gpt-5.6-luna
OpenAI 的 gpt-5.6-luna 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1.1M
按量计费
供应商 4省50%
输入$0.2$0.1/1M输出$1.2$0.6/1M缓存$0.01/1M
Anthropic
claude-fable-5
Anthropic 的 claude-fable-5 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 7省90%
输入$10$1/1M输出$50$5/1M缓存$0.1/1M
gemini-3.5-flash-lite
Google 的 gemini-3.5-flash-lite 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省50%
输入$0.3$0.15/1M输出$1.2$0.6/1M
Anthropic
claude-sonnet-5
Anthropic 的 claude-sonnet-5 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 7省90%
输入$2$0.2/1M输出$10$1/1M缓存$0.02/1M
OpenAI
gpt-5.5
OpenAI 的 gpt-5.5 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1.1M
按量计费
供应商 4省90%
输入$5$0.5/1M输出$30$3/1M缓存$0.05/1M
gemini-3.5-flash
Google 的 gemini-3.5-flash 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省50%
输入$1.5$0.75/1M输出$9$4.5/1M缓存$0.075/1M
Anthropic
claude-opus-4-8
Anthropic 的 claude-opus-4-8 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 7省90%
输入$5$0.5/1M输出$25$2.5/1M缓存$0.05/1M
OpenAI
gpt-5.4
OpenAI 的 gpt-5.4 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1.1M
按量计费
供应商 4省90%
输入$2.5$0.25/1M输出$15$1.5/1M缓存$0.025/1M
OpenAI
gpt-5.4-mini
OpenAI 的 gpt-5.4-mini 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 400K
按量计费
供应商 3省90%
输入$0.75$0.075/1M输出$4.5$0.45/1M缓存$0.0075/1M
OpenAI
gpt-5.4-nano
OpenAI 的 gpt-5.4-nano 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 400K
按量计费
供应商 3省90%
输入$0.2$0.02/1M输出$1.25$0.125/1M缓存$0.002/1M
OpenAI
gpt-5.3-codex
OpenAI 的 gpt-5.3-codex 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 400K
按量计费
供应商 1省90%
输入$1.75$0.175/1M输出$14$1.4/1M缓存$0.0175/1M
gemini-3.1-pro-preview
Google 的 gemini-3.1-pro-preview 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 3省90%
输入$2$0.2/1M输出$8$0.8/1M缓存$0.02/1M
Anthropic
claude-opus-4-7
Anthropic 的 claude-opus-4-7 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 7省90%
输入$5$0.5/1M输出$25$2.5/1M缓存$0.05/1M
OpenAI
gpt-5.2
OpenAI 的 gpt-5.2 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 400K
按量计费
供应商 3省90%
输入$1.75$0.175/1M输出$14$1.4/1M缓存$0.0175/1M
gemini-3.1-flash-lite
Google 的 gemini-3.1-flash-lite 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省50%
输入$0.25$0.125/1M输出$1.5$0.75/1M缓存$0.0125/1M
gemini-3.1-pro-preview-customtools
Google 的 gemini-3.1-pro-preview-customtools 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省50%
输入$2$1/1M输出$12$6/1M缓存$0.1/1M
Anthropic
claude-opus-4-6
Anthropic 的 claude-opus-4-6 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 7省90%
输入$5$0.5/1M输出$25$2.5/1M缓存$0.05/1M
OpenAI
gpt-5.1
OpenAI 的 gpt-5.1 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 400K
按量计费
供应商 1省90%
输入$1.25$0.125/1M输出$10$1/1M缓存$0.0125/1M
gemini-3-flash
Google 的 gemini-3-flash 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 3省90%
输入$0.5$0.05/1M输出$3$0.3/1M缓存$0.005/1M
Anthropic
claude-sonnet-4-6
Anthropic 的 claude-sonnet-4-6 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 6省90%
输入$3$0.3/1M输出$15$1.5/1M缓存$0.03/1M
gemini-2.5-pro
Google 的 gemini-2.5-pro 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省50%
输入$1.25$0.625/1M输出$10$5/1M缓存$0.0625/1M
gemini-2.5-flash
Google 的 gemini-2.5-flash 模型,支持文本、图像、音频、视频输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省50%
输入$0.3$0.15/1M输出$2.5$1.25/1M缓存$0.015/1M
gemini-2.5-flash-lite
Google 的 gemini-2.5-flash-lite 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省50%
输入$0.1$0.05/1M输出$0.4$0.2/1M缓存$0.005/1M
MiniMax
MiniMax-M3
MiniMax 的 MiniMax-M3 模型,支持文本、图像、视频输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
动态计费
供应商 2
输入$0.3/1M输出$2.1/1M缓存读取$0.06/1M
DeepSeek
deepseek-v4-1-flash-260910
DeepSeek 的 deepseek-v4-1-flash-260910 模型,支持文本、图像输入和文本输出。支持推理。
上下文 1M
动态计费
供应商 3省55%
输入$0.03$0.0135/1M输出$1.2$0.54/1M缓存读取$0.0027/1M
DeepSeek
deepseek-v4-pro-0813
DeepSeek 的 deepseek-v4-pro-0813 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 3省55%
输入$1.33$0.5985/1M输出$4$1.8/1M缓存$0.0198/1M
DeepSeek
deepseek-v4-flash-0731
DeepSeek 的 deepseek-v4-flash-0731 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 3省55%
输入$0.44$0.198/1M输出$1.33$0.5985/1M缓存$0.00675/1M
xAI
grok-4.6
xAI 的 grok-4.6 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。官方未设置独立的文本输出上限,总长度仍受上下文窗口约束。
上下文 500K
按量计费
供应商 1省40%
输入$2$1.2/1M输出$6$3.6/1M缓存$0.3/1M
MiniMax
MiniMax-M2.7
MiniMax 的 MiniMax-M2.7 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 204.8K
按量计费
供应商 2
输入$0.3/1M输出$1.2/1M缓存$0.06/1M
Alibaba
qwen3.8-flash
Alibaba 的 qwen3.8-flash 模型。支持文本、图像、视频输入和文本输出。
上下文 1M
按量计费
供应商 1
输入$0.12/1M输出$0.4/1M缓存$0.015/1M
Alibaba
qwen3.8-max
Alibaba 的 qwen3.8-max 模型。支持文本、图像、视频输入和文本输出。
上下文 1M
按量计费
供应商 1
输入$1.8/1M输出$5.3/1M缓存$0.22/1M
Xiaomi
mimo-v2.6-flash
Xiaomi 的 mimo-v2.6-flash 模型,支持文本、图像、视频、音频输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 1
输入$0.14/1M输出$0.28/1M缓存$0.0028/1M
Xiaomi
mimo-v2.6-pro
Xiaomi 的 mimo-v2.6-pro 模型,支持文本、图像、视频、音频输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 1
输入$0.435/1M输出$0.87/1M缓存$0.0036/1M
T
TypeSafe
typesafe/jev
TypeSafe Jev 是面向软件系统的结构化决策模型,接收状态与候选动作并返回机器可用的决策结果。
上下文 —
按量计费
供应商 1
输入$0.042/1M输出$0/1M
xAI
grok-4.7
xAI 的 grok-4.7 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。官方未设置独立的文本输出上限,总长度仍受上下文窗口约束。
上下文 500K
按量计费
供应商 1省40%
输入$2$1.2/1M输出$6$3.6/1M缓存$0.3/1M
Z.ai
glm-5.3-flash
Z.ai 的 glm-5.3-flash 模型,支持文本、图像、视频、文件输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 1
输入$0.12/1M输出$0.418/1M缓存$0.035/1M
Gemma 4-26B-A4B
Gemma 是一系列生成式人工智能模型,可用于各种生成任务,包括问答、总结和推理。Gemma 模型提供开放权重,并允许负责任的商业用途,让您可以在自己的项目和应用中调整和部署它们。
上下文 —
按量计费
供应商 1
输入$0.15/1M输出$0.6/1M缓存$0.015/1M
Moonshot
kimi-k3
Moonshot 的 kimi-k3 模型,支持文本、图像、视频输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2
输入$2.86/1M输出$14.29/1M缓存$0.286/1M
xAI
grok-4.5
xAI 的 grok-4.5 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。官方未设置独立的文本输出上限,总长度仍受上下文窗口约束。
上下文 500K
按量计费
供应商 1省40%
输入$2$1.2/1M输出$6$3.6/1M缓存$0.3/1M
Xiaomi
mimo-v2.5
Xiaomi 的 mimo-v2.5 模型,支持文本、音频、图像、视频输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1.1M
按量计费
供应商 1
输入$0.14/1M输出$0.28/1M缓存$0.0028/1M
Xiaomi
mimo-v2.5-pro
Xiaomi 的 mimo-v2.5-pro 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1.1M
按量计费
供应商 1
输入$0.435/1M输出$0.87/1M缓存$0.0036/1M
Tencent
hy3
Tencent 的 hy3 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 262.1K
按量计费
供应商 1
输入$0.15/1M输出$0.58/1M缓存$0.036/1M
Moonshot
kimi-k2.6
Moonshot 的 kimi-k2.6 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 262.1K
按量计费
供应商 2
输入$0.95/1M输出$4/1M缓存$0.16/1M
Z.ai
glm-5.2
Z.ai 的 glm-5.2 模型,支持文本输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 4省55%
输入$1.4$0.63/1M输出$4.4$1.98/1M缓存$0.117/1M
DeepSeek
deepseek-v4-pro
DeepSeek 的 deepseek-v4-pro 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 5省55%
输入$1.33$0.5985/1M输出$4$1.8/1M缓存$0.0198/1M
DeepSeek
deepseek-v4-flash
DeepSeek 的 deepseek-v4-flash 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 4省55%
输入$0.44$0.198/1M输出$1.33$0.5985/1M缓存$0.00675/1M
Alibaba
qwen3.7-plus
Alibaba 的 qwen3.7-plus 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2
输入$0.4/1M输出$1.6/1M缓存$0.08/1M
Moonshot
kimi-k2.7-code
Moonshot 的 kimi-k2.7-code 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 262.1K
按量计费
供应商 2
输入$0.95/1M输出$4/1M缓存$0.19/1M
ByteDance
doubao-seed-2-1-pro-260628
豆包 Seed 2.1 系列模型,支持深度思考、多模态理解、工具调用和结构化输出;官方标注 256K 上下文。
上下文 —
按量计费
供应商 1省8%
输入$0.86$0.7912/1M输出$4.3$3.956/1M
ByteDance
doubao-seed-2-1-turbo-260628
豆包 Seed 2.1 系列模型,支持深度思考、多模态理解、工具调用和结构化输出;官方标注 256K 上下文。
上下文 —
按量计费
供应商 1省8%
输入$0.43$0.3956/1M输出$0.43$0.3956/1M
MiniMax
MiniMax-M2.5
MiniMax 的 MiniMax-M2.5 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 204.8K
按量计费
供应商 2
输入$0.3/1M输出$1.2/1M缓存$0.03/1M
Anthropic
claude-haiku-4-5
Anthropic 的 claude-haiku-4-5 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 200K
按量计费
供应商 5省90%
输入$1$0.1/1M输出$5$0.5/1M缓存$0.01/1M
OpenAI
gpt-5-nano
OpenAI 的 gpt-5-nano 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 400K
按量计费
供应商 2省40%
输入$0.05$0.03/1M输出$0.4$0.24/1M缓存$0.003/1M
Anthropic
claude-sonnet-4-5
Anthropic 的 claude-sonnet-4-5 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 200K
按量计费
供应商 6省90%
输入$3$0.3/1M输出$15$1.5/1M缓存$0.03/1M
Anthropic
claude-opus-4-5
Anthropic 的 claude-opus-4-5 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 200K
按量计费
供应商 4省90%
输入$5$0.5/1M输出$25$2.5/1M缓存$0.05/1M
MiniMax
MiniMax/MiniMax-M3
MiniMax 的 MiniMax-M3 模型,支持文本、图像、视频输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2
输入$75/1M输出$75/1M
DeepSeek
deepseek-v4.1-flash
DeepSeek 的 deepseek-v4-1-flash-260910 模型,支持文本、图像输入和文本输出。支持推理。
上下文 1M
按量计费
供应商 1
输入$75/1M输出$75/1M
ByteDance
doubao-seed-2-0-code-preview-260215
豆包 Seed 2.0 系列模型接口,用于文本生成与智能体应用。精确版本规格以接入渠道为准。
上下文 —
按量计费
供应商 1省8%
输入$0.782$0.71944/1M输出$3.893$3.5816/1M
ByteDance
doubao-seed-2-0-lite-260428
豆包 Seed 2.0 系列模型接口,用于文本生成与智能体应用。精确版本规格以接入渠道为准。
上下文 —
按量计费
供应商 1省8%
输入$0.09041$0.083177/1M输出$0.54246$0.499063/1M缓存$0.016635/1M
ByteDance
doubao-seed-2-0-mini-260428
豆包 Seed 2.0 系列模型接口,用于文本生成与智能体应用。精确版本规格以接入渠道为准。
上下文 —
按量计费
供应商 1省8%
输入$0.0282$0.025944/1M输出$0.282$0.25944/1M缓存$0.005189/1M
ByteDance
doubao-seed-2-0-pro-260215
豆包 Seed 2.0 系列模型接口,用于文本生成与智能体应用。精确版本规格以接入渠道为准。
上下文 —
按量计费
供应商 1省8%
输入$0.782$0.71944/1M输出$3.876$3.5659/1M
xAI
grok-3
xAI 历史 Grok 模型名称。官方 API 已于 2026 年 5 月 15 日将该名称重定向到 Grok 4.3;本站实际模型版本以接入渠道为准。
上下文 —
按量计费
供应商 1省40%
输入$3$1.8/1M输出$15$9/1M缓存$1.8/1M
xAI
grok-3-fast-beta
xAI grok-3-fast-beta 系列文本模型接口。历史版本与当前官方服务可能存在差异,实际版本以接入渠道为准。
上下文 —
按量计费
供应商 1省40%
输入$5.5$3.3/1M输出$27.5$16.5/1M
xAI
grok-3-mini
xAI grok-3-mini 系列文本模型接口。历史版本与当前官方服务可能存在差异,实际版本以接入渠道为准。
上下文 —
按量计费
供应商 1省40%
输入$0.3$0.18/1M输出$0.501$0.3006/1M缓存$0.045/1M
xAI
grok-4
xAI grok-4 系列文本模型接口。历史版本与当前官方服务可能存在差异,实际版本以接入渠道为准。
上下文 —
按量计费
供应商 1省40%
输入$3.3$1.98/1M输出$16.5$9.9/1M缓存$0.495/1M
xAI
grok-4-0709
xAI 历史 Grok 模型名称。官方 API 已于 2026 年 5 月 15 日将该名称重定向到 Grok 4.3;本站实际模型版本以接入渠道为准。
上下文 —
按量计费
供应商 1省40%
输入$3$1.8/1M输出$15$9/1M
xAI
grok-4-1-fast-non-reasoning
xAI 历史 Grok 模型名称。官方 API 已于 2026 年 5 月 15 日将该名称重定向到 Grok 4.3;本站实际模型版本以接入渠道为准。
上下文 —
按量计费
供应商 1省40%
输入$0.2$0.12/1M输出$0.5$0.3/1M缓存$0.03/1M
xAI
grok-4-1-fast-reasoning
xAI 历史 Grok 模型名称。官方 API 已于 2026 年 5 月 15 日将该名称重定向到 Grok 4.3;本站实际模型版本以接入渠道为准。
上下文 —
按量计费
供应商 1省40%
输入$0.2$0.12/1M输出$0.5$0.3/1M缓存$0.03/1M
xAI
grok-4-fast-non-reasoning
xAI 历史 Grok 模型名称。官方 API 已于 2026 年 5 月 15 日将该名称重定向到 Grok 4.3;本站实际模型版本以接入渠道为准。
上下文 —
按量计费
供应商 1省40%
输入$0.2$0.12/1M输出$0.5$0.3/1M缓存$0.03/1M
xAI
grok-4-fast-reasoning
xAI 历史 Grok 模型名称。官方 API 已于 2026 年 5 月 15 日将该名称重定向到 Grok 4.3;本站实际模型版本以接入渠道为准。
上下文 —
按量计费
供应商 1省40%
输入$0.2$0.12/1M输出$0.5$0.3/1M缓存$0.03/1M
xAI
grok-4.20-0309-non-reasoning
xAI 的 grok-4.20-0309-non-reasoning 模型。支持文本、图像输入和文本输出。
上下文 1M
按量计费
供应商 1省40%
输入$2$1.2/1M输出$6$3.6/1M缓存$0.12/1M
xAI
grok-4.20-0309-reasoning
xAI 的 grok-4.20-0309-reasoning 模型。支持文本、图像输入和文本输出。
上下文 1M
按量计费
供应商 1省40%
输入$2$1.2/1M输出$6$3.6/1M缓存$0.12/1M
xAI
grok-4.20-beta-0309-non-reasoning
xAI 的 grok-4.20-beta-0309-non-reasoning 模型。支持文本、图像输入和文本输出。
上下文 1M
按量计费
供应商 1省40%
输入$2$1.2/1M输出$6$3.6/1M缓存$0.12/1M
xAI
grok-4.20-beta-0309-reasoning
xAI 的 grok-4.20-beta-0309-reasoning 模型。支持文本、图像输入和文本输出。
上下文 1M
按量计费
供应商 1省40%
输入$2$1.2/1M输出$6$3.6/1M缓存$0.12/1M
xAI
grok-4.3
xAI 的 grok-4.3 模型。支持文本、图像输入和文本输出。
上下文 1M
按量计费
供应商 1省40%
输入$1.25$0.75/1M输出$2.5$1.5/1M缓存$0.12/1M
Alibaba
qwen3-omni-flash-2025-12-01
千问 Qwen3-Omni-Flash 的 2025 年 12 月快照,提供多模态理解及文本、语音生成能力。
上下文 —
按量计费
供应商 2
输入$75/1M输出$75/1M
Alibaba
qwen3.5-flash
Alibaba 的 qwen3.5-flash 模型。支持文本、图像、视频输入和文本输出。
上下文 1M
按量计费
供应商 2
输入$0.0282/1M输出$0.282/1M缓存$0.00282/1M
Alibaba
qwen3.5-plus
Alibaba 的 qwen3.5-plus 模型。支持文本、图像、视频输入和文本输出。
上下文 1M
按量计费
供应商 2
输入$0.1096/1M输出$0.6576/1M缓存$0.01096/1M
Alibaba
qwen3.6-35b-a3b
Alibaba 的 qwen3.6-35b-a3b 模型。支持文本、图像、视频输入和文本输出。
上下文 262.1K
按量计费
供应商 2
输入$0.254/1M输出$1.524/1M缓存$0.254/1M
Alibaba
qwen3.6-flash
Alibaba 的 qwen3.6-flash 模型。支持文本、图像、视频输入和文本输出。
上下文 1M
按量计费
供应商 2
输入$0.169/1M输出$1.014/1M缓存$0.0169/1M
Alibaba
qwen3.6-max-preview
Alibaba 的 qwen3.6-max-preview 模型。支持文本输入和文本输出。
上下文 262.1K
按量计费
供应商 2
输入$1.268/1M输出$7.608/1M缓存$0.1268/1M
Alibaba
qwen3.6-plus
Alibaba 的 qwen3.6-plus 模型。支持文本、图像、视频输入和文本输出。
上下文 1M
按量计费
供应商 2
输入$0.282/1M输出$1.692/1M缓存$0.0282/1M
