
按类别探索 AI 模型 API
文本与语言模型 API
面向助手、智能体和生产应用的对话、推理、编程及多模态语言模型。
106 个可用模型
比较模型 API 价格与能力
打开模型详情页,查看当前价格、端点、上下文限制及相关 API。
Anthropic
NEWclaude-sonnet-5-5
隆重推出 Claude Sonnet 5.5,这是 Claude 5.5 系列的第二款产品。它相比 Claude Sonnet 5 有了显著的提升,运行速度提升 30% 以上,而且大多数工作的成本降低高达 30%。
上下文 1M
按量计费
供应商 4省75%
输入$2$0.5/1M输出$10$2.5/1M缓存$0.05/1M
Anthropic
NEWclaude-opus-5-5
Anthropic 的 claude-opus-5-5 模型,支持文本、图像输入和文本输出。支持推理、工具调用。思考模式始终开启。
上下文 1M
按量计费
供应商 5省75%
输入$4$1/1M输出$20$5/1M缓存$0.05/1M
OpenAI
NEWgpt-6-luna
OpenAI 的 gpt-6-luna 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。支持 Responses API 工具调用。
上下文 1.1M
按量计费
供应商 3省60%
输入$0.1$0.04/1M输出$0.5$0.2/1M缓存$0.004/1M
OpenAI
NEWgpt-6-sol
OpenAI 的 gpt-6-sol 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。支持 Responses API 工具调用。
上下文 1.1M
按量计费
供应商 3省95%
输入$2$0.1/1M输出$10$0.5/1M缓存$0.01/1M
OpenAI
NEWgpt-6-astra
OpenAI 的 gpt-6-astra 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。支持 Responses API 工具调用。
上下文 1.1M
按量计费
供应商 4省95%
输入$10$0.5/1M输出$50$2.5/1M缓存$0.05/1M
gemini-3.8-flash
Google 的 gemini-3.8-flash 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 3省90%
输入$0.5$0.05/1M输出$3$0.3/1M缓存$0.005/1M
gemini-3.7-flash
Google 的 gemini-3.7-flash 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 3省90%
输入$0.75$0.075/1M输出$3.75$0.375/1M缓存$0.0075/1M
Anthropic
claude-fable-5-1
Anthropic 的 claude-fable-5-1 模型,支持文本、图像输入和文本输出。支持推理、工具调用。思考模式始终开启。
上下文 1M
按量计费
供应商 5省90%
输入$10$1/1M输出$50$5/1M缓存$0.025/1M
Anthropic
claude-opus-5
Anthropic 的 claude-opus-5 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 8省90%
输入$5$0.5/1M输出$25$2.5/1M缓存$0.05/1M
gemini-3.6-flash
Google 的 gemini-3.6-flash 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 3省90%
输入$1.5$0.15/1M输出$7$0.7/1M缓存$0.015/1M
OpenAI
gpt-5.6-sol
OpenAI 的 gpt-5.6-sol 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1.1M
按量计费
供应商 4省95%
输入$5$0.25/1M输出$30$1.5/1M缓存$0.025/1M
OpenAI
gpt-5.6-terra
OpenAI 的 gpt-5.6-terra 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1.1M
按量计费
供应商 4省95%
输入$2$0.1/1M输出$12$0.6/1M缓存$0.01/1M
OpenAI
gpt-5.6-luna
OpenAI 的 gpt-5.6-luna 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1.1M
按量计费
供应商 4省60%
输入$0.2$0.08/1M输出$1.2$0.48/1M缓存$0.008/1M
Anthropic
claude-fable-5
Anthropic 的 claude-fable-5 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 7省90%
输入$10$1/1M输出$50$5/1M缓存$0.1/1M
gemini-3.5-flash-lite
Google 的 gemini-3.5-flash-lite 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省70%
输入$0.3$0.09/1M输出$1.2$0.36/1M
Anthropic
claude-sonnet-5
Anthropic 的 claude-sonnet-5 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 7省90%
输入$2$0.2/1M输出$10$1/1M缓存$0.02/1M
OpenAI
gpt-5.5
OpenAI 的 gpt-5.5 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1.1M
按量计费
供应商 4省95%
输入$5$0.25/1M输出$30$1.5/1M缓存$0.025/1M
gemini-3.5-flash
Google 的 gemini-3.5-flash 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省70%
输入$1.5$0.45/1M输出$9$2.7/1M缓存$0.045/1M
Anthropic
claude-opus-4-8
Anthropic 的 claude-opus-4-8 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 7省90%
输入$5$0.5/1M输出$25$2.5/1M缓存$0.05/1M
OpenAI
gpt-5.4
OpenAI 的 gpt-5.4 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1.1M
按量计费
供应商 4省95%
输入$2.5$0.125/1M输出$15$0.75/1M缓存$0.0125/1M
OpenAI
gpt-5.4-mini
OpenAI 的 gpt-5.4-mini 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 400K
按量计费
供应商 3省95%
输入$0.75$0.0375/1M输出$4.5$0.225/1M缓存$0.00375/1M
OpenAI
gpt-5.4-nano
OpenAI 的 gpt-5.4-nano 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 400K
按量计费
供应商 3省95%
输入$0.2$0.01/1M输出$1.25$0.0625/1M缓存$0.001/1M
OpenAI
gpt-5.3-codex
OpenAI 的 gpt-5.3-codex 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 400K
按量计费
供应商 1省95%
输入$1.75$0.0875/1M输出$14$0.7/1M缓存$0.00875/1M
gemini-3.1-pro-preview
Google 的 gemini-3.1-pro-preview 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 3省90%
输入$2$0.2/1M输出$8$0.8/1M缓存$0.02/1M
Anthropic
claude-opus-4-7
Anthropic 的 claude-opus-4-7 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 7省90%
输入$5$0.5/1M输出$25$2.5/1M缓存$0.05/1M
OpenAI
gpt-5.2
OpenAI 的 gpt-5.2 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 400K
按量计费
供应商 3省95%
输入$1.75$0.0875/1M输出$14$0.7/1M缓存$0.00875/1M
gemini-3.1-flash-lite
Google 的 gemini-3.1-flash-lite 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省70%
输入$0.25$0.075/1M输出$1.5$0.45/1M缓存$0.0075/1M
gemini-3.1-pro-preview-customtools
Google 的 gemini-3.1-pro-preview-customtools 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省70%
输入$2$0.6/1M输出$12$3.6/1M缓存$0.06/1M
Anthropic
claude-opus-4-6
Anthropic 的 claude-opus-4-6 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 7省90%
输入$5$0.5/1M输出$25$2.5/1M缓存$0.05/1M
OpenAI
gpt-5.1
OpenAI 的 gpt-5.1 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 400K
按量计费
供应商 1省95%
输入$1.25$0.0625/1M输出$10$0.5/1M缓存$0.00625/1M
gemini-3-flash
Google 的 gemini-3-flash 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 3省90%
输入$0.5$0.05/1M输出$3$0.3/1M缓存$0.005/1M
Anthropic
claude-sonnet-4-6
Anthropic 的 claude-sonnet-4-6 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 6省90%
输入$3$0.3/1M输出$15$1.5/1M缓存$0.03/1M
gemini-2.5-pro
Google 的 gemini-2.5-pro 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省70%
输入$1.25$0.375/1M输出$10$3/1M缓存$0.0375/1M
gemini-2.5-flash
Google 的 gemini-2.5-flash 模型,支持文本、图像、音频、视频输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省70%
输入$0.3$0.09/1M输出$2.5$0.75/1M缓存$0.009/1M
gemini-2.5-flash-lite
Google 的 gemini-2.5-flash-lite 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省70%
输入$0.1$0.03/1M输出$0.4$0.12/1M缓存$0.003/1M
MiniMax
MiniMax-M3
MiniMax 的 MiniMax-M3 模型,支持文本、图像、视频输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
动态计费
供应商 2省40%
输入$0.3$0.18/1M输出$2.1$1.26/1M缓存读取$0.036/1M
DeepSeek
deepseek-v4-1-flash-260910
DeepSeek 的 deepseek-v4-1-flash-260910 模型,支持文本、图像输入和文本输出。支持推理。
上下文 1M
动态计费
供应商 3省60%
输入$0.03$0.012/1M输出$1.2$0.48/1M缓存读取$0.0024/1M
DeepSeek
deepseek-v4-pro-0813
DeepSeek 的 deepseek-v4-pro-0813 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 3省60%
输入$1.33$0.532/1M输出$4$1.6/1M缓存$0.0176/1M
DeepSeek
deepseek-v4-flash-0731
DeepSeek 的 deepseek-v4-flash-0731 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 3省60%
输入$0.44$0.176/1M输出$1.33$0.532/1M缓存$0.006/1M
xAI
grok-4.6
xAI 的 grok-4.6 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。官方未设置独立的文本输出上限,总长度仍受上下文窗口约束。
上下文 500K
按量计费
供应商 1省60%
输入$2$0.8/1M输出$6$2.4/1M缓存$0.2/1M
MiniMax
MiniMax-M2.7
MiniMax 的 MiniMax-M2.7 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 204.8K
按量计费
供应商 2省40%
输入$0.3$0.18/1M输出$1.2$0.72/1M缓存$0.036/1M
Alibaba
qwen3.8-flash
Alibaba 的 qwen3.8-flash 模型。支持文本、图像、视频输入和文本输出。
上下文 1M
按量计费
供应商 1省40%
输入$0.12$0.072/1M输出$0.4$0.24/1M缓存$0.009/1M
Alibaba
qwen3.8-max
Alibaba 的 qwen3.8-max 模型。支持文本、图像、视频输入和文本输出。
上下文 1M
按量计费
供应商 1省40%
输入$1.8$1.08/1M输出$5.3$3.18/1M缓存$0.132/1M
Xiaomi
mimo-v2.6-flash
Xiaomi 的 mimo-v2.6-flash 模型,支持文本、图像、视频、音频输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 1
输入$0.14/1M输出$0.28/1M缓存$0.0028/1M
Xiaomi
mimo-v2.6-pro
Xiaomi 的 mimo-v2.6-pro 模型,支持文本、图像、视频、音频输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 1
输入$0.435/1M输出$0.87/1M缓存$0.0036/1M
T
TypeSafe
typesafe/jev
TypeSafe Jev 是面向软件系统的结构化决策模型,接收状态与候选动作并返回机器可用的决策结果。
上下文 —
按量计费
供应商 1
输入$0.042/1M输出$0/1M
xAI
grok-4.7
xAI 的 grok-4.7 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。官方未设置独立的文本输出上限,总长度仍受上下文窗口约束。
上下文 500K
按量计费
供应商 1省60%
输入$2$0.8/1M输出$6$2.4/1M缓存$0.2/1M
Z.ai
glm-5.3-flash
Z.ai 的 glm-5.3-flash 模型,支持文本、图像、视频、文件输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 1省40%
输入$0.12$0.072/1M输出$0.418$0.2508/1M缓存$0.021/1M
Z.ai
glm-5.3
Z.ai 的 glm-5.3 模型,支持文本输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 1省40%
输入$1.2$0.72/1M输出$4.18$2.508/1M缓存$0.18/1M
Gemma 4-26B-A4B
Gemma 是一系列生成式人工智能模型,可用于各种生成任务,包括问答、总结和推理。Gemma 模型提供开放权重,并允许负责任的商业用途,让您可以在自己的项目和应用中调整和部署它们。
上下文 —
按量计费
供应商 1省40%
输入$0.15$0.09/1M输出$0.6$0.36/1M缓存$0.009/1M
Moonshot
kimi-k3
Moonshot 的 kimi-k3 模型,支持文本、图像、视频输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省45%
输入$2.86$1.573/1M输出$14.29$7.8595/1M缓存$0.1573/1M
xAI
grok-4.5
xAI 的 grok-4.5 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。官方未设置独立的文本输出上限,总长度仍受上下文窗口约束。
上下文 500K
按量计费
供应商 1省60%
输入$2$0.8/1M输出$6$2.4/1M缓存$0.2/1M
Xiaomi
mimo-v2.5
Xiaomi 的 mimo-v2.5 模型,支持文本、音频、图像、视频输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1.1M
按量计费
供应商 1
输入$0.14/1M输出$0.28/1M缓存$0.0028/1M
Xiaomi
mimo-v2.5-pro
Xiaomi 的 mimo-v2.5-pro 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1.1M
按量计费
供应商 1
输入$0.435/1M输出$0.87/1M缓存$0.0036/1M
Tencent
hy3
Tencent 的 hy3 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 262.1K
按量计费
供应商 1
输入$0.15/1M输出$0.58/1M缓存$0.036/1M
Moonshot
kimi-k2.6
Moonshot 的 kimi-k2.6 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 262.1K
按量计费
供应商 2省40%
输入$0.95$0.57/1M输出$4$2.4/1M缓存$0.096/1M
Z.ai
glm-5.2
Z.ai 的 glm-5.2 模型,支持文本输入和文本输出。支持推理、工具调用。
上下文 1M
按量计费
供应商 4省60%
输入$1.4$0.56/1M输出$4.4$1.76/1M缓存$0.104/1M
Z.ai
glm-5.1
Z.ai 的 glm-5.1 模型,支持文本输入和文本输出。支持推理、工具调用。
上下文 204.8K
按量计费
供应商 2省40%
输入$0.87$0.522/1M输出$3.5$2.1/1M缓存$0.114/1M
Z.ai
glm-5
Z.ai 的 glm-5 模型,支持文本输入和文本输出。支持推理、工具调用。
上下文 204.8K
按量计费
供应商 2省40%
输入$0.58$0.348/1M输出$2.6$1.56/1M缓存$0.084/1M
DeepSeek
deepseek-v4-pro
DeepSeek 的 deepseek-v4-pro 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 5省60%
输入$1.33$0.532/1M输出$4$1.6/1M缓存$0.0176/1M
DeepSeek
deepseek-v4-flash
DeepSeek 的 deepseek-v4-flash 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 4省60%
输入$0.44$0.176/1M输出$1.33$0.532/1M缓存$0.006/1M
Alibaba
qwen3.7-plus
Alibaba 的 qwen3.7-plus 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省40%
输入$0.4$0.24/1M输出$1.6$0.96/1M缓存$0.048/1M
Moonshot
kimi-k2.7-code
Moonshot 的 kimi-k2.7-code 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 262.1K
按量计费
供应商 2省45%
输入$0.95$0.5225/1M输出$4$2.2/1M缓存$0.1045/1M
ByteDance
doubao-seed-2-1-pro-260628
豆包 Seed 2.1 系列模型,支持深度思考、多模态理解、工具调用和结构化输出;官方标注 256K 上下文。
上下文 —
按量计费
供应商 1省15%
输入$0.86$0.731/1M输出$4.3$3.655/1M
ByteDance
doubao-seed-2-1-turbo-260628
豆包 Seed 2.1 系列模型,支持深度思考、多模态理解、工具调用和结构化输出;官方标注 256K 上下文。
上下文 —
按量计费
供应商 1省15%
输入$0.43$0.3655/1M输出$0.43$0.3655/1M
MiniMax
MiniMax-M2.5
MiniMax 的 MiniMax-M2.5 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。
上下文 204.8K
按量计费
供应商 2省40%
输入$0.3$0.18/1M输出$1.2$0.72/1M缓存$0.018/1M
Anthropic
claude-haiku-4-5
Anthropic 的 claude-haiku-4-5 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 200K
按量计费
供应商 5省90%
输入$1$0.1/1M输出$5$0.5/1M缓存$0.01/1M
OpenAI
gpt-5-nano
OpenAI 的 gpt-5-nano 模型,支持文本、图像输入和文本输出。支持推理、工具调用、结构化输出。
上下文 400K
按量计费
供应商 2省60%
输入$0.05$0.02/1M输出$0.4$0.16/1M缓存$0.002/1M
Anthropic
claude-sonnet-4-5
Anthropic 的 claude-sonnet-4-5 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 200K
按量计费
供应商 6省90%
输入$3$0.3/1M输出$15$1.5/1M缓存$0.03/1M
Anthropic
claude-opus-4-5
Anthropic 的 claude-opus-4-5 模型,支持文本、图像输入和文本输出。支持推理、工具调用。
上下文 200K
按量计费
供应商 4省90%
输入$5$0.5/1M输出$25$2.5/1M缓存$0.05/1M
MiniMax
MiniMax/MiniMax-M3
MiniMax 的 MiniMax-M3 模型,支持文本、图像、视频输入和文本输出。支持推理、工具调用、结构化输出。
上下文 1M
按量计费
供应商 2省40%
输入$75$45/1M输出$75$45/1M
DeepSeek
deepseek-v4.1-flash
DeepSeek 的 deepseek-v4-1-flash-260910 模型,支持文本、图像输入和文本输出。支持推理。
上下文 1M
按量计费
供应商 1省40%
输入$75$45/1M输出$75$45/1M
ByteDance
doubao-seed-2-0-code-preview-260215
豆包 Seed 2.0 系列模型接口,用于文本生成与智能体应用。精确版本规格以接入渠道为准。
上下文 —
按量计费
供应商 1省15%
输入$0.782$0.6647/1M输出$3.893$3.309/1M
ByteDance
doubao-seed-2-0-lite-260428
豆包 Seed 2.0 系列模型接口,用于文本生成与智能体应用。精确版本规格以接入渠道为准。
上下文 —
按量计费
供应商 1省15%
输入$0.09041$0.076849/1M输出$0.54246$0.461091/1M缓存$0.01537/1M
ByteDance
doubao-seed-2-0-mini-260428
豆包 Seed 2.0 系列模型接口,用于文本生成与智能体应用。精确版本规格以接入渠道为准。
上下文 —
按量计费
供应商 1省15%
输入$0.0282$0.02397/1M输出$0.282$0.2397/1M缓存$0.004794/1M
ByteDance
doubao-seed-2-0-pro-260215
豆包 Seed 2.0 系列模型接口,用于文本生成与智能体应用。精确版本规格以接入渠道为准。
上下文 —
按量计费
供应商 1省15%
输入$0.782$0.6647/1M输出$3.876$3.2946/1M
xAI
grok-3
xAI 历史 Grok 模型名称。官方 API 已于 2026 年 5 月 15 日将该名称重定向到 Grok 4.3;本站实际模型版本以接入渠道为准。
上下文 —
按量计费
供应商 1省60%
输入$3$1.2/1M输出$15$6/1M缓存$1.2/1M
xAI
grok-3-fast-beta
xAI grok-3-fast-beta 系列文本模型接口。历史版本与当前官方服务可能存在差异,实际版本以接入渠道为准。
上下文 —
按量计费
供应商 1省60%
输入$5.5$2.2/1M输出$27.5$11/1M
xAI
grok-3-mini
xAI grok-3-mini 系列文本模型接口。历史版本与当前官方服务可能存在差异,实际版本以接入渠道为准。
上下文 —
按量计费
供应商 1省60%
输入$0.3$0.12/1M输出$0.501$0.2004/1M缓存$0.03/1M
xAI
grok-4
xAI grok-4 系列文本模型接口。历史版本与当前官方服务可能存在差异,实际版本以接入渠道为准。
上下文 —
按量计费
供应商 1省60%
输入$3.3$1.32/1M输出$16.5$6.6/1M缓存$0.33/1M
xAI
grok-4-0709
xAI 历史 Grok 模型名称。官方 API 已于 2026 年 5 月 15 日将该名称重定向到 Grok 4.3;本站实际模型版本以接入渠道为准。
上下文 —
按量计费
供应商 1省60%
输入$3$1.2/1M输出$15$6/1M
xAI
grok-4-1-fast-non-reasoning
xAI 历史 Grok 模型名称。官方 API 已于 2026 年 5 月 15 日将该名称重定向到 Grok 4.3;本站实际模型版本以接入渠道为准。
上下文 —
按量计费
供应商 1省60%
输入$0.2$0.08/1M输出$0.5$0.2/1M缓存$0.02/1M
xAI
grok-4-1-fast-reasoning
xAI 历史 Grok 模型名称。官方 API 已于 2026 年 5 月 15 日将该名称重定向到 Grok 4.3;本站实际模型版本以接入渠道为准。
上下文 —
按量计费
供应商 1省60%
输入$0.2$0.08/1M输出$0.5$0.2/1M缓存$0.02/1M
xAI
grok-4-fast-non-reasoning
xAI 历史 Grok 模型名称。官方 API 已于 2026 年 5 月 15 日将该名称重定向到 Grok 4.3;本站实际模型版本以接入渠道为准。
上下文 —
按量计费
供应商 1省60%
输入$0.2$0.08/1M输出$0.5$0.2/1M缓存$0.02/1M
xAI
grok-4-fast-reasoning
xAI 历史 Grok 模型名称。官方 API 已于 2026 年 5 月 15 日将该名称重定向到 Grok 4.3;本站实际模型版本以接入渠道为准。
上下文 —
按量计费
供应商 1省60%
输入$0.2$0.08/1M输出$0.5$0.2/1M缓存$0.02/1M
xAI
grok-4.20-0309-non-reasoning
xAI 的 grok-4.20-0309-non-reasoning 模型。支持文本、图像输入和文本输出。
上下文 1M
按量计费
供应商 1省60%
输入$2$0.8/1M输出$6$2.4/1M缓存$0.08/1M
xAI
grok-4.20-0309-reasoning
xAI 的 grok-4.20-0309-reasoning 模型。支持文本、图像输入和文本输出。
上下文 1M
按量计费
供应商 1省60%
输入$2$0.8/1M输出$6$2.4/1M缓存$0.08/1M
xAI
grok-4.20-beta-0309-non-reasoning
xAI 的 grok-4.20-beta-0309-non-reasoning 模型。支持文本、图像输入和文本输出。
上下文 1M
按量计费
供应商 1省60%
输入$2$0.8/1M输出$6$2.4/1M缓存$0.08/1M
xAI
grok-4.20-beta-0309-reasoning
xAI 的 grok-4.20-beta-0309-reasoning 模型。支持文本、图像输入和文本输出。
上下文 1M
按量计费
供应商 1省60%
输入$2$0.8/1M输出$6$2.4/1M缓存$0.08/1M
Alibaba
qwen3-omni-flash-2025-12-01
千问 Qwen3-Omni-Flash 的 2025 年 12 月快照,提供多模态理解及文本、语音生成能力。
上下文 —
按量计费
供应商 2省40%
输入$75$45/1M输出$75$45/1M
Alibaba
qwen3.5-flash
Alibaba 的 qwen3.5-flash 模型。支持文本、图像、视频输入和文本输出。
上下文 1M
按量计费
供应商 2省40%
输入$0.0282$0.01692/1M输出$0.282$0.1692/1M缓存$0.001692/1M
Alibaba
qwen3.5-plus
Alibaba 的 qwen3.5-plus 模型。支持文本、图像、视频输入和文本输出。
上下文 1M
按量计费
供应商 2省40%
输入$0.1096$0.06576/1M输出$0.6576$0.39456/1M缓存$0.006576/1M
Alibaba
qwen3.6-35b-a3b
Alibaba 的 qwen3.6-35b-a3b 模型。支持文本、图像、视频输入和文本输出。
上下文 262.1K
按量计费
供应商 2省40%
输入$0.254$0.1524/1M输出$1.524$0.9144/1M缓存$0.1524/1M
Alibaba
qwen3.6-flash
Alibaba 的 qwen3.6-flash 模型。支持文本、图像、视频输入和文本输出。
上下文 1M
按量计费
供应商 2省40%
输入$0.169$0.1014/1M输出$1.014$0.6084/1M缓存$0.01014/1M
Alibaba
qwen3.6-max-preview
Alibaba 的 qwen3.6-max-preview 模型。支持文本输入和文本输出。
上下文 262.1K
按量计费
供应商 2省40%
输入$1.268$0.7608/1M输出$7.608$4.5648/1M缓存$0.07608/1M
Alibaba
qwen3.6-plus
Alibaba 的 qwen3.6-plus 模型。支持文本、图像、视频输入和文本输出。
上下文 1M
按量计费
供应商 2省40%
输入$0.282$0.1692/1M输出$1.692$1.0152/1M缓存$0.01692/1M
Alibaba
qwen3.7-max
Alibaba 的 qwen3.7-max 模型。支持文本输入和文本输出。
上下文 1M
按量计费
供应商 2省40%
输入$2.5$1.5/1M输出$7.5$4.5/1M缓存$0.15/1M
