可用模型

查看各模型能力、定价、模型 ID 与支持的协议。点击卡片上的协议徽章可复制对应 Base URL。

37 / 37

文本生成

36

Qwen3.7 Flash

Alibaba Cloud

文本生成

Qwen3.7 原生视觉语言 Flash 模型,相较 3.6-Flash 全面提升多模态理解与 Agent 执行能力,适合低延迟多模态理解与 Coding / Agent 场景。

上下文

1M

最大输出

128K

价格 / MTok

输入$0.04输出$0.16

模型 ID

qwen3.7-flash

协议

Qwen3.7 Max

Alibaba Cloud

文本生成

Qwen3.7 旗舰模型,重点优化编程、生产力任务与 Agent 工作流。其 Agent 导向设计重点覆盖编程、办公生产力和复杂多步骤任务。

上下文

1M

最大输出

128K

价格 / MTok

输入$2.5输出$7.5

模型 ID

qwen3.7-max

协议

Qwen3.7 Plus

Alibaba Cloud

文本生成

兼顾成本与效果的 Qwen 多模态模型,适合通用推理、视觉理解与生产应用。兼顾文本与图像理解,并以更具成本效率的设计服务于生产级多模态推理。

上下文

1M

最大输出

128K

价格 / MTok

输入$0.4输出$1.6

模型 ID

qwen3.7-plus

协议

Qwen3.8 Flash

Alibaba Cloud

文本生成

上下文

1M

最大输出

128K

价格 / MTok

输入$0.16输出$0.47

模型 ID

qwen3.8-flash

协议

Qwen3.8 Max

Alibaba Cloud

文本生成

2.4 万亿参数 MoE 旗舰,全面提升编程与办公能力,可胜任法律、金融、设计等专业任务,并端到端交付生产级成果。原生视觉理解覆盖规划、执行与验证,支持超长文档与长视频深度解析。

上下文

1M

最大输出

128K

价格 / MTok

输入$2.5输出$7.5

模型 ID

qwen3.8-max

协议

Claude Fable 5

Anthropic

文本生成

面向自主知识工作、编程和多模态 Agent 的 Anthropic 模型。定位于自主知识工作与编程,支持多模态输入、推理及工具驱动工作流。

上下文

1M

最大输出

128K

价格 / MTok

输入$10输出$50

模型 ID

claude-fable-5

协议

Claude Haiku 4.5

Anthropic

文本生成

适合低延迟对话、编程和 Agent 任务的高速高效 Claude 模型。以显著更低的延迟和成本提供接近前沿水平的能力,适合高并发交互式任务。

上下文

200K

最大输出

64K

价格 / MTok

输入$1输出$5

模型 ID

claude-haiku-4.5

协议

Claude Opus 4.6

Anthropic

文本生成

面向端到端编程与长时间专业工作流的高性能 Claude 模型。针对贯穿完整软件与专业工作流的 Agent 优化,而不仅是处理孤立提示词。

上下文

1M

最大输出

128K

价格 / MTok

输入$5输出$25

模型 ID

claude-opus-4.6

协议

Claude Opus 4.7

Anthropic

文本生成

面向长时间异步 Agent 与复杂软件工作流的 Opus 模型。面向需要长时间持续执行编程与专业任务的异步 Agent。

上下文

1M

最大输出

128K

价格 / MTok

输入$5输出$25

模型 ID

claude-opus-4.7

协议

Claude Opus 4.8

Anthropic

文本生成

适合长上下文推理、编程与多模态分析的高性能 Opus 模型。结合多模态输入、推理能力与长上下文窗口,适合高要求的通用工作流。

上下文

1M

最大输出

128K

价格 / MTok

输入$5输出$25

模型 ID

claude-opus-4.8

协议

Claude Opus 5

Anthropic

文本生成

Anthropic 旗舰模型,面向复杂推理、编程、视觉分析与长时间 Agent 任务。尤其擅长端到端软件任务、代码审查与缺陷定位、文档和图表分析、复杂办公交付、工具调用及并行子 Agent 协作。

上下文

1M

最大输出

128K

价格 / MTok

输入$5输出$25

模型 ID

claude-opus-5

协议

Claude Sonnet 4.6

Anthropic

文本生成

适合迭代开发、Agent 与专业知识工作的均衡型前沿模型。优势包括迭代开发、复杂代码库导航,以及借助工具完成端到端项目执行。

上下文

1M

最大输出

128K

价格 / MTok

输入$3输出$15

模型 ID

claude-sonnet-4.6

协议

Claude Sonnet 5

Anthropic

文本生成

适合编程、专业工作与自适应 Agent 推理的前沿 Sonnet 模型。自适应推理等级可在前沿编程与 Agent 能力、延迟和 Token 消耗之间灵活取舍。

上下文

1M

最大输出

128K

价格 / MTok

输入$3输出$15

模型 ID

claude-sonnet-5

协议

DeepSeek V4 Flash

DeepSeek

文本生成

DeepSeek V4 Flash 正式版,面向高速长上下文推理、编程与 Agent。0731 后训练刷新保持混合专家架构,同时强化 Agent 编程与工具调用。

上下文

1M

最大输出

384K

价格 / MTok

输入$0.22输出$0.66

模型 ID

deepseek-v4-flash

协议

DeepSeek V4 Pro

DeepSeek

文本生成

DeepSeek V4 Pro 正式版旗舰模型,面向高级推理、编程与持续 Agent 任务。0813 生产检查点沿用同一 API 名称,提供 1M 上下文与思考/非思考双模式。

上下文

1M

最大输出

384K

价格 / MTok

输入$0.66输出$1.98

模型 ID

deepseek-v4-pro

协议

Gemini 3 Flash Preview

Google

文本生成

适合多轮对话、编程与 Agent 工作流的高速 Gemini 思考模型。以 Flash 级速度提供接近 Pro 的推理与工具调用能力,适用于多轮对话、编程和 Agent。

上下文

1M

最大输出

64K

价格 / MTok

输入$0.5输出$3

模型 ID

gemini-3-flash-preview

协议

Gemini 3.1 Flash Lite

Google

文本生成

针对高流量、延迟敏感应用优化的高效率 Gemini 预览模型。针对高吞吐工作负载优化,同时力求接近更大型 Flash 模型的质量。

上下文

1M

最大输出

64K

价格 / MTok

输入$0.25输出$1.5

模型 ID

gemini-3.1-flash-lite

协议

Gemini 3.1 Pro Preview

Google

文本生成

面向软件工程与高可靠 Agent 工作流的前沿 Gemini 推理预览模型。该预览版在复杂工作流中强化软件工程表现、Agent 可靠性和 Token 效率。

上下文

1.1M

最大输出

65.5K

价格 / MTok

输入$2输出$12

模型 ID

gemini-3.1-pro-preview

协议

Gemini 3.5 Flash

Google

文本生成

在编程、推理与并行 Agent 场景表现出色的高效 Gemini 多模态模型。在更高效的档位提供接近 Pro 的编程和推理能力,并针对并行 Agent 执行优化。

上下文

1.1M

最大输出

65.5K

价格 / MTok

输入$1.5输出$9

模型 ID

gemini-3.5-flash

协议

Gemini 3.5 Flash Lite

Google

文本生成

面向专注型子 Agent 与高流量生产任务的轻量 Gemini 模型。轻量化设计尤其适合大型多 Agent 系统中执行明确子任务的子 Agent。

上下文

1M

最大输出

64K

价格 / MTok

输入$0.3输出$2.5

模型 ID

gemini-3.5-flash-lite

协议

Gemini 3.6 Flash

Google

文本生成

面向编程、Agent、Web 与应用开发的高效率 Gemini 模型。面向 Agent 工作流中的编程与应用开发,力求以更少的无效修改产出更成熟的结果。

上下文

1M

最大输出

64K

价格 / MTok

输入$1.5输出$7.5

模型 ID

gemini-3.6-flash

协议

Gemini 3.7 Flash

Google

文本生成

面向编程、Agent 与知识工作的高效率 Gemini 主力模型。相较 Gemini 3.6 Flash,提升首轮代码准确率、多步工具调用与可上线应用产出。

上下文

1M

最大输出

64K

价格 / MTok

输入$1.5输出$7.5

模型 ID

gemini-3.7-flash

协议

Kimi K2.5

Moonshot AI

文本生成

面向视觉编程与协同 Agent 工作流的原生多模态 Kimi 模型。将原生多模态理解、视觉编程与自主 Agent 集群范式结合起来。

上下文

256K

最大输出

256K

价格 / MTok

输入$0.6输出$3

模型 ID

kimi-k2.5

协议

Kimi K2.6

Moonshot AI

文本生成

面向长周期编程、UI 生成与 Agent 编排的多模态 Kimi 模型。面向长周期编程、代码驱动的 UI 生成,以及复杂项目中的多 Agent 协同执行。

上下文

256K

最大输出

256K

价格 / MTok

输入$0.95输出$4

模型 ID

kimi-k2.6

协议

Kimi K2.7 Code

Moonshot AI

文本生成

面向长上下文端到端编程任务、强调可靠性的 Kimi Code 模型。以编程为中心,旨在长上下文中可靠完成端到端开发任务。

上下文

256K

最大输出

256K

价格 / MTok

输入$0.95输出$4

模型 ID

kimi-k2.7-code

协议

Kimi K3

Moonshot AI

文本生成

面向复杂编程、推理与 Agent 工作的开放权重 Kimi 多模态模型。这款开放权重多模态推理模型面向复杂编程、知识工作和长时间运行的 Agent。

上下文

1M

最大输出

1M

价格 / MTok

输入$3输出$15

模型 ID

kimi-k3

协议

GPT-5.4

OpenAI

文本生成

面向高级推理、编程、多模态输入与专业工作流的旗舰 GPT 模型。统一通用 GPT 与编程能力,面向大上下文专业工作和工具驱动执行。

上下文

1.1M

最大输出

128K

价格 / MTok

输入$2.5输出$15

模型 ID

gpt-5.4

协议

GPT-5.4 mini

OpenAI

文本生成

面向高吞吐推理、编程与多模态应用的高速 GPT-5.4 变体。较小规模版本保留较强推理和编程能力,同时提高速度与吞吐量。

上下文

400K

最大输出

128K

价格 / MTok

输入$0.75输出$4.5

模型 ID

gpt-5.4-mini

协议

GPT-5.4 nano

OpenAI

文本生成

针对低延迟、高流量与成本敏感任务优化的紧凑型 GPT 模型。针对强调速度的分类、抽取、路由及其他高并发轻量任务优化。

上下文

400K

最大输出

128K

价格 / MTok

输入$0.2输出$1.25

模型 ID

gpt-5.4-nano

协议

GPT-5.5

OpenAI

文本生成

面向复杂专业工作、强化推理能力与可靠性的前沿 GPT 模型。在保留长上下文能力的同时,提高困难专业任务上的可靠性和 Token 效率。

上下文

1.1M

最大输出

128K

价格 / MTok

输入$5输出$30

模型 ID

gpt-5.5

协议

GPT-5.6 Luna

OpenAI

文本生成

面向对话、分类与轻量 Agent 的高速高效 GPT-5.6 模型。高效档位面向高并发对话、分类和轻量 Agent 工作流,强调低延迟。

上下文

1.1M

最大输出

128K

价格 / MTok

输入$0.22输出$1.2

模型 ID

gpt-5.6-luna

协议

GPT-5.6 Sol

OpenAI

文本生成

GPT-5.6 旗舰模型,适合高难度推理、编程与多步骤 Agent 任务。旗舰档位尤其擅长命令行工作和复杂的多步骤编程流程。

上下文

1.1M

最大输出

128K

价格 / MTok

输入$5输出$30

模型 ID

gpt-5.6-sol

协议

GPT-5.6 Terra

OpenAI

文本生成

面向日常编程、推理与 Agent 应用的均衡型 GPT-5.6 模型。平衡档位在旗舰质量与成本效率之间取舍,适合日常编程、推理和 Agent。

上下文

1.1M

最大输出

128K

价格 / MTok

输入$2.2输出$13.2

模型 ID

gpt-5.6-terra

协议

Grok 4.6

xAI (Grok)

文本生成

面向长时运行 Agent、编程与知识工作的前沿 Grok 模型。侧重多步 Agent、复杂交互与视觉任务,以及可持续推进的编程轨迹。

上下文

500K

最大输出

128K

价格 / MTok

输入$2输出$6

模型 ID

grok-4.6

协议

GLM-5.2

Zhipu AI

文本生成

面向项目级软件工程与 Agent 的长上下文 GLM 推理模型。大规模推理模型面向项目级软件工程和长周期 Agent 工作流。

上下文

1M

最大输出

128K

价格 / MTok

输入$1.4输出$4.4

模型 ID

glm-5.2

协议

GLM-5.3

Zhipu AI

文本生成

面向长程编程、Agent 与安全审查的 GLM 旗舰模型。沿用 GLM-5.2 基座,通过后训练提升编程与智能体表现。

上下文

1M

最大输出

128K

价格 / MTok

输入$1.4输出$4.4

模型 ID

glm-5.3

协议

图像生成

1

GPT Image 2

OpenAI

图像生成

用于专用 Images API 的 OpenAI 高保真图片生成与编辑模型。

价格 / MTok

输入$8输出$30

模型 ID

gpt-image-2

协议