Qwen3.7 Flash
Alibaba Cloud
文本生成Qwen3.7 原生视觉语言 Flash 模型,相较 3.6-Flash 全面提升多模态理解与 Agent 执行能力,适合低延迟多模态理解与 Coding / Agent 场景。
上下文
1M
最大输出
128K
价格 / MTok
模型 ID
qwen3.7-flash协议
查看各模型能力、定价、模型 ID 与支持的协议。点击卡片上的协议徽章可复制对应 Base URL。
Alibaba Cloud
文本生成Qwen3.7 原生视觉语言 Flash 模型,相较 3.6-Flash 全面提升多模态理解与 Agent 执行能力,适合低延迟多模态理解与 Coding / Agent 场景。
上下文
1M
最大输出
128K
价格 / MTok
模型 ID
qwen3.7-flash协议
Alibaba Cloud
文本生成Qwen3.7 旗舰模型,重点优化编程、生产力任务与 Agent 工作流。其 Agent 导向设计重点覆盖编程、办公生产力和复杂多步骤任务。
上下文
1M
最大输出
128K
价格 / MTok
模型 ID
qwen3.7-max协议
Alibaba Cloud
文本生成兼顾成本与效果的 Qwen 多模态模型,适合通用推理、视觉理解与生产应用。兼顾文本与图像理解,并以更具成本效率的设计服务于生产级多模态推理。
上下文
1M
最大输出
128K
价格 / MTok
模型 ID
qwen3.7-plus协议
Alibaba Cloud
文本生成上下文
1M
最大输出
128K
价格 / MTok
模型 ID
qwen3.8-flash协议
Alibaba Cloud
文本生成2.4 万亿参数 MoE 旗舰,全面提升编程与办公能力,可胜任法律、金融、设计等专业任务,并端到端交付生产级成果。原生视觉理解覆盖规划、执行与验证,支持超长文档与长视频深度解析。
上下文
1M
最大输出
128K
价格 / MTok
模型 ID
qwen3.8-max协议
Anthropic
文本生成面向自主知识工作、编程和多模态 Agent 的 Anthropic 模型。定位于自主知识工作与编程,支持多模态输入、推理及工具驱动工作流。
上下文
1M
最大输出
128K
价格 / MTok
模型 ID
claude-fable-5协议
Anthropic
文本生成适合低延迟对话、编程和 Agent 任务的高速高效 Claude 模型。以显著更低的延迟和成本提供接近前沿水平的能力,适合高并发交互式任务。
上下文
200K
最大输出
64K
价格 / MTok
模型 ID
claude-haiku-4.5协议
Anthropic
文本生成面向端到端编程与长时间专业工作流的高性能 Claude 模型。针对贯穿完整软件与专业工作流的 Agent 优化,而不仅是处理孤立提示词。
上下文
1M
最大输出
128K
价格 / MTok
模型 ID
claude-opus-4.6协议
Anthropic
文本生成面向长时间异步 Agent 与复杂软件工作流的 Opus 模型。面向需要长时间持续执行编程与专业任务的异步 Agent。
上下文
1M
最大输出
128K
价格 / MTok
模型 ID
claude-opus-4.7协议
Anthropic
文本生成适合长上下文推理、编程与多模态分析的高性能 Opus 模型。结合多模态输入、推理能力与长上下文窗口,适合高要求的通用工作流。
上下文
1M
最大输出
128K
价格 / MTok
模型 ID
claude-opus-4.8协议
Anthropic
文本生成Anthropic 旗舰模型,面向复杂推理、编程、视觉分析与长时间 Agent 任务。尤其擅长端到端软件任务、代码审查与缺陷定位、文档和图表分析、复杂办公交付、工具调用及并行子 Agent 协作。
上下文
1M
最大输出
128K
价格 / MTok
模型 ID
claude-opus-5协议
Anthropic
文本生成适合迭代开发、Agent 与专业知识工作的均衡型前沿模型。优势包括迭代开发、复杂代码库导航,以及借助工具完成端到端项目执行。
上下文
1M
最大输出
128K
价格 / MTok
模型 ID
claude-sonnet-4.6协议
Anthropic
文本生成适合编程、专业工作与自适应 Agent 推理的前沿 Sonnet 模型。自适应推理等级可在前沿编程与 Agent 能力、延迟和 Token 消耗之间灵活取舍。
上下文
1M
最大输出
128K
价格 / MTok
模型 ID
claude-sonnet-5协议
DeepSeek
文本生成DeepSeek V4 Flash 正式版,面向高速长上下文推理、编程与 Agent。0731 后训练刷新保持混合专家架构,同时强化 Agent 编程与工具调用。
上下文
1M
最大输出
384K
价格 / MTok
模型 ID
deepseek-v4-flash协议
DeepSeek
文本生成DeepSeek V4 Pro 正式版旗舰模型,面向高级推理、编程与持续 Agent 任务。0813 生产检查点沿用同一 API 名称,提供 1M 上下文与思考/非思考双模式。
上下文
1M
最大输出
384K
价格 / MTok
模型 ID
deepseek-v4-pro协议
适合多轮对话、编程与 Agent 工作流的高速 Gemini 思考模型。以 Flash 级速度提供接近 Pro 的推理与工具调用能力,适用于多轮对话、编程和 Agent。
上下文
1M
最大输出
64K
价格 / MTok
模型 ID
gemini-3-flash-preview协议
针对高流量、延迟敏感应用优化的高效率 Gemini 预览模型。针对高吞吐工作负载优化,同时力求接近更大型 Flash 模型的质量。
上下文
1M
最大输出
64K
价格 / MTok
模型 ID
gemini-3.1-flash-lite协议
面向软件工程与高可靠 Agent 工作流的前沿 Gemini 推理预览模型。该预览版在复杂工作流中强化软件工程表现、Agent 可靠性和 Token 效率。
上下文
1.1M
最大输出
65.5K
价格 / MTok
模型 ID
gemini-3.1-pro-preview协议
在编程、推理与并行 Agent 场景表现出色的高效 Gemini 多模态模型。在更高效的档位提供接近 Pro 的编程和推理能力,并针对并行 Agent 执行优化。
上下文
1.1M
最大输出
65.5K
价格 / MTok
模型 ID
gemini-3.5-flash协议
面向专注型子 Agent 与高流量生产任务的轻量 Gemini 模型。轻量化设计尤其适合大型多 Agent 系统中执行明确子任务的子 Agent。
上下文
1M
最大输出
64K
价格 / MTok
模型 ID
gemini-3.5-flash-lite协议
面向编程、Agent、Web 与应用开发的高效率 Gemini 模型。面向 Agent 工作流中的编程与应用开发,力求以更少的无效修改产出更成熟的结果。
上下文
1M
最大输出
64K
价格 / MTok
模型 ID
gemini-3.6-flash协议
面向编程、Agent 与知识工作的高效率 Gemini 主力模型。相较 Gemini 3.6 Flash,提升首轮代码准确率、多步工具调用与可上线应用产出。
上下文
1M
最大输出
64K
价格 / MTok
模型 ID
gemini-3.7-flash协议
Moonshot AI
文本生成面向视觉编程与协同 Agent 工作流的原生多模态 Kimi 模型。将原生多模态理解、视觉编程与自主 Agent 集群范式结合起来。
上下文
256K
最大输出
256K
价格 / MTok
模型 ID
kimi-k2.5协议
Moonshot AI
文本生成面向长周期编程、UI 生成与 Agent 编排的多模态 Kimi 模型。面向长周期编程、代码驱动的 UI 生成,以及复杂项目中的多 Agent 协同执行。
上下文
256K
最大输出
256K
价格 / MTok
模型 ID
kimi-k2.6协议
Moonshot AI
文本生成面向长上下文端到端编程任务、强调可靠性的 Kimi Code 模型。以编程为中心,旨在长上下文中可靠完成端到端开发任务。
上下文
256K
最大输出
256K
价格 / MTok
模型 ID
kimi-k2.7-code协议
Moonshot AI
文本生成面向复杂编程、推理与 Agent 工作的开放权重 Kimi 多模态模型。这款开放权重多模态推理模型面向复杂编程、知识工作和长时间运行的 Agent。
上下文
1M
最大输出
1M
价格 / MTok
模型 ID
kimi-k3协议
OpenAI
文本生成面向高级推理、编程、多模态输入与专业工作流的旗舰 GPT 模型。统一通用 GPT 与编程能力,面向大上下文专业工作和工具驱动执行。
上下文
1.1M
最大输出
128K
价格 / MTok
模型 ID
gpt-5.4协议
OpenAI
文本生成面向高吞吐推理、编程与多模态应用的高速 GPT-5.4 变体。较小规模版本保留较强推理和编程能力,同时提高速度与吞吐量。
上下文
400K
最大输出
128K
价格 / MTok
模型 ID
gpt-5.4-mini协议
OpenAI
文本生成针对低延迟、高流量与成本敏感任务优化的紧凑型 GPT 模型。针对强调速度的分类、抽取、路由及其他高并发轻量任务优化。
上下文
400K
最大输出
128K
价格 / MTok
模型 ID
gpt-5.4-nano协议
OpenAI
文本生成面向复杂专业工作、强化推理能力与可靠性的前沿 GPT 模型。在保留长上下文能力的同时,提高困难专业任务上的可靠性和 Token 效率。
上下文
1.1M
最大输出
128K
价格 / MTok
模型 ID
gpt-5.5协议
OpenAI
文本生成面向对话、分类与轻量 Agent 的高速高效 GPT-5.6 模型。高效档位面向高并发对话、分类和轻量 Agent 工作流,强调低延迟。
上下文
1.1M
最大输出
128K
价格 / MTok
模型 ID
gpt-5.6-luna协议
OpenAI
文本生成GPT-5.6 旗舰模型,适合高难度推理、编程与多步骤 Agent 任务。旗舰档位尤其擅长命令行工作和复杂的多步骤编程流程。
上下文
1.1M
最大输出
128K
价格 / MTok
模型 ID
gpt-5.6-sol协议
OpenAI
文本生成面向日常编程、推理与 Agent 应用的均衡型 GPT-5.6 模型。平衡档位在旗舰质量与成本效率之间取舍,适合日常编程、推理和 Agent。
上下文
1.1M
最大输出
128K
价格 / MTok
模型 ID
gpt-5.6-terra协议
xAI (Grok)
文本生成面向长时运行 Agent、编程与知识工作的前沿 Grok 模型。侧重多步 Agent、复杂交互与视觉任务,以及可持续推进的编程轨迹。
上下文
500K
最大输出
128K
价格 / MTok
模型 ID
grok-4.6协议
Zhipu AI
文本生成面向项目级软件工程与 Agent 的长上下文 GLM 推理模型。大规模推理模型面向项目级软件工程和长周期 Agent 工作流。
上下文
1M
最大输出
128K
价格 / MTok
模型 ID
glm-5.2协议
Zhipu AI
文本生成面向长程编程、Agent 与安全审查的 GLM 旗舰模型。沿用 GLM-5.2 基座,通过后训练提升编程与智能体表现。
上下文
1M
最大输出
128K
价格 / MTok
模型 ID
glm-5.3协议