所有模型
171 个模型
最新
model
DeepSeek / DeepSeek-V4-Pro(限时2.5折)
DeepSeek V4 Pro 是 DeepSeek 推出的大型专家混合模型,它专为高级推理、编码和长远视野代理工作流设计,在知识、数学和软件工程基准测试中表现出色。它基于与 DeepSeek V4 Flash 相同的架构,引入了混合注意力系统,实现高效的长上下文处理,并支持多种推理模式,根据任务平衡速度和深度。它非常适合复杂工作负载,如全代码库分析、多步自动化和大规模信息综合,这些工作在能力和效率上都至关重要。
DeepSeek
1000K 上下文
¥ 3.00 / M 输入 tokens
¥ 6.00 / M 输出 tokens
model
ByteDance / Doubao-Seed-Character
Doubao-Seed-Character 是面向新一代虚拟陪伴场景打造的 Seed 分支模型,擅长虚拟演绎与“真人”风格的角色扮演,支持剧情创作、剧情演绎与推动、多人聊天等多类对话互动场景。 模型在角色理解、人设保持、多轮对话、剧情推进与互动表达上持续增强,能够稳定理解用户意图、延续角色设定,并以更具画面感的语言带来自然、生动、连贯的互动体验。
ByteDance
128K 上下文
¥ 0.80 / M 输入 tokens
¥ 2.00 / M 输出 tokens
model
ByteDance / Doubao-Seed-Evolving
Doubao-Seed-Evolving 面向 Coding 与 Agent 场景,持续周级升级,以统一模型 ID 提供最新能力,助力复杂任务高效落地。
ByteDance
256K 上下文
¥ 6.00 / M 输入 tokens
¥ 30.00 / M 输出 tokens
model
ByteDance / Doubao-Seed-2.1-turbo
效果与成本均衡,全面升级 Coding、Agent 与多模态能力,以更强的自主规划、长链路执行和动态修复能力,胜任企业真实复杂任务。
ByteDance
256K 上下文
¥ 3.00 / M 输入 tokens
¥ 15.00 / M 输出 tokens
model
ByteDance / Doubao-Seed-2.1-pro
Doubao-Seed-2.1 是面向 Coding 和 Agent 时代打造的新一代大模型,提供 Pro 和 Turbo 两个版本,分别面向高复杂度任务探索和规模化生产场景。相较上一代版本,Seed 2.1 在 Coding 工程交付、Agent 长链路任务执行和多模态理解三大方向上实现全面升级,以更强的自主规划与动态修复能力,胜任真实研发与高价值生产任务。
ByteDance
256K 上下文
¥ 6.00 / M 输入 tokens
¥ 30.00 / M 输出 tokens
model
bigmodel / GLM-5.2
GLM-5.2 是面向长任务时代的旗舰模型。支持真正可用的 1M 上下文,实测可承载项目级工程上下文,长程任务执行更稳定、工程规范遵循更可靠,开发场景成功率进一步提升。一次任务即可完成“从需求到多端可部署产物”的完整开发链路。
bigmodel
1000K 上下文
¥ 8.00 / M 输入 tokens
¥ 28.00 / M 输出 tokens
model
Moonshot / Kimi K2.7 Code
Kimi K2.7 Code 是 Kimi 迄今最智能的 Coding 模型,在长上下文中更可靠地遵循指令,能以更高的成功率完成编程任务。同时支持文本、图片与视频输入,仅支持思考模式,对话与 Agent 任务。模型上下文长度 256k,支持长思考擅长深度推理,支持自动上下文缓存功能,ToolCalls、JSON Mode、Partial Mode 等能力
Moonshot
256K 上下文
¥ 6.50 / M 输入 tokens
¥ 27.00 / M 输出 tokens
model
Ali / Qwen3.7-Plus(限时8折)
Qwen3.7系列中高性价比Plus模型,在强大文本能力的基础上全面升级了视觉-语言能力,同时保持了在编码、工具使用和生产力工作流方面的完整智能体能力。其核心特色为多模态交互混合智能体能力,能够感知真实世界场景、读取屏幕并操作 GUI、基于视觉参考生成代码、端到端导航移动应用。
Ali
1000K 上下文
¥ 1.60 / M 输入 tokens
¥ 6.40 / M 输出 tokens
model
MiniMax / MiniMax M3(5折)
MiniMax M3永久五折,MiniMax M3 在编程和智能体等专业任务上达到了前沿的能力。它使用了我们提出的全新注意力架构 MSA (MiniMax Sparse Attention ),最高支持 1M 超长上下文。
MiniMax
1000K 上下文
¥ 2.10 / M 输入 tokens
¥ 8.40 / M 输出 tokens
model
Anthropic / Claude Opus 4.8
Claude Opus 4.8 是 Anthropic 在 Opus 家族中最强大的通用型号。它支持文本、图片和文件输入,并输出文本,支持推理和 1M 令牌上下文窗口。它适合高度自主的代理、长视野代理工作、知识驱动工作以及在长时间会话中保持一致性的记忆驱动任务。 它在多步推理、复杂编码和端到端项目编排方面尤为强大——大型代码库、多阶段调试和长期运行的异步代理流水线。除了编码,它还处理知识工作,如起草文档、构建演示文稿和分析数据,保持长时间输出的质量。
Anthropic
1000K 上下文
$ 5.00 (¥35.00) / M 输入 tokens
$ 25.00 (¥175.00) / M 输出 tokens
model
Google / Gemini 3.5 Flash
Gemini 3.5 Flash 以 Flash 级别的成本和速度提供接近专业级的智能:专业级的编码能力、并行代理执行,所有这些都以更低的价格实现。
Google
1049K 上下文
$ 1.50 (¥10.50) / M 输入 tokens
$ 9.00 (¥63.00) / M 输出 tokens
model
Ali / Qwen3.7-Max(限时5折)
Qwen3.7系列中规模最大、综合能力最强的Max模型,当前开放纯文本模型能力供体验。Qwen3.7是面向智能体时代的新一代旗舰模型,核心优势在于智能体能力的广度与深度:在编程、办公与生产力、长周期自主执行方面均能出色胜任各项任务。
Ali
1000K 上下文
¥ 6.00 / M 输入 tokens
¥ 18.00 / M 输出 tokens
model
Google / Gemini 3.1 Flash Lite
Gemini 3.1 Flash-Lite 是谷歌最具成本效益的 Gemini 型号,针对低延迟、高成本的大型语言模型流量进行了优化。它相比 Gemini 2.0/2.5 Flash-Lite 型号实现了显著的质量提升,在关键能力领域的性能与 Gemini 2.5 闪存相当。
Google
1049K 上下文
$ 0.25 (¥1.75) / M 输入 tokens
$ 1.50 (¥10.50) / M 输出 tokens
model
Xiaomi / MiMo-V2.5
MiMo-V2.5 是小米原生的全模态模型。它以约一半的推理成本实现专业级代理性能,同时在图像和视频理解任务中的多模态感知上超越 MiMo-V2-Omni。其 100 万上下文窗口支持完整文档、扩展对话和复杂任务上下文,非常适合与代理框架集成,在需要强大推理、丰富感知和成本效益的环境中。
Xiaomi
1000K 上下文
¥ 1.00 / M 输入 tokens
¥ 2.00 / M 输出 tokens
model
Xiaomi / MiMo-V2.5-Pro
Xiaomi MiMo-V2-Pro 专为现实世界中高强度的 Agent 工作场景而打造。它拥有超过 1T 的总参数量(42B 激活参数),采用创新的混合注意力架构,并支持 1M 超长上下文长度。在强大的模型基座上,我们在更为广泛的 Agent 场景中持续 Scaling 算力,进一步拓展了智能的动作空间,实现了从 Coding 到 Claw 的重要泛化。
Xiaomi
1000K 上下文
¥ 3.00 / M 输入 tokens
¥ 6.00 / M 输出 tokens
model
OpenAI / GPT-5.5
GPT-5.5 是 OpenAI 为复杂专业工作负载设计的前沿模型,基于 GPT-5.4,具备更强的推理能力、更高的可靠性,处理困难任务。它配备了 1M上下文窗口(922K 输入,128K 输出),支持文本和图像输入,支持在单一系统内实现大规模推理、编码和多模态工作流。
OpenAI
400K 上下文
$ 5.00 (¥35.00) / M 输入 tokens
$ 30.00 (¥210.00) / M 输出 tokens
model
DeepSeek / DeepSeek-V4-Flash
DeepSeek-V4-Flash是深度求索公司于2026年4月24日发布的高效经济版大语言模型。它采用混合专家(MoE)架构,总参数量约2840亿,每次推理仅激活约130亿参数,并原生支持高达100万Token的超长上下文。该版本在推理能力和简单Agent任务上接近性能强大的Pro版本,但凭借更小的参数和激活规模,能提供更快捷、低成本的API服务。适合需要快速响应和追求极致性价比的各类轻量级应用场景。
DeepSeek
1000K 上下文
¥ 1.00 / M 输入 tokens
¥ 2.00 / M 输出 tokens
model
Tencent / Hunyuan-3-preview
混元 Hy3 preview 面向 Agent 工作负载设计,采用 295B/21B 激活的 MoE 架构。在同一个模型内提供 no_think(极速响应)、think_low(快速思考)、think_high(深度推理)三档模式,适配从高频交互到复杂工程任务的不同延迟与深度需求。在 SWE-bench Verified 等代码基准上接近当前最强水平,256K 上下文支持跨文件代码重构与长文档分析。适合需要可靠任务完成度、同时对推理成本敏感的开发者。
Tencent
256K 上下文
¥ 1.20 / M 输入 tokens
¥ 4.00 / M 输出 tokens
model
StepFun / Step 3.5 Flash-2603
基于 Step 3.5 Flash 针对高频 Agent 场景优化,在保留旗舰推理与工具调用能力的同时,进一步提升 Token 效率与推理速度,并支持切换低推理模式以降低消耗。对 Coding 与 Agent 框架兼容性也做了专项优化。
StepFun
256K 上下文
¥ 0.70 / M 输入 tokens
¥ 2.10 / M 输出 tokens
model
StepFun / Step 3.5 Flash
阶跃星辰的旗舰语言推理模型。该模型具备顶尖推理能力与快速可靠的执行能力。能够完成对复杂任务的分解、计划,可快速可靠地调用工具执行任务,胜任逻辑推理、数学、软件工程、深度研究等各种复杂任务。上下文长度为256K。
StepFun
256K 上下文
¥ 0.70 / M 输入 tokens
¥ 2.10 / M 输出 tokens
model
Moonshot / Kimi K2.6
Kimi K2.6 是 Kimi 最新最智能的模型,Kimi K2.6 的通用 Agent、代码、视觉理解等综合能力得到全面提升,其中在博士级难度的完整版人类最后的考试(Humanity’s Last Exam)、在考察模型真实软件工程能力的 SWE-Bench Pro、评估 Agent 深度检索能力的 DeepSearchQA 等基准测试中均取得行业领先的成绩,同时支持文本、图片与视频输入,思考与非思考模式,对话与 Agent 任务。
Moonshot
256K 上下文
¥ 6.50 / M 输入 tokens
¥ 27.00 / M 输出 tokens
model
Ali / Qwen3.6-Max-Preview
Qwen3.6系列中规模最大、综合能力最强的Max模型Preview版本,当前开放纯文本模型能力供体验。相较于此前发布的Qwen3-Max和Qwen3.6-Plus,本模型在vibe coding能力上进一步提升、coding agent执行更加高效、前端编程开发能力显著提升;长尾知识能力进一步升级。
Ali
256K 上下文
¥ 9.00 / M 输入 tokens
¥ 54.00 / M 输出 tokens
model
Anthropic / Claude Opus 4.7
Opus 4.7 是 Anthropic Opus 系列的下一代产品,专为长时间运行的异步代理而设计。它在 Opus 4.6 的编码和代理功能优势基础上,显著提升了复杂多步骤任务的性能,并在扩展工作流中实现了更可靠的代理执行。对于任务随时间展开的异步代理管道(例如大型代码库、多阶段调试和端到端项目编排),Opus 4.7 尤为有效。
Anthropic
1000K 上下文
$ 5.00 (¥35.00) / M 输入 tokens
$ 25.00 (¥175.00) / M 输出 tokens
model
bigmodel / GLM-5.1
GLM-5.1 是智谱最新旗舰模型,代码能力大大增强,长程任务显著提升,能够在单次任务中持续、自主地工作长达 8 小时,完成从规划、执行到迭代优化的完整闭环,交付工程级成果。 在综合能力与 Coding 能力上,GLM-5.1 整体表现对齐 Claude Opus 4.6,并在长程自主执行、复杂工程优化与真实开发场景中展现出更强的持续工作能力,是构建 Autonomous Agent 与长程 Coding Agent 的理想基座。
bigmodel
200K 上下文
¥ 6.00 / M 输入 tokens
¥ 24.00 / M 输出 tokens
model
Ali / Qwen3.6-Plus
Qwen3.6原生视觉语言系列Plus模型,展现出与当前顶尖前沿模型相媲美的卓越性能,模型效果相较3.5系列显著提升。模型在Agentic coding、前端编程、Vibe coding等代码能力、多模态万物识别、OCR、物体定位等能力上显著增强。
Ali
1000K 上下文
¥ 2.00 / M 输入 tokens
¥ 12.00 / M 输出 tokens
model
OpenAI / GPT-5.4-Nano
GPT-5.4-nano 是一款轻量化、超高效模型,专为大规模低延迟、低成本任务设计。GPT-5.4-nano 专为专业知识工作设计,包括文档和电子表格的创建、编码、数据分析、代理式工作流以及软件自动化。
OpenAI
400K 上下文
$ 0.20 (¥1.40) / M 输入 tokens
$ 1.25 (¥8.75) / M 输出 tokens
model
OpenAI / GPT-5.4-Mini
GPT-5.4-mini 是一款紧凑、成本效益高的模型,旨在满足高流量日常 AI 工作负载的可靠性能。GPT-5.4-mini 专为专业知识工作设计,包括文档和电子表格的创建、编码、数据分析、代理式工作流程以及软件自动化。
OpenAI
400K 上下文
$ 0.75 (¥5.25) / M 输入 tokens
$ 4.50 (¥31.50) / M 输出 tokens
model
MiniMax / MiniMax M2.7
M2.7 在真实的软件工程中有优异的表现,包括端到端的完整项目交付,分析日志排查 Bug、代码安全,机器学习等。 在专业办公领域,我们提升了模型在各领域的专业知识和任务交付能力,在 GDPval-AA 的ELO得分是1495,为开源最高。M2.7 对 Office 三件套 Excel/PPT/Word 的复杂编辑能力显著提升,能更好地完成多轮修改和高保真的编辑。 M2.7具备与复杂环境交互的能力,M2.7 在 40 个复杂 skills (> 2000 Token) 的 case 上,仍能保持 97% 的 skills 遵循率。在OpenClaw的使用中,M2.7相比于M2.5也有了显著的提升,在MMClaw的评测中接近最新的Sonnet 4.6。 M2.7具备优秀的身份保持能力和情商,除了生产力使用外,给互动娱乐场景的创新也准备了空间。
MiniMax
200K 上下文
¥ 2.10 / M 输入 tokens
¥ 8.40 / M 输出 tokens
model
bigmodel / GLM-5-Turbo
GLM-5-Turbo 是面向 OpenClaw 龙虾场景深度优化的基座模型。 其从训练阶段就针对龙虾任务的核心需求进行专项优化,增强如工具调用、指令遵循、定时与持续性任务、长链路执行等核心能力,使其在复杂、动态、长链路的任务中也真正具备可执行性。
bigmodel
200K 上下文
¥ 5.00 / M 输入 tokens
¥ 22.00 / M 输出 tokens
model
Ali / Qwen3.5-Flash
Qwen3.5原生视觉语言系列Flash模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步;响应速度快,兼具推理速度和性能。
Ali
1000K 上下文
¥ 0.20 / M 输入 tokens
¥ 2.00 / M 输出 tokens
model
OpenAI / GPT-5.4
GPT-5.4 是 OpenAI 最新的前沿模型,将 Codex 和 GPT 系列整合为一个系统。它配备了 1M+令牌上下文窗口(922K 输入,128K 输出),支持文本和图像输入,支持同一工作流程中的高上下文推理、编码和多模态分析。该模型在编码、文档理解、工具使用和指令执行方面提供了更好的性能。它被设计为通用任务和软件工程的强默认选项,能够生成生产质量的代码,综合多个来源的信息,并以更少的迭代和更高的令牌效率执行复杂的多步工作流程。
OpenAI
400K 上下文
$ 2.50 (¥17.50) / M 输入 tokens
$ 15.00 (¥105.00) / M 输出 tokens
model
OpenAI / GPT-5.3 Chat
GPT-5.3 Chat 是对 ChatGPT 最常用模型的升级,使日常对话更加流畅、实用且直接实用。它能提供更准确的答案,更好地提供上下文,显著减少不必要的拒绝、附加条件和过于谨慎的措辞,避免打断对话流畅。
OpenAI
400K 上下文
$ 1.75 (¥12.25) / M 输入 tokens
$ 14.00 (¥98.00) / M 输出 tokens
model
OpenAI / GPT 5.3 Codex
GPT-5.3-Codex 将先进的编码能力、更广泛的推理和专业问题解决整合在一个专为真实工程工作打造的单一模型中。它将 GPT-5.2-Codex 的前沿编码性能与 GPT5.2 的推理和专业知识能力整合到一个系统中。这使得体验从优化孤立输出转向支持更长时间的开发工作;当仓库庞大、变更跨越多个步骤,且需求不总是在一开始就完全明确时。
OpenAI
400K 上下文
$ 1.75 (¥12.25) / M 输入 tokens
$ 14.00 (¥98.00) / M 输出 tokens
model
Google / Gemini 3.1 Flash Lite Preview
Gemini 3.1 Flash-Lite 是谷歌最具成本效益的 Gemini 型号,针对低延迟、高成本的大型语言模型流量进行了优化。它相比 Gemini 2.0/2.5 Flash-Lite 型号实现了显著的质量提升,在关键能力领域的性能与 Gemini 2.5 闪存相当。
Google
1049K 上下文
$ 0.25 (¥1.75) / M 输入 tokens
$ 1.50 (¥10.50) / M 输出 tokens
model
Ali / Qwen3.5-397B-A17B
Qwen3.5系列397B-A17B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。在语言理解、逻辑推理、代码生成、智能体任务、图像理解、视频理解、图形用户界面(GUI)等多种任务中,均展现出与当前顶尖前沿模型相媲美的卓越性能。具备强大的代码生成与智能体能力,对于各类智能体场景具有良好的泛化性。
Ali
256K 上下文
¥ 1.20 / M 输入 tokens
¥ 7.20 / M 输出 tokens
model
Ali / Qwen3.5-Plus
Qwen3.5原生视觉语言系列Plus模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。在多项任务评测中,3.5系列均展现出与当前顶尖前沿模型相媲美的卓越性能,模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步。
Ali
1000K 上下文
¥ 0.80 / M 输入 tokens
¥ 4.80 / M 输出 tokens
model
Google / Gemini 3.1 Pro Preview
Gemini 3.1 Pro Preview 专为高级开发和智能体系统而设计,在提升令牌效率的同时,增强了长期稳定性、工具编排能力。它引入了一种新的中间思维模式,以更好地平衡成本、速度和性能。该模型在智能体编码、结构化规划、多模态分析和工作流自动化方面表现出色,因此非常适合自主智能体、金融建模、电子表格自动化和高上下文企业任务。
Google
1049K 上下文
$ 2.00 (¥14.00) / M 输入 tokens
$ 12.00 (¥84.00) / M 输出 tokens
model
Anthropic / Claude Sonnet 4.6
Sonnet 4.6 是 Anthropic 迄今为止最强大的 Sonnet 级模型,在编码、代理和专业工作领域表现出色。它擅长迭代开发、复杂的代码库导航、带内存的端到端项目管理、精致的文档创建,以及自信的网页质量保证和工作流程自动化的计算机使用。
Anthropic
1000K 上下文
$ 3.00 (¥21.00) / M 输入 tokens
$ 15.00 (¥105.00) / M 输出 tokens
model
MiniMax / MiniMax M2.5
在 MiniMax 真实业务场景中,整体任务的 30% 由 M2.5 自主完成,覆盖研发、产品、销售、HR、财务等职能,且渗透率仍在持续上升。其中,在编程场景表现尤为突出,M2.5 生成的代码已占新提交代码的 80%。
MiniMax
200K 上下文
¥ 2.10 / M 输入 tokens
¥ 8.40 / M 输出 tokens
model
Anthropic / Claude Opus 4.6
Opus 4.6 是 Anthropic 最强的代码生成和长期专业任务模型。它专为跨整个工作流运行的代理而构建,而不是单个提示,这使得它在大型代码库、复杂的重构和随着时间推移展开的多步骤调试方面特别有效。该模型比之前的模型表现出更深入的上下文理解、更强的问题分解能力,以及在工程任务难度较高的情况下更可靠的可靠性。
Anthropic
1000K 上下文
$ 5.00 (¥35.00) / M 输入 tokens
$ 25.00 (¥175.00) / M 输出 tokens
model
Moonshot / Kimi K2.5
Kimi K2.5 是 Kimi 迄今最智能的模型,在 Agent、代码、视觉理解及一系列通用智能任务上取得开源 SoTA 表现。同时 Kimi K2.5 也是 Kimi 迄今最全能的模型,原生的多模态架构设计,同时支持视觉与文本输入、思考与非思考模式、对话与 Agent 任务。 Kimi K2.5 在原有全栈开发与工具生态优势基础上,进一步强化前端代码质量与设计表现力前端能力,实现了跨越式突破,支持从自然语言直接生成功能完整、视觉精美的交互界面,并能精准处理动态布局、滚动动画等复杂效果。
Moonshot
128K 上下文
¥ 2.00 / M 输入 tokens
¥ 3.00 / M 输出 tokens
model
Ali / Qwen3-Max-2026-01-23
通义千问3系列Max模型,相较2025年9月23日快照,此版本实现思考模式和非思考模式的有效融合,模型整体效果得到全方位的大幅度提升。在思考模式下,同时发布Web搜索、Web信息提取和代码解释器工具能力,使得模型在慢思考的同时,能够通过引入外部工具,以更高的准确性解决更有难度的问题。此版本为2026年1月23日快照。
Ali
256K 上下文
¥ 2.50 / M 输入 tokens
¥ 10.00 / M 输出 tokens
model
OpenAI / GPT 5.2 Codex
GPT-5.2-Codex 旨在实现可导向性、前端开发和交互性。 开发者可以利用 gpt-5.2-codex 进行各种智能、多模态的开发任务。对于寻求更智能、更安全、更集成 AI 协助的开发者来说,该模型为你的 AI 工具包提供了强大的新工具。
OpenAI
400K 上下文
$ 1.75 (¥12.25) / M 输入 tokens
$ 14.00 (¥98.00) / M 输出 tokens
model
MiniMax / MiniMax M2.1 lightning
MiniMax-M2.1-lightning,强大多语言编程实力,全面升级编程体验,更快的速度。
MiniMax
200K 上下文
¥ 2.10 / M 输入 tokens
¥ 16.80 / M 输出 tokens
model
MiniMax / MiniMax M2.1
MiniMax M2.1,强大多语言编程实力,全面升级编程体验
MiniMax
200K 上下文
¥ 2.10 / M 输入 tokens
¥ 8.40 / M 输出 tokens
model
bigmodel / GLM-4.7
最新旗舰模型:通用对话、推理与智能体能力上实现全面升级。回复更简洁自然,写作更具沉浸感,且在工具调用时指令遵循更强,Artifacts 与 Agentic Coding 的前端美感和长程任务完成效率进一步提升
bigmodel
200K 上下文
¥ 2.00 / M 输入 tokens
¥ 8.00 / M 输出 tokens
model
Google / Gemini 3 Flash Preview
Gemini 3 Flash Preview 旨在以极高的速度和性价比提供强大的代理功能(接近专业级)。它非常适合进行多轮对话,并能与您的编码代理进行流畅的双向协作。与 2.5 Flash 版本相比,它在各方面都实现了显著提升。 Gemini 3 型号是具有思考能力的模型,能够在做出反应之前进行推理,从而提高性能和准确性。
Google
1049K 上下文
$ 0.50 (¥3.50) / M 输入 tokens
$ 3.00 (¥21.00) / M 输出 tokens
model
OpenAI / GPT-5.2
GPT-5.2 是 GPT-5 系列中最新的前沿级模型,相比 GPT-5.1 提供了更强的代理和长上下文性能。它利用自适应推理动态分配计算,快速响应简单查询,同时在复杂任务上投入更多深度。 GPT-5.2 专为广泛任务覆盖而设计,在数学、编程、科学和工具调用工作负载中持续带来进步,提供更连贯的长篇答案和提升的工具使用可靠性。
OpenAI
400K 上下文
$ 1.75 (¥12.25) / M 输入 tokens
$ 14.00 (¥98.00) / M 输出 tokens
model
OpenAI / GPT 5.1 Codex Max
(当前仅支持/v1/responses接口)GPT-5.1-Codex-Max 是 OpenAI 最新的代理编码模型,专为长期运行的高上下文软件开发任务设计。它基于更新版的 5.1 推理堆栈,并基于跨软件工程、数学和研究的代理工作流进行训练。 GPT-5.1-Codex-Max 在整个开发生命周期中实现了更快的性能、更优的推理和更高的代币效率。
OpenAI
400K 上下文
$ 1.25 (¥8.75) / M 输入 tokens
$ 10.00 (¥70.00) / M 输出 tokens
model
DeepSeek / DeepSeek V3.2 Thinking
DeepSeek-V3.2 是一款大型语言模型,旨在兼顾高计算效率、强大的推理能力以及智能体工具使用性能。它引入了 DeepSeek 稀疏注意力机制 (DSA),这是一种细粒度的稀疏注意力机制,能够在长上下文场景下降低训练和推理成本,同时保持模型质量。可扩展的强化学习后训练框架进一步提升了推理能力,其性能已达到 GPT-5 的水平,并在 2025 年国际数学奥林匹克竞赛 (IMO) 和国际信息学奥林匹克竞赛 (IOI) 中荣获金奖。V3.2 还采用了大规模智能体任务合成流程,将推理更好地融入工具使用场景,从而提升模型在交互式环境中的适应性和泛化能力。
DeepSeek
128K 上下文
¥ 2.00 / M 输入 tokens
¥ 3.00 / M 输出 tokens
model
DeepSeek / Deepseek V3.2
DeepSeek-V3.2 是一款大型语言模型,旨在兼顾高计算效率、强大的推理能力以及智能体工具使用性能。它引入了 DeepSeek 稀疏注意力机制 (DSA),这是一种细粒度的稀疏注意力机制,能够在长上下文场景下降低训练和推理成本,同时保持模型质量。可扩展的强化学习后训练框架进一步提升了推理能力,其性能已达到 GPT-5 的水平,并在 2025 年国际数学奥林匹克竞赛 (IMO) 和国际信息学奥林匹克竞赛 (IOI) 中荣获金奖。V3.2 还采用了大规模智能体任务合成流程,将推理更好地融入工具使用场景,从而提升模型在交互式环境中的适应性和泛化能力。
DeepSeek
128K 上下文
¥ 2.00 / M 输入 tokens
¥ 3.00 / M 输出 tokens
model
Anthropic / Claude Opus 4.5
Anthropic 最智能模型的下一代产品 ——Claude Opus 4.5,在编码、代理、计算机使用以及企业工作流方面处于行业领先地位。应用场景如下: 编码:Opus 4.5 能够自信地在几小时内完成原本需要数天的软件开发项目,它可以独立工作,凭借深厚的技术功底和出色的品味,打造高效且简洁的解决方案。它在各种编程语言上的性能都有所提升,在规划和架构选择方面表现更优,是企业开发者的理想模型。 代理:Claude Opus 4.5 结合我们先进的工具使用能力,能打造出功能更强大、具备新行为模式的代理。 计算机使用:作为我们目前最出色的计算机使用模型,Claude Opus 4.5 能以自信、一致的方式应对新场景,实现更接近人类的浏览体验,从而优化网络问答、工作流自动化以及高级用户体验。 企业工作流:Opus 4.5 可以为代理提供支持,助力其从头到尾管理庞大的专业项目。它能更好地利用内存来保持文件间的上下文连贯性和一致性,同时在创建电子表格、幻灯片和文档方面实现了显著的飞跃式改进。 财务分析:Opus 4.5 能够整合复杂信息系统中的各类数据,包括监管文件、市场报告和内部数据,从而实现复杂的预测建模和主动合规。 cybersecurity(网络安全):Opus 4.5 为安全工作流带来专业级别的分析能力,它能关联日志、漏洞数据库和威胁情报,实现主动威胁检测和自动化事件响应。
Anthropic
200K 上下文
$ 5.00 (¥35.00) / M 输入 tokens
$ 25.00 (¥175.00) / M 输出 tokens
model
OpenAI / GPT 5.1 Codex
(当前仅支持/v1/responses接口)GPT-5.1-Codex 是 GPT-5.1 的一个特殊版本,专为软件工程和编码工作流程而优化。它既适用于交互式开发,也适用于长时间独立执行复杂的工程任务。该模型支持从零开始构建项目、功能开发、调试、大规模重构和代码审查。与 GPT-5.1 相比,Codex 更易于控制,能够更严格地遵循开发者指令,并生成更简洁、更高质量的代码输出。可以通过 `reasoning.effort` 参数调整推理难度。
OpenAI
400K 上下文
$ 1.25 (¥8.75) / M 输入 tokens
$ 10.00 (¥70.00) / M 输出 tokens
model
OpenAI / GPT-5.1
GPT-5.1 是 GPT-5 系列的最新前沿模型,与 GPT-5 相比,它拥有更强大的通用推理能力、更高的指令遵循度以及更自然的对话风格。它采用自适应推理技术动态分配计算资源,能够快速响应简单查询,同时在处理复杂任务时投入更多精力。该模型能够生成更清晰、更贴近实际的解释,减少专业术语的使用,即使是技术性或多步骤问题也更容易理解。 GPT-5.1 旨在覆盖广泛的任务,在数学、编程和结构化分析等工作负载方面均取得了持续的提升,能够提供更连贯的长篇答案,并提高工具使用的可靠性。它还改进了对话对齐方式,能够在不牺牲准确性的前提下,提供更亲切、更直观的回答。GPT-5.1 是 GPT-5 的主要全功能继任者。
OpenAI
400K 上下文
$ 1.25 (¥8.75) / M 输入 tokens
$ 10.00 (¥70.00) / M 输出 tokens
model
Streamlake / KAT-Coder-Pro-V1
专为 Agentic Coding 设计,全面覆盖编程任务与场景,通过大规模智能体强化学习,实现智能行为涌现,在代码编写性能上显著超越同类模型。
Streamlake
128K 上下文
¥ 4.00 / M 输入 tokens
¥ 16.00 / M 输出 tokens
model
Streamlake / KAT-Coder-Air-V1
KAT-Coder 系列模型中的轻量化版本。专为 Agentic Coding 设计,全面覆盖编程任务与场景,通过大规模智能体强化学习,实现智能行为涌现,在代码编写性能上显著超越同类模型。
Streamlake
128K 上下文
¥ 0.00 / M 输入 tokens
¥ 0 / M 输出 tokens
model
Anthropic / Claude Haiku 4.5 Thinking
Claude Haiku 4.5 为各种用例提供​​近乎前沿的性能,并脱颖而出,成为最佳编码和代理模型之一——其速度和成本恰到好处,能够为免费产品和海量用户体验提供支持。用例:为免费层级用户体验提供支持:Claude Haiku 4.5 以合理的成本和速度提供近乎前沿的性能,使为免费代理产品和代理用例提供支持在经济上可行。
Anthropic
200K 上下文
$ 1.00 (¥7.00) / M 输入 tokens
$ 5.00 (¥35.00) / M 输出 tokens
model
Anthropic / Claude Haiku 4.5
Claude Haiku 4.5 为各种用例提供​​近乎前沿的性能,并脱颖而出,成为最佳编码和代理模型之一——其速度和成本恰到好处,能够为免费产品和海量用户体验提供支持。用例:为免费层级用户体验提供支持:Claude Haiku 4.5 以合理的成本和速度提供近乎前沿的性能,使为免费代理产品和代理用例提供支持在经济上可行。
Anthropic
200K 上下文
$ 1.00 (¥7.00) / M 输入 tokens
$ 5.00 (¥35.00) / M 输出 tokens
model
Anthropic / Claude Sonnet 4.5 Thinking
Claude Sonnet 4.5 是 Anthropic 迄今为止最先进的 Sonnet 模型,针对真实代理和编码工作流程进行了优化。它在 SWE-bench Verified 等编码基准测试中展现出顶尖性能,并在系统设计、代码安全性和规范遵循性方面均有所改进。该模型旨在实现扩展自主操作,保持跨会话的任务连续性,并提供基于事实的进度跟踪。 Sonnet 4.5 还引入了更强大的代理功能,包括改进的工具编排、推测并行执行以及更高效的上下文和内存管理。凭借增强的上下文跟踪和跨工具调用的令牌使用感知功能,它尤其适用于多上下文和长时间运行的工作流。用例涵盖软件工程、网络安全、财务分析、研究代理以及其他需要持续推理和工具使用的领域。
Anthropic
200K 上下文
$ 3.00 (¥21.00) / M 输入 tokens
$ 15.00 (¥105.00) / M 输出 tokens
model
Anthropic / Claude Sonnet 4.5
Claude Sonnet 4.5 是 Anthropic 迄今为止最先进的 Sonnet 模型,针对真实代理和编码工作流程进行了优化。它在 SWE-bench Verified 等编码基准测试中展现出顶尖性能,并在系统设计、代码安全性和规范遵循性方面均有所改进。该模型旨在实现扩展自主操作,保持跨会话的任务连续性,并提供基于事实的进度跟踪。 Sonnet 4.5 还引入了更强大的代理功能,包括改进的工具编排、推测并行执行以及更高效的上下文和内存管理。凭借增强的上下文跟踪和跨工具调用的令牌使用感知功能,它尤其适用于多上下文和长时间运行的工作流。用例涵盖软件工程、网络安全、财务分析、研究代理以及其他需要持续推理和工具使用的领域。
Anthropic
200K 上下文
$ 3.00 (¥21.00) / M 输入 tokens
$ 15.00 (¥105.00) / M 输出 tokens
model
Ali / Qwen3-Coder-Plus
Qwen3-Coder-Plus,这是通义千问系列迄今为止最具代理能力的代码模型。
Ali
1049K 上下文
¥ 4.00 / M 输入 tokens
¥ 16.00 / M 输出 tokens
model
Moonshot / Kimi K2 0905
( 最新版本 0905) Kimi K2是一款上下文长度256k的模型,具备更强的Agentic Coding能力、更突出的前端代码的美观度和实用性、以及更好的上下文理解能力。
Moonshot
256K 上下文
¥ 4.00 / M 输入 tokens
¥ 16.00 / M 输出 tokens
model
Xiaomi / MiMo-V2-Pro
Xiaomi MiMo-V2-Pro 专为现实世界中高强度的 Agent 工作场景而打造。它拥有超过 1T 的总参数量(42B 激活参数),采用创新的混合注意力架构,并支持 1M 超长上下文长度。在强大的模型基座上,我们在更为广泛的 Agent 场景中持续 Scaling 算力,进一步拓展了智能的动作空间,实现了从 Coding 到 Claw 的重要泛化。
Xiaomi
1000K 上下文
¥ 7.00 / M 输入 tokens
¥ 21.00 / M 输出 tokens
model
Xiaomi / MiMo-V2-Omni
MiMo-V2-Omni 专为现实世界中复杂的多模态交互与执行场景而生。我们从底层构建了融合文本、视觉、语音的全模态基座,并以统一架构将“感知”与“行动”深度绑定。这不仅打破了传统模型“重理解、轻执行”的局限,更让模型原生具备了多模态感知、工具调用、函数执行及 GUI 操作能力。MiMo-V2-Omni 可无缝接入各大智能体框架,实现了从理解到操控的跨越,大幅降低了全模态 Agent 的落地门槛。
Xiaomi
256K 上下文
¥ 2.80 / M 输入 tokens
¥ 14.00 / M 输出 tokens
model
bigmodel / GLM-5V-Turbo
GLM-5V-Turbo 是智谱首个多模态 Coding 基座模型,面向视觉编程任务打造。能够原生处理图片、视频、文本等多模态输入,同时擅长长程规划、复杂编程和动作执行;深度适配 Agent 工作流,能够与 Claude Code、OpenClaw 等 Agent 深度协同,完成”看懂环境→规划动作→执行任务”的完整闭环。
bigmodel
200K 上下文
¥ 5.00 / M 输入 tokens
¥ 22.00 / M 输出 tokens
model
xAI / Grok 4.1 Fast
Grok 4.1 Fast 是 xAI 最好的代理工具调用模型,在客户支持和深入研究等实际应用场景中表现出色。200 万上下文窗口。
xAI
2000K 上下文
$ 0.20 (¥1.40) / M 输入 tokens
$ 0.50 (¥3.50) / M 输出 tokens
model
MiniMax / MiniMax M2.7-highspeed
M2.7 在真实的软件工程中有优异的表现,包括端到端的完整项目交付,分析日志排查 Bug、代码安全,机器学习等。 在专业办公领域,我们提升了模型在各领域的专业知识和任务交付能力,在 GDPval-AA 的ELO得分是1495,为开源最高。M2.7 对 Office 三件套 Excel/PPT/Word 的复杂编辑能力显著提升,能更好地完成多轮修改和高保真的编辑。 M2.7具备与复杂环境交互的能力,M2.7 在 40 个复杂 skills (> 2000 Token) 的 case 上,仍能保持 97% 的 skills 遵循率。在OpenClaw的使用中,M2.7相比于M2.5也有了显著的提升,在MMClaw的评测中接近最新的Sonnet 4.6。 M2.7具备优秀的身份保持能力和情商,除了生产力使用外,给互动娱乐场景的创新也准备了空间。
MiniMax
200K 上下文
¥ 4.20 / M 输入 tokens
¥ 16.80 / M 输出 tokens
model
ByteDance / Doubao-Seed-2.0-Code
面向真实编程环境优化的 Coding 模型,能稳定调用 Claude Code 等常见 IDE 中的工具。模型特别优化了前端能力,在使用常见的前端框架时能有良好表现。模型支持使用 Skills,可以配合多种自定义技能使用。
ByteDance
256K 上下文
¥ 3.20 / M 输入 tokens
¥ 16.00 / M 输出 tokens
model
ByteDance / Doubao-Seed-2.0-lite
面向高频企业场景兼顾性能与成本的均衡型模型,综合能力超越上一代Doubao-Seed-1.8。胜任非结构化信息处理、内容创作、搜索推荐、数据分析等生产型工作,支持长上下文、多源信息融合、多步指令执行与高保真结构化输出。在保障稳定效果的同时显著优化成本。
ByteDance
256K 上下文
¥ 0.60 / M 输入 tokens
¥ 3.60 / M 输出 tokens
model
ByteDance / Doubao-Seed-2.0-mini
面向低时延、高并发与成本敏感场景,提供极致的模型推理速度。模型效果与Doubao-Seed-1.6相当。支持256k上下文、4档思考长度和多模态理解,适合成本和速度优先的轻量级任务。
ByteDance
256K 上下文
¥ 0.20 / M 输入 tokens
¥ 2.00 / M 输出 tokens
model
ByteDance / Doubao-Seed-2.0-pro
旗舰级全能通用模型,面向 Agent 时代的复杂推理与长链路任务执行场景。强调多模态理解、长上下文推理、结构化生成与工具增强执行。复杂指令与多约束执行能力突出,可稳定应对多步复杂规划、复杂图文推理、视频内容理解与高难度分析等场景。
ByteDance
256K 上下文
¥ 3.20 / M 输入 tokens
¥ 16.00 / M 输出 tokens
model
OpenAI / GPT-5.4-Pro
GPT-5 Pro 是 OpenAI 最先进的模型,在推理、代码质量和用户体验方面进行了重大改进。它针对需要分步推理、遵循指令和高风险用例准确性的复杂任务进行了优化。它支持测试时路由功能和高级提示理解,包括用户指定的意图,例如“认真考虑这个问题”。改进包括减少幻觉、阿谀奉承,以及在编码、写作和健康相关任务中表现更好。
OpenAI
1050K 上下文
$ 30.00 (¥210.00) / M 输入 tokens
$ 180.00 (¥1260.00) / M 输出 tokens
model
bigmodel / GLM-5
GLM-5 是智谱新一代的旗舰基座模型,面向 Agentic Engineering 打造,能够在复杂系统工程与长程 Agent 任务中提供可靠生产力。在 Coding 与 Agent 能力上,GLM-5 取得开源 SOTA 表现,在真实编程场景的使用体感逼近 Claude Opus 4.5,擅长复杂系统工程与长程 Agent 任务,是通用 Agent 助手的理想基座。
bigmodel
200K 上下文
¥ 4.00 / M 输入 tokens
¥ 18.00 / M 输出 tokens
model
ByteDance / Doubao-Seed-1.8
全新面向多模态 Agent 场景定向优化模型。更强Agent能力、升级多模态理解、更灵活的上下文管理。
ByteDance
256K 上下文
¥ 0.80 / M 输入 tokens
¥ 8.00 / M 输出 tokens
model
Xiaomi / MiMo V2 Flash
这是一个专为极致推理效率自研的总参数 309B(激活 15B)的 MoE 模型,通过 Hybrid 注意力架构创新及多层 MTP 推理加速,在多个 Agent 测评基准上保持进入全球开源模型 Top 2;代码能力超过所有开源模型,比肩标杆闭源模型 Claude 4.5 Sonnet,但推理成本仅为其 2.5%,生成速度提升 2 倍,成功将大模型推理效率推向极致。
Xiaomi
256K 上下文
¥ 0.70 / M 输入 tokens
¥ 2.10 / M 输出 tokens
model
Ali / Qwen-VL-OCR
通义千问VL-OCR(qwen-vl-ocr),即基于Qwen-VL训练的OCR识别大模型。通过统一模型的方式聚合多种图文识别、解析、处理类任务,提供强大的图文识别能力。
Ali
32K 上下文
¥ 0.30 / M 输入 tokens
¥ 0.50 / M 输出 tokens
model
DeepSeek / DeepSeek-OCR
DeepSeek-OCR 是 DeepSeek AI 发布的视觉语言模型,旨在探索视觉-文本压缩边界,专注于文档识别及图像转文本场景的解决方案 。该模型可将长文本渲染为高压缩比图像,在 10 倍无损压缩下能实现 97% 的 OCR 准确率,即使压缩到 20 倍也能保持约 60% 的准确率。
DeepSeek
0K 上下文
¥ 0.00 / M 输入 tokens
¥ 0 / M 输出 tokens
model
OpenAI / GPT 5.1 Codex Mini
(当前仅支持/v1/responses接口)GPT-5.1-Codex 的小参数快速版本。
OpenAI
400K 上下文
$ 0.25 (¥1.75) / M 输入 tokens
$ 2.00 (¥14.00) / M 输出 tokens
model
Streamlake / KAT-Coder-Exp-72B-1010
KAT-Coder-Exp-72B 是 KAT-Coder 系列模型中的 RL 创新实验版本,在软件开发能力评测基准 SWE-Bench verified 上取得了 74.6% 的卓越性能,创下开源模型新纪录。专注于 Agentic Coding,目前仅支持 SWE-Agent 脚手架,也可进行简单对话。
Streamlake
128K 上下文
¥ 0.00 / M 输入 tokens
¥ 0 / M 输出 tokens
model
MiniMax / MiniMax M2
MiniMax M2,专为 Agent 和代码而生,仅 Claude Sonnet 8% 价格,2倍速度。
MiniMax
200K 上下文
¥ 2.10 / M 输入 tokens
¥ 8.40 / M 输出 tokens
model
OpenAI / GPT-5-Codex
GPT-5-Codex 是 GPT-5 的专用版本,针对软件工程和编码工作流程进行了优化。它专为交互式开发会话和复杂工程任务的长时间独立执行而设计。该模型支持从头开始构建项目、功能开发、调试、大规模重构和代码审查。与 GPT-5 相比,Codex 更具可作性,严格遵守开发人员的指令,并生成更干净、更高质量的代码输出。
OpenAI
400K 上下文
$ 1.25 (¥8.75) / M 输入 tokens
$ 10.00 (¥70.00) / M 输出 tokens
model
bigmodel / GLM-4.6 Thinking
GLM-4.6 是智谱最新的旗舰模型,其总参数量 355B,激活参数 32B。GLM-4.6 所有核心能力上均完成了对 GLM-4.5 的超越
bigmodel
200K 上下文
¥ 2.00 / M 输入 tokens
¥ 8.00 / M 输出 tokens
model
bigmodel / GLM-4.6
GLM-4.6 是智谱最新的旗舰模型,其总参数量 355B,激活参数 32B。GLM-4.6 所有核心能力上均完成了对 GLM-4.5 的超越
bigmodel
200K 上下文
¥ 2.00 / M 输入 tokens
¥ 8.00 / M 输出 tokens
model
xAI / Grok 4 Fast
Grok 4 Fast 是 xAI 最新的多模态模型,具有 SOTA 成本效益和 2M 令牌上下文窗口。它有两种类型:非推理和推理。
xAI
2000K 上下文
$ 0.20 (¥1.40) / M 输入 tokens
$ 0.50 (¥3.50) / M 输出 tokens
model
Ali / Qwen3-VL-Plus
Qwen3系列视觉理解模型,实现思考模式和非思考模式的有效融合,视觉智能体能力在OS World等公开测试集上达到世界顶尖水平。此版本在视觉coding、空间感知、多模态思考等方向全面升级;视觉感知与识别能力大幅提升,支持超长视频理解。
Ali
262K 上下文
¥ 1.00 / M 输入 tokens
¥ 10.00 / M 输出 tokens
model
Ali / Qwen3-Max
Qwen3-Max 是在 Qwen3 系列的基础上构建的更新版本,与 2025 年 1 月版本相比,在推理、指令遵循、多语言支持和长尾知识覆盖方面进行了重大改进。它在数学、编码、逻辑和科学任务中提供更高的准确性,更可靠地遵循复杂的中文和英文指令,减少幻觉,并为开放式问答、写作和对话提供更高质量的回答。该模型支持 100 多种语言,具有更强的翻译和常识推理能力,并针对检索增强生成 (RAG) 和工具调用进行了优化,尽管它不包括专用的“思考”模式。
Ali
262K 上下文
¥ 6.00 / M 输入 tokens
¥ 24.00 / M 输出 tokens
model
Ali / Qwen3-Omni-Flash
Qwen-Omni 模型能够接收文本、图片、音频、视频等多种模态的组合输入,并生成文本或语音形式的回复, 提供多种拟人音色,支持多语言和方言的语音输出,可应用于文本创作、视觉识别、语音助手等场景。
Ali
66K 上下文
¥ 1.80 / M 输入 tokens
¥ 6.90 / M 输出 tokens
model
Ali / Qwen3-Max-Preview
Qwen3-Max-Preview是阿里巴巴旗下通义千问团队发布的最新旗舰大语言模型,是 Qwen3 系列中参数量最大的模型,参数规模超过1万亿。模型在推理、指令跟随、多语言支持和长尾知识覆盖等方面有重大改进,支持超过100种语言,中英文理解能力出色。在数学推理、编程和科学推理等任务中表现出色,能更可靠地遵循复杂指令,减少幻觉,生成更高质量的响应。
Ali
262K 上下文
¥ 6.00 / M 输入 tokens
¥ 24.00 / M 输出 tokens
model
OpenAI / GPT-5
GPT-5是OpenAI推出的最新一代先进模型,在推理能力、代码生成质量和用户体验方面实现显著提升。该模型针对复杂任务进行了专项优化,尤其擅长需要逐步推理、精准遵循指令以及对准确性要求严格的高风险场景。
OpenAI
400K 上下文
$ 1.25 (¥8.75) / M 输入 tokens
$ 10.00 (¥70.00) / M 输出 tokens
model
OpenAI / GPT-5-Nano
GPT-5-Nano是GPT-5系列中最快速的版本,专为开发者工具、即时交互和超低延迟场景优化。尽管在复杂推理能力上略逊于更大的模型,但它保留了核心的指令跟随与安全特性。
OpenAI
400K 上下文
$ 0.05 (¥0.35) / M 输入 tokens
$ 0.40 (¥2.80) / M 输出 tokens
model
xAI / Grok 4
Grok 4是xAI的多模态大型语言模型,目前支持文本模态,视觉、图像生成等功能即将推出。
xAI
256K 上下文
$ 3.00 (¥21.00) / M 输入 tokens
$ 15.00 (¥105.00) / M 输出 tokens
model
Google / Gemini 2.5 Flash
Gemini 2.5 Flash是Google在性价比方面表现最优的模型,兼具全面能力与高效性能。作为首个具备“思维能力”的 Flash 系列模型,Gemini 2.5 Flash支持可视化的思维过程,让用户直观了解模型在生成回答时的推理路径。
Google
1049K 上下文
$ 0.30 (¥2.10) / M 输入 tokens
$ 2.50 (¥17.50) / M 输出 tokens
model
Google / Gemini 2.5 Pro
Gemini 2.5 Pro是一款强大的推理模型,专为解决复杂问题而设计。它具备卓越的理解与分析能力,能够处理来自多种信息源的海量数据,包括文本、音频、图像、视频,甚至是完整的代码库。
Google
1049K 上下文
$ 1.25 (¥8.75) / M 输入 tokens
$ 10.00 (¥70.00) / M 输出 tokens
model
Tencent / Hunyuan-Turbos-Vision
采用混元MOE结构,是混元最新多模态模型,支持多语种作答,中英文能力均衡。
Tencent
32K 上下文
¥ 3.00 / M 输入 tokens
¥ 9.00 / M 输出 tokens
model
Ali / Qwen3 Next 80B A3B Thinking
Qwen3-Next-80B-A3B-Thinking 是Qwen3-Next系列中以推理为核心的对话模型,默认输出结构化的“思维链”内容。它专为复杂多步问题而设计,能够处理数学证明、代码生成与调试、逻辑推演以及智能体规划等任务,并在知识、推理、编程、对齐和多语言评测上表现出色。与以往的Qwen3模型相比,该版本在长链式思维下的稳定性与推理阶段的高效扩展上更具优势,且在复杂指令跟随时显著降低了重复或偏离任务的情况。
Ali
131K 上下文
¥ 1.00 / M 输入 tokens
¥ 10.00 / M 输出 tokens
model
Ali / Qwen3 Next 80B A3B Instruct
Qwen3-Next-80B-A3B-Instruct是Qwen3-Next系列中的一款指令微调对话模型,专为提供快速、稳定的响应而优化。它能够胜任复杂推理、代码生成、知识问答和多语言应用,同时在对齐与格式控制方面保持稳健。与以往的Qwen3 指令模型相比,该版本在超长输入和多轮对话场景下具备更高吞吐与更强稳定性,非常适用于RAG、工具调用以及需要一致性最终答案的智能体工作流。
Ali
131K 上下文
¥ 1.00 / M 输入 tokens
¥ 4.00 / M 输出 tokens
model
xAI / Grok Code Fast 1
Grok Code Fast 1是xAI的首款编程模型,是一款兼具速度、高性价比的推理模型。
xAI
256K 上下文
$ 0.20 (¥1.40) / M 输入 tokens
$ 1.50 (¥10.50) / M 输出 tokens
model
Ali / Qwen3-Coder-480B-A35B-Instruct
基于Qwen3的代码生成模型,具有强大的Coding Agent能力,代码能力达到开源模型 SOTA。
Ali
128K 上下文
¥ 6.00 / M 输入 tokens
¥ 24.00 / M 输出 tokens
model
DeepSeek / DeepSeek V3.1
DeepSeek V3.1是DeepSeek的新一代模型,具备混合推理(Think & Non-Think双模式),显著提升思考速度和任务处理效率,并通过后训练强化工具调用与多步骤智能体能力。
DeepSeek
128K 上下文
¥ 4.00 / M 输入 tokens
¥ 12.00 / M 输出 tokens