美团LongCat-2.0正式上线,总参数1.6T,平均激活约48B,动态范围33B~56B,原生支持1M超长上下文。
精益 Timeline
追踪胜算云最新功能与优化。← 横向拖动查看更多版本 →
doubao-seedream-5-0-pro在更复杂、更真实的图像生成与编辑需求等维度全面升级。
GPT-5.6–Sol 是 GPT-5.6 系列中的旗舰模型。主要面向复杂编程、专业研究、科学分析、网络安全、电脑操作和设计任务。在长流程任务、工具调用和自主执行方面有明显提升。 GPT-5.6–Terra 是 GPT-5.6 系列中的一款均衡模型,介于旗舰级 Sol 层级与高性价比 Luna 层级之间。它适用于日常编码、推理及代理任务场景,在这些场景中兼顾性能与成本。 GPT-5.6–Luna 是 GPT-5.6 系列中的一款快速且成本效益高的模型。适合高频调用、批量内容处理、信息提取、代码检查和对响应速度要求较高的 Agent。
Kimi K3 正式上线,拥有 2.8 万亿参数、100 万 token 上下文窗口,原生支持视觉理解。该模型在长程编程、知识工作等场景表现前沿。
Claude Opus 5 已正式上线,其智能水平接近 Claude Fable 5,但价格减半,适用于需要复杂推理、编码以及长期规划的代理任务。
Google 的 Gemini 3.6 Flash 和 Gemini 3.5 Flash Lite 已正式上线。Gemini 3.6 Flash 被定位为在智能体与编程任务中提供持续前沿性能的最智能模型,而 Gemini 3.5 Flash Lite 则主打高吞吐、低延迟,适用于大规模智能体任务与子智能体工作流。
Kimi K2.7 Code HighSpeed已正式上线,Kimi K2.7 Code HighSpeed 是 Kimi K2.7 Code 的高速版模型,编码任务中长输入可达约 180 tok/s,短上下文任务最高 260 tok/s,速度提升最多 6 倍,带来更极致的编程体验。
Grok 4.5已正式上线,Grok 4.5是目前XAI最智能的模型,具备在编程、知识工作和STEM领域的前沿性能。专为快速智能体编码和复杂多步骤工作流打造,提供高达 50 万 token 的上下文窗口、图像支持及可调节推理深度。
Grok 4.6已上线模型列表,支持500K上下文token、文本与图像输入,并新增xhigh推理强度档位。模型针对长时间运行的智能体任务进行了强化,提升了跨代码库分析和自我验证能力,并改进了复杂交互和视觉工作。
GLM-5.3已正式上线, 该模型专为编程、防御性网络安全及长周期智能体任务打造。在 Artificial Analysis 智能指数上,GLM-5.3 获得 60 分,追平 Kimi K3,成为最强开源权重模型,并与 Claude Fable 5、GPT-5.6 Sol 等闭源旗舰同级。模型保持 753B 总参数/40B 激活的 MoE 架构,上下文 1M tokens,MIT 许可。
DeepSeek-V4-Flash-Vision-Exp 已正式上线,该模型为稀疏混合专家模型,总参数量2840亿,激活参数量130亿。文本能力与 V4-Flash 持平,多模态智能体基准测试大幅跃升,性能接近 Opus-4.8。可处理文本、图像和视频输入,在编码与智能体任务中表现出色!
MiniMax H3已正式上线,该模型能够统一理解文字、图片、视频和音频等多模态信息,在指令遵循、文字与品牌信息呈现、V2V Motion Transfer(视频到视频动作迁移)等方面表现出色,实现更精准、可控的内容编辑与生成。从广告、品牌、电商,到影视、产品设计、UI/UX、游戏,H3 正在让更多创作场景变得更简单。