全部
qwen3.8-max
2.4 万亿参数的 MoE 旗舰模型,面向编程、专业工作、多模态理解与长程智能体工作流
qwen3.8-flash
Qwen4 架构的早期预览版,以 125B 总参数、每 token 仅激活 6B 的极致稀疏 MoE 设计,在编程与办公任务上实现了高性价比与百万级上下文的兼顾
deepseek-v4.1-flash
DeepSeek 轻量旗舰,越级智能。采用 552B MoE 非对称架构,输入激活仅 8B,支持 1M 上下文与 384K 最大输出,原生多模态视觉理解,Terminal-Bench 2.1 得分 90.6,性能超越 V4-Pro,KV Cache 压缩至上一代 1/4,长上下文成本大幅降低。适合智能体、代码生成、长文档处理与复杂推理。
glm-5.3-flash
前沿智能,极致普惠。AA 综合智能指数 57 分,与 Claude Opus 4.8 持平,采用 320B-A18B MoE 架构,激活仅 18B,是首个稀疏注意力与线性注意力混合架构的开源前沿模型;原生多模态,视觉反馈融入 Coding 循环,全部线上流量由 10 万张国产芯片集群承载。适合多模态 Agent、前端/游戏/3D 开发、批量图文文档处理与长文档智能分析。
qwen3.7-max
Qwen 前沿模型,针对智能体框架、编程助手与长程任务调优
qwen3.7-plus
多模态 Qwen 主力模型,面向长上下文智能体、视觉输入与编程
qwen3.7-flash
轻量级多模态 Qwen 模型,面向高吞吐的文本、图像与视频任务
qwen3.6-flash
Qwen3.6原生视觉语言系列Flash模型,模型效果相较3.5-Flash显著提升。本模型重点提升agentic coding能力(在多项代码智能体基准上大幅超越前代)、数学推理和代码推理能力;视觉方面在空间智能能力上显著增强,物体定位与目标检测提升尤为突出。
deepseek-v4-pro
DeepSeek-V4-Pro是深度求索公司于2026年发布的旗舰级开源大模型,采用混合专家(MoE)架构,总参数量达1.6万亿,实际推理中每个Token仅激活490亿参数,在保证强大性能的同时显著优化了计算效率。它原生支持高达100万Token的上下文窗口,并采用了混合注意力机制等创新技术,在处理长文本时计算量仅为前代V3.2的27%,KV缓存占用仅为其10%。该模型专为解决极高难度的编程挑战、多步逻辑推理及复杂的多智能体协作而生,在代码生成(如LiveCodeBench达93.5%)、软件工程(如SWE Verified 80.6分)及Agent任务等基准测试中表现优异,性能比肩甚至超越部分顶级闭源模型。模型支持可调节强度的“思考模式”与“非思考模式”,并已同步在网页、App及API上线,且已在华为昇腾等国产算力平台完成深度适配。
