全部
Qwen3.6-35B-A3B-256K
Qwen3.6-35B-A3B 是通义千问团队推出的 Qwen3.6 系列大语言模型,采用混合专家(MoE)架构,拥有 350 亿总参数,每次推理仅激活约 30 亿参数,兼顾高效推理与优秀性能。模型支持思考与非思考双模式,可在快速响应与深度推理间灵活切换,并支持 256K 的上下文长度。
Qwen/Qwen3.6-35B-A3B
Qwen3.6-35B-A3B 是通义千问团队推出的 Qwen3.6 系列大语言模型,采用混合专家(MoE)架构,拥有 350 亿总参数,每次推理仅激活约 30 亿参数,兼顾高效推理与优秀性能。模型支持思考与非思考双模式,可在快速响应与深度推理间灵活切换,并支持 64K 的上下文长度。
Qwen/Qwen3-30B-A3B-Thinking-2507
Qwen3-30B-A3B-Thinking-2507 是由阿里巴巴通义千问团队发布的 Qwen3 系列的最新思考模型。作为一个拥有 305 亿总参数和 33 亿激活参数的混合专家(MoE)模型,它专注于提升复杂任务的处理能力。该模型在逻辑推理、数学、科学、编程和需要人类专业知识的学术基准测试上表现出显著的性能提升。同时,它在指令遵循、工具使用、文本生成和与人类偏好对齐等通用能力方面也得到了显著增强。模型原生支持 256K 的长上下文理解能力,并可扩展至 100 万 tokens。此版本专为“思考模式”设计,旨在通过详尽的逐步推理来解决高度复杂的任务,其 Agent 智能体能力也表现出色
kimi-k3
Kimi K3 是 Kimi 迄今能力最强的旗舰模型,拥有 2.8 万亿参数,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。
glm-5.2
GLM-5.2是智谱AI推出的面向长程任务(Long Horizon Task)设计的最新旗舰模型,支持1M超长上下文。拥有强大逻辑推理、长文本理解与代码生成能力、兼顾性能与推理效率;在多任务基准中表现优异,适用于智能交互、企业应用、开发辅助等场景。
qwen3.6-flash
Qwen3.6原生视觉语言系列Flash模型,模型效果相较3.5-Flash显著提升。本模型重点提升agentic coding能力(在多项代码智能体基准上大幅超越前代)、数学推理和代码推理能力;视觉方面在空间智能能力上显著增强,物体定位与目标检测提升尤为突出。
qwen3.5-27b
Qwen3.5系列27B原生视觉语言Dense模型,融合了线性注意力机制;响应速度快,兼具推理速度和性能。该模型的综合能力接近于Qwen3.5-122B-A10B。
qwen3.6-max-preview
Qwen3.6系列中规模最大、综合能力最强的Max模型Preview版本,当前开放纯文本模型能力供体验。相较于此前发布的Qwen3-Max和Qwen3.6-Plus,本模型在vibe coding能力上进一步提升、coding agent执行更加高效、前端编程开发能力显著提升;长尾知识能力进一步升级。
qwen3-coder-next
Qwen3系列新一代代码生成模型,效果接近Qwen3-Coder-Plus兼具更优性能。模型重点优化仓库级别理解、支持多轮工具交互、提升对于agentic coding类工具的适配能力。
