模型 API
一个 API Key,调用主流大模型
搜索
全部
Qwen3.8-27B
Qwen3.8-27B是一款拥有270亿参数的原生多模态稠密大模型,它通过创新的混合架构(深度融合线性注意力与完整注意力机制),在显著降低显存占用的同时,原生支持26.2万tokens的超长上下文,并可外推至百万级别。这款模型在编程与智能体任务上展现了惊人的实力,例如在SWE-bench Pro和OSWorld等权威测试中大幅超越Claude Opus 4.6 Max,整体表现不仅显著优于前代Qwen3.6-27B,更超过了Qwen3.7-Plus,堪称性能屠榜。
输入:
3.001.50 积分/M tokens
输出:
18.005.60 积分/M tokens
DeepSeek-V4-Flash-0731
DeepSeek-V4-Flash-0731 是 DeepSeek-V4-Flash 的官方正式稳定版本(发布于 2026 年 7 月底),全面取代先前的预览版。该模型在保持原有模型架构与参数规模不变的前提下,大幅增强了智能体(Agentic)能力与复杂任务处理表现。
输入:
1.000.60 积分/M tokens
输出:
2.001.20 积分/M tokens
Ornith-1.0-35B
Ornith-1.0-35B 是由 DeepReinforce 基于 Qwen3.5 预训练权重通过强化学习(RL)后训练优化打造的轻量级开源混合专家(MoE)推理模型。它总参数量为 35B,每次推理实际仅激活约 3B 到 8B 参数,专为高效的单 GPU 部署、复杂编程(Vibe Coding)以及智能体(Agent)工具调用而设计。
输入:
3.201.50 积分/M tokens
输出:
12.803.70 积分/M tokens
Qwen3.6-35B-A3B-256K
Qwen3.6-35B-A3B 是通义千问团队推出的 Qwen3.6 系列大语言模型,采用混合专家(MoE)架构,拥有 350 亿总参数,每次推理仅激活约 30 亿参数,兼顾高效推理与优秀性能。模型支持思考与非思考双模式,可在快速响应与深度推理间灵活切换,并支持 256K 的上下文长度。
输入:
3.201.60 积分/M tokens
输出:
12.803.95 积分/M tokens
kimi-k3
Kimi K3 是 Kimi 迄今能力最强的旗舰模型,拥有 2.8 万亿参数,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。
输入:
20.0015.00 积分/M tokens
输出:
100.0075.00 积分/M tokens
glm-5.2
GLM-5.2是智谱AI推出的面向长程任务(Long Horizon Task)设计的最新旗舰模型,支持1M超长上下文。拥有强大逻辑推理、长文本理解与代码生成能力、兼顾性能与推理效率;在多任务基准中表现优异,适用于智能交互、企业应用、开发辅助等场景。
输入:
8.005.20 积分/M tokens
输出:
28.0018.20 积分/M tokens
qwen3.6-flash
Qwen3.6原生视觉语言系列Flash模型,模型效果相较3.5-Flash显著提升。本模型重点提升agentic coding能力(在多项代码智能体基准上大幅超越前代)、数学推理和代码推理能力;视觉方面在空间智能能力上显著增强,物体定位与目标检测提升尤为突出。

2档阶梯计费

≤256K:

输入

输出

1.200.66 积分/M tokens

7.203.96 积分/M tokens

qwen3.5-27b
Qwen3.5系列27B原生视觉语言Dense模型,融合了线性注意力机制;响应速度快,兼具推理速度和性能。该模型的综合能力接近于Qwen3.5-122B-A10B。

2档阶梯计费

<128K:

输入

输出

0.600.26 积分/M tokens

4.802.06 积分/M tokens

qwen3.6-max-preview
Qwen3.6系列中规模最大、综合能力最强的Max模型Preview版本,当前开放纯文本模型能力供体验。相较于此前发布的Qwen3-Max和Qwen3.6-Plus,本模型在vibe coding能力上进一步提升、coding agent执行更加高效、前端编程开发能力显著提升;长尾知识能力进一步升级。

2档阶梯计费

≤128K:

输入

输出

9.004.95 积分/M tokens

54.0029.70 积分/M tokens