模型 API
一个 API Key,调用主流大模型
搜索
全部
GLM-5.0
GLM-5 是智谱新一代的旗舰基座模型,面向 Agentic Engineering 打造,能够在复杂系统工程与长程 Agent 任务中提供可靠生产力。在 Coding 与 Agent 能力上,GLM-5 取得开源 SOTA 表现,在真实编程场景的使用体感逼近 Claude Opus 4.5,擅长复杂系统工程与长程 Agent 任务,是通用 Agent 助手的理想基座。

2档阶梯计费

<32K:

输入

输出

4.003.16 积分/M tokens

18.0014.22 积分/M tokens

glm-4.7-flashx
GLM-4.7-FlashX 是智谱 GLM-4.7 系列的轻量高效版,总参数30B,兼顾性能与性价比。继承 GLM-4.7 系列在 Agentic Coding、长程任务规划与工具协同方面的强化能力,FlashX 版本以更快的响应速度和更高的吞吐量,满足实时交互、高频调用等业务场景需求。同时具备简洁自然的回复风格与沉浸式写作能力,在工具调用场景下指令遵循能力依然稳定可靠。 能力:文本生成 最大上下文长度:200K 输入: 文本 输出: 文本
输入:
0.500.40 积分/M tokens
输出:
3.002.37 积分/M tokens
glm-4.7
GLM-4.7 系列是智谱最新旗舰模型,面向 Agentic Coding 场景强化了编码能力、长程任务规划与工具协同,并在多个公开基准的当期榜单中取得开源模型中的出色表现。通用能力提升,回复更简洁自然,写作更具沉浸感。在执行复杂智能体任务,在工具调用时指令遵循更强,Artifacts 与 Agentic Coding 的前端美感和长程任务完成效率进一步提升。 能力:文本生成 最大上下文长度:200K 输入: 文本 输出: 文本

2档阶梯计费

<32K:

输入

输出

3.002.37 积分/M tokens

14.0011.06 积分/M tokens

GLM4.6V
GLM-4.6V 系列是 GLM 系列在多模态方向上的一次重要迭代,它将训练时上下文窗口提升到128k tokens,在视觉理解精度上达到同参数规模 SOTA,并首次在模型架构中将 Function Call(工具调用)能力原生融入视觉模型,打通从「视觉感知」到「可执行行动(Action)」的链路,为真实业务场景中的多模态 Agent 提供统一的技术底座。

2档阶梯计费

<32K:

输入

输出

1.000.84 积分/M tokens

3.002.52 积分/M tokens

Kimi-K2-Thinking
kimi-k2-thinking 是具备通用 Agentic 能力和推理能力的思考模型,支持深度推理和多步工具调用,帮助解决各类复杂问题。 最大上下文长度:256K 输入: 文本 输出: 文本
输入:
4.002.96 积分/M tokens
输出:
16.0011.84 积分/M tokens
Kimi-K2.5
Kimi K2.5 是 Kimi 迄今最智能的模型,在 Agent、代码、视觉理解及一系列通用智能任务上取得开源 SoTA 表现。同时 Kimi K2.5 也是 Kimi 迄今最全能的模型,原生的多模态架构设计,同时支持视觉与文本输入、思考与非思考模式、对话与 Agent 任务。 最大上下文长度:256K 输入: 文本 输出: 文本
输入:
4.002.96 积分/M tokens
输出:
21.0015.54 积分/M tokens
Doubao-Seed-2.0-Mini
面向低时延、高并发与成本敏感场景,提供极致的模型推理速度。模型效果与Doubao-Seed-1.6相当。支持256k上下文、4档思考长度和多模态理解,适合成本和速度优先的轻量级任务。 最大上下文长度:256K 输入:文字、图片、视频 输出:文字

3档阶梯计费

<32K:

输入

输出

0.200.17 积分/M tokens

2.001.70 积分/M tokens

Doubao-Seed-2.0-Lite
面向高频企业场景兼顾性能与成本的均衡型模型,综合能力超越上一代Doubao-Seed-1.8。胜任非结构化信息处理、内容创作、搜索推荐、数据分析等生产型工作,支持长上下文、多源信息融合、多步指令执行与高保真结构化输出。在保障稳定效果的同时显著优化成本。 最大上下文长度:256K 输入:文字、图片、视频 输出:文字

3档阶梯计费

<32K:

输入

输出

0.600.51 积分/M tokens

3.603.06 积分/M tokens

Doubao-Seed-2.0-Code
面向真实编程环境优化的 Coding 模型,能稳定调用 Claude Code 等常见 IDE 中的工具。模型特别优化了前端能力,在使用常见的前端框架时能有良好表现。模型支持使用 Skills,可以配合多种自定义技能使用。 最大上下文长度:256K 输入:文字、图片、视频 输出:文字

3档阶梯计费

<32K:

输入

输出

3.202.72 积分/M tokens

16.0013.60 积分/M tokens