模型名称厂商特性价格 (星元)简介
glm-5.3
厂商
流式输出深度思考工具调用结构化输出
输入价格: 0.00/ M tokens
输出价格: 0.00/ M tokens
创建缓存价格: 0.00/ M tokens
命中缓存价格: 2000.00/ M tokens

GLM-5.3 是面向复杂软件工程与长程 Agent 任务的最新旗舰模型。编程体验较前代提升 50%,部分网络安全能力持平 Mythos 5,并在效果与 Token 利用率之间实现了更优平衡。

glm-5.2
厂商
流式输出深度思考工具调用结构化输出
输入价格: 8000.00/ M tokens
输出价格: 28000.00/ M tokens
创建缓存价格: 0.00/ M tokens
命中缓存价格: 2000.00/ M tokens

GLM-5.2 是面向长任务时代的旗舰模型。支持真正可用的 1M 上下文,实测可承载项目级工程上下文,长程任务执行更稳定、工程规范遵循更可靠,开发场景成功率进一步提升。

kimi-k3
厂商
流式输出图像理解深度思考工具调用结构化输出
输入价格: 20000.00/ M tokens
输出价格: 100000.00/ M tokens
命中缓存价格: 2000.00/ M tokens

Kimi K3 是 Kimi 迄今能力最强的旗舰模型,拥有 2.8 万亿参数,它是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。

o-5.6-sol
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 35000.00/ M tokens
输出价格: 210000.00/ M tokens
命中缓存价格: 3500.00/ M tokens

顶尖语言模型

qwen3.7-max
厂商
流式输出深度思考工具调用结构化输出
输入价格: 6000.00/ M tokens
输出价格: 18000.00/ M tokens
创建缓存价格: 7500.00/ M tokens
命中缓存价格: 1200.00/ M tokens

Qwen3.7系列中规模最大、综合能力最强的Max模型,当前开放纯文本模型能力供体验。Qwen3.7是面向智能体时代的新一代旗舰模型,核心优势在于智能体能力的广度与深度:在编程、办公与生产力、长周期自

qwen3.7-plus
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 1600.00/ M tokens
输出价格: 6400.00/ M tokens
创建缓存价格: 2000.00/ M tokens
命中缓存价格: 320.00/ M tokens

Qwen3.7系列中高性价比Plus模型,在强大文本能力的基础上全面升级了视觉-语言能力,同时保持了在编码、工具使用和生产力工作流方面的完整智能体能力。其核心特色为多模态交互混合智能体能力,能够感知真

qwen3.6-plus
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 2000.00/ M tokens
输出价格: 12000.00/ M tokens
创建缓存价格: 2500.00/ M tokens
命中缓存价格: 200.00/ M tokens

Qwen3.6原生视觉语言系列Plus模型,展现出与当前顶尖前沿模型相媲美的卓越性能,模型效果相较3.5系列显著提升。

qwen3.5-plus
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 800.00/ M tokens
输出价格: 4800.00/ M tokens
创建缓存价格: 1000.00/ M tokens
命中缓存价格: 80.00/ M tokens

Qwen3.5原生视觉语言系列Plus模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。

qwen3.5-flash
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 200.00/ M tokens
输出价格: 2000.00/ M tokens
创建缓存价格: 250.00/ M tokens
命中缓存价格: 20.00/ M tokens

Qwen3.5原生视觉语言系列Flash模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。

glm-5.1
厂商
流式输出深度思考工具调用结构化输出
输入价格: 6000.00/ M tokens
输出价格: 24000.00/ M tokens
创建缓存价格: 0.00/ M tokens
命中缓存价格: 1300.00/ M tokens

GLM-5.1 是智谱最新旗舰模型,代码能力大大增强,长程任务显著提升,能够在单次任务中持续、自主地工作长达 8 小时,完成从规划、执行到迭代优化的完整闭环,交付工程级成果。

glm-5
厂商
流式输出深度思考工具调用结构化输出
输入价格: 4000.00/ M tokens
输出价格: 18000.00/ M tokens
创建缓存价格: 0.00/ M tokens
命中缓存价格: 1000.00/ M tokens

GLM-5 是智谱的基座模型,面向 Agentic Engineering 打造,能够在复杂系统工程与长程 Agent 任务中提供可靠生产力。

kimi-k2.7-code
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 6500.00/ M tokens
输出价格: 27000.00/ M tokens
命中缓存价格: 1300.00/ M tokens

Kimi K2.7 Code 是 Kimi 迄今最智能的 Coding 模型,在长上下文中更可靠地遵循指令,能以更高的成功率完成编程任务,同时支持文本、图片与视频输入,思考模式。

kimi-k2.6
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 6500.00/ M tokens
输出价格: 27000.00/ M tokens
命中缓存价格: 1100.00/ M tokens

Kimi K2.6 是 Kimi 最新最智能的模型,Kimi K2.6 的通用 Agent、代码、视觉理解等综合能力得到全面提升。

kimi-k2.5
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 4000.00/ M tokens
输出价格: 21000.00/ M tokens
命中缓存价格: 700.00/ M tokens

Kimi K2.5 是 Kimi 在2026年最新推出的智能模型,在 Agent、代码、视觉理解及一系列通用智能任务上取得开源 SoTA 表现。

deepseek-v4-pro
厂商
流式输出深度思考工具调用结构化输出
输入价格: 9000.00/ M tokens
输出价格: 27000.00/ M tokens
命中缓存价格: 300.00/ M tokens

DeepSeek-V4-Pro 1.6T 参数的原生多模态旗舰,通过全新的 CSA+HCA 混合注意力架构,在复杂数学推理、长程代码工程及深度智能体协作领域代表了当前的行业顶尖水平。

deepseek-v4-flash
厂商
流式输出深度思考工具调用结构化输出
输入价格: 3000.00/ M tokens
输出价格: 9000.00/ M tokens
命中缓存价格: 100.00/ M tokens

DeepSeek-V4-Flash 专为高并发与低延迟设计的生产级利器,以 1M 上下文为全系标配,在极低成本下实现了媲美旗舰的推理表现与卓越的 Agent 响应效率。

g-3.1-pro-preview
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 13000.00/ M tokens
输出价格: 80000.00/ M tokens
命中缓存价格: 1300.00/ M tokens

顶尖语言模型

o-5.5
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 34000.00/ M tokens
输出价格: 200000.00/ M tokens
命中缓存价格: 3400.00/ M tokens

顶尖语言模型

o-5.4
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 17000.00/ M tokens
输出价格: 100000.00/ M tokens
命中缓存价格: 1700.00/ M tokens

顶尖语言模型

g-3.5-flash
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 10000.00/ M tokens
输出价格: 60000.00/ M tokens

顶尖语言模型

o-5.4-mini
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 5000.00/ M tokens
输出价格: 30000.00/ M tokens
命中缓存价格: 500.00/ M tokens

顶尖语言模型

a-fable-5
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 68000.00/ M tokens
输出价格: 340000.00/ M tokens
命中缓存价格: 6800.00/ M tokens

顶尖语言模型

a-opus-4-8
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 34000.00/ M tokens
输出价格: 170000.00/ M tokens
命中缓存价格: 3400.00/ M tokens

顶尖语言模型

a-opus-4-7
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 34000.00/ M tokens
输出价格: 170000.00/ M tokens
命中缓存价格: 3400.00/ M tokens

顶尖语言模型

a-opus-4-6
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 34000.00/ M tokens
输出价格: 170000.00/ M tokens
命中缓存价格: 3400.00/ M tokens

顶尖语言模型

a-sonnet-4-6
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 20000.00/ M tokens
输出价格: 100000.00/ M tokens
命中缓存价格: 2000.00/ M tokens

顶尖语言模型

a-opus-5
厂商
流式输出深度思考工具调用结构化输出
输入价格: 34000.00/ M tokens
输出价格: 170000.00/ M tokens
命中缓存价格: 3400.00/ M tokens

顶尖语言模型

a-sonnet-5
厂商
流式输出深度思考工具调用结构化输出
输入价格: 14000.00/ M tokens
输出价格: 70000.00/ M tokens
命中缓存价格: 1500.00/ M tokens

顶尖语言模型

g-3.6-flash
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 10000.00/ M tokens
输出价格: 52500.00/ M tokens

顶尖语言模型

o-5.6-luna
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 1400.00/ M tokens
输出价格: 8400.00/ M tokens
命中缓存价格: 140.00/ M tokens

顶尖语言模型

o-5.6-terra
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 14000.00/ M tokens
输出价格: 84000.00/ M tokens
命中缓存价格: 1400.00/ M tokens

顶尖语言模型

qwen3.8-max
厂商
流式输出图像理解视频理解深度思考工具调用结构化输出
输入价格: 12000.00/ M tokens
输出价格: 36000.00/ M tokens
创建缓存价格: 15000.00/ M tokens
命中缓存价格: 1500.00/ M tokens

2.4万亿参数MoE旗舰,编程与办公能力全面跃升,可自主编程十数天交付完整项目。胜任法律、金融、设计等数百种专业任务,一次对话端到端交付生产级成果。

hy3
厂商
流式输出深度思考工具调用结构化输出
输入价格: 1000.00/ M tokens
输出价格: 4000.00/ M tokens
命中缓存价格: 250.00/ M tokens

Hy3 正式版面向真实业务场景打磨,采用 295B 总参数、21B 激活 MoE 架构,原生支持 256K 上下文。

联系我们联系我们