← 返回全球模型雷达

中国 · Kimi / GLM / 文心 / 豆包 / MiniMax

中国模型生态 模型历史

中国模型现在最值得看的,是 Kimi K3 把开放权重、1M 上下文、视觉能力和高价值 coding / agent 任务进一步推上台面,不只看单次排行榜。

中文办公1M context开放权重代码 Agent国内价格

当前重点模型

Kimi K3

当前最值得中文开发者和工具团队立刻实测的国产高价值任务层之一,但不等于要替代所有默认低成本流量层。

官方/参考来源 →
最新 · 2026-07-17

Kimi K3

当前最值得中文开发者和工具团队立刻实测的国产高价值任务层之一,但不等于要替代所有默认低成本流量层。

推理代码中文多模态上下文速度成本友好
推理91
代码93
中文94
多模态88
上下文97
速度80
成本友好82

类型:开放权重

上下文:1M context,原生视觉,16 / 896 experts active

输入:$0.30 / 1M cached, $3.00 / 1M uncached

输出:$15.00 / 1M tokens

更适合高价值中文 coding、research 和 agent 任务;官方建议部署准备 64+ accelerators,完整权重将在 2026-07-27 前放出。

现役 · 2026-04-21

Kimi K2.6

从中文长文本入口进一步走向开放模型、代码 Agent 和工程工作流,适合开发者和工具团队重点测试。

推理代码中文多模态上下文速度成本友好
推理88
代码90
中文92
多模态82
上下文94
速度78
成本友好84

类型:混合生态

上下文:官方强调 256K context 与长时编程工作流

输入:以 Kimi/API/Hugging Face 托管成本为准

输出:以 Kimi/API/Hugging Face 托管成本为准

重点观察开放权重、长时编程、Agent swarm 和工具调用在真实代码库里的完成率。

观察 · 持续更新

Kimi / Moonshot 系列

长文本和中文资料处理仍然值得持续跟踪。

推理代码中文多模态上下文速度成本友好
推理84
代码78
中文92
多模态70
上下文94
速度78
成本友好76

类型:混合生态

上下文:长文本与中文资料处理方向

输入:以官方价格页为准

输出:以官方价格页为准

适合长文本、资料阅读、中文办公和模型生态观察。

观察 · 持续更新

GLM / 智谱系列

企业和开发者生态值得看。

推理代码中文多模态上下文速度成本友好
推理82
代码78
中文88
多模态78
上下文82
速度80
成本友好78

类型:混合生态

上下文:多规格

输入:以官方价格页为准

输出:以官方价格页为准

适合企业 API、Agent 和国产生态观察。

观察 · 持续更新

文心 / 豆包 / MiniMax

更接近普通用户日常入口,适合跟踪产品体验。

推理代码中文多模态上下文速度成本友好
推理80
代码74
中文90
多模态82
上下文78
速度86
成本友好82

类型:混合生态

上下文:多规格

输入:以官方价格页为准

输出:以官方价格页为准

普通用户入口和国内应用生态更重要。