国庆假期刚过,国产大模型又进入了新一轮密集发布期。两款新模型的消息几乎同时浮出水面,一个来自月之暗面,一个来自阶跃星辰。
Kimi K3.1:后台标识已可调用,预计10月发布
9月28日,多名开发者注意到月之暗面 API 平台的后台模型注册表中出现了“kimi-k3-1”标识。这枚标识不仅出现在列表里,还通过了接口探测、确实可以被调用。
从目前流出的配置看,Kimi K3.1 预计支持最高 100万 Token 上下文窗口,并提供 Low、High、Max 三档推理强度选项。更值得注意的是,它可能原生引入 Agent 智能体模式、Swarm 多智能体协作,以及搜索和批处理等任务模式。
有开发者分析,把推理强度拆成多档,很可能对应着不同的算力资源配置与计费模型——用户既能按任务轻重选 Low 省钱,也能为质量拉满 Max。
价格方面,Kimi 开放平台显示 K3.1 的 API 定价与现役 K3 相同(输入 ¥20/MTok、输出 ¥100/MTok、缓存命中 ¥2/MTok),但考虑到模型尚未官宣,这有可能只是占位符。
阶跃 Step 5 Preview:600B 稀疏 MoE,10月15日开源
9月20日,阶跃星辰正式发布并全量开放新一代旗舰基座模型 Step 5 Preview。
核心规格:总参数 600B、激活仅 27B 的稀疏 MoE 架构,支持 100万 Token 上下文窗口,原生支持文本与视觉输入。
在 Artificial Analysis Intelligence Index v4.3 中,Step 5 Preview 得分 44 分,与参数量达 2.8 万亿的 Kimi K3 Max 持平,位列全球开源模型前三。
更值得关注的是成本效率。AA 数据显示,Step 5 Preview 每项 Intelligence Index 任务的成本为 0.71 美元,而 Kimi K3 Max 为 2 美元,成本降至约三分之一。官方称单任务成本仅为 Claude Opus 5 的八分之一。
API 定价为:输入 7 元/百万 Token,输出 18 元/百万 Token,缓存命中 0.35 元/百万 Token。
完整模型权重将于 10月15日正式开源,开发者可期待后续本地部署与二次开发空间。
一个值得留意的细节
AA 同时指出,Step 5 Preview 非常冗长(very verbose)——在 Intelligence Index 评估中产生了 1.6 亿输出 Token,远高于中位数的 9000 万。这意味着虽然单 Token 价格有优势,但在实际任务中的总 Token 消耗可能偏高。省钱的账,还是要按单任务成本来算。
对开发者的含义
两款模型都在 “能力够用的前提下把成本压到极低” 这个方向上做文章。Kimi K3.1 的多档推理强度,本质上是把“用多少算力”的选择权交给开发者;Step 5 Preview 的稀疏 MoE 架构,则是从模型结构层面降低推理成本。
但模型的选择越来越多,计价方式也越来越碎。Kimi 按三档推理强度可能对应不同价格,阶跃按 Token 计费但输出量偏大——不同模型的账单结构各不相同。当你在多个模型之间做调度时,调用层的管理成本会悄悄吃掉一部分省下来的钱。EasyAPI 这类聚合入口的价值就在这里:一个 Key 接入所有主流模型,统一记录调用和成本,按任务类型分配模型,切换只改配置不碰业务代码。
转载自 CSDN-专业IT技术社区
原文链接:https://blog.csdn.net/Pin_Qing/article/details/167363011




