Kimi K3 现已上线

Kimi K3 现已上线

Hacker News 摘要

原标题:Kimi K3 is now live

月之暗面正式推出了其最强大的模型 Kimi K3。在 Hacker News 的讨论中,这款新模型引起了广泛关注,其技术参数和性能指标显示出它正在挑战当前的全球顶尖模型。

核心参数与架构

参数规模:Kimi K3 的总参数量达到了 2.8 万亿。它采用了 Stable LatentMoE 架构,在推理时能高效激活 896 个专家中的 16 个。据推测,其激活参数量大约在 500 亿到 700 亿之间。

上下文长度:支持高达 100 万标记的上下文窗口。

训练效率:得益于架构和数据配方的改进,K3 的扩展效率比 K2 提高了约 2.5 倍,能更有效地将算力转化为模型能力。

定价情况

Kimi K3 的 API 定价为每 100 万标记输入 3 美元,输出 15 美元,缓存价格为 0.3 美元。

价格定位:这一价格与 Anthropic 的 Sonnet 系列基本持平。

市场反馈:部分用户认为对于一个国产权重开放模型来说,这个价格非常高。但也有观点指出,如果它的性能确实能与顶级模型竞争,这个定价是合理的。

推理效率:讨论中提到,实际使用成本还取决于推理效率。如果 K3 需要更多的推理标记才能完成任务,其实际性价比可能会低于 GPT 或 Claude 的模型。

性能表现与评测

根据 Kimi 官方此前在文档中披露的数据(部分内容随后被修改):

整体智力:Kimi K3 的表现处于第一梯队,在测试中其综合智力仅次于 Claude Fable 5 和 GPT-5.6 Sol。

GDPval-AA v2 榜单:K3 得分为 1687 分,在涵盖 44 种职业和 9 大行业的真实世界任务评估中,仅落后于 Fable 5 Max 和 GPT-5.6 Sol Max,领先于 Claude Opus 4.8 Max。

AA-Briefcase 榜单:这是一个评估长程知识工作能力的私有智能体基准测试,K3 得分为 1527 分,位列全球第二。

使用限制与功能特性

目前 Kimi K3 在 API 调用上存在一些特定的技术约束:

推理模式:目前仅支持 max 模式,这意味着模型始终开启深度思考功能。

输出限制:最大完成标记数默认为 13.1 万,最高可设置为 104.8 万。

固定参数:温度设定为 1.0,top_p 为 0.95,且不允许修改。

多模态支持:视觉输入不支持公共图片链接,需使用 base64 编码或其内部文件格式。

联网搜索:目前正在更新中,官方不建议在近期的生产流程中使用该功能。

开放权重争议

关于 Kimi K3 是否会像之前的版本一样开放权重,社区存在讨论。官方文档曾提到将在未来几天发布完整模型权重和技术报告,但有用户观察到相关的“开放”字样在随后的文档更新中被移除,这引发了对其是否会保持开放权重的担忧。

用户体验反馈

一些早期试用者反馈,K3 在处理复杂提示词时依然保留了 K2 系列优秀的创意写作能力。但也有用户抱怨其推理过程过于冗长,存在重复内容的情况,这可能会增加实际的使用成本。此外,该平台目前仅支持通过手机号或谷歌账号注册,引起了一些关注隐私的用户的不满。


原文:https://www.kimi.com/en

评论:https://news.ycombinator.com/item?id=48935342

Report Page