7月21日,月之暗面Kimi在北京办公区举行媒体交流活动,企业业务负责人黄震昕首次全面回应K3模型发布及后续商业规划。四天前,Kimi官宣开源大模型K3,总参数量2.8万亿,支持100万Token上下文窗口;测试显示其综合智能水平仅次于Claude Fable 5和GPT-5.6 Sol。马斯克评价“令人印象深刻”,多家外媒与研究机构称其为“DeepSeek2.0时刻”。
黄震昕指出K3性能跃升源于底层原创架构创新,并介绍三项自研技术:MoonClip二阶优化器可使20T训练数据达到40T效果,同等性能下训练成本与算力功耗减半;KimiLinearTension线性注意力机制解决超长任务性能衰减问题,使上下文窗口扩大十倍且训练成本同步扩大十倍;AttentionResiduals优化多层网络信息传递,提升2.8万亿参数模型推理效率25%。他强调三项技术分别支撑LongContext、TokenEfficiency与AgentSwarm三大能力维度。
针对马斯克称Grok4.5有望超越K3的表态,黄震昕回应“拭目以待”。在幻觉问题上,他坦言模型幻觉无法完全避免,但属创造力同源产物;K3已属幻觉较少模型,并通过AgentSwarm架构部署三Agent协同生成与专属“事实校验员”子Agent逐项校验实现降低。他指出幻觉机制与人类认知误差同源,故不可根除。
K3上线后因算力需求逼近峰值,月之暗面于7月19日晚公告暂停新会员注册。黄震昕表示火爆程度远超预期,团队权衡后选择优先保障存量付费用户体验,宁弃新增收入以守住体验底线;模型效能优化与算力供给扩容正在进行,但尚未明确重启注册时间表。
针对OpenAI高管将开源模型称为“减速主义”的论调,黄震昕强调开源与闭源非对立关系,亦不绑定模型质量高低;K3作为SOTA级别模型,定价未趋低价,全球供不应求。高盛研报认为K3标志中国模型迈向定价权新节点,摩根士丹利评价其在规模、性能、定价层面实现对美国头部模型全方位追赶。Kimi自K2起坚持开源路线,核心底层技术与论文均对外公开。
商业化方面,Kimi现阶段不提供私有化部署服务,商业模式对标海外成熟AI企业,聚焦模型基础能力打磨;API业务占收入约70%,主要来自数据平台类客户。截至6月中旬,月之暗面ARR(年度经常性收入)突破3亿美元,继3月破1亿、5月破2亿后达成新节点。产品策略长期聚焦编程、金融、法律、科学研究等高难度生产力场景,回避娱乐、文生图、文生视频赛道。黄震昕确认大模型参数规模将持续向上拓展,不会止步于当前2.8万亿。
免责声明:本文内容由开放的智能模型自动生成,仅供参考。



