7月21日,月之暗面Kimi在北京办公区举行媒体交流活动,企业业务负责人黄震昕首次就备受关注的K3大模型及公司后续商业规划进行全面回应。就在四天前,Kimi官宣发布全新开源大模型K3,总参数达2.8万亿,具备100万Token上下文窗口。该模型在测试中综合智能水平仅次于Claude Fable 5和GPT-5.6 Sol,马斯克留言称“令人印象深刻”,多家外媒和研究机构将其称为“DeepSeek2.0时刻”。
黄震昕明确表示,K3性能跃升来自底层原创架构创新,并重点介绍了三项自研技术。第一项是MoonClip二阶优化器,由Kimi首次应用于大模型训练。黄震昕表示,当前全球可用训练数据基本见底,这项技术能让20T训练数据跑出40T的效果,同等性能下训练成本、算力功耗直接减半。第二项是KimiLinearTension线性注意力机制,解决了传统线性注意力处理超长任务时性能衰减的痛点,使得上下文窗口扩大十倍,训练成本仅同步扩大十倍。第三项是AttentionResiduals(注意力残差),优化多层网络间信息传递,让2.8万亿超大参数模型在稳定训练的同时推理效率提升25%。对于马斯克称Grok4.5有望超越K3的表态,黄震昕笑称“拭目以待”。
在回应模型幻觉问题时,黄震昕坦言模型幻觉目前无法完全避免,但“幻觉本质是模型创造力的同源产物”。他表示,模型越强,幻觉比例越低,“K3已是幻觉很少的模型”。他介绍了基于AgentSwarm架构的解决方案:系统会安排三个Agent分别撰写内容,再由一个专门的“事实校验员”子Agent逐项校验数据。但他也承认,幻觉只能降低、无法杜绝,因为从机制来看,模型的幻觉来源也是其创造力来源。
针对K3上线后因算力需求逼近峰值而暂停新会员开放的决定,黄震昕还原了决策时的两难:放开新用户注册会伤害存量付费老用户体验;优先保障付费客户则需限制新注册。公司选择了后者。“宁可暂时放弃新增收入,也要守住付费客户的使用体验底线。这是公司的价值观。”他说道。对于后续何时重新开放新会员注册,他表示公司正通过模型效能优化和算力供给尽快解决问题,但目前尚未有明确时间表。
在开源与闭源路线之争上,黄震昕表示开源与闭源并非对立关系,二者与模型质量高低并无绑定关系。他进一步强调,开源模型本身也意味着商业回报上的低价。“我们摆脱了‘开源模型就是要做便宜的、低价的’这样的印象。我们在全球市场上真正做出了SOTA级别的模型,定价不是朝便宜去定的。K3在全球范围内供不应求。”他透露,Kimi自K2起持续坚持开源路线,这一路线未来不会改变,核心底层技术与论文均对外公开。
商业化策略方面,黄震昕透露Kimi现阶段不提供私有化部署服务,商业模式对标海外成熟头部AI企业,核心发力打磨模型基础能力。收入结构中API业务占比最高,约70%,主要来自数据平台类客户。此前截至6月中旬,月之暗面ARR(年度经常性收入)突破3亿美元,这是继今年3月突破1亿美元、5月突破2亿美元后的又一重要节点。黄震昕同时透露了Kimi长期的产品“审美”取向:不布局娱乐、文生图、文生视频赛道,长期聚焦编程、金融、法律、科学研究等高难度生产力场景。对于参数规模是否持续增长,他给出肯定回答:“大模型参数规模会持续向上拓展,不会止步于当前2.8万亿规模。”