7月15日,一款名为Kivine的匿名模型悄然出现在LMArena竞技场,短短几小时内便成为全球AI社区焦点。众多测试者怀疑,这个隐藏身份的模型正是月之暗面尚未正式发布的下一代旗舰模型Kimi K3。目前,月之暗面并未公开确认两者关系,也未发布任何官方技术资料,但一系列线索正指向这一结论。
事件的起点来自X用户@lentils80,他在7月15日凌晨发现LMArena上新上线了名为Kivine的模型,并发布推文称“Kimi K3 is already on LMArena under the stealth name Kivine.”该推文迅速传播。LMArena是真实用户环境下的公开竞技场,模型需应对写代码、分析文件、长文本总结、多步骤推理等复杂任务,能力表现容易被用户察觉。Kivine在测试中展现出的长上下文优势尤为突出,多名用户注意到其处理超长信息的能力与Kimi系列技术路线高度吻合。X用户@kimmonismus测试后表示,Kivine拥有1M context,在长程任务中表现更好。百万token上下文正是外界对Kimi K3的最大期待之一,意味着模型可一次性处理企业资料、研究报告、大型代码库等大规模信息。
除了长上下文,Kivine的生成质量也备受关注。测试用户@synthwavedd反馈,其输出质量已接近“Fable level”,Fable被认为对应Anthropic旗下顶级模型水平。一些测试案例显示,Kivine在需要连续规划和创造性工作的任务中表现突出,例如制作包含中世纪城堡、森林环境、光影效果及寻宝机制的小游戏。然而,速度成为明显短板,一次完整生成可能需要等待约35分钟,这暗示其使用了高强度推理模式,追求极致质量而非即时响应。对于科研、软件开发等专业领域,这种等待或许仍有商业价值,但普通消费者难以接受。
在产品层面,Kimi K3的发布迹象也在泄露。7月14日晚,一张“Kimi K3发布限时充值活动”截图在AI圈传播,但页面很快被撤下。随后,网友通过抓包发现beta.kimi.link后台已出现K3相关模型信息,显示K3被放在默认位置,负责复杂任务处理;K3 Agent集群对应自动化能力;K2.6则被重新定位为快速响应模型。这透露出月之暗面未来产品策略:一个模型负责快速交流,一个负责复杂推理,再通过Agent系统执行具体任务。此外,社区流传的测试成绩显示,Kimi K3在部分测试中超过Claude Opus 4.7、GPT-5.5及GPT-5.6 Terra,但与GPT-5.6 Sol和Fable 5仍有差距。这些结果未经官方验证,需谨慎看待。
关于技术规格,传闻称Kimi K3参数规模可能超过2.5万亿,支持百万token上下文、原生多模态能力及新的注意力架构。若属实,它将成为国产大模型中规模最大的之一。然而,Kimi K3迟迟未正式发布,可能源于模型稳定性、产品设计及发布节奏等现实考量。35分钟的生成时间表明,降低成本、提高响应速度是商业化必须解决的问题;会员体系、调用限制、价格策略等也需提前规划。如今大模型发布已是一场综合竞争,技术报告、产品体验、生态合作及市场传播需同步准备。
从LMArena上的Kivine到beta接口中的K3信息,再到泄露的运营页面,线索正汇聚。虽然月之暗面尚未确认,但Kimi K3已难以称为秘密。若最终证实,这不仅意味着月之暗面的模型升级,更可能成为国产AI竞争格局的重要节点——国产模型开始尝试进入全球顶级模型竞争。不过,Kimi K3的商业价值最终取决于能否解决一个现实问题:一个需要35分钟完成任务的超级模型,如何变成普通用户每天都愿意使用的AI助手?这或许是它正式发布后真正的挑战。