2025年2月,Andrej Karpathy 在 X 上提出“vibe coding”概念,不到一年便成为柯林斯词典年度词汇。这一趋势迅速席卷全球:瑞典公司 Lovable 的 ARR 在2026年6月达到5亿美元,平台每周新增约100万个项目,累计超过5000万个,其中八成用户没有技术背景。Cursor 的 ARR 则从年初约20亿美元增长到年中接近40亿美元,短短几个月完成翻倍。国内同样跟进,蚂蚁灵光、百度秒哒、腾讯“吐司”、字节 Trae 等成为大厂标配。

应用生成变得容易,但数据库的服务对象随之改变。过去数据库服务的是像淘宝、微信这样的少量大型应用,而现在成千上万个应用都需要自己的数据空间。对于 AI 生成应用来说,数据空间不仅是存储空间,更是支撑应用持续运行的“记忆”,需要保存数据结构、业务状态,并保证后续准确调用和计算。面对“海量 AI 生成应用×动态 Schema”的挑战,数据基础设施需要新的解决思路。

传统数据库方案开始失效。根据 Sensor Tower 数据,2026年上半年苹果商店新增约56万个应用,几乎相当于2025年全年总量,全年有望突破100万,其中大量来自非专业开发者使用 vibe coding 工具(如 Replit、Bolt.new)提交。这意味着数据库面对的不再是单一大型数据库,而是数千万个彼此独立的数据空间。以蚂蚁灵光为例,上线四个月便累计生成超过3000万个闪应用。这些应用数量巨大、单体数据量小、Schema 动态生成,多数应用生命周期短,但用户重新点开时又必须立即响应。

一位接近项目的技术人士指出,传统数据库规模问题问的是“一个库能装多少数据”,而这里的问题是“一套数据库能否同时容纳3000万个互不相同的小库”。有人可能认为 AI 能生成代码,数据计算也可交给大模型,但现实并非如此。AI 擅长生成页面、代码和业务流程,但涉及金额汇总、排序、过滤等需要绝对准确结果的计算,仍需数据库完成。以记账闪应用为例,用户需要按月汇总支出,这类精确计算不能由大模型完成,也不能由平台为每个应用开发接口。从 Agent 视角看,这些能力构成应用的“运行记忆”:Schema 定义数据理解方式,业务数据记录交互状态,应用标识划定记忆边界,SQL 负责准确调用和计算。

传统数据库的两种典型方案在 AI 生成应用场景下都失效。第一种是所有应用共享一张 JSON 大表,物理表数量少,但 SQL 聚合、过滤、排序能力难以直接使用,计算回到业务层,多租户权限隔离复杂,等于只解决“存”而放弃“算”。第二种是为每个应用单独创建物理表,体验完整但规模灾难:每创建一个应用就需一次 DDL 操作,3000万次创建使控制面持续承压,且应用数据量极小,开销远超业务数据。蚂蚁集团平台技术事业群总架构师黄挺形容:“不能让每个人都单独盖一栋房子,也不能让所有人睡一个大通铺。”数据库行业过去优化方向瞄准“少量、稳定、巨型”的库表,而 AI 时代负载首次呈现“海量、动态、长尾”形态。

OceanBase 提出“逻辑独立,物理共享”的新路径:将应用的数据模型与底层物理存储解耦,每个应用保持独立数据模型和访问边界,底层共享存储和计算资源。OceanBase 产品部总经理韩富晟比喻为写字楼:“每家公司都有独立办公室,按自己风格装修,但整栋楼共享水电和物业。”实现上,OceanBase 将“表”拆成两层:一层记录 Schema,一层保存数据内容,所有应用数据写入共享数据表并以 JSON 存储,物理表数量不再随应用数量线性增长。同时增加“翻译”能力,通过 JSON Table SDK 将标准 SQL 自动转换为对共享存储的访问,利用 JSON_TABLE() 映射成关系表完成计算。隔离方面,SQL 执行时自动附带应用标识等限制条件,结合白名单机制约束范围。这种设计还带来成本优势:多数 AI 应用生命周期短、访问量低,共享资源降低运行成本;当应用成长为高频业务时,可平滑迁移到独立物理表。

据彭博社援引知情人士报道,外界曾将 OceanBase 看作中国的 Databricks。两家公司起点不同,但都在回答 AI 应用大规模涌现后数据基础设施如何演进的问题。OceanBase 在灵光项目中的实践提供了一种新思路:物理资源共享、逻辑边界独立、确定性计算留在数据库。这重新定义了数据库的“规模”:互联网时代关注单库容量、事务处理能力和性能;AI 时代挑战变成如何以有限资源承载千万级动态数据空间,同时兼顾隔离、确定性和成本。数据库的角色也在变化,过去回答“数据怎么存、怎么算”,如今还需回答 AI 如何持续、安全地使用数据,以及如何组织资源服务开发者和 Agent。当应用生成成本趋近于零,竞争从“如何生成应用”转向“如何承载应用”。韩富晟表示,OceanBase 会持续探索,搭建面向 Agent 的数据底座,为下一代 AI 应用构建真正可依赖的数据基础设施。3000万个闪应用只是第一站,数据层的竞争才真正开始。