对话盖国强丨从厂商视角看国产数据库发展技术路线与前景

发布时间:2026/10/11 1:17:26

对话盖国强丨从厂商视角看国产数据库发展技术路线与前景 近日云和恩墨创始人兼总经理盖国强先生受国君计算机首席分析师李沐华博士之邀在线上展开对话就国产数据库发展技术路线与前景进行了观点阐述并回答了听众的提问。以下是对话实录根据录音整理。核心要点1、数据库从关系型数据库诞生经历了三个时代从商业时代到开源时代再到云数据库时代。2、全球数据库技术四大灵感来源集中式数据库奠基论文谷歌分布式数据库论文MySQL Postgres。3、金融行业国产数据库探索分为三个阶段第一个阶段是用户在边缘和外围系统尝试第二个阶段是用户开始在非关键核心系统采用第三个阶段是用户选择在核心关键系统采用。过去前两个阶段探索历程基本完成预计2024-2025年完成第三阶段然后向全行业推广。4、openGauss 已经把 PostgreSQL 的100多万行代码的80%重写了可以认为是全新的国产数据库。华为将它开源出来自主检测出来有报告它不会跟国际社区有关联是安全可控的。首先数据库技术到今天已经发展到第三个时代云数据库时代。回顾过去从关系型数据库诞生经历了三个时代即从商业时代到开源时代再到云数据库时代。商业时代有 Oracle、DB2推动了商业软件蓬勃发展。第二个时代是 MySQL 推动了互联网技术发展又推动了云数据库发展。云数据库还有两个分支公有云和私有云。整体来看云数据库时代是对前两个时代的总结和演进。开源数据库开放源代码社区共建快速赢得了用户的采纳支持了大部分免费的互联网应用。开源的问题是如何实现商业变现云为开源数据库变现找到了出口云改变了数据库行业的玩法。Gartner 发布了2021年数据库份额报告去年微软超越 Oracle今年亚马逊也超越了 Oracle。中国三大云厂商跻身全球排行榜阿里云、腾讯云和华为云。在云的概念之下私有云和公有云会长期共存。回到中国的数据库领域我把中国数据库行业划分成四个流派分别是学院派——起步最早源于高校和科研院所包括金仓、达梦等。第二个流派是互联网派以阿里、腾讯为代表以开源数据库迭代改进满足自身需求现在把数据库带入企业。第三个流派叫做创业派这里面有一系列外企打磨过的专家或者本土创业企业通过积累和学习再自主创业这个流派里面有非常多国内数据库新兴企业比如 PingCAP、巨杉、星环等。第四个流派是国内 ICT 企业他们通过投入也在进入细分市场比如华为、中兴、浪潮纷纷推出自己的数据库产品。这四大流派恰好满足了四大魔力象限分别是领导者、挑战者等等。这里面只有少数企业能够突围进入领导者象限。纵观全球数据库技术发展有四大灵感来源。第一个是1970年的关系型数据库奠基论文关系型数据库开始蓬勃发展主要是集中式产品。第二个是谷歌发表了一系列分布式技术相关的奠基论文。它是一家互联网企业站点遍布全球数据中心也是跨地域的这些基础特征使得它的探索面向分布式催生了一系列分布式论文。除了这两大理论源泉还有两大实践源泉就是 MySQL 和 Postgres。MySQL 引发了开源数据库浪潮因为互联网兴起而风靡全球。第二个是 Postgres现在叫做PG最早可回溯到70年代。MySQL 和 PG 的开源为很多后续数据库奠定了基础现在很多数据库产品是围绕这两个开源产品进行研发迭代产生的。我们看一看今天中国数据库的世界。墨天轮排行榜上有205个国产数据库参与排名现在是百花齐放的时期。我总结为万象更新中国数据库的时代正在到来最近俄乌事件中我们看到技术有国界开源数据库也有国界中国数据库必须自立自强满足市场的需求。根据我们做的统计关系型产品占到69%其次是图和时序超过20个。MySQL 和 PG 是很多国产数据库的源起分别有23和24个加起来有近50个产品是基于开源数据库研发的。虽然国内有这么多数据库产品但是我们要认识到中国商业数据库市场在全球的占比依然很低。2020年中国GDP占全球17.4%但是数据库占比只有5.2%所以我们认为中国数据库市场有很大发展空间到2025年规模将达到688亿元。数据库的国产化进程。首先我的判断是不管是中国信创产业的发展还是俄乌事件冲击整个行业都在探索数据库国产化之路。国产数据库的自主探索已经到了什么阶段呢我们认为可以分为三个阶段第一个阶段是用户在边缘和外围系统尝试第二个阶段是用户开始在非关键核心系统采用第三个阶段是用户选择在核心关键系统采用。过去前两个阶段探索历程基本完成在边缘系统上已经很多国产数据库在运行用户非核心关键系统中也已经进行了一到两年的尝试。我认为决战时刻就要到来了就是用户在典型核心系统中采用。一旦这一步验证成功国产数据库将推向所有行业迎来真正的爆发期我个人判断会在2024-2025年到来。我曾在 openGauss 峰会上讲过从尝试到信任再到深入采用这是三年才能够见到成效的事情。“十四五”这个关键时期这五年我认为是国产数据库从外围到核心到完全自主替代的历程这是所有国产数据库厂商的关键、核心也是百年难遇的时间窗口。最后简单介绍一下云和恩墨。我们把自己归入到新兴创业派里面我们创立于2011年经过了十几年发展1.0阶段是我们围绕着数据库服务进入市场服务了国内1000多家企业级客户为他们提供全栈的数据库服务支持。2.0时代是把我们的经验能力转化成了生态产品从安装部署到运维再到智能运维产品我们都做到了行业第一。3.0时代是我们跟华为合作华为在2020年开源了 openGauss 数据库我们成为了它的首要合作伙伴推出了商业发行版 MogDB过去两年间已经获得了大量客户的采用。云和恩墨围绕一千家客户提供服务打磨自己的产品能够为这个行业和时代带来一款易用的具备国产替代能力的核心数据库产品。今天的国产数据库要想取得成功核心是建立广泛的数据库生态。今天的中国数据库还在追赶和超越谁能够赢得广泛的DBA群体支持能够触达更多的客户需求打磨和迭代产品就能够取得最后的成功。数据库领域从全球来看只有 Oracle 公司建立了广泛的生态云和恩墨过去就是 Oracle 生态的重要参与者。第二位的 DB2 甚至 MySQL 都没有形成良好的社区生态在数据库领域只有位居前列的产品才能够建立完整生态链才能够在市场上游刃有余地生存下去。我们是跟华为共建生态社区打造数据库领域第一品牌和生态帮助用户实现商业数据库替代。Q1: 华为在国产数据库发展过程中扮演一个什么角色我们自己做数据库的时候也做了很多思考在中国怎么做数据库才能超越 Oracle。它的成功有几个要素第一个是抓住了关系型数据库的萌芽期第二个是建立了强大的先发规模优势。Oracle 有4000名研发人员中国所有数据库厂商加起来都没有这个数量中国还处于人才稀缺阶段。怎么才能后来居上我认为唯一的一点就是开源通过开源去汇聚人才才有可能形成规模优势。假如华为投入1000人云和恩墨投入200人越来越多人加入有可能快速聚集超过4000人的规模快速进行产品迭代和完善这个也是为什么我们会毫不犹豫地加入开源社区的原因。华为目前的战略是说关键投入领域或者要破局的领域在芯片和处理器。华为把数据库定义到计算产品线开源了 openEuler 和 openGauss这两个发展起来它的芯片生态才能起来。这是它为什么坚定开源这个也写入了战略定位里面。华为定位是硬件开放、软件开源、使能伙伴。有了华为未来可能就有了中国的开源社区过去大家在国外的开源社区做贡献华为去年就提出来建设中国本土的根社区和根生态往上可以有无限可能。Q2: 目前国产数据库对于开源的依赖程度有多高如果断开开源社区有多大影响为什么我们说在中国建立根社区特别重要开源软件方面如果我们贡献的代码不能合入主分支下次更新的时候你的代码就要重写这是特别痛苦的事情。根社区建设在国内治理都是由国内企业参与它是自主可控的。openGauss 已经把 PostgreSQL 的100多万行代码80%重写了可以认为是全新的国产数据库。华为将它开源出来自主检测出来有报告它不会跟国际社区有关联是安全可控的。反过来 MySQL 就会有很多问题。国内对于 MySQL 的代码贡献非常有限如果我们不在核心代码上做贡献只是在外围修正永远打造不了核心竞争力。过去我很痛心的一点是很多国产数据库在做低层次循环或者重复劳动。很多厂商都是做的中间件能力往内核逐步渗透每个版本都要重新做一次这是低层次循环。openGauss 把华为过去十几年的积累开放出来大家共同开发有助于大家共同去攻克技术难关。Q3: 您讲到的2024年爆发是指从今年到2023年还是相对试点范围比较小到2024年会有明显爆发过程还是说这两年会有快速爬坡爆发以后国产数据库市占率会是什么状态我第一个判断如果大家关注过国产信创或者金融信创金融信创有明确的比例要求这三步走在2024年就会达到金融行业30%-50%国产化。一旦我们在金融行业关键系统上都实现了自主替代大概率我们判断会向全行业推广不需要再做什么论证了。2024-2025这两年我认为是关键的时点。国产数据库以前做了20多年用户的心态是挑剔的总认为国产数据库能力不够、不愿意用但是到了2019年中美开始贸易摩擦一部分用户开始看清楚国产自主可控的正确性。再到今年美国对俄罗斯的断供所有人都看清楚这是大势、不可逆。从过去的被动到今天的主动这是一个变化会加速这个市场的推进。第二个事情是市占率。这个也是我们在思考的一个事情我先说我的观点现在的国产数据库市场份额大概也就5%。用户的大部分投资都在硬件上软件投资比较少导致了中国数据库占比不高。到2025年65%左右会在私有云和混合云下面大概400亿这其中国产数据库应该会达到50%以上。Q4: 站在现在这个时点看华为高斯这条路线技术上相较于之前这些体系有无革命性进步未来市场能够起来是它能够开启新的技术路线还是因为国产替代的政策Oracle 的成功能不能复制我认为它的根本是抓住了技术萌芽。今天还会不会有这样的机遇会有但是颠覆性技术还没有出现。除了颠覆还有关键性创新比如谷歌做的一些论文就是关键创新。国产数据库厂商要获得这个先机就是要在学术和人才上进行投入他们要去洞察行业里面技术演进路线上的关键创新才有可能具备区分于他人的核心竞争力。Q5: 在商业数据库和开源数据库上客户选型的考虑因素有无差异用户现在选择一个数据库会特别关注什么呢我们自己的数据库品牌是 MogDB定位就是安稳易用。数据库需求第一个是安全越来越多数据存在数据库里面泄露和篡改有很大风险未来安全需求还会不断强化。第二个是稳定用户数据库不能总出问题。过去商业数据库比如 Oracle 和 DB2 展现出来的稳定性让用户印象深刻。第三个是易用要让用户容易替代过去的产品要适合不同的业务场景和数据类型。所以我们提炼四个字就是“安稳易用”这是对于数据库内核来说的。跳出这个之外生态就是最核心关键的数据库生态非常庞大包括处理器、操作系统、中间件、客户的应用以及开发商和ISV等这些都是数据库生态只有获得了广泛生态支持才能够顺利发展。
延伸阅读

更多相关文章

2026/10/11 1:17:26

VSCode终端配置conda powershell

1、ctrl shift p打开palete管理面板2、搜索setting,找到setting.json,后打开3、按照以下格式添加如下配置代码,其中args参数列表可以参考Anaconda Powershell Prompt快捷键属性中目标里的内容注:若是在VSCode中配置cmd&#xff…

2026/10/11 1:17:26

大数据之路:数据同步

目录 1.数据同步基础 2.阿里数据仓库的同步方式 3.数据同步遇到的问题和解决方案 1.数据同步基础 大数据的数据同步主要包括从分布式业务系统同步进入数据仓库和数据从数据仓库同步进入数据应用和数据服务两个方面。本文主要讲述的是前者。 从业务系统同步数据到数据仓库的…

2026/10/11 1:12:26

AI解决方案落地指南:从50页PPT到可执行任务拆解

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/11 5:47:44

KEGG通路交互式网络图绘制指南:KGML解析与Python实现

简介:面向生物信息学中KEGG通路可视化与交互分析需求,该资源提供了一套完整的KEGG Network Viewer项目源码,采用HTML、JavaScript与PHP构建,可直接部署为在线代谢途径查看器。工具实现了基于AP检测算法的蛋白质分类展示&#xff0…

2026/10/11 5:47:44

337.安卓刷机通关教程!Fastboot/Recovery 双模式底层原理 + 自动化脚本

摘要:本文从安卓系统启动链路出发,系统讲解Fastboot与Recovery两种刷机模式的底层原理、分区表结构、镜像文件格式,并结合真实维修案例给出可落地的ADB/Fastboot命令与Python自动化脚本。内容覆盖解锁引导、刷写分区、救砖恢复、Magisk Root、常见报错排查,适合具备基本命令…

2026/10/11 5:47:44

12nm 的芯片,它的ddr 和 cpu 是怎么规划位置的?

#灵感# 研究下存算一体芯片在 12nm(比如 TSMC 12FFC) FCBGA​ 的 SoC 里,CPU 和 DDR 不是“并排随便放”,而是按“数据流最短 出球最近 供电不炸”三件事一起定的。下面用一颗典型应用处理器/边缘 AI SoC 的 floorplan 逻辑给你…

2026/10/11 5:42:44

开源工具 claude-mem:给 Claude Code 装上持久化记忆层

最近在做 AI 辅助开发的时候,我遇到了一个特别典型的场景:上午刚和 Claude Code 敲定的重构方案,下午新开一个会话,它居然把上下文忘得一干二净,我只能把背景、约束、进度重新讲一遍。反复几次之后,我开始认…

2026/10/11 0:02:13

Python调用Gemini Structured Outputs实现工单路由门禁

客服工单最怕的不是模型“答错一句话”,而是它给出一段看起来合理的说明,程序却从中猜错优先级。通俗做法是:要求模型只交 JSON(JavaScript Object Notation,轻量数据格式),再让代码验证它。Gem…

2026/10/11 0:02:13

Spring Boot超市进销存系统毕设实战:从需求拆解到答辩通关

最近带的一个学生项目组里,有A同学跑来问我:选什么毕设题目最稳妥,既能让评审老师觉得工作量够,又不会在答辩时被问到语无伦次。我第一反应就是推荐基于Spring Boot的超市仓库管理系统——也就是超市进销存系统。这个题目乍一看平…

2026/10/11 0:02:13

Flutter StatefulWidget 生命周期核心解析

很多刚开始接触 Flutter 的朋友,在看完一堆“Hello World”和基础组件之后,大概率都会撞上同一堵墙:StatefulWidget 里那堆 initState、build、dispose 方法,到底什么时候被调用?为什么顺序是那样?在里面到…

2026/10/11 0:02:13

Python调用Gemini Structured Outputs实现工单路由门禁

客服工单最怕的不是模型“答错一句话”,而是它给出一段看起来合理的说明,程序却从中猜错优先级。通俗做法是:要求模型只交 JSON(JavaScript Object Notation,轻量数据格式),再让代码验证它。Gem…

2026/10/11 0:02:13

Spring Boot超市进销存系统毕设实战:从需求拆解到答辩通关

最近带的一个学生项目组里,有A同学跑来问我:选什么毕设题目最稳妥,既能让评审老师觉得工作量够,又不会在答辩时被问到语无伦次。我第一反应就是推荐基于Spring Boot的超市仓库管理系统——也就是超市进销存系统。这个题目乍一看平…

2026/10/11 0:02:13

Flutter StatefulWidget 生命周期核心解析

很多刚开始接触 Flutter 的朋友,在看完一堆“Hello World”和基础组件之后,大概率都会撞上同一堵墙:StatefulWidget 里那堆 initState、build、dispose 方法,到底什么时候被调用?为什么顺序是那样?在里面到…

还想了解更多?直接咨询顾问

免费诊断 + 免费方案 + 透明报价。

全国咨询热线400-8866-253
免费获取方案
☎咨询二维码 ☎ ↑