我遇到过许多NoSQL数据库和SQL数据库。有不同的参数来衡量这些数据库的强弱,可伸缩性就是其中之一。横向和纵向缩放这些数据库有什么区别?
当前回答
还有一个没有提到的额外架构——基于SQL的数据库服务,它支持水平扩展,而不需要手动分片的复杂性。这些服务在后台进行分片,因此它们使您能够运行传统的SQL数据库,并像使用MongoDB或CouchDB等NoSQL引擎一样进行扩展。我熟悉的两个服务是EnterpriseDB for PostgreSQL和Xeround for MySQL。我看到了Xeround的一篇深入文章,它解释了为什么SQL数据库的扩展很困难,以及它们如何以不同的方式进行扩展——用一点盐来看待这一点,因为这是一篇供应商文章。还可以查看维基百科的云数据库条目,其中对SQL与NoSQL以及服务与自托管进行了很好的解释,列出了每种组合的供应商和扩展选项
其他回答
添加大量负载平衡器会产生额外的开销和延迟,这是在nosql数据库中横向扩展的缺点。这就像人们为什么说RPC不推荐的问题,因为它不健壮。
我认为在一个真实的系统中,我们应该同时使用sql和nosql数据库来利用当今系统的多核和云计算能力。
另一方面,如果使用oracle之类的sql数据库,复杂的事务查询具有很高的性能。NoSql可以通过分片用于bigdata和水平可伸缩性。
公认的答案是水平与垂直缩放的基本定义。但与人们普遍认为的只有Cassandra、MongoDB等才能实现数据库的水平缩放不同,我想补充一点,任何传统的RDMS都可以实现水平缩放;而不使用任何第三方解决方案。
我知道很多公司,特别是基于SaaS的公司都这样做。这是使用简单的应用程序逻辑完成的。基本上,您需要一组用户,并将他们划分到多个DB服务器上。因此,例如,您通常会有一个存储客户端、DB服务器/连接字符串等的“元”数据库/表,以及一个存储客户机/服务器映射的表。
然后,只需将来自每个客户端的请求定向到它们映射到的DB服务器。
现在有些人可能会说这类似于水平分区,而不是“真正的”水平缩放,他们在某些方面是正确的。但最终结果是,您已经在多个DB服务器上扩展了数据库。
两种水平缩放方法之间的唯一区别是,一种方法(MongoDB等)缩放是由DB软件本身完成的。从这个意义上说,你是在“购买”规模。在另一种方法中(对于RDBMS水平缩放),缩放是由应用程序代码/逻辑构建的。
还有一个没有提到的额外架构——基于SQL的数据库服务,它支持水平扩展,而不需要手动分片的复杂性。这些服务在后台进行分片,因此它们使您能够运行传统的SQL数据库,并像使用MongoDB或CouchDB等NoSQL引擎一样进行扩展。我熟悉的两个服务是EnterpriseDB for PostgreSQL和Xeround for MySQL。我看到了Xeround的一篇深入文章,它解释了为什么SQL数据库的扩展很困难,以及它们如何以不同的方式进行扩展——用一点盐来看待这一点,因为这是一篇供应商文章。还可以查看维基百科的云数据库条目,其中对SQL与NoSQL以及服务与自托管进行了很好的解释,列出了每种组合的供应商和扩展选项
水平缩放===>数千小黄人将为您一起完成工作。
垂直缩放===>一个大块头将为您完成所有工作。
水平缩放意味着通过向资源池中添加更多机器来进行缩放,而垂直缩放意味着可以通过向现有机器添加更多功率(CPU、RAM)来进行缩放。
记住这一点的一个简单方法是将机器放在服务器机架上,我们在水平方向上添加更多机器,在垂直方向上向机器添加更多资源。
在数据库世界中,水平缩放通常基于数据的分区,即每个节点仅包含部分数据,在垂直缩放中,数据驻留在单个节点上,通过多核进行缩放,即在该机器的CPU和RAM资源之间分散负载。
通过水平扩展,通过将更多机器添加到现有池中,通常更容易动态扩展。垂直扩展通常限于单个机器的容量,超出该容量的扩展通常会导致停机,并有上限。
水平缩放的好例子有Cassandra、MongoDB、Google Cloud Spaner。。垂直缩放的一个很好的例子是MySQL-Amazon RDS(MySQL的云版本)。通过从小型机器切换到大型机器,它提供了一种简单的垂直缩放方式。此过程通常涉及停机时间。
内存数据网格(如GigaSpaces XAP、Coherence等)通常针对水平和垂直缩放进行优化,因为它们不绑定到磁盘。通过分区实现水平扩展,通过多核支持实现垂直扩展。
你可以在我之前的文章中阅读更多关于这个主题的内容:横向扩展与横向扩展以及NOSQL替代方案背后的共同原则
推荐文章
- 获得PostgreSQL数据库中当前连接数的正确查询
- MySQL数据库表中的最大记录数
- 从现有模式生成表关系图(SQL Server)
- HyperLogLog算法是如何工作的?
- 数据库和模式的区别
- 如何从命令行在windows中找到mysql数据目录
- 货币应该使用哪种数据类型?
- 如何找到MySQL的根密码
- 将表从一个数据库复制到另一个数据库的最简单方法?
- 什么是分片,为什么它很重要?
- 数据库触发器是必要的吗?
- 为什么我应该使用基于文档的数据库而不是关系数据库?
- 哪个更快/最好?SELECT *或SELECT columnn1, colum2, column3等
- 将值从同一表中的一列复制到另一列
- 什么是数据库池?