`
Vikings825
  • 浏览: 65955 次
  • 性别: Icon_minigender_1
  • 来自: 威海
文章分类
社区版块
存档分类
最新评论

分布式数据库 MongoDB和Apache Cassandra

阅读更多
MongoDB是一个介于关系数据库和非关系数据库之间的产品,是非关系数据库当中功能最丰富,最像关系数据库的。他支持的数据结构非常松散,是类似json的bjson格式,因此可以存储比较复杂的数据类型。Mongo最大的特点是他支持的查询语言非常强大,其语法有点类似于面向对象的查询语言,几乎可以实现类似关系数据库单表查询的绝大部分功能,而且还支持对数据建立索引。

它的特点是高性能、易部署、易使用,存储数据非常方便。主要功能特性有:

    面向集合存储,易存储对象类型的数据。
    模式自由。
    支持动态查询。
    支持完全索引,包含内部对象。
    支持查询。
    支持复制和故障恢复。
    使用高效的二进制数据存储,包括大型对象(如视频等)。
    自动处理碎片,以支持云计算层次的扩展性
    支持RUBY,PYTHON,JAVA,C++,PHP等多种语言。
    文件存储格式为BSON(一种JSON的扩展)
    可通过网络访问

所谓“面向集合”(Collenction-Orented),意思是数据被分组存储在数据集中,被称为一个集合(Collenction)。每个 集合在数据库中都有一个唯一的标识名,并且可以包含无限数目的文档。集合的概念类似关系型数据库(RDBMS)里的表(table),不同的是它不需要定 义任何模式(schema)。
模式自由(schema-free),意味着对于存储在mongodb数据库中的文件,我们不需要知道它的任何结构定义。如果需要的话,你完全可以把不同结构的文件存储在同一个数据库里。
存储在集合中的文档,被存储为键-值对的形式。键用于唯一标识一个文档,为字符串类型,而值则可以是各中复杂的文件类型。我们称这种存储形式为BSON(Binary Serialized dOcument Format)。

MongoDB服务端可运行在Linux、Windows或OS X平台,支持32位和64位应用,默认端口为27017。推荐运行在64位平台,因为MongoDB

在32位模式运行时支持的最大文件尺寸为2GB。

MongoDB把数据存储在文件中(默认路径为:/data/db),为提高效率使用内存映射文件进行管理。

Apache Cassandra是一套开源分布式Key-Value存储系统。它最初由Facebook开发,用于储存特别大的数据。Facebook目前在使用此系统。

主要特性:

    分布式
    基于column的结构化
    高伸展性

Cassandra的主要特点就是它不是一个数据库,而是由一堆数据库节点共同构成的一个分布式网络服务,对Cassandra 的一个写操作,会被复制到其他节点上去,对Cassandra的读操作,也会被路由到某个节点上面去读取。对于一个Cassandra群集来说,扩展性能 是比较简单的事情,只管在群集里面添加节点就可以了。

Cassandra是一个混合型的非关系的数据库,类似于Google的BigTable。其主要功能比 Dynomite(分布式的Key-Value存 储系统)更丰富,但支持度却不如文档存储MongoDB(介于关系数据库和非关系数据库之间的开源产品,是非关系数据库当中功能最丰富,最像关系数据库 的。支持的数据结构非常松散,是类似json的bjson格式,因此可以存储比较复杂的数据类型。)Cassandra最初由Facebook开发,后转变成了开源项目。它是一个网络社交云计算方面理想的数据库。以Amazon专有的完全分布式的Dynamo为基础,结合了Google BigTable基于列族(Column Family)的数据模型。P2P去中心化的存储。很多方面都可以称之为Dynamo 2.0。

和其他数据库比较,有几个突出特点:

模式灵活 :使用Cassandra,像文档存储,你不必提前解决记录中的字段。你可以在系统运行时随意的添加或移除字段。这是一个惊人的效率提升,特别是在大型部 署上。
真正的可扩展性 :Cassandra是纯粹意义上的水平扩展。为给集群添加更多容量,可以指向另一台电脑。你不必重启任何进程,改变应用查询,或手动迁移任何数据。
多数据中心识别 :你可以调整你的节点布局来避免某一个数据中心起火,一个备用的数据中心将至少有每条记录的完全复制。

一些使Cassandra提高竞争力的其他功能:

范围查询 :如果你不喜欢全部的键值查询,则可以设置键的范围来查询。
列表数据结构 :在混合模式可以将超级列添加到5维。对于每个用户的索引,这是非常方便的。
分布式写操作 :有可以在任何地方任何时间集中读或写任何数据。并且不会有任何单点失败。
分享到:
评论

相关推荐

    金融级分布式数据库白皮书1

    近年来,随着微服务架构的普及,分布式数据库得到了更广泛的应用,如Apache Cassandra、MongoDB等,它们提供了高性能、高可用和可伸缩的解决方案。 【金融级分布式数据库的特性与需求】 金融行业对数据库的要求...

    分布式数据库课件资料宝典

    分布式数据库是现代大数据处理和高并发场景下的关键技术之一,它将数据分布在多个物理节点上,通过网络进行通信和协作,实现数据的透明访问和一致性保证。这份“分布式数据库课件资料宝典”无疑是深入理解这一领域的...

    distributed-database.rar_分布式数据库

    常见的分布式数据库解决方案有Google的Spanner、Apache Cassandra、MongoDB以及商业产品如Oracle RAC等。酒店管理系统选择合适的分布式数据库方案,可以实现高效、稳定且易于扩展的后台支撑,为用户提供更优质的服务...

    Learning Apache Cassandra 2015

    **Apache Cassandra**是一款分布式NoSQL数据库系统,由Facebook开发并在2008年作为开源项目发布。它以Amazon的Dynamo为基础,并结合了Google Bigtable的数据模型。Cassandra支持水平扩展、高可用性以及写优化等特性...

    Cassandra(apache-cassandra-3.11.11-bin.tar.gz)

    其主要功能比Dynamo (分布式的Key-Value存储系统)更丰富,但支持度却不如文档存储MongoDB(介于关系数据库和非关系数据库之间的开源产品,是非关系数据库当中功能最丰富,最像关系数据库的。支持的数据结构非常...

    Apache Cassandra存储系统 v4.1.1 GA

    其主要功能比Dynomite(分布式的Key-Value存储系统)更丰富,但支持度却不如文档存储MongoDB(介于关系数据库和非关系数据库之间的开源产品,是非关系数据库当中功能最丰富,最像关系数据库的。支持的数据结构非常...

    Cassandra分布式模型与源代码分析

    Cassandra 是一个开源的分布式数据库系统,源自 Facebook,后来成为了 Apache 项目的一部分。它的设计灵感来源于 Dynamo 和 Bigtable,融合了两者的关键特性。Cassandra 提供了一个高度可扩展且容错性强的数据库解决...

    Cassandra(apache-cassandra-3.0.25-bin.tar.gz)

    其主要功能比Dynamo (分布式的Key-Value存储系统)更丰富,但支持度却不如文档存储MongoDB(介于关系数据库和非关系数据库之间的开源产品,是非关系数据库当中功能最丰富,最像关系数据库的。支持的数据结构非常...

    Cassandra(apache-cassandra-4.0.1-bin.tar.gz)

    其主要功能比Dynamo (分布式的Key-Value存储系统)更丰富,但支持度却不如文档存储MongoDB(介于关系数据库和非关系数据库之间的开源产品,是非关系数据库当中功能最丰富,最像关系数据库的。支持的数据结构非常...

    apache-cassandra-3.11.4-bin.tar.gz

    其主要功能比Dynamo (分布式的Key-Value存储系统)更丰富,但支持度却不如文档存储MongoDB(介于关系数据库和非关系数据库之间的开源产品,是非关系数据库当中功能最丰富,最像关系数据库的。支持的数据结构非常...

    CASSANDRA分布式模型与源代码分析文茂V0.7 - CASSANDRA-SHAWN.doc

    2. 与MongoDB等文档型数据库相比,Cassandra在功能上可能稍显简单,但在分布式特性和可扩展性方面表现出色。 3. 与Dynomite相比,Cassandra提供了更丰富的数据模型和更多的功能,但可能在某些特定场景下不如...

    分布式课件

    5. 分布式数据库和NoSQL:Cassandra、MongoDB、HBase等。 6. 分布式计算框架:Hadoop生态系统,Spark实时计算。 7. 分布式服务治理:负载均衡、熔断、限流、降级等。 8. 容器化与虚拟化技术:Docker、Kubernetes在...

    分布式环境中数据存储技术的研究.pdf

    Google Spanner,Cassandra和MongoDB是分布式数据库技术领域的几个知名实例。它们各自具有独特的架构设计,用于解决不同场景下的数据存储需求。 - Google Spanner是一个全球分布式数据库,它通过全球同步的时钟系统...

    分布式网站架构的演进.docx

    - 面对大量数据,采用Hadoop HDFS等分布式文件系统和分布式数据库(HBase、Cassandra等)存储,确保数据的高效管理和检索,解决了单机存储的限制。 8. **引入NoSQL和搜索引擎**: - NoSQL数据库如MongoDB、CouchDB...

    kettle连接需要的常用数据库jar包.zip

    6. Cassandra:Apache Cassandra是分布式NoSQL数据库,适合大规模数据分布式存储。Cassandra的JDBC驱动可能为`cassandra-jdbc.jar`,但请注意,Cassandra的原生协议不完全符合JDBC标准,某些功能可能有限制。配置...

    1211数据库分论坛

    1. **数据库设计**:包括关系型数据库的范式理论,如何通过ER图进行实体关系建模,以及非关系型数据库如MongoDB、Cassandra的设计原则。 2. **性能优化**:涉及索引策略、查询优化、存储过程的使用、数据库分区与分...

    海量数据库设计

    例如,谷歌的Bigtable和Apache Hadoop的HBase都是著名的分布式数据库系统。在设计分布式数据库时,需要考虑数据的一致性模型(强一致性、最终一致性等)、CAP定理以及分布式事务处理。 最后,备份与恢复策略在海量...

    分布式开发的一些分析

    其次,分布式数据存储是一个关键领域,包括分布式数据库如Hadoop HDFS、Cassandra和MongoDB,以及分布式缓存如Redis和Memcached。这些系统设计用于处理大量数据,并提供高可用性和容错性。 再来是分布式计算框架,...

    大数据背景下的数据库新技术探讨.zip

    传统的SQL数据库在处理JSON、XML等复杂数据格式时效率低下,而NoSQL数据库如MongoDB、Cassandra和Redis则提供了更为灵活的数据模型和更高的扩展性。NoSQL数据库通常采用分布式架构,易于扩展,适用于需要快速处理...

Global site tag (gtag.js) - Google Analytics