跳转到主要内容

Apache® Druid

一款高性能的实时分析数据库,能够在负载下实现流式和批处理数据的大规模亚秒级查询。

下载 加入 Slack GitHub

概览

任意规模的亚秒级查询

针对数十亿到数万亿行的高基数和高维度数据集,在无需预定义或预缓存查询的情况下,实现毫秒级的 OLAP 查询执行。

低成本下的高并发

构建支持每秒数百到数十万次查询的实时分析应用;凭借高效的架构,其基础设施需求低于其他数据库,并能保持性能的一致性。

实时与历史洞察

通过 Druid 与 Apache Kafka 和 Amazon Kinesis 的原生集成,释放流数据潜能;支持每秒数百万事件的“到达即查询”、低延迟摄取以及一致性保障。

Druid 核心特性

交互式查询引擎

Druid 利用 scatter/gather(分散/收集)技术进行高速查询,并将数据预加载到内存或本地存储中,从而避免数据移动和网络延迟。

分层与 QoS

具有服务质量(QoS)的可配置分层机制,能够针对混合工作负载实现理想的性价比,保障任务优先级,并避免资源争用。

优化数据格式

摄取的数据会自动进行列式存储、时间索引、字典编码、位图索引和类型感知压缩。

弹性架构

将摄取、查询和编排组件松散耦合,并结合深度存储层,实现了简单且快速的纵向扩展(Scale-up)与横向扩展(Scale-out)。

真正的流式摄取

与流式平台无需连接器的集成,实现了“到达即查询”、高可扩展性、低延迟及一致性保障。

不间断的可靠性

包括持续备份、自动恢复和多节点复制在内的自动数据服务,确保了高可用性和持久性。

自动发现模式(Schema)

Druid 能够在摄取时自动检测、定义和更新列名及数据类型,兼具无模式(schemaless)的便捷性与强类型模式的高性能。

灵活的 Join 支持

Druid 支持在数据摄取时和查询执行时进行 Join 操作;在摄取期间预先 Join 表可获得最快的查询性能。

SQL 支持

开发者和分析师可以轻松使用熟悉的 SQL API,完成从摄取、转换到查询的端到端数据操作。


了解更多

应用案例

Druid 已被全球领先企业在海量规模的生产环境中验证。

常见问题

了解一些关于 Druid 最常见的问题

快速入门

在几分钟内开始使用 Druid。加载并查询您自己的数据。

安全

了解关于 安全特性、配置说明和最佳实践,以保障 Druid 的安全。

获取帮助

庞大的社区成员网络中获取使用 Druid 的帮助。

播客

AppleSpotifyYouTube Music 上收听来自 Druid 社区的声音。