Skip to content
GitHub
6.5k
v1.2.0-beta.1

开源的可观测性数据库

一个数据库,
统一指标、日志和链路

同一个列式存储引擎处理指标、日志和链路,以对象存储为主存储,可运行在你的环境中。通过 OpenTelemetry 和 Prometheus Remote Write 写入,使用 SQL 查询可观测数据、PromQL 查询指标。

Streaming
Storage

三套系统

三个后端,三套扩展模型

  • 写入和留存要按信号分别配置
  • 每个后端的扩展方式和故障模型各不相同
  • 跨信号排查需要使用多种查询语言
  • 规模扩大后,实时监控和历史分析需要分别规划容量
  • 要部署、升级、加固和监控的组件更多
VS
一个引擎 →

一个引擎,一套数据模型

  • 指标、日志和链路采用统一的表模型:Tag 列、Timestamp 列和 Field 列
  • 保留原始事件,可在查询时按需派生指标,也可通过 Flow 持续聚合并物化指标
  • 当数据包含共同标识符时,可以通过一条 SQL 关联不同信号
  • 同一个引擎同时处理近期数据和长期留存,无需另建分析系统
  • 通过压缩和对象存储,存储成本最高可降至原来的 1/50

沿用现有协议写入

支持通过 OpenTelemetry、Prometheus Remote Write、Loki Push 和 Elasticsearch Bulk API 写入,使用 SQL 查询可观测数据、PromQL 查询指标。写入可以按信号逐步迁移,无需重建现有采集器。

数据源
Metrics
Traces
Logs
标准开放协议
OpenTelemetry
Prometheus Remote Write
Loki Push
Elasticsearch Bulk
标准写入协议
数据库内计算
预处理
Pipeline
流式处理 &
物化视图
告警/触发规则
GreptimeDB
压缩聚合、低成本、可扩展的数据存储
对象存储
应用
APM
Dashboard
O11y Data Analytics
AI & Machine Learning
Alerting
标准协议
SQL
PromQL
多种查询方式

Agent 正在改变可观测数据的生产和使用

Agent 应用会产生高基数遥测数据,排障 Agent 则会并行查询这些数据。后端需要同时承受更高的 数据基数、写入量和查询并发。

工程师

逐层下钻

每一步都要等上一步的结果出来,再决定下一步查什么。

  1. 1先看仪表盘
  2. 2下钻到具体服务
  3. 3查看服务日志
  4. 4跳到对应的链路

跨信号上下文通常仍要由工程师手动串起来。

Agent

并行扇出

一次发出大量查询,没命中的分支直接丢弃,命中的继续往下查。

agent

中途被放弃的分支

阅读文章可观测性已经开始统一,但查询它的不再只是人

客户之声

从 Loki 迁移到 GreptimeDB
OceanBase Cloud
资深工程师
了解更多
从 Loki 迁移到 GreptimeDB 实现了海量日志数据的高性能大规模查询,提供多云部署灵活性,并显著简化了应用和部署架构。
生产规模
300TBincrease
存储成本下降
60%+decrease
查询延迟
一天内日志检索亚秒级返回

一个引擎带来的实际收益

热路径与历史分析,共用一套系统

热路径与历史分析,共用一套系统

  • 近期数据由内存和本地磁盘缓存提供,长期数据保存在对象存储中;两类负载共用同一个引擎和同一套 SQL

  • 数据保留策略(TTL)、降采样和持续聚合由数据库内置,派生指标无需额外的数据处理链路

  • 倒排索引、跳数索引和全文索引;分布式表按列值范围分区

以对象存储承载长期数据

以对象存储承载长期数据

  • 对象存储为主存储 —— S3、GCS、Azure Blob 以及兼容 S3 的服务

  • 通过压缩和对象存储,存储成本最高可降至原来的 1/50

  • OceanBase Cloud 从 Loki 迁移后承载 300 TB 日志数据,存储成本下降 60% 以上

在你的环境中,从单机扩展至百节点集群

在你的环境中,从单机扩展至百节点集群

  • 存算分离

  • 同一个二进制支持从单节点部署扩展至百节点 Kubernetes 集群

  • 企业版提供读副本、工作负载隔离、自动重分区和 Region 负载均衡

选择适合您需求的方案

企业用户和技术支持需求?

联系我们
开源版

开源版

同一个列式存储引擎处理指标、日志和链路,以对象存储为主存储。使用 SQL 查询可观测数据、PromQL 查询指标。核心代码采用 Apache-2.0 许可证。

  • 生产就绪的单机或集群部署

  • 内置数据保留策略(TTL)、降采样和持续聚合

  • 社区驱动,开放治理

企业版

企业版

面向大规模部署,提供工作负载隔离、读容量独立扩展、自动重分区、高可用和技术支持。

  • 关键业务系统监控和分析

  • 更高性能和数据治理

  • 需要高安全性和合规性的行业(金融、医疗等)

  • 需要自动化运维和智能资源调度的组织

  • 希望数据留在自己环境中、同时需要企业级支持的团队