三套系统
三个后端,三套扩展模型
- 写入和留存要按信号分别配置
- 每个后端的扩展方式和故障模型各不相同
- 跨信号排查需要使用多种查询语言
- 规模扩大后,实时监控和历史分析需要分别规划容量
- 要部署、升级、加固和监控的组件更多
开源的可观测性数据库
同一个列式存储引擎处理指标、日志和链路,以对象存储为主存储,可运行在你的环境中。通过 OpenTelemetry 和 Prometheus Remote Write 写入,使用 SQL 查询可观测数据、PromQL 查询指标。
三套系统
沿用现有协议写入
支持通过 OpenTelemetry、Prometheus Remote Write、Loki Push 和 Elasticsearch Bulk API 写入,使用 SQL 查询可观测数据、PromQL 查询指标。写入可以按信号逐步迁移,无需重建现有采集器。
Agent 正在改变可观测数据的生产和使用
Agent 应用会产生高基数遥测数据,排障 Agent 则会并行查询这些数据。后端需要同时承受更高的 数据基数、写入量和查询并发。
工程师
每一步都要等上一步的结果出来,再决定下一步查什么。
跨信号上下文通常仍要由工程师手动串起来。
Agent
一次发出大量查询,没命中的分支直接丢弃,命中的继续往下查。
中途被放弃的分支


近期数据由内存和本地磁盘缓存提供,长期数据保存在对象存储中;两类负载共用同一个引擎和同一套 SQL
数据保留策略(TTL)、降采样和持续聚合由数据库内置,派生指标无需额外的数据处理链路
倒排索引、跳数索引和全文索引;分布式表按列值范围分区

对象存储为主存储 —— S3、GCS、Azure Blob 以及兼容 S3 的服务
通过压缩和对象存储,存储成本最高可降至原来的 1/50
OceanBase Cloud 从 Loki 迁移后承载 300 TB 日志数据,存储成本下降 60% 以上

存算分离
同一个二进制支持从单节点部署扩展至百节点 Kubernetes 集群
企业版提供读副本、工作负载隔离、自动重分区和 Region 负载均衡