Tiger Data (TimescaleDB Cloud)
Tiger Data 是 Timescale 公司推出的基于 PostgreSQL 的时序数据云平台,专为工业、能源、机器人等传感器与机器数据场景设计。支持 PB 级数据存储、每秒数万亿指标写入、自动分区、行列混合存储、分层存储和湖仓集成,提供 200+ 时序 SQL 函数与混合检索能力,是高性能时序数据管理的企业级解决方案。
背景
Tiger Data 是由 Timescale, Inc.(以 Tiger Data 品牌运营)推出的企业级时序数据云平台,其核心引擎是开源项目 TimescaleDB。TimescaleDB 自 2017 年发布以来,已成为 PostgreSQL 生态中最成熟的时序数据库扩展。Tiger Data 将 TimescaleDB 的能力封装为全托管的云服务,面向工业物联网、能源管理、机器人运维、智能制造等场景,解决传统关系型数据库在海量时序数据写入、存储和分析方面的性能瓶颈。平台宣称单个实例可处理每天 3 万亿指标、存储 1 千万亿数据点,总数据量达 3 PB,展现了极高的扩展性。核心功能
Tiger Data 的核心功能围绕时序数据全生命周期管理展开:- 自动分区:基于时间间隔和可选的键值(如设备 ID)自动创建分区(称为 chunk),避免手动维护分区表,显著提升写入和查询性能。
- 行列混合存储:默认使用行存储(堆表)支持高频写入,同时提供列式压缩存储(称为 hypercore)用于分析查询,压缩比可达 90% 以上。
- 分层存储:支持将近期热数据保留在高速 SSD 上,历史冷数据自动迁移到低成本对象存储(如 S3),在保证查询性能的同时降低存储成本。
- 湖仓集成:原生支持从 Apache Kafka 和 Amazon S3 持续摄取数据,并可复制到 Apache Iceberg 格式,便于与数据湖、数据仓库协同分析。
- 200+ 时序函数:包括时间桶聚合、插值、降采样、滑动窗口、异常检测等,全部通过标准 SQL 调用,降低学习成本。
- 混合检索:结合关键词搜索、向量嵌入、过滤和排序,支持对时序数据及其元数据进行语义和结构化混合查询。
技术特色
Tiger Data 的技术优势体现在对 PostgreSQL 的深度增强:- Postgres 原生兼容:完全支持 PostgreSQL 的 SQL、索引、事务、扩展和工具链,用户无需学习新语法,现有应用可无缝迁移。
- 高性能写入:通过批量写入、内存缓冲和异步 I/O,实现每秒数百万甚至数十亿指标写入。
- 实时分析:利用列式存储和向量化执行引擎,复杂聚合查询比原生 PostgreSQL 快 10-40 倍。
- 高可用与安全:提供自动故障转移、持续备份、时间点恢复、加密传输与存储、私有网络、SOC 2 Type II 认证和 GDPR 合规。
- 多云与混合部署:支持 AWS、Azure、GCP 等主流云平台,以及本地部署(TimescaleDB Enterprise 版本)和边缘环境。
应用场景
Tiger Data 主要服务于以下领域:- 能源与公用事业:智能电网监控、风力/太阳能发电数据采集、负荷预测。
- 石油天然气:管道压力监测、钻井传感器数据、设备振动分析。
- 智能制造:生产线设备 OEE 计算、质量追溯、预测性维护。
- 机器人系统:机器人关节温度、扭矩、位置数据实时监控与回放。
- 数据中心与 IT 运维:服务器指标、网络流量、日志分析。
最新动态
截至 2025 年,Tiger Data 持续迭代:- 2024 年推出 Hypercore 引擎,将行存储与列存储自动融合,用户无需手动选择存储格式。
- 2025 年初增强湖仓集成能力,支持双向同步 Iceberg 表。
- 与 Inductive Automation(Ignition SCADA 平台)达成金牌合作伙伴关系,深度集成工业自动化场景。
- 发布 Tiger Cloud 2.0,提供更细粒度的资源弹性伸缩和按秒计费。
Tiger Data 通过将 TimescaleDB 的成熟能力与云原生弹性相结合,为需要处理海量时序数据的企业提供了既兼容 Postgres 生态又具备专业时序性能的一站式解决方案。