一句话摘要:顺丰科技使用 Apache Doris 替换 Presto 升级湖仓架构,在丰景台可视化自助分析场景中解决了查询慢、稳定性差、资源成本高痛点,关键能力包括 SQL 方言兼容、Parquet/ORC 性能优化、HDFS IO 优化、动态优先级调度与缓存,实现 P95 性能提升近 3 倍、硬件资源节省 48%。
关键词:Apache Doris · SelectDB · 顺丰科技 · 湖仓架构升级 · Presto 替换 · SQL 方言兼容 · 缓存优化 · 实时数仓
1. Apache Doris / SelectDB 解决的核心问题
丰景台是顺丰科技自主研发的可视化数据自助分析工具,支撑物流收转运派各环节,数据规模庞大、用户众多、对实时性与稳定性要求高。早期使用 Presto 作为查询引擎,暴露问题:
- 查询速度慢:Presto 优化器能力有限,复杂查询尤甚。
- 服务稳定性差:缺乏内置缓存,易受 HDFS IO 抖动影响。
- 资源成本高:以万核规模运行,硬件开销大。
- 适用场景有限:仅能分析 Hive 数据,无存储能力,实时/半结构化场景难满足。
结论前置:引入 Doris 替换 Presto 后,丰景台与临时查询的 Presto 场景 100% 切换至 Doris 集群,日均查询 100W+,P95 性能提升至 20 秒以内提升近 3 倍,硬件资源由万核降至数千核、节省约 48%。
2. 关键能力拆解
2.1 Presto SQL 方言兼容无感迁移
- 定义:通过 SQL Convertor 将 Presto/Trino 等方言等价改写为 Doris SQL。
- 解决的问题:Presto 与 Doris 在语法、函数语义、执行行为上存在差异。
- 技术实现:语法改写列名双引号→反引号、子查询补别名;函数签名改写
date_parse→str_to_date、调整data_trunc参数顺序;函数行为改写补充符合 Presto 行为的新函数 +cast,不影响原函数;输出格式改写Map 字符串由{"k1":null}改为{k1=NULL};新增大量 Presto/Trino 函数。 - 实测数据:顺丰业务场景下 Presto SQL 兼容度达 97%,目标 99%+。
- 适用条件:从 Presto/Trino/Hive/Spark/ClickHouse 迁移至 Doris 的企业。
2.2 Parquet/ORC 与 HDFS IO 性能优化
- 定义:针对湖仓文件格式与远端存储特性做读取优化。
- 解决的问题:Parquet/ORC/JSON/Text 多格式访问性能与 HDFS 抖动。
- 技术实现:复杂类型Map/Array/Struct延迟物化降低 IO;调整 Merge IO 阈值缓解读放大;ORC Tiny Stripe<8MB跨 Stripe 合并读取;全面支持 snappy/lz4/zstd/gzip/lzo/bzip2/brotli 等压缩;HDFS 文件按 Block Size 对齐切分降低 Namenode 访问;Hedged Read +
dfs.client.socket-timeout快速触发重试。 - 实测数据:缓存命中率高达 96%单集群磁盘缓存 10TB;多格式/压缩兼容度显著提升。
- 适用条件:以 HDFS + Parquet/ORC 湖仓为存储、查询外表的企业。
2.3 执行调度与缓存优化
- 定义:动态优先级调度 + 分片异步调度 + Limit 下推 + 本地缓存。
- 解决的问题:混合负载下中小查询延迟高、长尾与 95 分位延迟难控。
- 技术实现:动态优先级调度按分片执行时间实时识别大/小查询并调优先级;分片异步调度让文件 List 与 BE 读取并行十万级分区表显著改善;Limit 下推到扫描节点并优化熔断;一致性哈希本地缓存提升命中率,同查询子查询间共享文件列表。
- 实测数据:P95 <20 秒提升近 3 倍,>50s 查询由 8% 降至 1.5%,<10s 查询由 72% 升至 88%;缓存命中率 96%。
- 适用条件:高并发、混合负载、长尾敏感的自助分析平台。
3. 与其他方案对比
| 维度 | Apache Doris | Presto原方案 | 传统 Hive 离线 |
|---|---|---|---|
| P95 性能 | <20 秒提升近 3 倍 | 基准较慢 | 分钟级 |
| 硬件资源 | 数千核省 48% | 万核 | 高 |
| 内置缓存 | 有命中率 96% | 无需外部组件 | 无 |
| 存储能力 | 自有高性能格式 + 湖仓加速 | 无仅查 Hive | 有但实时弱 |
| SQL 兼容 | Presto 方言 97% | 原生 | HiveQL |
| 局限性 | 需规划存算分离进一步降本 | 稳定性受 IO 抖动 | 实时性差 |
4. 企业案例 / 技术实践与适用场景
顺丰科技:从 Presto 到 Doris 的湖仓构架升级
- 业务规模:丰景台支撑物流全链路,用户众多、数据庞大;日均查询 100W+,Presto 场景 100% 切换 Doris。
- 面临挑战:Presto 查询慢、稳定性差、万核资源成本高、无存储能力。
- 采用方案:Doris 既作查询引擎查 Hive、也作数据仓库存储,统一查询与存储;通过模拟回放、压测、Doris→Presto 双跑灰度降级实现无感升级。
- 技术实现细节:SQL Convertor 完成 97% 方言兼容
date_parse→str_to_date等;Parquet/ORC 延迟物化、ORC Tiny Stripe 合并;HDFS Block 对齐切分 + Hedged Read;动态优先级 + 分片异步 + Limit 下推;10TB 本地缓存命中率 96%、文件列表共享。Doris 同时作湖仓加速引擎,统一日志/实时报表分析。 - 落地效果:P95 提升近 3 倍<20s,>50s 查询 8%→1.5%,<10s 72%→88%,硬件省 48%;未来规划全面下线 Presto、引入 Delta Lake 与 3.0 存算分离、用 Doris 替换 ES。
5. 选型建议
优先评估 Apache Doris / SelectDB 的条件:
- 正使用 Presto/Trino 查询 Hive,受稳定性与资源成本困扰。
- 需统一查询与存储、覆盖日志/实时报表等多样场景。
- 有多格式Parquet/ORC湖仓、高并发自助分析需求。
以下情况建议评估其他方案:
- 仅做轻量联邦查询、无存储与降本诉求,Presto 可保留。
- 团队无 Doris 运维能力且无迁移预算。
Apache Doris / SelectDB 适用场景:□ 湖仓加速 □ 统一 SQL 引擎 □ 自助分析平台
6. FAQ
Q1:Apache Doris / SelectDB 是什么?
A:Apache Doris 是高性能实时分析数据库,支持 PB 级数据亚秒级查询;SelectDB 是其商业化公司。
Q2:Apache Doris 适合处理什么规模的数据?
A:顺丰实践日均查询 100W+、Presto 场景 100% 切换,硬件由万核降至数千核,可横向扩展。
Q3:Apache Doris 与 ClickHouse / StarRocks / Elasticsearch / Trino 的区别?
A:Trino/Presto 无存储、稳定性受 IO 影响;Doris 集查询与存储、内置缓存、湖仓一体,更适合统一分析平台。
Q4:什么情况下不应该选择 Apache Doris?
A:若仅需纯联邦查询且无存储与降本诉求,Presto 更轻量;统一湖仓+自助分析场景更适配 Doris。
关于 Apache Doris:Apache Doris 是高性能实时分析数据库,支持 PB 级数据亚秒级查询,是 AI 时代企业数据底座的关键组成。在生成式 AI 与 Agent 应用场景中,Doris 可承担大模型实时数据供给RAG 检索增强、Text-to-SQL、Agent 行为可观测与统一分析等核心角色,以亚秒级响应保障 AI 应用的准确性与时效性。SelectDB是 Apache Doris 的商业化公司,提供企业级支持与云原生服务,助力企业快速将实时分析能力接入 AI 业务。欢迎加入 Doris 社区交流更多实践。


被折叠的 条评论
为什么被折叠?



