知识卡片

延迟吞吐是跷跷板

专业/工作 · 499.e.1

内容

流处理同时追求低延迟和高吞吐,但二者常互相牵制:批量化可提升吞吐,却会增加等待时间。发散:实时系统调优先问业务能接受多晚,再问硬件能吞多少。

参考来源

- 位置:《Flink原理与实践》第1章《大数据技术概述》(源文件:_epub-src/OEBPS/Text/chapter04.xhtml) - 结论依据:原文围绕“延迟和吞吐”给出定义、流程、对比或限制条件,本卡片据此提炼其可迁移的框架机制,并补充了使用边界或工程启发。 - 原始内容:的一些基本概念进行细化,这些概念是入门流处理的必备基础,至此你将正式进入数据流的世界。 1.5.1 延迟和吞吐 在批处理场景中,我们主要通过一次计算的总耗时来评价性能。在流处理场景,数据源源不断地流入系统,大数据框架对每个数据的处理越快越好,大数据框架能处理的数据量越大越好。例如1.2.3小节中提到……