快讯资讯
手机优化
系统数码
网络通信人工智能
网站游戏
测评专题
智车

  什么让 Apache Kafka 如此快       如何处理过时的数据中心    

什么让 Apache Kafka 如此快速?

时间:2026-10-08 16:48 来源:未知 人气:

Kafka 支持高吞吐量、高度分布式、容错性强的平台,能够以低延迟传递消息。

有几种技术使 Apache Kafka 如此快速:

  • 低延迟消息传递
  • 批量数据和压缩
  • 水平扩展

低延迟消息传递

大多数传统的数据系统使用随机存取内存(RAM)进行数据存储,因为RAM提供了极低的延迟。让我们看看使用RAM的优缺点。

  • 优点:这种方法使它们变得非常快速。
  • 缺点:RAM的成本远高于磁盘,特别是当系统中有数百GBPS的数据流时。

Kafka 避免了随机存取内存,它通过顺序I/O和零拷贝原理实现低延迟消息传递。

顺序I/O:

Kafka 在存储和缓存消息时大量依赖文件系统。有一种普遍的看法是“磁盘很慢”,这意味着高寻址时间。想象一下,如果我们可以避免寻址时间,我们可以实现与RAM一样低的延迟。Kafka 通过顺序I/O来实现这一点。

Kafka 的基本概念是日志(log);这是一种仅附加、完全有序的数据结构。

下面是一个演示日志流(队列)的图示,生产者以不可变和单调的方式在日志流的末尾追加,而订阅者/消费者可以维护自己的指针以指示当前消息的处理。

来源:https://kafka.apache.org/intro.html

每当生产者发布一条消息时,它都会收到包含记录偏移量的确认。第一条发布到分区的记录的偏移量为0,第二条为1,以此类推,以递增的顺序。消费者从由偏移量指定的位置消费数据,然后定期将其位置保存在日志中以进行提交。保存偏移量的目的是让另一个消费者在消费者实例崩溃时可以从其位置恢复。

零拷贝原理:

当我们从内存中提取数据并将其发送到网络时会发生什么。

  • 从内存中提取数据,它会将数据从内核上下文复制到应用程序上下文
  • 将这些数据发送到互联网,它会将数据从应用程序上下文复制到内核上下文。

图像概念来自:https://developer.ibm.com/articles/j-zerocopy/

正如您所看到的,将数据在内核上下文和应用程序上下文之间进行复制是多余的,这会消耗CPU周期和内存带宽,尤其是在数据量很大时会导致性能下降。这正是零拷贝原则要解决的问题。

图像概念来自:https://developer.ibm.com/articles/j-zerocopy/

批量数据和压缩

高效的压缩需要将多个消息一起压缩,而不是分别压缩每个消息。

Kafka 支持这一点,允许递归消息集。一批消息可以被聚合在一起压缩,并以这种形式发送到服务器。这批消息将以压缩形式写入,保持在日志中并只能由消费者解压缩。

更多文章

相关文章

网站导航: | 快讯 | 资讯 | 手机 | 优化 | 系统 | 数码 | 网络通信 | 人工智能

  • 游戏 | 测评 | 专题 | 智车

    合作伙伴:

  • 友情链接(欢迎业界知名网站交换链接)申请友情

    

    声明:本站资源皆来自网络,如有侵权问题,请联系管理员处理!

    Copyright ©2020-2028快知站 版权所有 All rights reserved.

    闽ICP备20010713号-1 闽公网安备 35020602001684号