












Kafka 服务简介
Kafka是最初由Linkedin公司开发,是一个分布式、支持分区的(partition)、多副本的(replica),基于zookeeper协调的分布式消息系统,它的最大的特性就是可以实时的处理大量数据以满足各种需求场景:比如基于hadoop的批处理系统、低延迟的实时系统、storm/Spark流式处理引擎,web/nginx日志、访问日志,消息服务等等,用scala语言编写,Linkedin于2010年贡献给了Apache基金会并成为顶级开源 项目。
1. 一句话理解 Kafka
Kafka 是一个「高吞吐、低延迟」的分布式消息队列(也叫“消息中间件”),负责在不同的程序、服务或系统之间可靠地搬运数据,就像一条“高速数据公路”。
2. 为什么要用 Kafka
解耦:生产数据的应用只管发,消费数据的应用只管收,两边互不干扰。
缓冲:如果后端系统临时宕机或处理慢,Kafka 先把数据囤起来,高峰期也不丢。
削峰填谷:突发大流量先写到 Kafka,后端按自己节奏慢慢消费,防止数据库/业务被冲垮。
可扩展:一条 Topic(主题)可以分多个 Partition(分区),随时加机器就能横向扩容。
高可靠:消息默认多副本存储,单台 Windows 机器宕机也不丢数据。
3. 典型场景举例
4. 部分部署流程
5. 包含内容与下载链接
下载链接:通过网盘分享的文件:kafka_2.12-3.4.0.zip
链接: https://pan.baidu.com/s/1_GjcasDD6xpZrlks5NF1lg?pwd=pvf2 提取码: pvf2
此内容由惯性聚合(RSS阅读器)自动聚合整理,仅供阅读参考。 原文来自 — 版权归原作者所有。