搭建大型分布式服务(四十二)SpringBoot 无代码侵入实现多Kafka数据源整合插件发布

限时加码!20+主流AI编程工具免费用 购周边加赠Coding Plan Lite,Claude Code、Cursor等即刻畅享,学习进阶更高效! 阅读详情

系列文章目录



前言

在分布式服务的架构演进中,消息队列作为核心组件之一,承载着解耦、异步、削峰填谷等关键职责。Apache Kafka 作为业界广泛使用的分布式流处理平台,因其高吞吐、低延迟的特性被大量应用在各类大数据场景中。然而,随着业务的复杂度不断提升,如何在 SpringBoot 中高效地整合并管理多个 Kafka 数据源,成为了一个值得探讨的问题。

在过去的一段时间里,我们通过系列文章详细阐述了如何在 SpringBoot 中以零代码或极低的代码侵入方式,实现多 Kafka 数据源的整合。从基础的配置到高级特性如 protobuf 支持、Aware 模式以及亿级消息生产者的优化,我们希望通过这些内容帮助开发者更加便捷地应对复杂的业务场景。

今天,我们将这些内容凝练成一个全新的 SpringBoot 插件——MultiKafkaStarter,旨在进一步降低开发者整合多 Kafka 数据源的门槛,提升系统的可维护性和扩展性。

核心特点

  • 无代码侵入:通过 SpringBoot 的自动配置机制,无需修改业务代码即可实现多 Kafka 数据源的整合。
  • 灵活配置:支持动态配置多个 Kafka 数据源,包括 bootstrap servers、group id、security protocol 等关键参数。
  • 全面特性支持:不仅支持基础的消息消费和生产功能,还提供了对 protobuf 序列化/反序列化的支持,以及对 Aware 模式的适配。
  • 亿级消息处理:针对高并发场景,提供了包括批量发送、分区策略优化等在内的多项性能优化措施,确保系统能够稳定处理亿级消息量。
  • 易用性与可维护性:插件采用模块化的设计思想,易于集成和升级,同时提供了丰富的文档和社区支持

国籍惯例,先上源码:Github源码

MultiKafkaStarter [V2.2]

SpringBoot 零代码方式整合多个kafka数据源,支持任意kafka集群,已封装为一个小模块,集成所有kafka配置,让注意力重新回归业务本身。

一、功能特性

  • SpringBoot无编程方式整合多个kafka数据源
  • 支持批量消费kafka并对单批次消息根据条件去重
  • 支持消费kafka消息类型为pb格式
  • 支持任意数量生产者

1、引入最新依赖包,如果找不到依赖包,请到工程目录mvn clean package install执行一下命令。

<dependency>
    <groupId>io.github.vipjoey</groupId>
    <artifactId>multi-kafka-starter</artifactId>
    <version>2.2</version>
</dependency>

二、快速开始(生产端)

2、添加kafka地址等相关配置。


## json消息生产者
spring.kafka.four.enabled=true
spring.kafka.four.producer.count=1 ## 生产者数量,默认为1个
spring.kafka.four.producer.name=fourKafkaSender  ## 设置bean的名称,方便后续引用。如果没有设置,默认值为xxxKafkaSender
spring.kafka.four.producer.bootstrap-servers=${spring.embedded.kafka.brokers} ## 必须设置
spring.kafka.four.producer.key-serializer=org.apache.kafka.common.serialization.StringSerializer
spring.kafka.four.producer.value-serializer=org.apache.kafka.common.serialization.StringSerializer

## pb 消息生产者
spring.kafka.five.enabled=true
spring.kafka.five.producer.name=fiveKafkaSender
spring.kafka.five.producer.bootstrap-servers=${spring.embedded.kafka.brokers}
spring.kafka.five.producer.key-serializer=org.apache.kafka.common.serialization.StringSerializer
spring.kafka.five.producer.value-serializer=org.apache.kafka.common.serialization.ByteArraySerializer

3、根据名称注入生产者MmcKafkaMultiSender,就可以发送kafka消息。


    @Resource(name = "fourKafkaSender")
    private MmcKafkaMultiSender mmcKafkaMultiSender;

    @Resource(name = "fiveKafkaSender")
    private MmcKafkaMultiSender mmcKafkaMultiSender;

    @Resource
    private MmcKafkaOutputContainer mmcKafkaOutputContainer;
    
    // 方式一
    void produceMessage() {

        for (int i = 0; i < 10; i++) {
    
            DemoAwareMsg msg = new DemoAwareMsg();
            msg.setRoutekey("routekey" + i);
            msg.setName("name" + i);
            msg.setTimestamp(System.currentTimeMillis());
        
            String json = JsonUtil.toJsonStr(msg);
        
            mmcKafkaMultiSender.sendStringMessage(topicOne, "aaa", json);
    
    
        }

    }
    
    // 方式二
    void produceMessage() {

            MmcKafkaSender sender = mmcKafkaOutputContainer.getOutputs().get("xxxKafkaSender");

            sender.sendStringMessage(topic, sku.getRoutekey(), message);
    }

三、快速开始(消费端)

2、添加kafka地址等相关配置。

## topic1的kafka配置
spring.kafka.one.enabled=true
spring.kafka.one.consumer.bootstrapServers=${spring.embedded.kafka.brokers}
spring.kafka.one.topic=mmc-topic-one
spring.kafka.one.group-id=group-consumer-one
spring.kafka.one.processor=你的处理类bean名称(例如:oneProcessor)
spring.kafka.one.dupicate=true   ## 如果为true表示对批次内的kafka消息去重,需要实现MmcKafkaMsg接口,默认为false
spring.kafka.one.consumer.auto-offset-reset=latest
spring.kafka.one.consumer.max-poll-records=10
spring.kafka.one.consumer.value-deserializer=org.apache.kafka.common.serialization.StringDeserializer
spring.kafka.one.consumer.key-deserializer=org.apache.kafka.common.serialization.StringDeserializer

## topic2的kafka配置
spring.kafka.two.enabled=true
spring.kafka.two.consumer.bootstrapServers=${spring.embedded.kafka.brokers}
spring.kafka.two.topic=mmc-topic-two
spring.kafka.two.group-id=group-consumer-two
spring.kafka.two.processor=你的处理类bean名称
spring.kafka.two.consumer.auto-offset-reset=latest
spring.kafka.two.consumer.max-poll-records=10
spring.kafka.two.consumer.value-deserializer=org.apache.kafka.common.serialization.StringDeserializer
spring.kafka.two.consumer.key-deserializer=org.apache.kafka.common.serialization.StringDeserializer

## protobuf类型的消息的kafka配置
spring.kafka.pb.enabled=true
spring.kafka.pb.consumer.bootstrapServers=${spring.embedded.kafka.brokers}
spring.kafka.pb.topic=mmc-topic-pb
spring.kafka.pb.group-id=group-consumer-pb
spring.kafka.pb.processor=pbProcessor
spring.kafka.pb.consumer.auto-offset-reset=latest
spring.kafka.pb.consumer.max-poll-records=10
spring.kafka.pb.consumer.key-deserializer=org.apache.kafka.common.serialization.StringDeserializer
spring.kafka.pb.consumer.value-deserializer=org.apache.kafka.common.serialization.ByteArrayDeserializer

3、新建kafka消息对应的实体类,可以选择实现MmcMsgDistinctAware接口,例如

@Data
class DemoMsg implements MmcMsgDistinctAware {

    private String routekey;

    private String name;

    private Long timestamp;

}

如果你配置了spring.kafka.xxx.duplicate=fale,则不需要实现MmcMsgDistinctAware接口。

        PS:如果实现MmcMsgDistinctAware接口,就自动具备了消息去重能力


4、新建kafka消息处理类,要求继承MmcKafkaKafkaAbastrctProcessor,然后就可以愉快地编写你的业务逻辑了。

@Slf4j
@Service("oneProcessor") // 你的处理类bean名称,如果没有定义bean名称,那么默认就是首字母缩写的类名称
public class OneProcessor extends MmcKafkaKafkaAbastrctProcessor<DemoMsg> {
    

    @Override
    protected void dealMessage(List<DemoMsg> datas) {

        // 下面开始编写你的业务代码
    }


}

@Slf4j
@Service("pbProcessor")
public class PbProcessor extends MmcKafkaKafkaAbastrctProcessor<DemoMsg> {

    @Override
    protected Stream<DemoMsg> doParseProtobuf(byte[] record) {


        try {

            DemoPb.PbMsg msg = DemoPb.PbMsg.parseFrom(record);
            DemoMsg demo = new DemoMsg();
            BeanUtils.copyProperties(msg, demo);

            return Stream.of(demo);

        } catch (InvalidProtocolBufferException e) {

            log.error("parssPbError", e);
            return Stream.empty();
        }

    }

    @Override
    protected void dealMessage(List<DemoMsg> datas) {

        System.out.println("PBdatas: " + datas);

    }
}


四、其它特性

1、支持单次拉取kafka的batch消息里去重,需要实现MmcMsgDistinctAware的getRoutekey()和getTimestamp()方法;如果为false,则不要实现MmcMsgDistinctAware接口。

spring.kafka.xxx.duplicate=true

2、支持字符串kafka消息,json是驼峰或者下划线

# 默认为支持驼峰的kafka消息,为ture则支持下划线的消息
spring.kafka.xxx.snakeCase=false

3、支持pb的kafka消息,需要自行重写父类的doParseProtobuf方法;

    @Override
    protected Stream<DemoMsg> doParseProtobuf(byte[] record) {
    
            try {
    
                DemoMsg msg = new DemoMsg();
                DemoPb.PbMsg pb = DemoPb.PbMsg.parseFrom(record);
                BeanUtils.copyProperties(pb, msg);
        
                return Stream.of(msg);
        
                } catch (InvalidProtocolBufferException e) {
        
                log.error("doParseProtobuf error: {}", e.getMessage());
        
                return Stream.empty();
            }

        }

4、支持获取kafka的topic、offset属性,注入到实体类中,需要实现MmcMsgKafkaAware接口

@Data
class DemoAwareMsg implements MmcKafkaAware {
    
    private String routekey;

    private String name;

    private Long timestamp;

    private String topic;

    private long offset;

}


五、变更记录

  • 20240623 v2.2 支持Kafka生产者,并对MultiKafkaConsumerStarter项目重命名为MultiKafkaStarter
  • 20240602 v2.1 支持获取kafka消息中topic、offset属性
  • 20240602 v2.0 支持protobuf、json格式
  • 20240430 v1.1 取消限定符
  • 20231111 v1.0 初始化

六、参考文章

加我加群一起交流学习!更多干货下载、项目源码和大厂内推等着你

SpringBoot配置kafka配置 有几个就配置几个 ,这里只配置两个。 阅读详情

相关推荐

React Vue Next.js Nuxt 底层原理与全栈能力对比

现代前端开发已超越单一框架语法学习,进入以组件化、响应式、虚拟DOM、SSR/SSG、客户端水合(Hydration)为核心的范式统一阶段。理解这些基础概念,是掌握React声明式UI哲学、Vue响应式系统(Proxy实现)、Next.js约定优于配置的服务端能力、Nuxt生态整合机制的前提。技术价值在于打破框架壁垒,实现跨栈协同与微前端集成;典型应用场景包括新闻聚合类SSR+SSE实时页面、企业级后台系统(Vue+Element Plus+C#)、AI Agent工作流编排等。本文聚焦四大框架共性内核与差

an4455的博客 371

springboot整合kafka数据源

在很与第三方公司对接的时候,或者处在不同的网络环境下,比如在互联网和政务外网的分布部署服务的时候,我们需要对接kafka来达到我们的业务需求,那么当kafka存在数据源的情况,就与单机的情况有所不同。 配置 单机的情况 如果是单机的kafka我们直接通过springboot自动配置的就可以使用,例如在yml里面直接引用 在使用的时候直接注入,然后就可以使用里面的方法了 数据源情况下本篇文章主要讲的是在数据源下的使用,和单机的有所不同,我也看了网上的一些博客,但是当我去按照网上的配置的时候,总是会

weixin_56227932的博客 1613

重启和查看Kafka Connector插件版本

重启和查看Kafka Connector插件版本Kafka Connect是Apache Kafka的一个关键组件,用于在Kafka和外部系统之间进行可靠的数据传输。Kafka Connect提供了一个可扩展的插件框架,允许用户开发和使用各种连接器来实现与不同外部系统的集成。在使用Kafka Connect时,经常需要重启连接器或查看其插件版本。本文将介绍如何在大数据环境中重启和查看Kafka Connect连接器的插件版本。

AlianBlank的博客 474

搭建大型分布式服务(二十二)SpringBoot 如何优雅地整合kafka数据源

系列文章目录 文章目录系列文章目录前言一、本文要点二、开发环境三、创建项目四、修改项目五、测试一下六、小结 前言 在日常开发当中,经常会遇到需要消费的topic不在同一个kafka集群内,这时候需要配置数据源,如何优雅地完成这个配置呢? 一、本文要点 接前文,我们已经在项目里集成了kafka。本文将介绍如何优雅地整合kafka数据源。系列文章完整目录 springboot 整合kafka数据源 springboot 整合个消费者topic kafka listener 配置f

hanyi_的专栏 2888

springbootkafka配置

【代码】springbootkafka配置。

小流慢影 5287

搭建大型分布式服务(一)开篇

本系列文章将一步一步介绍如果搭建一个大型分布式服务系统,从零开始介绍搭建、开发、测试、部署、维护等一系列过程,每周一更,欢迎关注留言,交流学习。 先挂个图,至少包含以下知识,持续更新。。。 ........................

hanyi_的专栏 2990

SpringBoot框架篇】4.集成jta-atomikos实现分布式事务

springboot集成jta-atomikos实现分布式事务简介引入依赖修改配置文件添加配置读取类创建数据源,管理事务数据持久化数据库DLL文件模拟事务回滚 简介 1.分布式事务 说到分布式事务,可以理解为,由于分布式而引起的事务不一致的问题。随着项目做大,模块拆分,数据库拆分。一次包含增删改操作数据库涉及到了更新两个不同物理节点的数据库,这样的数据库事务只能保证自己处理的部分的事务,但是整个...

皓亮君的博客 6113

SpringBoot框架篇】13.使用springboot admin对springboot应用进行监控

应用集成adminSpring Boot Admin 对springboot应用进行监控

皓亮君的博客 9133

SpringBoot框架篇】16.security整合jwt实现对前后端分离的项目进行权限认证

使用Spring Security+JWT实现对前后端分离的项目进行权限认证

皓亮君的博客 5633

SpringBoot框架篇】12.使用druid的monitor工具查看sql执行性能

使用druid的monitor工具查看sql执行性能

皓亮君的博客 8429

SpringBoot框架篇】30.使用sharding-jdbc实现读写分离和分库分表

ShardingSphere-JDBC 提供了 4 种配置方式,用于不同的使用场景。 通过配置,应用开发者可以灵活的使用数据分片、读写分离、数据加密、影子库等功能,并且能够叠加使用。

皓亮君的博客 2345

SpringBoot框架篇】28.使用JdbcTemplate操作数据库

使用JdbcTemplate操作数据库

皓亮君的博客 2351

SpringBoot 3.x 第268节】夯爆了,测试、观测、Starter 封装与生产级最佳实践(超详解)!

🏆本文收录于《滚雪球学SpringBoot 3.x》,专门攻坚指数提升,本年度国内最系统+最专业+最详细(永久更新)。

**My Coding Family** 1万+

面试八股题目

什么是 ThreadLocal全称(线程局部变量),功用非常简单,使用场合主要解决线程中数据因并发产生不一致问题。ThreadLocal 为每一个线程都提供了变量的副本,使得每个线程在某时间访问到的并不是同一个对象。这样就隔离了个线程对数据的数据共享,这样的结果是耗费了内存。但大大减少了线程同步所带来性能消耗,也减少了线程并发控制的复杂度。同一个线程内共享数据,线程之间数据隔离。注意:ThreadLocal 不能使用原子类型,只能使用 Object 类型。应用场景。

ah68356的博客 235

Spring Boot配置Kafka数据源

Spring Boot配置Kafka数据源

qq_45443475的博客 3655

搭建大型分布式服务(三十六)SpringBoot 零代码方式整合kafka数据源

让我们来看一下网上是怎样使用SpringBoot整合kafka数据源的,都存在哪些痛点?手撸kafka配置代码,各种硬编码,无法利用SpringBoot的约定大于配置的优势。当项目需要消费的topic,而且他们在不同集群时,需要不断地复制粘贴config和factory,如果项目需要5个不同集群的topic以上,那么这些代码将面临巨大维护压力,并且极其容易出错。假如来了个新业务,也是消费kafka,然后做一些业务逻辑处理,你会发现你不得不又搭建一个新工程,然后重复上述步骤,把代码和配置都复制粘贴一遍。

hanyi_的专栏 881

springboot配置kafka

kafka,说起这个玩意,大家应该都不陌生,不知道啥是kafka的直接去搜索 就像MySQL的使用一样,我们在用kafka的时候,也会碰到需要使用kafka的情况,比如我从kafkaA的一个topic里消费出数据,进行一次处理,然后我要写入到kafkaB的topic里,,从网上找了很配置kafka的教程,但是都不大好使,后来还是找到了,加上我自己改了点点东西,贴出来和大家分享一下~ 首先是pom文件,kafka的依赖 <dependency>

未知的希望,是我不灭的信仰 8220

基于Confluent Kafka部署Kafka Connect集群,Kafka Connect集群加载debezium插件

基于Confluent Kafka部署Kafka Connect集群,Kafka Connect集群加载debezium插件

zhengzaifeidelushang的博客 3227

基于JMeter 的KAFKA请求插件

基于网络开源代码开发的kafka采样器插件,可用于kafka写消息测试,特别是配合先发送java请求,再参数传递往kafka写消息 jmeter是一款使用广泛的测试软件, 为了支持复杂的业务场景(先发送java请求,再写kafka),避免种测试工具来回切换,故开发了此KAFKA插件。 以下展示JMeter Kafka Sampler使用示例: 1.使用前准备   `安装JDK...

deng_xintao的博客 3796
上一篇: 搭建大型分布式服务(四十一)SpringBoot 整合多个kafka数据源-支持亿级消息生产者
下一篇: 搭建大型分布式服务(四十三)SpringBoot 无代码侵入实现多Kafka数据源发布到Maven中央仓库:让世界看到你的作品!
hanyi_
博客等级 码龄15年 438粉丝 75原创
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值