aws AWS Big Data Blog ·

Best Practices for Scaling Large Consumer Groups on Amazon MSK

blogdataawsengineer
patch

This post details best practices for managing large consumer groups on Amazon Managed Streaming for Apache Kafka (MSK), addressing `RecordTooLargeException` errors during rebalances caused by oversized internal metadata records. It explains how consumer group metadata grows and provides a formula to estimate its size. The guidance includes increasing topic-level size limits, splitting groups, right-sizing partitions, optimizing naming, and capacity planning. These strategies are crucial for maintaining stable operations when scaling Kafka consumer groups.

Maintenance (1)
  • Test the new protocol in a non-production environment before migrating production consumer groups
Read the original announcement →

https://aws.amazon.com/blogs/big-data/best-practices-for-scaling-large-consumer-groups-on-amazon-msk/

Related releases