| name | Kafka Topic Designer |
| description | Designs and optimizes Apache Kafka topics and configurations |
| version | 1.0.0 |
| category | Streaming |
| skillId | SK-DEA-007 |
| allowed-tools | ["Read","Write","Edit","Glob","Grep","Bash"] |
| graph | {"domains":["domain:data-engineering"],"specializations":["specialization:data-engineering-analytics"],"skillAreas":["skill-area:messaging-queuing","skill-area:streaming-realtime-processing"],"roles":["role:data-engineer","role:analytics-engineer"],"workflows":["workflow:data-pipeline-deployment"],"topics":["topic:event-sourcing","topic:event-driven-architecture"]} |
Kafka Topic Designer
Overview
Designs and optimizes Apache Kafka topics and configurations. This skill provides expertise in topic architecture, partitioning strategies, and producer/consumer configuration for optimal streaming performance.
Capabilities
- Topic naming convention design
- Partition strategy optimization
- Replication factor recommendations
- Retention policy configuration
- Compaction strategy design
- Schema registry integration
- Consumer group design
- Throughput capacity planning
- Security configuration (ACLs, encryption)
Input Schema
{
"requirements": {
"throughputMBps": "number",
"messageSize": "number",
"retentionDays": "number",
"orderingRequirements": "string"
},
"existingTopics": ["object"],
"clusterConfig": "object"
}
Output Schema
{
"topicDesign": {
"name": "string",
"partitions": "number",
"replicationFactor": "number",
"configs": "object"
},
"schemaDefinition": "object",
"producerConfig": "object",
"consumerConfig": "object"
}
Target Processes
- Streaming Pipeline
- ETL/ELT Pipeline (CDC)
- Feature Store Setup
Usage Guidelines
- Define throughput and latency requirements
- Specify message size and retention needs
- Document ordering requirements (per-partition, global)
- Include existing topic configurations for consistency
Best Practices
- Use consistent naming conventions across all topics
- Size partitions based on consumer parallelism needs
- Configure appropriate retention for compliance and replay scenarios
- Implement schema registry for schema evolution
- Set up proper ACLs for security