Document chunking with multiple strategies including semantic, recursive, and fixed-size chunking
Scanned 9/2/2026
Install to Claude Code
npx -y skills add a5c-ai/babysitter --skill rag-chunking-strategy --agent claude-codeInstalls into .claude/skills of the current project.
Are you the author of Rag Chunking Strategy?
Add the live security badge to your README — it updates automatically with every re-scan.
[](https://www.skillsdirectory.com/skills/a5c-ai-rag-chunking-strategy-babysitter)More formats (shields.io, HTML) on the badges page.
---
name: rag-chunking-strategy
description: Document chunking with multiple strategies including semantic, recursive, and fixed-size chunking
allowed-tools:
- Read
- Write
- Edit
- Bash
- Glob
- Grep
graph:
domains: [domain:software-engineering]
specializations: [specialization:ai-agents-conversational]
skillAreas: [skill-area:retrieval-augmented-generation, skill-area:natural-language-processing]
roles: [role:ml-engineer, role:backend-engineer]
workflows: [workflow:ml-model-lifecycle, workflow:feature-development]
---
# RAG Chunking Strategy Skill
## Capabilities
- Implement multiple document chunking strategies
- Configure semantic chunking based on content boundaries
- Set up recursive character text splitting
- Design fixed-size chunking with overlap
- Implement document-aware chunking (markdown, code, etc.)
- Optimize chunk sizes for retrieval quality
## Target Processes
- rag-pipeline-implementation
- chunking-strategy-design
## Implementation Details
### Chunking Strategies
1. **RecursiveCharacterTextSplitter**: Hierarchical splitting with separators
2. **SemanticChunker**: Embedding-based semantic boundaries
3. **TokenTextSplitter**: Token-aware splitting
4. **MarkdownHeaderTextSplitter**: Structure-aware markdown splitting
5. **CodeSplitter**: Language-aware code chunking
### Configuration Options
- Chunk size (characters or tokens)
- Chunk overlap percentage
- Separator hierarchy
- Embedding model for semantic chunking
- Document type detection
### Best Practices
- Match chunk size to embedding model limits
- Use appropriate overlap for context preservation
- Test retrieval quality with different strategies
- Consider document structure in strategy selection
### Dependencies
- langchain-text-splitters
- sentence-transformers (for semantic chunking)
Is this your skill, or is something wrong with this listing? Request removal or report an issue. Author removals are honored within 72 hours.
No comments yet. Be the first to comment!