
Claude Skills by Rahulchaube1
github.com/Rahulchaube1Saving and merging PEFT adapters back to base models.
Training INT4 quantized models with QLoRA adapters.
Designing reward models for reinforcement learning loops.
Executing reinforcement learning from human feedback loops.
Generating clean synthetic datasets for specific tasks.
Auto-generated specification module 16 for Training Tuning.
Auto-generated specification module 17 for Training Tuning.
Auto-generated specification module 18 for Training Tuning.
Auto-generated specification module 19 for Training Tuning.
Auto-generated specification module 20 for Training Tuning.
Auto-generated specification module 21 for Training Tuning.
Auto-generated specification module 22 for Training Tuning.
Auto-generated specification module 23 for Training Tuning.
Auto-generated specification module 24 for Training Tuning.
Auto-generated specification module 25 for Training Tuning.
Auto-generated specification module 26 for Training Tuning.
Auto-generated specification module 27 for Training Tuning.
Auto-generated specification module 28 for Training Tuning.
Auto-generated specification module 29 for Training Tuning.
Auto-generated specification module 30 for Training Tuning.
Auto-generated specification module 31 for Training Tuning.
Auto-generated specification module 32 for Training Tuning.
Auto-generated specification module 33 for Training Tuning.
Auto-generated specification module 34 for Training Tuning.
Auto-generated specification module 35 for Training Tuning.
Auto-generated specification module 36 for Training Tuning.
Auto-generated specification module 37 for Training Tuning.
Auto-generated specification module 38 for Training Tuning.
Auto-generated specification module 39 for Training Tuning.
Auto-generated specification module 40 for Training Tuning.
Auto-generated specification module 41 for Training Tuning.
Auto-generated specification module 42 for Training Tuning.
Auto-generated specification module 43 for Training Tuning.
Auto-generated specification module 44 for Training Tuning.
Auto-generated specification module 45 for Training Tuning.
Auto-generated specification module 46 for Training Tuning.
Auto-generated specification module 47 for Training Tuning.
Auto-generated specification module 48 for Training Tuning.
Auto-generated specification module 49 for Training Tuning.
Auto-generated specification module 50 for Training Tuning.
Auto-generated specification module 51 for Training Tuning.
Auto-generated specification module 52 for Training Tuning.
Auto-generated specification module 53 for Training Tuning.
Auto-generated specification module 54 for Training Tuning.
Auto-generated specification module 55 for Training Tuning.
Pruning model weights to fit small GPU footprints.