Skills DirectorySkills Directory
SkillsLearnSecurityCategoriesDocsCommunityBlog
Sign InSubmit Skill
Skills Directory

Security-tested agent skills for Claude, coding agents, and AI workflows.

Directory

  • Browse Skills
  • All Skills A–Z
  • Claude Skills
  • Claude Code Skills
  • Agent Skills
  • Categories
  • Submit a Skill

Learn

  • Learn Hub
  • Install Claude Skills
  • Write SKILL.md
  • Skills vs MCP
  • Directories Compared

Security

  • Security
  • Methodology
  • Secure Claude Skills
  • Security Badges

Company

  • About
  • Community
  • Blog
  • API Docs
  • Advertise

2026 Skills Directory. All rights reserved.

Back to skills

Self Improvement Ladder

ASecurity

Govern a self-improvement ladder B0-L5 for agent loops: experience bank, reusable repair procedures, structural-vs-effective gate, anti-benchmark-gaming. Use quando o loop deve melhorar sozinho, auditar autoaperfeiçoamento, decidir se recursão é estrutural ou efetiva. Triggers PT: escada de autoaperfeiçoamento, banco de experiências, recursão estrutural vs efetiva, benchmark gaming, melhorar o produtor. Triggers EN: self-improvement ladder, experience bank, structural vs effective recursion, ...

2 stars
0 votes
0 copies
0 views
Added 9/19/2026
ai-agentsgo

Security Analysis

A100/100

Scanned 9/19/2026

Install to Claude Code

$npx -y skills add majinmagros/magros.ai-skills --skill self-improvement-ladder --agent claude-code

Installs into .claude/skills of the current project.

Are you the author of Self Improvement Ladder?

Add the live security badge to your README — it updates automatically with every re-scan.

Security grade badge for Self Improvement Ladder
[![Security: A — Skills Directory](https://www.skillsdirectory.com/api/skills/majinmagros-self-improvement-ladder/badge)](https://www.skillsdirectory.com/skills/majinmagros-self-improvement-ladder)

More formats (shields.io, HTML) on the badges page.

Download Zip
Files
SKILL.md
---
name: self-improvement-ladder
description: Govern a self-improvement ladder B0-L5 for agent loops: experience bank, reusable repair procedures, structural-vs-effective gate, anti-benchmark-gaming. Use quando o loop deve melhorar sozinho, auditar autoaperfeiçoamento, decidir se recursão é estrutural ou efetiva. Triggers PT: escada de autoaperfeiçoamento, banco de experiências, recursão estrutural vs efetiva, benchmark gaming, melhorar o produtor. Triggers EN: self-improvement ladder, experience bank, structural vs effective recursion, anti benchmark gaming, improve the producer.
---

# Self-Improvement Ladder (B0–L5)

"The Last AI builds by Humans": audite em que degrau seu loop está, suba com persistência real — e prove que a recursão é efetiva, não só estrutural.

## Quando usar

- Loop que deveria "aprender sozinho" mas só repete os mesmos erros.
- Decidir investimento: melhorar o output ou melhorar o produtor do output.
- Auditar alegação de autoaperfeiçoamento / RSI antes de escalar ou publicar.
- NÃO é loop de skill única (`self-improving-skill`) nem instintos de sessão (`continuous-learning-v2`). Esta é a governança da escada.

## A escada B0–L5

- **B0 — manual:** humano opera tudo; nenhuma persistência entre runs.
- **L1 — memória episódica:** log append-only de runs (o que tentou, o que deu). Sem reuso.
- **L2 — banco de experiências:** episódios viram procedimentos de reparo reutilizáveis, com aprovação humana antes de entrar no banco. Busca por similaridade na próxima falha.
- **L3 — produtor evolui:** o loop reescreve a própria estratégia (prompts, ordem de tools, heurísticas) a partir do banco. Mudança versionada + rerun obrigatório.
- **L4 — recursão estrutural:** o sistema gera sub-sistemas que herdam o loop (fábrica de agentes com o mesmo ciclo). Ainda supervisionado.
- **L5 — recursão efetiva:** sub-sistemas melhoram o produtor sem humano no caminho. Exige todos os gates abaixo; alegar L5 sem eles é benchmark-gaming.

## Passos

1. **Classifique o degrau atual** — para seu loop, marque B0–L5 com evidência (onde mora a persistência? quem aprova a mudança? o produtor já mudou sozinho alguma vez?). Sem evidência, desça 1 degrau.
2. **Ache a persistência faltante** — o degrau mais comum de travar é L1→L2: falta memória procedimental. Adicione banco de experiências: `falha | contexto | reparo que funcionou | aprovação humana | data`. Sem aprovação, o banco vira lixeira.
3. **Adicione repair-procedures reutilizáveis** — cada entrada do banco vira procedimento testável (input → passos → verificação). Na próxima falha similar, o loop consulta antes de improvisar. Registre hit-rate do banco.
4. **Invista onde o gabarito é barato** — tese da verificabilidade: autoaperfeiçoamento só compõe onde o acerto é barato de checar (math, código com testes, cyber com sandbox). Em tool-use aberto e julgamento subjetivo, o loop aprende a trapacear o juiz — não suba a escada ali.
5. **Passe o gate estrutural≠efetivo** — antes de alegar o próximo degrau: a mudança melhorou o produtor (estratégia reutilizável) ou só o output desta run? Só o primeiro conta. Exija delta medido em benchmark travado, não em vibes.
6. **Bloqueie benchmark-gaming** — anti-patterns que invalidam a subida: seed-picking (escolher seed que passa), atalhos (resolver o teste, não a tarefa), evaluator-probing (sondar o juiz). Seeds fixas + juiz cego + tarefas held-out.

## Regras

- Melhore o produtor, não só o output. Output melhor sem estratégia reutilizável = L0 com maquiagem.
- Nenhum degrau sem persistência auditável: memória que não sobrevive ao restart não conta.
- Humano aprova entrada no banco (L2) e promoção de estratégia (L3+). Auto-promoção = deriva silenciosa.
- Recursão sem gate é rumor de RSI: alegação extraordinária exige benchmark travado + replicação.
- Se o gabarito é caro ou subjetivo, pare em L2 e opere bem — escada errada é pior que escada baixa.

## Related skills

- `self-improving-skill` — loop de melhoria por skill (degraus L1–L2 instanciados).
- `continuous-learning-v2` — instintos de sessão com promoção a regras.
- `closed-loop-verifier-pattern` — verificação runtime que ancora o gate.
- `knowledge-work-proxy-eval` — proxies duros para medir delta real entre degraus.

Attribution

majinmagrosmajinmagros
View sourceMore from majinmagros →
SSkills DirectorySkills Directory

Ship a skill? Prove it's safe.

Free 120-pattern security scan, letter grade, and an embeddable README badge.

Submit a skill

Is this your skill, or is something wrong with this listing? Request removal or report an issue. Author removals are honored within 72 hours.

Comments (0)

No comments yet. Be the first to comment!

SSkills DirectorySkills Directory

Ship a skill? Prove it's safe.

Free 120-pattern security scan, letter grade, and an embeddable README badge.

Submit a skill

Related Skills

Caveman

Ultra-compressed communication mode. Cuts token usage ~75% by speaking like caveman while keeping full technical accuracy. Supports intensity levels: lite, full (default), ultra, wenyan-lite, wenyan-full, wenyan-ultra. Use when user says "caveman mode", "talk like caveman", "use caveman", "less tokens", "be brief", or invokes /caveman. Also auto-triggers when token efficiency is requested.

1023331 votes

Hyperplan

Adversarial multi-agent planning skill. Self-orchestrates 5 hostile category members (unspecified-low, unspecified-high, deep, ultrabrain, artistry) via team-mode for ruthless cross-critique debate, distills only the defensible insights, then MANDATORILY hands the distilled insight bundle to the `plan` agent for executable plan formalization. Use when planning needs maximum rigor and surfacing of weak assumptions, blind spots, and over-engineering. Triggers: 'hyperplan', 'hpp', '/hyperplan', ...

686011 votes

Mcp Code Execution

Routes multi-tool workflows through MCP servers for large datasets and pipelines. Use when Bash tool overhead is limiting throughput on data-heavy tasks.

3331 votes

catchup

Recovers prior coding-agent session context by running `catchup <agent> --since-compact`, which extracts a clean summary of a previous Codex, Claude Code, Antigravity, OpenCode, or Pi Agent session. Use when the user says "catch up", "what did the last session do", "get me up to speed", "I switched agents", or asks to recover/summarize a previous session before continuing. Do NOT use for the current conversation, git history, or any non-agent log.

611 votes

math-skill

A comprehensive mathematical reasoning skill for AI assistants — handles arithmetic to research-level problems with rigorous step-by-step reasoning, systematic verification, and transparent uncertainty handling

381 votes
View all in ai-agents →