Arena — 100 Claudes compiten en un torneo y se queda la mejor respuesta
Una skill gratis para Claude Code que, cuando una respuesta no te convence, no la repite: monta un torneo. Lanza 100 subagentes con la misma tarea y una estrategia distinta cada uno, se emparejan, se atacan y se corrigen, un juez puntúa y van cayendo hasta que queda una sola respuesta. Ojo: la skill es gratis, pero las 595 llamadas del torneo de 100 las pagas tú en tokens.
Revisada el 2026-10-05
- Popularidad
- 258
- Licencia
- MIT
- Autor
- Jake Schincariol (opusjake.ai)
- Categoría
- Automatización y agentes
Seguridad: revisada
El contenido es seguro; el instalador o el servicio externo no se auditan aquí.
¿Qué es?
Arena es una skill para Claude Code que se usa cuando la respuesta que te han dado no te convence. En vez de decir «hazlo otra vez» a ver si hay suerte, escribes /arena y monta un torneo:
- lanza 100 subagentes (versiones de Claude trabajando a la vez) con la misma tarea, palabra por palabra;
- a cada uno le da una tarjeta distinta: una forma de razonar, un método de trabajo y una estrategia (hay 2.160 tarjetas posibles y no repite ninguna);
- se emparejan, y cada uno ataca la solución del otro (qué está mal, qué requisito se ha saltado, con qué entrada se rompe), se defiende y la reescribe;
- un juez (también Claude) lee las dos, comprueba cada ataque y puntúa con una rúbrica escrita: corrección 30, completa 25, aguanta los ataques 20, concreción 15, claridad 10;
- el que pierde se va: 100 → 50 → 25 → 13 → 7 → 4 → 2 → 1.
Al terminar te da la respuesta que sobrevivió, los ataques que aguantó y en cuántas rondas. Y si partías de una respuesta que rechazaste, un último juez compara las dos a ciegas (y te dice si la tuya era mejor).
⚠️ Un detalle que el vídeo no aclara: son 100 subagentes del MISMO modelo, no 100 inteligencias artificiales distintas. Lo que los diferencia es la tarjeta (su estrategia), no el modelo.
¿Cuándo me sirve?
Cuando una respuesta te da rabia pero no sabes explicar por qué: un titular, un plan para una semana que tienes liada, un texto difícil, una decisión con muchos criterios o un problema de código que no acaba de arreglarse.
En lugar de dar vueltas («hazlo otra vez», «no, así no»), pones a competir versiones y te quedas con la que aguanta todos los ataques. El propio autor lo dice claro: no arregla una tarea mal definida. Si pides algo vago, salen 100 vaguedades.
¿Esto me sirve a mí?
Si estás empezando, es una herramienta para el día que ya uses Claude Code y te topes con una respuesta floja en algo que importa (no para preguntar la hora: cuesta tokens).
También es una manera estupenda de aprender a mejorar una respuesta: ver los ataques que aguantó, y la rúbrica con la que se puntúa, enseña a criticar tu propio trabajo aunque luego no uses el torneo.
Casos de uso
- Un titular o un texto que no acaba de convencer (la web, el correo, la publicación).
- Un plan con poco tiempo: «tengo 6 horas al día esta semana».
- Una decisión con varios criterios y opciones que se parecen.
- Un fallo de código cabezota:
/arena --agents 32 arregla este test que falla. - Revisar un texto importante antes de mandarlo, con 16 competidores (
--quick) para no dispararte el gasto.
Cómo se instala
Necesita Claude Code y Python 3.8 o más nuevo (no hay nada que instalar con pip).
- Lo más fácil: pídeselo a Claude tal cual:
https://github.com/Jakeschincariol/arena-skill
Instala esta skill y confirma que /arena funciona.- O copiando la carpeta (si quieres que se llame
/arenay no/arena-skill:arena):
git clone https://github.com/Jakeschincariol/arena-skill.git
cp -r arena-skill/skills/arena ~/.claude/skills/- O como plugin (entonces se llama
/arena-skill:arena):
/plugin marketplace add Jakeschincariol/arena-skill
/plugin install arena-skill@arena-skill- Y a usarlo:
/arena # el torneo completo (100 competidores)
/arena --quick escribe el titular de la web # 16 competidores: el ajuste del día a día
/arena --agents 32 arregla el test que falla # tú eliges cuántos(--seed 7 repite las mismas tarjetas y el mismo cuadro; --wave cambia cuántos van por tanda.)
⚠️ Lo que hay que saber antes
El vídeo termina con «comenta ARENA y te mando el enlace». No hace falta comentar nada: el repositorio es público, gratis y con licencia MIT.
- Gratis no es lo mismo que barato. La skill no cuesta nada, pero los tokens los pagas tú, y 100 agentes son muchos. La cuenta que da el propio proyecto:
Esta tabla se desliza: arrástrala con el dedo para ver las columnas que faltan.
| Competidores | Rondas | Llamadas a subagentes |
|---|---|---|
| 100 (por defecto) | 7 | 595 |
| 64 | 6 | 379 |
| 32 | 5 | 187 |
16 (--quick) | 4 | 91 |
| 8 | 3 | 43 |
Su recomendación: --quick (16) para el día a día y el torneo de 100 para la respuesta que de verdad importa.
- Tarda. Claude Code no lanza 100 cosas a la vez (su límite por defecto son 10), así que el torneo va por tandas de 10: el de 100 agentes son 70 tandas.
- Te va a pedir permisos. Cada subagente escribe un fichero dentro de
.arena/; si no lo pones en modo «aceptar cambios», sale una pregunta por fichero. - No toca tu proyecto: los cambios vienen dentro de la respuesta ganadora y los aplicas tú (la skill pregunta).
- Los subagentes no ven tu conversación: solo un fichero con la tarea. Si falta un requisito, se le pierde a los 100. Está en
.arena/<carrera>/task.mdpara que lo revises. - El ganador es la mejor respuesta que encontró ese torneo, no una prueba de que sea correcta. Lo dice el propio proyecto, y por eso te enseña los ataques que aguantó.
- Es nuevo y de una sola persona: creado el 27/09/2026, 258 estrellas, autor Jake Schincariol (opusjake.ai). Es corto y se puede leer entero (SKILL.md,
bracket.py, la rúbrica y las estrategias), y trae pruebas.
¿Es segura?
Es una skill de texto: no instala programas, no se conecta a ningún servicio y no pide claves (todo va con tu Claude). Lo único que escribe es su carpeta .arena/ dentro de tu proyecto, y no toca tus archivos: los cambios vienen dentro de la respuesta que gana.
Los matices son de coste y de origen, no de seguridad: lanza cientos de llamadas (tokens tuyos) y el proyecto es nuevo y de un solo autor, así que conviene mirar qué instala antes de darle vía libre.
Limpia*, con matices: el contenido es seguro; el instalador y el servicio externo (el modelo o la web de la que sale) no se auditan aquí.