Dime qué necesitas.
No hace falta saber cómo se llama nada. Escribe lo que quieres hacer con tus palabras y te digo qué te sirve.
37 resultados para «vision»
Skill — Productividad y negocio
Charlie CFO (EveryInc)
Un asesor financiero (CFO) para tu IA, centrado en startups que crecen sin inversores: calcular cuánto dinero te queda (runway), si un gasto merece la pena, tus métricas clave (LTV/CAC), previsiones de caja y disciplina de capital. Se activa solo cuando preguntas cosas de dinero.
Plugin — Automatización y agentes
AgentSys — Automatizar todo lo que rodea al código
AgentSys es un sistema modular para automatizar lo que rodea al código: 24 plugins, 49 agentes y 44 skills (revisión, CI, documentación, seguridad, pruebas...). Es el instalador y orquestador; los plugins viven en repos aparte. "La IA escribe el código; esto automatiza el resto."
Novedad — General
DeepSeek V4.1 Flash: visión, contexto enorme y al frente de su API
DeepSeek (China) ha lanzado V4.1 Flash, un modelo ligero y de pesos abiertos que entiende imágenes, admite hasta un millón de tokens de contexto y cuesta bastante menos que los grandes de EE.UU. La empresa lo ha puesto al frente de su servicio para programadores y jubila su V4 Pro, porque este rinde mejor y sale más económico.
Skill — Programación
Agent Skills (Addy Osmani)
25 skills de ingeniería de nivel producción para cubrir todo el ciclo de desarrollo: definir → planificar → construir → verificar → revisar → publicar. Encapsula las buenas prácticas de Google para que tu IA no se salte pasos.
Skill — Programación
gstack (Garry Tan)
Convierte tu IA en un equipo de ingeniería virtual completo: un CEO, un diseñador, un jefe de ingeniería, QA, seguridad y un ingeniero de despliegue. Cubre todo el ciclo de un proyecto: pensar → planificar → construir → revisar → probar → publicar → reflexionar.
Skill — Programación
Skills for Real Engineers (Matt Pocock)
Skills de ingeniería de software seria (no "vibe coding"): ayudan a tu IA a preguntarte antes de programar, escribir pruebas, depurar con método y cuidar la arquitectura. Son pequeñas, fáciles de adaptar y funcionan con cualquier modelo.
Skill — Programación
Superpowers
Es una metodología de trabajo para programar con IA: obliga a tu asistente a planificar, escribir pruebas y revisar antes de programar. Convierte a la IA en un equipo de desarrollo ordenado en vez de una máquina que escribe código a lo loco.
Skill — Gestión de skills
pstack: reglas de trabajo serias para que tu agente no se salte pasos
pstack es un conjunto de reglas de trabajo para que tu agente de código actúe con orden y rigor: primero planifica, luego comprueba lo que hace y al final revisa la calidad antes de dar algo por terminado. Está pensado para que no se salte pasos ni te entregue cosas a medias. Va con Claude Code, Codex, Copilot, Gemini y otros. Es gratis y de código abierto.
Modelo — Texto y razonamiento
Nex-N2.5 — El modelo chino que tiene versión gratis en OpenRouter
Nex-N2.5 es la familia de modelos de la empresa china Nex-AGI, hecha para tareas de agente: mirar la pantalla, manejar el navegador, programar y comprobar por sí misma si lo que ha hecho funciona. Tiene tres tamaños (mini, Pro y Max), hasta 262.000 tokens de contexto y una versión gratis en OpenRouter, pero con tope: 20 peticiones por minuto y 50 al día. En calidad va por detrás de Claude y de GPT; su fuerte es el precio.
Programa — Equipos de agentes
Genie: le cuentas la idea y te devuelve el trabajo hecho y revisado
Genie es un ayudante de terminal que primero te hace preguntas, luego planifica el trabajo, reparte varias IAs en paralelo (cada una en su copia del proyecto) y revisa el resultado antes de enseñártelo. Al final te queda un cambio listo para que lo apruebes. Es gratis y de código abierto.
Skill — Programación
Security Skills (UnitOneAI)
45 skills de ciberseguridad respaldadas por marcos reales (OWASP, NIST, MITRE ATT&CK, CIS). Cubren revisión de código, APIs, nube, identidad, cumplimiento, incidentes y seguridad de IA (prompt injection, LLM). Incluye protección anti-inyección en las propias skills.
Modelo — Texto y razonamiento
Phi (Microsoft) — Pequeños que rinden mucho
Phi es la familia de modelos pequeños de Microsoft: la idea es que un modelo diminuto (que cabe en tu PC o móvil) haga una tarea concreta casi tan bien como uno gigante. Su gama llega a Phi-4 (con versión de razonamiento y visión) y Phi-5. Son ligeros, abiertos (MIT) y gratis. Ideales para clasificar, resumir o extraer datos en tu equipo.
Novedad — Modelos
OpenBMB sube MiniCPM-V 4.7 sin ficha, sin licencia y sin pruebas
El laboratorio chino OpenBMB publicó la noche del 6 de octubre un modelo de visión y lenguaje de 35.000 millones de parámetros (35B-A3B) en Hugging Face, y lo hizo sin tarjeta de modelo, sin licencia y sin ninguna tabla de resultados. Solo hay 16 trozos de pesos, 70,4 GB. La configuración sí cuenta lo importante: mezcla de expertos derivada de Qwen3.5, 256 expertos de los que activa 8 por palabra, contexto de 256.000 tokens y una atención híbrida que combina tres capas lineales por cada una completa. Al no declarar licencia, el repositorio queda por defecto con todos los derechos reservados, así que conviene esperar antes de construir sobre él.
Skill — Diseño
Accessibility Agents — Haz tu web accesible (WCAG 2.2)
Un paquete de 11 especialistas en accesibilidad para que tu IA no genere webs inaccesibles. Enseñan a cumplir las normas WCAG 2.2 AA: contraste, textos alternativos, navegación con teclado, formularios, ARIA... Es el hueco de la accesibilidad que faltaba. Funciona en Claude Code, Copilot, Codex, Gemini y Antigravity.
Skill — Legal y cumplimiento
Claude for Legal (Anthropic, oficial)
El paquete legal oficial de Anthropic: agentes y skills para los flujos jurídicos más comunes (revisar contratos, triar NDAs, cumplimiento de entidades, privacidad, propiedad intelectual, laboral, litigios, gobernanza de IA...). Cada plugin aprende tu forma de trabajar y todo resultado es un borrador para que lo revise un abogado.
Skill — Automatización y agentes
Claude Forge — Kit Profesional para Claude Code
Un kit profesional "todo en uno" para Claude Code: agentes, comandos, skills y 21 automatizaciones (hooks) que se ejecutan solas, más un sistema de verificación adversarial (un agente revisa el trabajo de otro) y un paquete de fiabilidad. Es "oh-my-zsh para Claude Code".
Skill — Productividad y negocio
Claude Office Skills — 136+ Skills de Oficina
Una navaja suiza de oficina para tu IA: más de 136 skills para trabajar con Excel, Word, PDF, PowerPoint, facturas, contratos, RRHH y finanzas. Además trae un servidor MCP con 39 herramientas (leer/escribir Excel, OCR de PDF, crear presentaciones...). "Sin configuración".
Skill — Legal y cumplimiento
Claude para Abogados (Derecho Español)
La adaptación al derecho español del paquete legal oficial de Anthropic: agentes, skills y conectores para los flujos jurídicos habituales en España (mercantil, laboral, fiscal, privacidad, protección de datos, procesal, consumo, familia...). Traducido al castellano y con áreas propias del ordenamiento español.
Skill — Diseño
drawio-skill — De texto a diagramas profesionales editables
Convierte una frase (o tu código, Terraform, SQL, OpenAPI...) en un diagrama profesional y editable de draw.io: arquitectura, UML, ERD, flujos, mapas mentales... La IA planea, dibuja, se comprueba con una captura y corrige solapes y etiquetas. Funciona en Claude Code, Cursor, Copilot, Codex, OpenCode y más.
Skill — Diseño
Impeccable
Es una herramienta de diseño para tu IA con 24 comandos (polish, audit, critique, bolder...) y un detector automático que caza los defectos típicos de las webs hechas por IA. Corrige lo que hace que todo se vea igual y genérico.
Skill — Automatización y agentes
metaswarm — Equipo de Agentes Coordinados
Un equipo de 18 agentes especializados (investigador, arquitecto, programador, auditor de seguridad...) que trabajan coordinados en un ciclo completo: investigar → planificar → diseñar → repartir el trabajo → ejecutar → revisar → publicar. Se auto-mejoran y trabajan en paralelo con controles de calidad obligatorios.
Skill — Legal y cumplimiento
rgpd-guard — Cumplimiento RGPD en tu Código
Una skill que vigila que tu código cumpla el RGPD (y la LOPDGDD española): revisa el proyecto al entrar y avisa de riesgos (datos personales en registros, falta de permisos, borrados indebidos, envíos a IA...). Va guiando mientras programas y tiene un agente que vigila cambios legales. Muy centrada en datos de salud.
Skill — Productividad y negocio
Startup Founder Skills (Shawn Pang)
50 skills que dan a tu IA el papel de "cofundador": estrategia de producto (MVP, PRD, hoja de ruta), buscar inversión, ventas y prospección, contratar equipo, operaciones, actualizaciones al consejo, SEO y hasta contratos y páginas legales. Todo lo que hace un fundador, repartido en fichas.
Skill — Diseño
UI UX Pro Max
Una skill de "inteligencia de diseño" que recomienda colores, tipografías, estilos y buenas prácticas para tu web o app, eligiendo según el tipo de negocio (spa, banco, gimnasio...).
Skill — Programación
Agents & Skills (wshobson)
Un mercado de plugins de ingeniería de software con 92 bloques instalables por separado (backend, bases de datos, seguridad, Kubernetes, IA...). Cada bloque carga solo lo suyo, así que no satura. Funciona en 7 asistentes.
Skill — Programación
ECC — 293 skills y 68 agentes para convertir tu agente en un equipo
El «sistema operativo» de tu agente de código: 293 skills, 68 agentes especializados, 94 comandos, reglas, hooks y memoria, todo en un mismo paquete de código abierto (MIT). Se instala con un comando y hace que tu agente planifique, escriba las pruebas antes del código, revise lo que ha hecho y busque fallos de seguridad. Para Claude Code, Codex, OpenCode, Cursor y más.
MCP — Productividad y Docs
Atlassian MCP (oficial) — Jira y Confluence, en la IA
Conector oficial de Atlassian (la empresa de Jira y Confluence). Le permite a tu IA buscar, crear y actualizar tareas de Jira, páginas de Confluence y más, siempre con tus mismos permisos. Ideal si en tu trabajo (o con clientes) usáis Jira. Riesgo medio porque puede escribir (crear tareas y páginas).
MCP — Código y GitHub
GitHub MCP Server (oficial)
El conector oficial de GitHub: permite a tu IA ver repositorios, gestionar issues, crear y revisar pull requests, buscar código y mirar el CI. Convierte a tu IA en un compañero de trabajo real en GitHub.
MCP — Código y GitHub
GitLab MCP — Repos, Issues y MRs
El conector más usado para GitLab (la alternativa a GitHub, muy usada en empresas): tu IA puede ver repositorios, gestionar issues y merge requests (MRs), mirar el CI y buscar código. Tiene modo solo lectura.
MCP — Redes y seguridad
nmap MCP — Escanea tu propia red (avanzado)
Conecta tu IA con nmap, el escáner de redes clásico. Sirve para auditar tu propia red: qué dispositivos hay, qué puertos tienen abiertos y qué servicios corren. Útil para detectar cosas que no deberían estar abiertas. Es avanzado y de riesgo medio, y el proyecto es pequeño (poco mantenido). Solo escanea tu propia red.
MCP — Núcleo y Sistema
Sequential Thinking (oficial)
Le da a tu IA una libreta para pensar paso a paso. En vez de responder de golpe, va razonando por etapas, puede corregirse y volver atrás. Mejora la calidad en problemas complicados o con muchos pasos.
Modelo — Texto y razonamiento
Mistral — El cerebro europeo (abierto y con RGPD)
Mistral es el cerebro europeo (Francia). Su bandera: ser abierto, barato y cumplir el RGPD (tus datos en Europa, algo que no ofrecen los gigantes americanos). Tiene de todo: Large 3 (el listo), Small 4 (abierto), Ministral (diminutos), y especialistas: Codestral (código), Magistral (razonar), Voxtral (voz). Ideal si te importa la privacidad europea o quieres modelos abiertos.
Modelo — Robótica (modelos de acción / VLA)
Helix 02 (Figure) — El cerebro que mueve un robot humanoide entero
Helix 02 es el «cerebro» con el que la empresa Figure AI mueve su robot humanoide (el Figure 03). No es un chatbot: es un modelo de acción, la clase de IA que mira lo que ve el robot y decide cómo mover cada articulación para hacer una tarea física, desde andar hasta coger un vaso. Une vista, lenguaje y movimiento en un solo sistema: le dices «recoge los platos» y el robot lo hace entero y solo. Está cerrado del todo: no se puede descargar, ni llamar por API, ni usar sin ser Figure.
Modelo — Robótica (modelos de acción / VLA)
Gemini Robotics 2 — El cerebro de Google para robots (solo por invitación)
Gemini Robotics 2 es el modelo de Google DeepMind que convierte lo que ve un robot y tus órdenes en movimientos. Es un modelo VLA, es decir, ve, entiende el lenguaje y decide acciones para que el robot se mueva. Controla brazos y humanoides enteros, con manos y pinzas muy precisas, y hasta coordina varios robots a la vez. Está cerrado: solo se puede usar por invitación, en fase de acceso anticipado («private preview»). No se descarga, no se vende y no hay precios públicos.
Modelo — Robótica (modelos de acción / VLA)
GR00T N1.7 — El cerebro de NVIDIA para robots, que puedes descargar gratis
GR00T N1.7 es el modelo de NVIDIA para dar cerebro a robots, sobre todo humanoides. Es un modelo VLA, es decir, ve por las cámaras, entiende órdenes en lenguaje normal y las convierte en movimientos para el robot. Es abierto: el código es Apache 2.0 y los pesos se descargan gratis bajo la licencia abierta de NVIDIA. Tiene 3.000 millones de parámetros. La pega: no es para el ordenador de casa. Para probarlo hace falta una GPU de 16 GB y para entrenarlo, 40 GB o más, y además hay que pedir acceso a otro modelo en Hugging Face.
Modelo — Robótica (modelos de acción / VLA)
π0.7 (pi-0.7) — El modelo que dobla la ropa con un robot que nunca lo había hecho (cerrado)
π0.7 es el modelo de Physical Intelligence (empresa de Estados Unidos) que convierte lo que ve un robot y tus órdenes en movimientos. Es un modelo VLA, es decir, ve, entiende el lenguaje y decide acciones para que el robot se mueva. Tiene unos 5.000 millones de parámetros. Lo llamativo: hace tareas nuevas sin entrenamiento previo, como doblar ropa en un robot que nunca lo había hecho, y acepta órdenes más ricas que un simple «haz esto». La pega gorda: está cerrado. Publicaron el estudio y los vídeos, no los pesos, así que no se puede descargar.
Novedad — General
OpenAI despide a tres investigadores de seguridad que avisaban de los riesgos
OpenAI ha despedido a tres de sus investigadores de seguridad (Tomek Korbak, Jasmine Wang y Mikita Balesni), a los que acusa de filtrar información sensible. Los tres eran conocidos por pedir públicamente que se frene el desarrollo de la IA; uno de ellos había avisado de que la IA podía ser peligrosa.