Dime qué necesitas.
No hace falta saber cómo se llama nada. Escribe lo que quieres hacer con tus palabras y te digo qué te sirve.
40 resultados para «qwen-image»
Modelo — Imagen
Qwen-Image (Alibaba) — Modelo de imagen abierto, fuerte con texto
Qwen-Image es el modelo de imagen de Alibaba (la familia Qwen, que en el catálogo aparece para texto). Es abierto (se puede descargar) y de los mejores escribiendo texto dentro de la imagen (carteles, rótulos). También edita imágenes.
Modelo — Imagen
GPT Image (OpenAI) — El cerebro de dibujar y editar
GPT Image es el "cerebro de dibujar" de OpenAI (el mismo que genera imágenes dentro de ChatGPT). Su gama actual es GPT Image 2. Es de frontera y cerrado. Destaca en entender bien lo que le pides, escribir texto legible dentro de la imagen y editar fotos. Lo más fácil: usarlo desde ChatGPT, sin instalar nada.
Skill — Diseño
AI Image Generator (jezweb) — Dibujar con Gemini y OpenAI
Una skill que enseña a tu IA a generar imágenes con Gemini y OpenAI: qué modelo elegir en cada caso, cómo escribir buenos prompts (en 5 partes), cómo llamar a la API y cómo editar en varias rondas. Produce fotos, iconos, imágenes OG, pósters, infografías y fotos de producto.
MCP — Diseño y Frontend
MCP Image Generator — Dibujar con Gemini y OpenAI
Le da a tu IA el pincel: describe la imagen (o una edición) y la genera de verdad, guardándola en tu carpeta de proyecto. Su truco: mejora el prompt solo (añade luz, encuadre, detalle) antes de enviarlo al modelo, así sales mejor de lo que pediste. Funciona con Gemini, OpenAI y Seedream.
Modelo — Texto y razonamiento
Qwen (Alibaba) — El cerebro abierto y multilingüe
Qwen (se pronuncia "chuen") es la familia de Alibaba y la más completa del mundo abierto: tiene modelos desde 0,6 mil millones hasta más de 2 billones de parámetros, casi todos abiertos (Apache 2.0) y gratis de usar. Especialista en idiomas (más de 200) y en correr en tu propio PC. Su gama 2026: Qwen3.5 (397B abierto), Plus y Flash. Ideal si quieres modelos abiertos, gratis y locales.
Programa — Todo-en-uno
Qwen Code (oficial de Alibaba) — El agente de terminal de código abierto de Qwen
El agente de código abierto oficial de Qwen (Alibaba) para la terminal. Muy completo: trae memoria automática, skills automáticas, subagentes y equipos de agentes, y funciona con muchos modelos (no te ata a Qwen). Su pega en 2026: ya no tiene plan gratis en la nube — para gastar 0 € tienes que usar un modelo local.
Plugin — Diseño
Claude Image Generation (hex) — Genera y edita imágenes con 4 proveedores
Un plugin para Claude Code que añade un comando /generate-image para crear y editar imágenes con cuatro proveedores (Gemini, OpenAI, xAI y OpenRouter). Puede generar en paralelo con todos y mostrar las imágenes en la propia terminal.
Modelo — Imagen
Grok Imagine (xAI) — Imagen y vídeo desde Grok
Grok Imagine es la herramienta de imagen y vídeo de xAI (la empresa de Grok, en X). Crea imágenes y también vídeos desde una descripción. Es cerrado, pero se usa dentro de Grok/X (con límites gratis). En el catálogo, grok es el de texto; este es el de crear imágenes/vídeo.
Modelo — Imagen
Ideogram — El cerebro que escribe dentro de la imagen
Ideogram nació con una idea: la IA dibuja fatal el texto dentro de las imágenes. Y lo resolvió. Hoy es el mejor escribiendo letras legibles (carteles, logos, infografías, portadas), con ~90% de acierto frente al ~30% de otras. Es equilibrado y cerrado, con plan gratis (10 imágenes/día) y planes baratos. Ideal para gráficos con palabras.
Modelo — Imagen
Nano Banana (Google) — El que entiende y edita imágenes
Nano Banana es el modelo de imagen de Google (por dentro se llama Gemini Image). Su nombre es un apodo que se hizo viral. Lo bueno: no solo dibuja, también entiende la imagen (razona sobre ella) y la edita conversando ("cámbiale el fondo", "quítale las gafas"). Va incluido en Gemini. Es frontera y cerrado, con capa gratis. De los mejores y más fáciles.
Novedad — Cerebros
OpenAI lanza ChatGPT Images 2.5 (más nítidas y hasta 50% más rápidas)
OpenAI presentó ChatGPT Images 2.5 el 8 de septiembre de 2026: más detalle, edición más precisa y hasta 50% menos de espera. En la API llegan GPT-Image-2.5 Flare (la opción por defecto) y Sunburst (máxima precisión).
Novedad — Cerebros
Google retira Imagen — ahora su modelo de imagen es Nano Banana
Google apagó Imagen (su antiguo generador de imágenes) el 17 de agosto de 2026. Su modelo de imagen actual es Nano Banana (Gemini Image), que además de generar, entiende y edita imágenes conversando.
MCP — Datos e IA
Pollinations MCP (oficial) — Imagen, vídeo, audio y 3D
El servidor MCP oficial de Pollinations, una plataforma gratuita y de código abierto para generar imagen, vídeo, audio y modelos 3D. En vez de instalarlo, conectas tu IA a una URL y le das tu clave: desde ahí puede dibujar y más, sin montar nada en tu ordenador.
MCP — Diseño y Frontend
Prompt to Asset — Imágenes y recursos de web, gratis
El conector de imágenes más pensado para montar una web y gratis de verdad: con una frase crea logos, favicons, iconos de app, imágenes para compartir (OG) e ilustraciones, y las genera por rutas sin coste (Cloudflare, NVIDIA, Hugging Face, Pollinations...) o en SVG sin conexión. No necesita clave de API para empezar.
MCP — Diseño y Frontend
Unsplash MCP — Imágenes Libres para tu Web
Le permite a tu IA buscar fotos en Unsplash (un banco de imágenes gratuitas) para ponerlas en tu web: encuentra la imagen y te da el enlace y el crédito. Cómodo para prototipos y webs con imágenes.
Modelo — Texto y razonamiento
Amazon Nova — Los cerebros de Amazon (texto, imagen y vídeo)
Amazon Nova son los "cerebros" de Amazon. Hay varios niveles (de baratos a potentes) para texto, y también para imagen (Nova Canvas) y vídeo (Nova Reel). Se usan desde Amazon Bedrock (su plataforma en la nube). Es cerrado, pero con capa gratis para probar.
Modelo — Imagen
FLUX (Black Forest Labs) — Calidad de frontera y abierto
FLUX es la familia de Black Forest Labs (creada por ex-ingenieros de Stability AI, los de Stable Diffusion). Su gran logro: calidad de frontera estando abierto. Con la versión FLUX.2 compite con GPT Image y Midjourney, y además puedes descargarlo y usarlo en tu PC. Ideal si quieres lo mejor sin depender de una nube.
Modelo — Imagen
Leonardo — Una caja con muchos modelos dentro
Leonardo (de Canva) ya no es "un modelo", sino una caja con muchos modelos dentro: los suyos (Lucid, Phoenix) y los de otros (Nano Banana Pro, Flux.2, Seedream, Veo, Kling...). Además te deja entrenar tu propio modelo con tus imágenes y hacer vídeo. Es equilibrado y cerrado, con capa gratis. Ideal para quien quiere probar muchos modelos desde un solo sitio.
Modelo — Imagen
Midjourney — El cerebro más artístico
Midjourney es el rey del arte y el fotorrealismo: sus imágenes son, de media, las más bonitas de todas. Es de frontera y cerrado. Su pega: no tiene plan gratis (desde 10 $/mes) y se cobra por tiempo de "GPU", no por número de imágenes. Ideal si lo que buscas es estética espectacular (y no tanto texto o precisión).
Modelo — Imagen
Stable Diffusion (Stability AI) — El rey de lo abierto
Stable Diffusion (de Stability AI) es el abuelo y el rey del "local": la primera gran IA de imágenes abierta, y la que más comunidad tiene. Con él, generas gratis en tu propio PC, sin límites y con control total (estilos, modelos afinados, LoRAs...). Sus modelos (SDXL, SD3.5) son abiertos. Ideal si quieres trastear, no pagar y tener privacidad.
Modelo — Texto y razonamiento
Gemini (Google) — El cerebro con memoria gigante
Gemini es el cerebro de Google. Su gran baza es una memoria gigante (hasta 2 millones de "tokens", como leer libros enteros de una vez) y que es multimodal (entiende texto, imágenes, vídeo y audio). Su gama 2026: 3.1 Pro (el listo), 3.8 Flash (equilibrado y barato) y Flash-Lite (el más barato). Es frontera y cerrado, con capa gratis.
Modelo — Texto y razonamiento
Grok (xAI) — El cerebro en tiempo real
Grok es el cerebro de xAI, la empresa de Elon Musk, y vive muy pegado a la red X (Twitter). Su gran baza es la información en tiempo real: puede mirar qué se dice ahora mismo en X. Su gama 2026: Grok 4.7 (el estrella). Es de frontera y cerrado, con capa gratis dentro de X, y tiene modelos propios de imagen, voz y vídeo.
Modelo — Imagen
Recraft — El que hace gráficos vectoriales editables
Recraft hace algo que casi nadie: generar gráficos vectoriales (SVG) editables, no solo fotos. Eso lo hace ideal para logos, iconos e ilustraciones que luego quieres escalar y retocar sin perder calidad. Su versión actual es V4.1 (con modo "Styles" para mantener el mismo estilo en toda la marca). Es equilibrado y cerrado, con plan gratis. Ideal para identidad visual y diseño.
Skill — Marketing
SEOmator SEO Audit
Una herramienta que audita cualquier web contra 332 reglas de SEO repartidas en 20 categorías (técnico, Core Web Vitals, schema, accesibilidad, seguridad, enlaces, imágenes, IA...). Devuelve un informe priorizado con una sugerencia de arreglo por cada problema.
Skill — Diseño
Taste Skill
Le da "buen gusto" a tu IA para que deje de hacer webs genéricas y aburridas. Mejora el diseño (estructura, tipografía, animaciones, espaciado) y también puede generar imágenes de referencia.
MCP — Web, Búsqueda e Investigación
Brave Search MCP (oficial) — Buscar y Buscar Local
El buscador oficial de Brave para IA: busca en web, noticias, imágenes, vídeos y también negocios y lugares locales. Con un enfoque privado (Brave no te perfila) y opción de resumen con IA.
MCP — Diseño y Frontend
ComfyUI MCP — Dibujo total en tu ordenador (Stable Diffusion / Flux)
Conecta tu IA con ComfyUI, el "taller" de Stable Diffusion/Flux que corre en tu propio ordenador. Así puedes dibujar (y crear vídeo/audio/3D) sin pagar por imagen y con total privacidad, porque nada sale de tu máquina. A cambio, es avanzado: hay que montar ComfyUI y tener una GPU decente.
MCP — Datos e IA
Hugging Face MCP (oficial) — IA y Modelos
Conector oficial de Hugging Face (la mayor comunidad de IA): buscar modelos y datasets, usar Spaces y apps de IA (generar imágenes, transcribir...) y explorar el Hub. Es la puerta de entrada a miles de herramientas de IA gratis.
MCP — Diseño y Frontend
mcpimg — Dibujar con muchos modelos desde un solo conector
Un conector de imagen multi-proveedor: con una sola herramienta puedes generar con openRouter, Together, Replicate o fal.ai, según la clave que tengas. Funciona en OpenCode, Claude Code y Cursor. Su punto débil: es un proyecto pequeño y sin licencia declarada.
MCP — Datos e IA
fal MCP (oficial) — Más de 1.000 modelos para dibujar y crear
El servidor MCP oficial de fal.ai: conectas tu IA a una URL y le das tu clave, y desde ahí puede buscar y ejecutar más de 1.000 modelos (Flux, SDXL, y modelos de vídeo, audio y 3D). La IA elige el modelo adecuado sola y lo lanza, con precios a la vista antes de gastar.
MCP — Diseño y Frontend
Excalidraw MCP — Que la IA dibuje diagramas de verdad
Le da a tu IA una pizarra (Excalidraw) de verdad: dibuja diagramas y esquemas editables, los ve con capturas, corrige lo que se solapa o no encaja y los guarda en tu proyecto. Es gratis, local y sin claves (no usa modelos de imagen, dibuja con formas y líneas).
MCP — Redes sociales
Instagram MCP — Publica y analiza tu Instagram Business
Un conector no oficial que une tu IA con Instagram a través de la API oficial de Meta (Graph API). Permite publicar imágenes/vídeos, leer comentarios y mensajes, y sacar métricas (insights) de una cuenta de Instagram Business o Creator. Es gratis, pero más técnico: hay que crear una app de Meta y sacar un token. Riesgo medio porque puede publicar y responder por ti.
Modelo — Vídeo
CogVideoX — Vídeo con IA, de código abierto
CogVideoX es un modelo de vídeo con IA de código abierto, creado por Zhipu AI con la universidad Tsinghua. Convierte texto (o una imagen) en un vídeo corto. La versión pequeña (2B) es Apache-2.0 y se puede descargar y usar en tu equipo.
Modelo — Texto y razonamiento
Doubao / Seed (ByteDance) — Barato y a lo grande
Doubao (la app) y Seed (los modelos) son de ByteDance, la dueña de TikTok. Su familia Seed 2.x es frontera y muy barata: compite con GPT/Gemini en muchas pruebas a una fracción del precio, y es multimodal (texto, imagen, voz, vídeo). Es cerrado. Ideal si quieres calidad a precio de saldo (y no te importa que sea chino).
Modelo — Texto y razonamiento
Gemma (Google) — Pequeño, abierto y para tu PC
Gemma es la familia abierta y pequeña de Google (hermana menor de Gemini). Su versión actual, Gemma 4, es multimodal (texto, imagen, vídeo, OCR y hasta audio en las versiones pequeñas) y está pensada para correr en tu PC o móvil. Es ligera y gratis. Ideal si quieres IA privada, sin pagar y en tu equipo.
Modelo — Texto y razonamiento
MiMo (Xiaomi) — El abierto que lidera y es omnimodal
MiMo es la familia de IA de Xiaomi (la del móvil). Su versión actual, MiMo-V2.6 (sep-2026), llegó a lo más alto de los rankings de modelos abiertos y es omnimodal: entiende texto, imagen, audio y vídeo de entrada, con 1M de contexto. Es frontera y abierto (MIT). Ideal para quien quiere lo mejor abierto y probar suerte autoalojándolo.
Modelo — Vídeo
Seedance (ByteDance) — El vídeo más completo
Seedance es el modelo de vídeo de ByteDance (TikTok). Su versión actual, Seedance 2.5 (ago-2026), es de las más completas: clips de hasta 30 segundos, audio integrado, y acepta muchas referencias (imagen, vídeo y audio) para mantener personajes y estilo. Lidera varios rankings. Es frontera y cerrado. Ideal para narración larga, anuncios y coherencia de personaje.
Novedad — Cerebros
Xiaomi abre MiMo-V2.6 — lo más alto en modelos abiertos
Xiaomi publicó el 22 de septiembre de 2026 su serie MiMo-V2.6 (Pro y Flash) con pesos abiertos (MIT). Es omnimodal (texto, imagen, audio y vídeo) y llegó a lo más alto del ranking de modelos abiertos.
Modelo — Vídeo
Wan (Alibaba) — El vídeo abierto que puedes autoalojar
Wan es el modelo de vídeo abierto de Alibaba, y es la gran excepción del sector: mientras casi todos los vídeos son cerrados, Wan publica sus pesos. Su versión actual es Wan 2.6: 1080p, audio sincronizado, multi-plano y hasta 15 segundos, con opción de referencias para mantener personajes. Es frontera y abierto. Ideal si quieres vídeo en tu propio equipo, gratis y privado.
Skill — Diseño
Accessibility Agents — Haz tu web accesible (WCAG 2.2)
Un paquete de 11 especialistas en accesibilidad para que tu IA no genere webs inaccesibles. Enseñan a cumplir las normas WCAG 2.2 AA: contraste, textos alternativos, navegación con teclado, formularios, ARIA... Es el hueco de la accesibilidad que faltaba. Funciona en Claude Code, Copilot, Codex, Gemini y Antigravity.