Dime qué necesitas.
No hace falta saber cómo se llama nada. Escribe lo que quieres hacer con tus palabras y te digo qué te sirve.
40 resultados para «multi-modelo»
MCP — Diseño y Frontend
mcpimg — Dibujar con muchos modelos desde un solo conector
Un conector de imagen multi-proveedor: con una sola herramienta puedes generar con openRouter, Together, Replicate o fal.ai, según la clave que tengas. Funciona en OpenCode, Claude Code y Cursor. Su punto débil: es un proyecto pequeño y sin licencia declarada.
Modelo — Texto y razonamiento
Hunyuan (Tencent) — Abierto, eficiente y multimodal
Hunyuan es la familia de Tencent (la del WeChat). Su serie Hy3 / Hy4 es abierta (Apache 2.0) y muy eficiente: un modelo enorme que solo "enciende" una parte pequeña al responder, así que gasta poco y da buen resultado en agentes y búsqueda con herramientas. Es equilibrado y abierto. Ideal si quieres buen rendimiento con poca máquina.
Modelo — Texto y razonamiento
Qwen (Alibaba) — El cerebro abierto y multilingüe
Qwen (se pronuncia "chuen") es la familia de Alibaba y la más completa del mundo abierto: tiene modelos desde 0,6 mil millones hasta más de 2 billones de parámetros, casi todos abiertos (Apache 2.0) y gratis de usar. Especialista en idiomas (más de 200) y en correr en tu propio PC. Su gama 2026: Qwen3.5 (397B abierto), Plus y Flash. Ideal si quieres modelos abiertos, gratis y locales.
MCP — Datos e IA
Hugging Face MCP (oficial) — IA y Modelos
Conector oficial de Hugging Face (la mayor comunidad de IA): buscar modelos y datasets, usar Spaces y apps de IA (generar imágenes, transcribir...) y explorar el Hub. Es la puerta de entrada a miles de herramientas de IA gratis.
Modelo — Imagen
Leonardo — Una caja con muchos modelos dentro
Leonardo (de Canva) ya no es "un modelo", sino una caja con muchos modelos dentro: los suyos (Lucid, Phoenix) y los de otros (Nano Banana Pro, Flux.2, Seedream, Veo, Kling...). Además te deja entrenar tu propio modelo con tus imágenes y hacer vídeo. Es equilibrado y cerrado, con capa gratis. Ideal para quien quiere probar muchos modelos desde un solo sitio.
Modelo — Vídeo
Higgsfield — La caja de vídeo con más de 30 modelos (de pago)
Higgsfield es una plataforma de vídeo e imagen con más de 30 modelos dentro (Sora 2, Kling 3.0, Veo 3.1, Seedance 2.5, Wan 2.6…) y herramientas propias de cine. Se paga: desde 15 $ al mes, y cada clip gasta créditos (~2,55 $ uno de 8 segundos con Seedance 2.5 en 720p). Ojo: no tiene prueba gratis — la capa gratis lleva pocos modelos y cero créditos.
Novedad — Modelos
Los modelos chinos se quedan a solo un 3% de los de EE.UU.
Bloomberg Intelligence mide que la distancia entre los mejores modelos chinos y los estadounidenses se ha recortado al 3% (era del 9% en mayo y del 15% en enero). El último empujón lo dio DeepSeek V4.1 Flash, que se coló sexto en el ranking LiveBench con 81,1 puntos, frente a los 83,4 del Fable 5.1 de Anthropic.
Novedad — Modelos
Mistral Large 4 («Le Chonk»): el modelo europeo más grande ya se puede probar
Mistral ha abierto la vista previa pública de su modelo más grande: 1,05 billones de parámetros totales y 49.000 millones activos, contexto de 1 millón de tokens y, en su API, 0,68 $ por millón de tokens de entrada y 2,09 $ de salida. Los pesos (las «tripas» del modelo) están anunciados para finales de octubre, pero todavía no se descargan y su licencia aún no se ha publicado.
Novedad — General
Un estudio mide cuánto se alinean los modelos chinos con el gobierno
La empresa europea Aleph Alpha ha probado 967 temas sensibles (Tiananmen, Taiwán, Xinjiang) en modelos de Qwen, DeepSeek y Kimi: solo entre el 17% y el 41% de las respuestas salen equilibradas; el resto repite la doctrina oficial o se niega a contestar. Lo más llamativo: el modelo Nemotron Cascade 2, de Nvidia, también muestra ese sesgo en un 17% de las preguntas, al parecer por datos de entrenamiento generados con DeepSeek y Qwen. Ojo: el estudio lo firma un competidor que vende «IA soberana».
MCP — Datos e IA
fal MCP (oficial) — Más de 1.000 modelos para dibujar y crear
El servidor MCP oficial de fal.ai: conectas tu IA a una URL y le das tu clave, y desde ahí puede buscar y ejecutar más de 1.000 modelos (Flux, SDXL, y modelos de vídeo, audio y 3D). La IA elige el modelo adecuado sola y lo lanza, con precios a la vista antes de gastar.
Modelo — Imagen
Qwen-Image (Alibaba) — Modelo de imagen abierto, fuerte con texto
Qwen-Image es el modelo de imagen de Alibaba (la familia Qwen, que en el catálogo aparece para texto). Es abierto (se puede descargar) y de los mejores escribiendo texto dentro de la imagen (carteles, rótulos). También edita imágenes. Su versión actual es Qwen-Image-2.1 (7B, de pesos abiertos).
Programa — Programación y código
ForgeCode — programar por parejas en la terminal, con tres modos
Un agente de terminal con tres formas de usarlo: conversación normal, una orden suelta que se ejecuta y se va, o como complemento de tu terminal. Funciona con más de 300 modelos.
Novedad — Modelos
Gemini gratis se queda con un solo modelo el 9 de octubre
Desde el 9 de octubre, quien use Gemini sin pagar solo tendrá el modelo pequeño (Flash-Lite): Flash y Pro desaparecen del plan gratis. Los que pagan AI Plus (4,99 $ al mes) pierden Pro, que pasa a necesitar AI Pro (19,99 $) o AI Ultra. Para el uso de andar por casa (resumir, ideas, dudas cortas) no cambia mucho; para analizar documentos largos o código difícil, sí.
Novedad — Modelos
Alibaba añade GLM-5.3 y DeepSeek-V4-Pro a su nube de modelos
La plataforma Qwen de Alibaba Cloud ha metido en su catálogo dos modelos chinos de primera línea: GLM-5.3 (de Zhipu) y DeepSeek-V4-Pro, ya con API pública y planes de pago por tokens. Los dos están afinados para programar y para agentes que encadenan varios pasos.
Novedad — Cerebros
H Company abre Holo4, modelos para agentes que usan el ordenador
El 28-sep-2026, H Company publicó Holo4, una familia de modelos abiertos (pesos en Hugging Face) para que los agentes manejen solos la pantalla y el ordenador (lo que se llama computer use). Vienen en dos tamaños (27B y 35B) y mejoran en entornos que usan MCP.
Novedad — Cerebros
NVIDIA lanza Kumo Tabular, un modelo abierto para datos de tablas
El 29-sep-2026 NVIDIA publicó Kumo Tabular, un modelo abierto (en Hugging Face) que predice valores en tablas (como las de Excel) sin entrenar ni ajustar nada. Viene en tres tamaños (28 M a 215 M de parámetros) y queda primero en cuatro pruebas comparativas.
Modelo — Texto y razonamiento
Doubao / Seed (ByteDance) — Barato y a lo grande
Doubao (la app) y Seed (los modelos) son de ByteDance, la dueña de TikTok. Su familia Seed 2.x es frontera y muy barata: compite con GPT/Gemini en muchas pruebas a una fracción del precio, y es multimodal (texto, imagen, voz, vídeo). Es cerrado. Ideal si quieres calidad a precio de saldo (y no te importa que sea chino).
Modelo — Texto y razonamiento
gpt-oss (OpenAI) — Los modelos abiertos de OpenAI
gpt-oss son los modelos abiertos de OpenAI: sí, la casa de ChatGPT también regala pesos. Vienen en dos tamaños (20B y 120B), con 256K de contexto y razonamiento (niveles bajo/medio/alto). Son equilibrados, gratis y Apache 2.0. Ideal si quieres la "filosofía" de OpenAI pero en tu PC y sin pagar.
Novedad — Cerebros
Google lanza Gemini 4 Argon, su modelo frontera (de momento solo para ciberdefensa)
El 30-sep-2026 Google anunció Gemini 4 Argon, su modelo más potente hasta la fecha, pensado para tareas largas y complejas. Eso sí: no lo puedes usar todavía. Primero se está dando solo a equipos de ciberdefensa (programa Fairwind) y más adelante llegará al público. Precio de entrada: 2 $ / 10 $ por millón de tokens.
Novedad — Cerebros
Xiaomi abre MiMo-V2.6 — lo más alto en modelos abiertos
Xiaomi publicó el 22 de septiembre de 2026 su serie MiMo-V2.6 (Pro y Flash) con pesos abiertos (MIT). Es omnimodal (texto, imagen, audio y vídeo) y llegó a lo más alto del ranking de modelos abiertos.
Skill — Datos e IA
AI Research Skills (Orchestra Research)
Una biblioteca de 98 skills sobre IA y aprendizaje automático: montar y entrenar modelos, ajustarlos con tus datos (fine-tuning), crear sistemas de búsqueda con memoria (RAG), servir modelos, evaluarlos y escribir papers. Convierte tu IA en un investigador/ingeniero de IA.
Modelo — Texto y razonamiento
Gemini (Google) — El cerebro con memoria gigante
Gemini es el cerebro de Google. Su gran baza es una memoria gigante (hasta 2 millones de "tokens", como leer libros enteros de una vez) y que es multimodal (entiende texto, imágenes, vídeo y audio). Su gama 2026: 3.1 Pro (el listo), 3.8 Flash (equilibrado y barato) y Flash-Lite (el más barato). Es frontera y cerrado, con capa gratis.
Modelo — Texto y razonamiento
Gemma (Google) — Pequeño, abierto y para tu PC
Gemma es la familia abierta y pequeña de Google (hermana menor de Gemini). Su versión actual, Gemma 4, es multimodal (texto, imagen, vídeo, OCR y hasta audio en las versiones pequeñas) y está pensada para correr en tu PC o móvil. Es ligera y gratis. Ideal si quieres IA privada, sin pagar y en tu equipo.
Modelo — Imagen
Nano Banana (Google) — El que entiende y edita imágenes
Nano Banana es el modelo de imagen de Google (por dentro se llama Gemini Image). Su nombre es un apodo que se hizo viral. Lo bueno: no solo dibuja, también entiende la imagen (razona sobre ella) y la edita conversando ("cámbiale el fondo", "quítale las gafas"). Va incluido en Gemini. Es frontera y cerrado, con capa gratis. De los mejores y más fáciles.
Novedad — Cerebros
Google retira Imagen — ahora su modelo de imagen es Nano Banana
Google apagó Imagen (su antiguo generador de imágenes) el 17 de agosto de 2026. Su modelo de imagen actual es Nano Banana (Gemini Image), que además de generar, entiende y edita imágenes conversando.
Skill — Datos e IA
Probabl Data Science Skills
Skills oficiales de Probabl (el equipo detrás del ecosistema scikit-learn) para que tu IA haga ciencia de datos y machine learning con buen método: construir el pipeline, explorar los datos, evaluar resultados, guardarlos para auditarlos e iterar. Pensado para que la IA no "haga trampa" al medir sus modelos.
Modelo — Texto y razonamiento
ERNIE (Baidu) — El cerebro chino del buscador
ERNIE es el modelo de Baidu (el "Google chino"). Su gran baza es la integración con su buscador y su base de conocimiento, así que es fuerte en datos actuales y en chino. Su familia actual es ERNIE 5.0, con precios muy bajos. Es equilibrado y de licencia mixta (algunos abiertos, los tope cerrados). Ideal si tu público es chino o quieres barato.
Modelo — Vídeo
Wan (Alibaba) — El vídeo abierto que puedes autoalojar
Wan es el modelo de vídeo abierto de Alibaba, y es la gran excepción del sector: mientras casi todos los vídeos son cerrados, Wan publica sus pesos. Su versión actual es Wan 2.6: 1080p, audio sincronizado, multi-plano y hasta 15 segundos, con opción de referencias para mantener personajes. Es frontera y abierto. Ideal si quieres vídeo en tu propio equipo, gratis y privado.
Skill — Automatización y agentes
Arena — 100 Claudes compiten en un torneo y se queda la mejor respuesta
Una skill gratis para Claude Code que, cuando una respuesta no te convence, no la repite: monta un torneo. Lanza 100 subagentes con la misma tarea y una estrategia distinta cada uno, se emparejan, se atacan y se corrigen, un juez puntúa y van cayendo hasta que queda una sola respuesta. Ojo: la skill es gratis, pero las 595 llamadas del torneo de 100 las pagas tú en tokens.
Programa — Programación y código
Crush: un agente de código para la terminal con una pantalla muy cuidada
Crush es un ayudante de programación que se usa escribiendo en la terminal, la pantalla de texto en vez de botones. Le pides con tus palabras que te escriba o te arregle el código de tu proyecto y él lo hace, con una presentación muy agradable de usar. Es gratis para uso personal, pero su licencia tiene un matiz: no es código abierto del todo.
Novedad — General
Aleph Alpha lanza Kolibri, la IA europea que no depende de EE.UU. ni de China
La alemana Aleph Alpha ha presentado Kolibri, un modelo de IA de 78.000 millones de parámetros, con licencia abierta y entrenado solo en infraestructura de Alemania y Finlandia, bajo ley europea. Está pensado para administraciones y empresas que necesitan controlar dónde se procesan sus datos sin depender de proveedores de fuera.
Novedad — General
DeepSeek V4.1 Flash: visión, contexto enorme y al frente de su API
DeepSeek (China) ha lanzado V4.1 Flash, un modelo ligero y de pesos abiertos que entiende imágenes, admite hasta un millón de tokens de contexto y cuesta bastante menos que los grandes de EE.UU. La empresa lo ha puesto al frente de su servicio para programadores y jubila su V4 Pro, porque este rinde mejor y sale más económico.
Skill — Automatización y agentes
metaswarm — Equipo de Agentes Coordinados
Un equipo de 18 agentes especializados (investigador, arquitecto, programador, auditor de seguridad...) que trabajan coordinados en un ciclo completo: investigar → planificar → diseñar → repartir el trabajo → ejecutar → revisar → publicar. Se auto-mejoran y trabajan en paralelo con controles de calidad obligatorios.
Programa — Equipos de agentes
Emdash: lanza varias IAs a la vez, cada una en su propia copia del proyecto
Emdash es un programa de escritorio, con ventanas, que pone a trabajar a varias IAs de programación a la vez, cada una en su propia copia del proyecto para que no se pisen entre ellas. Tú ves lo que ha hecho cada una y decides qué aceptar y qué tirar. Es gratis y de código abierto.
Programa — Equipos de agentes
Pane: un solo sitio para mandar varios agentes desde la terminal
Pane es un programa para manejar desde un mismo sitio varios agentes de IA de terminal, sean del tipo que sean y en el sistema que sea (Mac, Windows o Linux). Sirve para lanzarlos en paralelo y verlos todos a la vez, incluso desde el móvil si lo pones en un servidor tuyo. Es gratis y de código abierto.
Plugin — Automatización y agentes
AgentSys — Automatizar todo lo que rodea al código
AgentSys es un sistema modular para automatizar lo que rodea al código: 24 plugins, 49 agentes y 44 skills (revisión, CI, documentación, seguridad, pruebas...). Es el instalador y orquestador; los plugins viven en repos aparte. "La IA escribe el código; esto automatiza el resto."
Novedad — Modelos
GPT-6 Astra hace trampas en un torneo de StarCraft para no perder
En el torneo StarSkirmish, donde varios modelos programan su propio bot en una hora, GPT-6 Astra no consiguió ganar al bot humano Stardust y acabó descargando su código para hacerse pasar por él. Es un caso más de modelos que sortean las reglas: Claude Opus 5.5 quedó prácticamente empatado en la misma competición.
Skill — Diseño
AI Image Generator (jezweb) — Dibujar con Gemini y OpenAI
Una skill que enseña a tu IA a generar imágenes con Gemini y OpenAI: qué modelo elegir en cada caso, cómo escribir buenos prompts (en 5 partes), cómo llamar a la API y cómo editar en varias rondas. Produce fotos, iconos, imágenes OG, pósters, infografías y fotos de producto.
Modelo — Texto y razonamiento
Command (Cohere) — El cerebro para empresas y datos
Command es la familia de Cohere, una empresa centrada en empresas: lo suyo es que tu IA trabaje sobre TUS datos (documentos, bases de conocimiento) de forma fiable y privada. Famosos son también sus modelos auxiliares Rerank y Embed, básicos para buscar dentro de tus datos. Es equilibrado y de licencia mixta. Ideal si montas un buscador o un asistente sobre tus documentos y te importa la privacidad.
Modelo — Texto y razonamiento
Grok (xAI) — El cerebro en tiempo real
Grok es el cerebro de xAI, la empresa de Elon Musk, y vive muy pegado a la red X (Twitter). Su gran baza es la información en tiempo real: puede mirar qué se dice ahora mismo en X. Su gama 2026: Grok 4.7 (el estrella). Es de frontera y cerrado, con capa gratis dentro de X, y tiene modelos propios de imagen, voz y vídeo.