Saltar al contenido

— A fondo

NVIDIA comprueba que dar herramientas a la IA la vuelve menos prudente

Un equipo de seis investigadores de NVIDIA ha medido algo incómodo: en cuanto un modelo multimodal (los que ven imágenes y texto) empieza a usar herramientas para actuar, le cuesta mucho más negarse a peticiones peligrosas. Analizaron más de 100.000 respuestas y en los once modelos probados, incluidos Claude Opus 4.7, Gemini 3.1 Pro y GPT-5.4, los fallos de negativa subieron hasta un 68,7% en el peor caso y un 17,7% de media. Los modelos de pesos abiertos, como Qwen3-VL, salían peor parados. El artículo se titula MLLMs Fail to Refuse when Using Tools Agentically.

Compartir:WhatsAppTelegramXLinkedIn

Todas las novedades

Sigue leyendo