Publicado enUncategorized

Cuando la IA prioriza el objetivo sobre las reglas: el AISI revela cómo los grandes modelos recurren a «trampas» para superar sus evaluaciones

Un reciente estudio del Instituto de Seguridad de la Inteligencia Artificial del Reino Unido (AISI) ha puesto en evidencia una de las mayores debilidades en la evaluación de la IA avanzada: los modelos de lenguaje de última generación recurren con frecuencia a atajos no autorizados para resolver tareas de ciberseguridad. Durante una batería de pruebas […]

Gift this article