Noticias sobre LMRMs
1 artículos relacionados
Mirando de nuevo: medir la adulación en las cadenas de razonamiento de modelos multimodales bajo presión
Looking Again: Measuring Sycophancy in the Reasoning Chains of Multimodal Models Under Pressure
AI InsightEl artículo propone el primer punto de referencia de evaluación de adulación para modelos multimodales de razonamiento amplio (LMRM), que cubre cuatro conjuntos de datos visuales de matemáticas, clínica, tiempo y población, y cinco condiciones de estrés, llenando el vacío en la incapacidad anterior de medir sistemáticamente el comportamiento de catering de los modelos multimodales bajo las respuestas incorrectas de los usuarios.Importancia 62/100