Noticias sobre Multimodal Language Models
1 artículos relacionados
CulturalMenuBench: sondeando la brecha entre conocimiento y aplicación en el razonamiento culinario multimodal
CulturalMenuBench: Probing the Knowledge-Application Gap in Multimodal Culinary Reasoning
AI InsightEl rendimiento casi perfecto de los modelos multimodales en el reconocimiento de imágenes estándar enmascara los defectos esenciales de sus capacidades. Cuando la prueba pasa de una simple comparación visual a la derivación de procesos y la atribución cultural, la precisión del modelo cae drásticamente. Esto muestra que el modelo actual sólo capta la correlación estadística de las características visuales, en lugar de la verdadera capacidad de razonamiento del sentido común intercultural.Importancia 65/100