Noticias sobre GPT-Neo
1 artículos relacionados
Do Large Language Models Capture the Diversity in their Training Data?
AI InsightEsta investigación transforma la "diversidad de resultados" de una descripción cualitativa a un indicador computable de la teoría de la información, lo que significa que la evaluación del modelo se extiende desde una simple medición del límite superior de capacidades hasta una prueba estadística de "si la distribución generada es fiel a la distribución de datos de entrenamiento", lo que puede proporcionar una nueva herramienta para diagnosticar la sobredeterminación del modelo.Importancia 55/100