Articles sur arXiv CS.AI
4 articles liés
Gouverner le modèle, pas seulement les données : stockage, circulation et apprentissage dans l'IA créative
Govern the Model, Not Only the Data: Storage, Circulation, and Learning in Creative AI
AI InsightL'article souligne que l'apprentissage fédéré n'est pas une panacée pour résoudre les problèmes d'extraction de l'IA, car le contrôle du modèle peut toujours être entre les mains de l'initiateur. Ce qui change réellement la structure du pouvoir, c’est le « modèle de gouvernance » plutôt que la simple protection des données. La communauté créative tente de reprendre le contrôle aux trois niveaux de stockage, de circulation et d’apprentissage à travers des mécanismes de confiance et de coopération.Importance 45/100EntitésarXiv CS.AIConvDeck : génération conversationnelle de papier à diapositives via les commentaires des utilisateurs spécifiques à l'étape
ConvDeck: Conversational Paper-to-Slide Generation via Stage-Specific User Feedback
AI InsightLa génération de présentations académiques est un processus créatif qui nécessite des itérations répétées. En introduisant des commentaires d'utilisateurs par étapes dans le pipeline multi-agents, ConvDeck brise les limites des systèmes existants qui disposent d'une boucle interne fermée ou ne permettent aux utilisateurs d'intervenir qu'en fin de compte, indiquant que l'accent d'optimisation de la génération de contenu d'IA passe de la génération entièrement automatique au lien intermédiaire de collaboration homme-machine.Importance 40/100Évaluation des évaluateurs : théorie des mesures de Rasch pour l'évaluation LLM
Rating the Raters: Rasch Measurement Theory for LLM Evaluation
AI InsightarXiv a publié une nouvelle recherche proposant l'application de la théorie des mesures de Rasch (RMT) pour l'évaluation LLM. Par rapport à la pratique standard précédente consistant simplement à traiter le modèle comme un sujet ou un évaluateur, RMT décompose les notes ordinales en facettes séparables sur une échelle commune et diagnostique les erreurs d'étalonnage et les biais des évaluateurs. Cela montre que l'évaluation LLM passe d'un simple test de référence à une analyse psychométrique multidimensionnelle quantifiable.Importance 65/100FORME de la chaîne de pensée dans le raisonnement mathématique
SHAPE of Chain-of-Thought in Math Reasoning
AI InsightCet article propose le cadre SHAPE pour analyser la trajectoire de la chaîne de pensée du raisonnement mathématique sur grand modèle à travers les deux dimensions de l'espace sémantique et des stratégies heuristiques. Par rapport à la méthode d’évaluation précédente qui se concentrait uniquement sur l’exactitude de la réponse finale, cela marque un changement d’évaluation d’une évaluation orientée vers les résultats vers une évaluation orientée sur les processus, ce qui permet de mieux expliquer les capacités mathématiques sous-jacentes du modèle.Importance 65/100