Articles sur SAGE
2 articles liés
SAGE : Évaluation fondée sur l'État et tenant compte de l'abstention des agents de dialogue axés sur les tâches
SAGE: State-Grounded, Abstention-Aware Evaluation of Task-Oriented Dialogue Agents
AI InsightSAGE fait passer l'évaluation des agents de dialogue d'un jugement sémantique holistique à une vérification atomique basée sur l'état du flux de travail, et introduit un mécanisme de renonciation pour éviter toute erreur de jugement en cas d'incertitude. Cela signifie que la fiabilité de l'évaluation automatisée ne peut plus reposer sur l'intuition généralisée du LLM, mais sur des spécifications d'état explicites et des preuves intermédiaires vérifiables, fournissant ainsi une voie d'évaluation plus vérifiable pour l'automatisation des processus métiers à haut risque.Importance 55/100L'apprentissage actif conscient de soi permet une amélioration continue de la conduite autonome
Self-Aware Active Learning Enables Continual Improvement in Autonomous Driving
AI InsightL'article arXiv propose le cadre d'apprentissage actif SAGE, qui génère des signaux de « peur » et de « curiosité » en prédisant le modèle mondial, afin que le système de conduite autonome puisse estimer ses propres capacités et demander de l'aide de manière proactive lors de l'adaptation post-formation. Plutôt que d’apprendre passivement de l’expérience, ce cadre donne aux systèmes la capacité de transformer les rencontres critiques pour la sécurité en améliorations ciblées.Importance 65/100