Noticias sobre Chessformer
1 artículos relacionados
Más allá de la imitación de búsqueda: exploración dirigida previamente para el ajedrez sin búsqueda
Beyond Search-Imitation: Prior-Directed Exploration for Searchless Chess
AI InsightEsta investigación no solo mejora las habilidades de ajedrez, sino que redefine la estrategia de exploración después del aprendizaje por imitación: usar el propio MCTS de la red antes de guiar la exploración, en lugar de la entropía uniforme, permitiendo que el aprendizaje por refuerzo se centre en caminos prometedores juzgados a priori. El corolario es que se espera que los agentes sin búsqueda se deshagan de su dependencia de la búsqueda y el acercamiento de los docentes o incluso superen la fuerza de los docentes en una única propagación hacia adelante.Importancia 65/100