Noticias sobre ProxPI
1 artículos relacionados
ProxPI: Proximal Prior Injection for Sampling-Based MPC under Learned-Prior Mismatch
AI InsightEl enfoque tradicional para incorporar políticas de aprendizaje en el MPC es colocar el centro de la distribución muestral en el resultado de la política, pero esto limita la exploración cuando ocurre el desajuste anterior. ProxPI preserva el muestreo central nominal a través del costo de proximidad suave, manteniendo la accesibilidad óptima de la tarea en escenarios fuera de distribución. Esto muestra que la integración de la estrategia y el control de optimización está pasando de "dirigida por la estrategia" a "guiada por la estrategia bajo restricciones de optimización".Importancia 45/100