Noticias sobre Terminal-Bench-Science
1 artículos relacionados
Claude Fable 5.1 me convirtió en un pelícano animado muy simpático
Claude Fable 5.1 made me a really nice animated pelican
AI InsightAnthropic lanzó Claude Fable 5.1 y su puntuación Terminal-Bench-Science saltó del 24,7% en 5.0 al 52,6%. En comparación con modelos anteriores que hacían que las capacidades de inferencia fueran opcionales, Fable 5.1 se ve obligado a tener cinco niveles de intensidad de inferencia incorporados y no se puede desactivar por completo. Esto muestra que Anthropic está utilizando la inferencia profunda como la capacidad básica predeterminada del modelo en lugar de un interruptor adicional.Importancia 70/100