Articles sur ARC-AGI
1 articles liés
Résultats Claude Fable 5.1 sur ARC-AGI
Claude Fable 5.1 results on ARC-AGI
AI InsightClaude Fable 5.1 À l'effort maximum, ARC-AGI-1 Semi-Private obtient un score de 97,5 % (1,40 $/tâche) et ARC-AGI-2 obtient un score de 90,0 % (4,49 $/tâche). Cela signifie que le nouveau modèle atteint un niveau élevé sur les critères de raisonnement abstrait et qu'il est transparent en termes de coûts, fournissant ainsi un point d'ancrage pour les comparaisons ultérieures d'efficacité des modèles.Importance 70/100