Articles sur Claude Fable 5.1
7 articles liés
Claude Fable 5.1 m'a fait un très joli pélican animé
Claude Fable 5.1 made me a really nice animated pelican
AI InsightAnthropic a sorti Claude Fable 5.1, et son score Terminal-Bench-Science est passé de 24,7 % en 5,0 à 52,6 %. Par rapport aux modèles précédents qui rendaient les capacités d'inférence facultatives, Fable 5.1 est obligé d'avoir cinq niveaux d'intensité d'inférence intégrée et ne peut pas être complètement désactivé. Cela montre qu'Anthropic utilise l'inférence profonde comme capacité de base par défaut du modèle plutôt que comme commutateur supplémentaire.Importance 70/100Anthropic lance Claude Fable 5.1 et affirme que le travail agent est jusqu'à 45 % moins cher
Anthropic launches Claude Fable 5.1 and says it’s up to 45 percent cheaper for agentic work
AI InsightAnthropic a lancé Claude Fable 5.1, affirmant que ses performances sont meilleures que celles de Fable 5, avec des coûts réguliers réduits d'environ 25 % et des tâches d'agent complexes réduites jusqu'à 45 % grâce à la tarification des données mises en cache. Cela signifie que par rapport à l'amélioration précédente des capacités du modèle, cette fois-ci, cela améliore directement l'économie des flux de travail des agents à haute fréquence et répond directement aux critiques des utilisateurs concernant le prix et la conservation des données.Importance 70/100Résultats Claude Fable 5.1 sur ARC-AGI
Claude Fable 5.1 results on ARC-AGI
AI InsightClaude Fable 5.1 À l'effort maximum, ARC-AGI-1 Semi-Private obtient un score de 97,5 % (1,40 $/tâche) et ARC-AGI-2 obtient un score de 90,0 % (4,49 $/tâche). Cela signifie que le nouveau modèle atteint un niveau élevé sur les critères de raisonnement abstrait et qu'il est transparent en termes de coûts, fournissant ainsi un point d'ancrage pour les comparaisons ultérieures d'efficacité des modèles.Importance 70/100Anthropic lance Claude Fable 5.1 et Claude Mythos 5.1 : 52,6 % sur Terminal-Bench-Science et 75 % de lectures de cache moins chères
Anthropic Releases Claude Fable 5.1 and Claude Mythos 5.1: 52.6% on Terminal-Bench-Science and 75% Cheaper Cache Reads
AI InsightAnthropic publie Claude Fable 5.1 et Mythos 5.1. Fable 5.1 obtient un score de 52,6 % sur Terminal-Bench-Science 0.1, soit plus du double de Fable 5 (24,7 %), tandis que les coûts de lecture du cache chutent à 0,25 $ par million de jetons, soit une baisse de 75 %. Cela signifie que les capacités d'automatisation des tâches des terminaux scientifiques se sont considérablement améliorées et que le coût du raisonnement en contexte long a considérablement diminué.Importance 70/100Claude Fable 5.1 d'Anthropic promet un meilleur codage et une meilleure recherche jusqu'à 45 % de moins
Anthropic's Claude Fable 5.1 promises better coding and research at up to 45 percent less
AI InsightAnthropic a publié Claude Fable 5.1, qui a doublé son score sur Terminal-Bench-Science, amélioré le codage des agents de plus de 30 % et réduit les coûts d'exploitation autonome à long terme jusqu'à 45 %. Par rapport à la génération précédente, les performances et les coûts ont été améliorés simultanément, ce qui favorisera une application plus large des tâches de codage et de recherche basées sur des agents.Importance 72/100Claude Fable 5.1 et Claude Mythe 5.1
Claude Fable 5.1 and Claude Mythos 5.1
AI InsightAnthropic a publié Claude Fable 5.1 et Mythos 5.1, qui sont le même modèle mais avec des niveaux de protection de sécurité différents : Fable est accessible au public, tandis que Mythos est limité à un accès fiable et est orienté vers la sécurité des réseaux et les sciences de la vie. Par rapport à Fable 5, le nouveau modèle réduit les prix d'environ 25 % dans les scénarios de facturation de jetons, et jusqu'à environ 45 % pour les tâches nécessitant beaucoup d'agents, ce qui est obtenu en abaissant les prix de lecture du cache. Cela signifie qu'Anthropic utilise des niveaux de prix et des niveaux de sécurité pour étendre l'adoption par les entreprises tout en améliorant les capacités.Importance 80/100Claude Fable 5.1 est généralement disponible dans GitHub Copilot
Claude Fable 5.1 is generally available in GitHub Copilot
AI InsightClaude Fable 5.1 d'Anthropic est officiellement disponible dans GitHub Copilot pour un codage autonome et un travail de connaissances à long terme. Par rapport à la nécessité précédente de l'utiliser via les propres canaux d'Anthropic, cette intégration permet au modèle d'entrer directement dans le flux de travail IDE traditionnel, et les développeurs peuvent l'appeler sans changer d'outil. Combiné avec ses fonctionnalités d'inférence forcée à cinq niveaux, de réduction des coûts d'agent jusqu'à 45 % et d'ARC-AGI-2 jusqu'à 90 %, cela signifie que la compétitivité de Copilot dans les scénarios de codage indépendants devrait augmenter.Importance 68/100