Articles sur Z.ai
3 articles liés
GLM-5.3-Flash matches top models at a fraction of the cost, and runs without Nvidia
AI InsightZ.ai a lancé le modèle open source GLM-5.3-Flash, doté de 320 milliards de paramètres, qui, sur l'indice d'analyse artificielle, ne cède que de trois points à un plus grand GLM-5.3, mais à un coût sept fois inférieur à celui-ci. Il convient de noter que tous les flux d'inférence sont exécutés sur des puces AI chinoises, et non sur le matériel Nvidia. La sortie de GLM-5.3-Flash marque une nouvelle percée dans l'équilibre entre le coût et les performances des modèles d'IA.Z.ai Releases GLM-5.3-Flash: A 320B-A18B Natively Multimodal MoE With a 1M-Token Context
AI InsightZ.ai a lancé GLM-5.3-Flash, le premier modèle multimodal natif de la série GLM-5. Il dispose de 320 milliards de paramètres totaux et 18 milliards de paramètres actifs, et prend en charge une fenêtre de contexte de 1 048 576 jetons. Les poids du modèle sont publiés sous licence MIT et disponibles sur Hugging Face, la tarification de l'API est de 0,15 dollar par million d'entrées et de 0,50 dollar par million de sorties. GLM-5.3-Flash a obtenu des scores de 84,3 et 63,4 respectivement sur Terminal-Bench 2.1 et DeepSWE v1.1.Surprise: Z.ai is the AI lab behind the mysterious Ox Alpha model
AI InsightZ.ai a officiellement confirmé qu'il s'agit du laboratoire derrière le modèle mystérieux Ox Alpha, dont les performances exceptionnelles sur des benchmarks et des classements ont fait sensation, et dont les fichiers de poids seront bientôt publiés. L'arrivée du modèle Ox Alpha a provoqué un véritable engouement dans le domaine de la recherche en IA. Cette initiative de Z.ai va encourager le développement et l'ouverture des modèles d'IA.