关于 GLM-5.3-Flash 的报道
共 2 篇相关报道
GLM-5.3-Flash 以极低的成本与顶级型号相匹配,并且无需 Nvidia 即可运行
GLM-5.3-Flash matches top models at a fraction of the cost, and runs without Nvidia
AI 洞察Z.ai发布了开源模型GLM-5.3-Flash,拥有320亿参数,在Artificial Analysis的智能指数上仅比更大的GLM-5.3低三分,成本却是后者的七分之一。值得注意的是,所有的推理流量都在中国的AI芯片上运行,而不是在Nvidia的硬件上。GLM-5.3-Flash的发布标志着AI模型的成本和性能之间的平衡取得了新的突破。Z.ai 发布 GLM-5.3-Flash:一种320B-A18B 原生多模态 MoE,具有 1M 令牌上下文
Z.ai Releases GLM-5.3-Flash: A 320B-A18B Natively Multimodal MoE With a 1M-Token Context
AI 洞察Z.ai 发布了GLM-5.3-Flash,这是GLM-5系列的第一个原生多模态模型。它具有320B总参数量和18B活跃参数量,支持1,048,576个令牌的上下文窗口。模型权重采用MIT许可证,在Hugging Face上发布,API定价为每百万输入0.15美元和每百万输出0.50美元。GLM-5.3-Flash在Terminal-Bench 2.1和DeepSWE v1.1上分别获得了84.3和63.4的分数。