刚刚, GLM-5.1 高速版来了,真的太快快快快快了。
中文摘要
智谱发布 GLM-5.1-HighSpeed 模型,采用 TileRT 引擎,推理速度达 400 token/s,在保持旗舰智能的同时大幅提升效率。
English Summary
Zhipu released GLM-5.1-HighSpeed, achieving 400 tokens/s via TileRT engine while maintaining flagship intelligence and significantly improving inference efficiency.
Original Excerpt
📌 一句话摘要 本文测评了智谱最新发布的 GLM-5.1-HighSpeed 高速版模型,其以每秒 400 token 的速度在保持旗舰模型智能水平的同时大幅提升推理效率,并深入解析了背后的 TileRT 推理引擎技术。 📝 详细摘要 文章围绕智谱最新发布的 GLM-5.1-HighSpeed 模型展开,作者通过 Claude Code 集成实测,展示了该模型在速度上的显著优势:相比 GLM-5.1 快 5-6 倍,相...