智谱发布 GLM-5.1 高速版 API,刷新全球大模型 API 速度纪录
5 月 22 日
智谱近日推出 GLM-5.1 高速版 API,模型输出速度达 400 tokens / s,打破高速模型多为轻量级的行业惯例,首次在国产大模型中实现旗舰级能力与低延迟并存。实测显示其在 AI 编程、3D 游戏、交互界面等场景表现出色,核心在于 TileRT 高性能推理引擎,该引擎由智谱 GLM 团队与 TileRT 团队联合打造,通过系统级优化实现。目前适用于速度敏感场景,并通过智谱 MaaS 平台向部分企业客户开放。
2026-06-17
智谱:上线并开源 GLM-5.22026-06-15
智谱:公司已推出最新一代旗舰模型 GLM-5.22026-06-15
智谱发布并开源 GLM-5.2,具备 1M 上下文处理能力2026-05-22
智谱发布 GLM-5.1 高速版 API,刷新全球大模型 API 速度纪录2026-04-08
GLM-5.1 开源:实现 8 小时长程任务持续工作的里程碑式突破2026-04-08
智谱发布新一代旗舰模型 GLM-5.1,同时提价 10%2026-04-02
智谱发布原生多模态 Coding 基座模型 GLM-5V-Turbo2026-03-27
智谱:GLM-5.1 已面向所有 Coding Plan 用户开放2026-03-16
智谱上调新模型 API 价格 20%查看更多
体验专业版特色功能,拓展更丰富、更全面的相关内容。