智谱发布并开源多模态模型 GLM-5.3-Flash:对标 DeepSeek,由 10 万国产卡支持
15 小时前
智谱上线并开源 GLM-5.3-Flash(320B-A18B),这是 GLM-5 系列首个原生多模态模型,总参数 320B,能力超 GLM-5.2,在 AA 综合智能指数中获 57 分,与 Claude Opus 4.8 得分持平,编程表现也相当。该模型定价为 GLM-5.3 的 1/10,限时折扣为其 1/20、Opus 4.8 的 1/40。此前它以匿名模型 Ox-Alpha 在 OpenCode 和 OpenRouter 测试,成当周最受欢迎模型,调用量创双平台新高,算力由国产芯片支持。GLM-5.3-Flash 采用全新低成本架构,激活参数量与层数近乎减半,是首个采用稀疏与线性注意力混合架构的开源前沿模型,还采用流形约束超连接提升 Scaling 能力。其注意力计算量较 GLM-5.3 降 3.01 倍,KV 缓存大小降 4.44 倍,注意力计算量为基线模型中最低。智谱用国产芯片集群为其提供服务,自研推理引擎,借助 GLM-5.3 驱动的 infra agent 加速构建,通过多项内存优化及 EPD 分离式架构,使端到端服务性能较初始基线提升 3 倍,硬件效率和单 token 成本达主流英伟达 GPU 水平。目前该模型已面向全球开源,接入 ZCode 等平台,纳入 GLM Coding Plan 并开放 API 调用。
GLM-5.3-Flash 发布,多模态终于来了
钛媒体 / maomu.com
2026-08-26
智谱确认 Ox Alpha 为 GLM 系列新迭代2026-08-21
GLM-5.3、Deepseek-V4-Pro 等多款模型上线千问 AI 平台2026-07-31
扩建算力数据中心后,智谱 GLM Coding Plan 开放订阅2026-06-22
智谱市值首次突破 1 万亿港元,股价年内涨超 2000%2026-06-17
智谱:上线并开源 GLM-5.22026-06-15
智谱:公司已推出最新一代旗舰模型 GLM-5.22026-06-15
智谱发布并开源 GLM-5.2,具备 1M 上下文处理能力2026-05-22
智谱发布 GLM-5.1 高速版 API,刷新全球大模型 API 速度纪录2026-04-08
GLM-5.1 开源:实现 8 小时长程任务持续工作的里程碑式突破查看更多
体验专业版特色功能,拓展更丰富、更全面的相关内容。