智谱

让机器像人一样思考

IP属地:未知
    • 智谱智谱
      ·09-01
      智谱2026中报发布:智能上界,新局加载
      6.30万评论
      举报
    • 智谱智谱
      ·08-27

      GLM-5.3-Flash:前沿智能进入普惠时代

      今天,我们上线并开源GLM-5.3-Flash (320B-A18B),这是GLM-5系列的首个原生多模态模型。 大家好像已经习惯将前沿智能与前沿价格绑定,并认为这是技术进步必须支付的成本。今天,GLM-5.3-Flash来了:320B总参数,能力超过GLM-5.2,在全球权威的Artificial Analysis Intelligence Index(AA综合智能指数)中取得57分,进入全球前沿模型能力区间,与Anthropic最受欢迎的模型Claude Opus 4.8得分持平。在自研Z.ai Code Bench体感评估中,其编程表现与Claude Opus 4.8相当。 与此同时,GLM-5.3-Flash定价为1/10的GLM-5.3,限时折扣内为1/20的GLM-5.3,为Opus 4.8的1/40。同样智力,1/40价格,前沿智能,第一次不需要省着用。 为收集广大用户的广泛、专业反馈,我们在正式发布前,以匿名模型Ox-Alpha(中文社区称作牛来)在OpenCode和OpenRouter上进行了大规模测试。Ox-Alpha迅速成为当周最受欢迎的模型,创下双平台调用量新高。而这些请求流量全部由国产芯片提供算力支持。 GLM-5.3-Flash在各项基准测试和实际使用中,全面超越参数量高出一倍的GLM-5.2,定价却仅为后者的1/10。这得益于其全新模型架构。GLM-5.3-Flash的架构专为极低成本而设计,总参数量与GLM-4.5相当(355B vs. 320B),但激活参数量(32B → 18B)与层数(92 → 45)几乎减半。结合我们最新的30T Token多模态预训练语料,GLM-5.3-Flash能够以更少的计算资源实现更强的性能。 GLM-5.3-Flash同时进行了多项架构升级,是首个采用稀疏注意力与线性注意力混合架构的开源前沿模型,在保持精准
      5.82万评论
      举报
      GLM-5.3-Flash:前沿智能进入普惠时代
       
       
       
       

      热议股票