英文原标题:Introducing GLM 5.3 on Amazon Bedrock

本文为英文原文的机器翻译摘要,原文见:AWS Machine Learning Blog ↗

  • Z.ai(智谱AI)的GLM 5.3现已上线Amazon Bedrock,这是一个753B参数的混合专家模型,针对编码和长周期智能体任务优化,Z.ai报告其展现出显著的网络安全能力。
  • 与GLM 5相比,GLM 5.3在编码能力上更强,Z.ai称在DeepSWE、Terminal Bench 3.0和FrontierSWE等基准测试中具有竞争力,内部编码基准较GLM 5.2提升50%;在CyberGym基准上测得84.5的领先分数。
  • 在Amazon Bedrock上,GLM 5.3提供完全托管的API,支持跨区域推理、提示缓存和服务层级,无需管理基础设施,面向符合条件的企业客户开放。
  • GLM 5.3支持OpenAI兼容的Responses和Chat Completions API以及Bedrock的Invoke和Converse API,默认启用隐式提示缓存,并支持显式缓存控制以减少延迟和输入成本。
  • 文章演示了如何通过OpenAI Python SDK和aws-bedrock-token-generator调用模型,并展示了一个使用开源AI渗透测试代理Strix进行授权安全测试的智能体工作负载示例。

关键数据

  • GLM 5.3是753B参数的混合专家模型
  • Z.ai报告内部编码基准较GLM 5.2提升50%
  • CyberGym基准上测得84.5的领先分数
  • 跨区域推理配置文件:us.zai.glm-5.3和global.zai.glm-5.3
  • 显式缓存断点需至少1,024个token

为什么值得看:GLM 5.3作为开源权重模型在Amazon Bedrock上提供托管服务,结合强大的编码和网络安全能力,可降低企业部署智能体工作负载的基础设施门槛。

站内导航