智谱 2026-09-18 12:37 北京 GLM-5.3-Flash此前以“Ox Alpha”之名与全球开发者见面,获得海内外开发者的广泛认可,调用量持续攀升。面对快速增长的需求,我们在10万张国产芯片提供的推理算力基础上,进一步加大对Infra侧的投入与推理优化。今日起,我们正式推出GLM-5.3-FlashX(最高200 tokens/s),为企业与开发者带来更快、更流畅的模型体验。GLM-5.3-Flash长期保持同尺寸最强智能水平,并具备极高性价比,本次提速进一步形成智能、价格、速度的全面竞争力。GLM-5.3-FlashX API现已上线,Model Key:GLM-5.3-FlashX。使用方式:API调用:http…
阅读全文MaaS平台进入爆发期
阅读全文智谱 2026-08-26 22:11 北京 今天,我们上线并开源GLM-5.3-Flash (320B-A18B),这是GLM-5系列的首个原生多模态模型。大家好像已经习惯将前沿智能与前沿价格绑定,并认为这是技术进步必须支付的成本。今天,GLM-5.3-Flash来了:320B总参数,能力超过GLM-5.2,在全球权威的Artificial Analysis Intelligence Index(AA综合智能指数)中取得57分,进入全球前沿模型能力区间,与Anthropic最受欢迎的模型Claude Opus 4.8得分持平。在自研Z.ai Code Bench体感评估中,其编程表现与Claude Opus 4.8相当。与此同时,…
阅读全文跻身开源模型SOTA
阅读全文单弦不成音,独木不成林
阅读全文智谱 2026-08-11 13:52 北京 ZCode是一款针对GLM深度优化的国产Coding Harness,已成为百万开发者用GLM写代码的首选入口。今天,ZCode迎来重大升级,Goal、Subagents、Remote Control与闲时任务四大功能正式上线。作为百万用户里程碑的特别回馈,GLM Coding Plan全体用户额度已于今天13:00统一重置,届时全员额度全部回满。ZCode,GLM的最佳拍档模型决定能力上限,Harness负责上下文管理、工具调用、任务调度、缓存和结果校验,决定模型能力能发挥出多少。同一个模型放在不同的Coding Agent里,实际表现可能差很多。在ZCode里使用GLM可以获得更好的…
阅读全文智谱 2026-06-17 09:11 北京 今天,我们上线并开源GLM-5.2。在全球百万用户参与盲测的前端开发评估系统Code Arena上,GLM-5.2取得全球可用模型第一的表现。从2025初开始,我们几乎投入全部力量攻关Coding,历时大半年,细扣每一个代码环境的优化,终于迎来代码基座GLM-4.5,年底的GLM-4.7已经成为效果最好的国产Coding模型。但代码还不是AGI,在通往AGI的路上,还有更多的高山需要翻越,迎面而来的就是长程任务。当下最需要模型突破的是完成一个极长的,跨越数天、数周乃至数月的任务执行。当一个模型不知疲倦地在写软件工程代码,本质上是在学习一名顶级软件工程师的思维方式,然后以机器的耐力将其放大…
阅读全文智谱 2026-06-13 14:19 北京 在一些前沿模型突然变得不可用的时刻,我们选择相信另一条路:前沿智能不应只属于少数人,也不应被少数规则随时收回。它应该开放、可用、可构建,并服务于每一位开发者。GLM-5.2 是智谱迄今能力最强的开源模型,支持真正可用的 1M 上下文,并在长程任务中继续保持领先。它也依旧是我们心中最强的国产 Coding 模型。今晚 5:21,GLM-5.2 将面向 GLM Coding Plan 全量用户开放,覆盖 Lite / Pro / Max / 团队版。GLM-5.2 API 将于下周上线,模型下周正式开源,遵循 MIT 协议。A step closer to frontier intellig…
阅读全文智谱 2026-05-22 09:41 北京 Coding时代,速度是爽点。今天,我们面向部分企业客户提供GLM-5.1高速版API“GLM-5.1-highspeed”。模型输出速度达到400 tokens/s,刷新当前全球大模型厂商API的速度上限。这一速度意味着,一位写作者连续伏案数天才能写完的文字量,它在1分钟内便交付完毕;一名工程师埋头敲键盘3天才能完成的开发任务,它能在喝一杯咖啡的时间里完成。更重要的是,在过去,“快”往往意味着“小”,高速模型几乎总是轻量级模型。GLM-5.1高速版打破了这一行业惯例,首次在国产大模型中,将旗舰级能力与极致低延迟同时带入生产环境,无需再为响应速度牺牲模型质量。我们对比了GLM-5.1高速…
阅读全文智谱 2026-05-22 09:41 北京 近日,滴滴与智谱联合成立的“滴滴-智谱AI探索实验室”(DiDi–Z.AI Universe Lab)在北京正式启动。双方围绕通用人工智能(AGI)关键技术及其在出行领域的Agent应用开展前瞻性协同探索,共同推进Agent场景落地和大模型领域人才培养。作为滴滴产学研合作的新实践,实验室以滴滴的真实出行场景、Agent创新应用的丰富实践为牵引,结合智谱的大模型能力,聚焦“技术探索-场景验证-产品落地”的闭环,持续拓展智慧出行的边界。随着人工智能的发展,用户习惯于通过自然语言表达复杂需求,AI Agent成为重要交互形态。滴滴在大模型与Agent方向持续投入,AI打车助手上线后实现快速增长…
阅读全文