WORK / ArchiveKelly Personal Marketing Intelligence OS
阅读READ
每日简报Daily Brief市场情报Market Intelligence品牌案例库Brand Casebook公司研究Company Dossier
收听与学习LISTEN & LEARN
播客Podcasts商务英语Business English
创作CREATE
创意工作室Creative Studio视觉素材库Visual Library作品集Portfolio
职业CAREER
面试题库Interview Bank营销工具箱Marketing Toolkit
资料库LIBRARY
收藏集Collections观察名单Watchlists来源体系Sources
我的Profile设置Settings
⌘K
更新于 —KKelly
今日情报播客来源我的
WORK / ArchiveKelly Personal Marketing Intelligence OS
阅读READ
每日简报Daily Brief市场情报Market Intelligence品牌案例库Brand Casebook公司研究Company Dossier
收听与学习LISTEN & LEARN
播客Podcasts商务英语Business English
创作CREATE
创意工作室Creative Studio视觉素材库Visual Library作品集Portfolio
职业CAREER
面试题库Interview Bank营销工具箱Marketing Toolkit
资料库LIBRARY
收藏集Collections观察名单Watchlists来源体系Sources
我的Profile设置Settings
⌘K
更新于 —KKelly
WORK / ArchiveKelly Personal Marketing Intelligence OS
阅读READ
每日简报Daily Brief市场情报Market Intelligence品牌案例库Brand Casebook公司研究Company Dossier
收听与学习LISTEN & LEARN
播客Podcasts商务英语Business English
创作CREATE
创意工作室Creative Studio视觉素材库Visual Library作品集Portfolio
职业CAREER
面试题库Interview Bank营销工具箱Marketing Toolkit
资料库LIBRARY
收藏集Collections观察名单Watchlists来源体系Sources
我的Profile设置Settings
⌘K
更新于 —KKelly
Market Intelligence/量子位

刚刚,GLM-5.3发布:Coding更接近Fable 5!潜伏40年的bug都被揪出来了

顺手拿下最强开源安全模型

十三·2026.08.14·4 min 阅读
事件背景基于真实抓取数据整理

本条来自 量子位(AI / 中文),聚焦 technology。 昨儿DeepSeek V4 Pro正式版+Harness、Grok 4.6“你方唱罢”,今儿 GLM-5.3 闪亮一记 “我登场” ——

Original Intelligence基于真实抓取数据整理

顺手拿下最强开源安全模型

  • 在 28分钟 后,一个中文版的指环王基准,就水灵灵地做出来了:
  • 视频地址:
  • 视频地址:
  • 视频地址:
  • 昨儿DeepSeek V4 Pro正式版+Harness、Grok 4

顺手拿下最强开源安全模型

昨儿DeepSeek V4 Pro正式版+Harness、Grok 4.6“你方唱罢”,今儿 GLM-5.3 闪亮一记 “我登场” ——

一出手便杀回 开源一哥 、 国模一哥 ,甚至在Coding方面更加 接近Claude Fable 5!

也就是说,唐杰给马斯克“画的饼”(说国产模型超越Fable 5不会太久),往前拱了一大截,也就花了2个月整。

在多项主流基准测试中,GLM-5.3是当前 排名最高的开源模型 ,编程与智能体能力接近Claude Fable 5,编程 体感 超过其他国产模型。

更值得注意的是不同推理强度下的表现。随着Token预算增加,GLM-5.3的Coding准确率继续往上走;在High档位下,已经能以明显更低的Token消耗,做到超过Claude Opus 4.8最高档位的准确率。

但你先别急着“嚯~”、“好家伙”,因为好戏还在后头。

这次GLM-5.3除了Coding之外,另一个更重要的关键词,是 安全 。

在CyberGym白盒代码审查中,GLM-5.3拿到84.5%,相比5.2的77.2%继续提升,也略高于Mythos 5和GPT-5.6 Sol,一举成为 最强开源安全模型 。

并且在GLM-5.3发布前两周,智谱就联合清华、南开,以及国内众多企业、实验室,开展了密集的红队测试与安全评估。

据悉,累计发现漏洞2404个(经过初筛、去重),其中1088个为中高危,覆盖系统内核、操作系统、浏览器引擎、开源基础组件、互联网应用与互联网协议等220个项目。

所以,这次智谱发布GLM-5.3,两个关键词便一目了然了:一个是Coding,另一个是安全。

不意外,GLM-5.3一出,瞬间在X引发了大量的关注和热议,网友们已经把它称作 “Fable 5级” 了:

不得不说啊,这次GLM-5.3又在国际上把国产AI给支棱起来,这盛况,真是应了揽佬的“名人名言”:

最重要的一点是,在体验GLM-5.3的真实过程中,我们的体感真真儿的可以用一句话来概括:

丝滑,相当的丝滑! 是有点 超预期 在身上的。

我们这次所有的实测,都会在智谱自家的Harness,即 ZCode 里进行。

第一个任务,就拿 Karpathy 最新抛出的 指环王基准 来小试牛刀一下。

在把《指环王》第一章开头的文字和对应Prompt输进去之后,模型选择我们提前拿到的内测GLM-5.3,并把模式变成“完全访问”,保证全程无人工干预:

然后,GLM-5.3就自己唰唰唰地开始干活了,你只需要做的,就是等:

在 28分钟 后,一个中文版的指环王基准,就水灵灵地做出来了:

视频地址:

https://mp.weixin.qq.com/s/LXLsciw8OqStAyxWnktbzg

Karpathy设计的这个任务,考验的是模型能否长时间自主规划、写代码、摆放3D资产、编排动画并做出完整可运行作品。

并且我们在Prompt中还刻意加大了难度,让AI根据原文自行改编成约90秒中文旁白,但不能改变核心情节。

从GLM-5.3的结果来看,它不仅可以hold住这项测试的基本要求,更能从文学文本里抓重点,并把文字重新组织成视听语言。

这类任务的难点,其实也不只是Three.js能不能跑起来。模型得先把一段文学叙事拆成场景、人物、镜头和时间线,再一路落进代码里,最后还得保证90秒的内容能连续跑起来。

为了更直观地感受GLM-5.3 Coding能力的提升,我们还用一模一样的Prompt和设置,让GLM-5.2跑了一遍:

视频地址:

https://mp.weixin.qq.com/s/LXLsciw8OqStAyxWnktbzg

接下来,我们加大难度,让它再做一个可以完全交互的3D手表解构的Demo。

在输入完Prompt之后,GLM-5.3依旧是自己开始操作,遇到需要修复的地方,也会自行检查做调整:

视频地址:

https://mp.weixin.qq.com/s/LXLsciw8OqStAyxWnktbzg

在没有任何扫描、没有下载任何手表相关模型的情况下,手表各处细节都能被解构得明明白白,而且是把镜头拉到特别大也是能hold住的那种。

相比前面的“指环王基准”,这一关考的又不太一样:一块完整的表好画,但拆开以后,表盘、机芯、齿轮和表链之间的空间关系还能不能保持住,才是考验3D Coding的地方。

不过有一说一,上面两个实测效果虽然还算不错,但终归是属于演示级别的Demo。

因此,Coding能力的最后一个实测,我们尝试GLM-5.3是否能做 可交付的模拟游戏 。

也就是说,这个任务跑下来,它不仅是有视觉效果,还得是有后端、有数据库、有权限、有测试、有部署的完整模拟游戏。

这次任务较为复杂,GLM-5.3总共花了40分钟。

但对于此次任务的验收,我们不能停留在只放出来最终效果,且得一步一步验证。

然后我们进入游戏后进行操作,点击 保存到数据库 ,并退出游戏;要保证进来后还是刚才 存档的进度 :

权限 测试方面,我们退出刚才的账号,再重新注册一个;进入游戏后,我们不难发现2个账号的信息是 互相看不到 的。

这就证明GLM-5.3已经跑通了权限的设置:

❧
Industry Analysis规则派生 · 可核对

本条目归入「Technology AI」垂直,涉及真实话题:technology。

· 市场:关注 technology 对相关品类与竞争格局的潜在影响。

· 消费者:受众行为与偏好变化值得追踪。

· 品牌:本动向对品牌资产建设的启示。

· 渠道:内容分发与触点组合(社媒 / 电商 / 线下)的协同值得复盘。

Marketing Insight规则派生 · 可核对

· 核心话题:technology。

· 可思考:如何把「technology」的洞察,转化为可衡量的内容与增长动作?

Career Usage规则派生 · 可核对

面试中可引用「刚刚,GLM-5.3发布:Coding更接近Fable 5!潜伏40年的bug都被揪出来了」:围绕 technology,说明你对行业动向的判断与可落地动作。

本条目相关英文术语可在「商务英语」模块按话题检索,用于外企面试表达训练。

关联播客真实 RSS 单集
Pump and circumstance: is China the new OPEC?
The Intelligence · 2026.08.12
The Innovation Strategy Most Companies Miss
HBR IdeaCast · 2026.08.11
Spring, then fall: a weakened Muslim Brotherhood
The Intelligence · 2026.08.11
延伸信源A / B 级权威来源 · 供深挖
Marketing BrewACampaignAThe DrumAWARCAAdweekADigidayA
Business English提取正文真实商业词汇
ai
ai

不得不说啊,这次GLM-5.3又在国际上把国产AI给支棱起来,这盛况,真是应了揽佬的“名人名言”:…

系统商务英语 →
关联 English Brief
面向多模态推理的高效长上下文建模|AICon深圳
InfoQ 中文
“AI版金融创新”:博通大跌背后的AI芯片“卖方担保”模式
华尔街见闻
来源
阅读原文 · 量子位 ↗
发布:2026.08.14
类型:AI / 中文
话题:technology
相关阅读
量子位/2026.08.15
对话郎咸朋:用机器人创业重做一次“百万智驾量产”
量子位/2026.08.14
刚刚,Qwen3.8-27B 开源了!家用显卡也能跑
量子位/2026.08.14
7亿年薪留不住!余家辉离职Meta创业
量子位/2026.08.14
太初元碁助力国家级“AI+教育”大赛 “AI+加速卡模型适配赛道”开启招募
量子位/2026.08.14
百度文库网盘「库库AI」AI办公MAU超2500万,新推办公独立端
个人笔记
自动同步到云端