智谱AI科学家许斌:从追赶到先进,智谱要走一条普惠的可信智能之路

admin 2026-10-05 04:30:11 网络安全文章 来源:ZONE.CI 全球网 0 阅读模式

文章总结: 智谱AI科学家许斌在CSA大会上分享GLM大模型从追赶到领先的自主发展之路,强调自主可控与普惠可信智能。团队坚持原创研发,每两月迭代新模型,GLM-5.3具备网络安全能力,已发现2436个漏洞。未来聚焦前沿模型研发、自主可控与普惠性,让安全成为可信智能底座。 综合评分: 72 文章分类: AI安全,安全建设,解决方案,应用安全


智谱AI科学家许斌:从追赶到先进,智谱要走一条普惠的可信智能之路

张晓兵 张晓兵

国际云安全联盟CSA上海代表处

2026年9月30日 16:45 广东

在小说阅读器读本章

去阅读

在公众号小说中沉浸阅读

9月23日,2026 CSA大中华区大会暨AI+安全大会在清华大学主楼后厅举行。大会以“智序·本体:为可信智能时代筑基”为主题,来自政府单位、高校、科研机构和企业的代表围绕大模型与智能体安全、AI基础设施、AI智能安全治理与标准化等议题展开交流。

会上,清华大学教授、智谱AI科学家兼联合创始人许斌带来《自主可控的智谱GLM大模型的研究与应用》主题演讲,分享了GLM大模型从早期艰难起步,追赶世界领先者步伐,并最终成为世界领先者的AI原创自主发展之路。而今天,许斌站在CSA的大会舞台,强调:智谱要做世界领先的普惠“可信智能”。

(文末附完整演讲视频)

01

起航:一群人、一堆卡、一个开源模型

大模型研究既是科学热点,多次登上《Nature》《Science》封面;也是国际科技竞争的焦点。人民日报很早就下过判断,大模型的竞争也是科技战略的竞争,中国必须布局自己全栈自主的大模型产品。

许斌回顾了GLM开起的起点,2020年,当OpenAI推出第一个千亿参数规模的大模型GPT-3后,出现了智能涌现现象,但它90%的训练语料都是英文,是一个以英语为母语的数字大脑。

2020年底,智谱团队开了个会,在智谱AI首席科学家张钹院士的指导下,团队下定决心:努力研发一个“以中文为核心”的高水平大模型。

起手的难度很大。研发基座大模型需要算力、数据和算法。算力方面,最好要有一万张卡,一张卡20万元人民币,一万张卡就是20亿元,一开始很难满足。团队克服各种困难,要么借、要么租、再买一点点,把早期的算力凑齐,开始研发自己的大模型。

经过一年多的努力,2022年8月,团队终于训出第一个千亿参数规模的大模型GLM-130B(B是billion,130B即1300亿参数),并把它开源。

在全球评测中,GLM-130B可以和GPT-3匹敌:准确性、幻觉性上跟它差不多,鲁棒性和校准误差在所有模型中表现最好。更重要的是,训好的模型可以和国产芯片适配——训练时还在英伟达卡上进行,但训好之后的推理应用阶段,可以在国产芯片上运行。

02

原创:一个本科生,一套自主算法

这个过程中,团队一直坚持原创自主。GLM的全称是General Language Model,即通用语言模型,发表在国际CCF A类会议ACL上。这项工作最早由一位大四本科生做出,他读到博士一年级时,正好把论文发表出来。

有了GLM-130B以后,团队持续推出各种各样的模型。智谱的研发过程,也可以看作团队追赶世界先进水平的每一段历程。从时间上,有的模型比对方晚半年,有的晚两年;但在性能上,能达到对方的90%到100%,至少做到了“人有我有”,避免被卡脖子。

团队的工作也得到国际学术同行的高度瞩目。《Nature》在2024年发表报道,来自中国的多个大模型团队在研发以中文为主的大模型方面做出了很大贡献,其中ChatGLM便是佼佼者之一。

03

突围:实体清单下,每两个月一个模型

正是因为智谱团队作为中国大模型的先行者和先锋队、坚持原创自主,团队得到国家领导人的高度重视。2024年李强总理考察北京科技创新工作时,特意听取团队负责人的汇报;同年在济南召开的全国企业家专家座谈会上,团队负责人受邀参会,并在会后受到习近平总书记接见。

不仅中国政府重视,美国政府也相当重视,重视的措施就是制裁。2025年1月,智谱被美国商务部列入实体清单,包括所有子公司。

怎么办?唯一的解法就是更努力、跑得更快,在全世界大模型竞争的牌桌上,要能经常拿出好的作品。于是团队的节奏是每两个月必须发布一个新模型,而且必须属于世界前列:最好进前10,至少也得前25,要在Artificial Analysis榜单上有名字。

04

发展:从“回答问题”到“完成复杂任务”

2026年2月,智谱推出GLM-5.0,把推理、Agent和编程能力三位一体,集成在一个模型中,在Artificial Analysis测试中名列世界第四。前三名是OpenAI和Anthropic的模型,都是闭源模型,GLM-5.0是开源模型中排名第一。

又过了两个月,4月推出GLM-5.1。5.1在单科上,也就是coding这件事上,冲到了开源第一名;更重要的是,它具备了长程任务能力,可以完成8个小时的任务,自主决策并执行。

又过了两个月,6月17日推出GLM-5.2。5.2的特点是百万上下文,上下文窗口更大,可以用它做更多事情。发布当天,智谱也和国内主流的8款GPU芯片完成了适配,形成国产大模型的应用生态。

05

进阶:大模型的安全底牌,不能攥在别人手里

8月14日,智谱推出GLM-5.3。5.3一方面继续加强编程能力,强在完成同样任务需要消耗的Token数量少了,可以帮大家省钱;另一方面,涌现出了网络安全能力。

许斌举了一个例子。今年7月,OpenAI在训练最新模型时,要测试它的网络攻击能力,本来把它限制在一个沙箱里,结果它跑了出来,攻击了Hugging Face。Hugging Face先把受攻击的信息拿去问OpenAI和Anthropic的模型,对方拒绝回答,因为问的是敏感问题;后来他们用自己的GPU服务器下载了GLM-5.2,安装后在内部询问如何解决受攻击的问题,最后真的解决了这个难题。

其实智谱从去年开始就关注用大模型增强网络安全能力,所以5.3推出的同时,也联合国内很多安全厂商,用它来发现软件漏洞。到目前为止,已经发现了2436个;据报道,其中几个漏洞如果去拿赏金,价值大概有3000多万。

AI安全不再只是“保护AI”,AI本身也正在成为安全能力的重要组成部分。一方面,大模型及智能体可能产生新的攻击面,需要建立相应的安全防护体系;另一方面,大模型自身的推理、代码理解和漏洞分析能力,也可以被用于安全检测、漏洞发现和风险分析。

这与本届大会关注的AI安全边界变化形成了呼应——当AI从内容生成进一步进入代码开发、系统操作和业务流程,安全的对象、工具和边界也随之发生变化。

06

普惠:从“更强”到“更普惠”

除了追求模型能力的提升,许斌还特别谈到了一个容易被忽略的问题:大模型不仅要足够聪明,还要足够“用得起”。

8月底,GLM进一步推出GLM-5.3 Flash。Flash智力水平比5.3低5个点,但价格是5.3的二十分之一,非常优惠;而且它是在国产芯片上进行推理服务,在10万卡规模的国产芯片上提供服务。许斌将这一阶段概括为:“前沿智能进入普惠时代”。

从高性能模型到低成本模型,从云端服务到国产芯片适配,再到开源模型生态,模型的价值正在从单纯追求性能指标,逐渐扩展到可获得、可部署、可应用和可持续使用。真正能够成为基础设施的大模型,需要同时解决智能、安全、成本与可用性。

07

未来:AI正在进入“长程任务”时代

展望未来,许斌将视线放到了下一阶段的大模型如何发展上。

他介绍,智谱未来仍将持续推进Scaling,同时探索“用AI训练AI”,即利用AI参与模型训练和优化。与此同时,模型能力也将从长程任务进一步向自治系统演进。

这意味着,大模型发展的下一阶段可能不再只是单纯扩大参数规模或增加知识,而是让模型拥有更强的持续规划、自主执行、环境适应和任务完成能力。

而当模型开始承担越来越多复杂任务后,“安全”也将从模型外围的防护机制,进一步进入模型、智能体、工具、数据和基础设施本身。因此,智能能力越强,可信与安全的重要性也越突出。

08

终章:让自主可控成为可信智能的底座

从2022年的GLM-130B,到今天不断迭代的GLM系列,大模型技术正在经历从“模型能力竞争”向“智能系统竞争”的转变。

在许斌看来,智谱未来的努力方向主要集中在三个方面:

第一,研发世界水平的前沿基础大模型GLM,为人工智能提供智能底座与基础设施;

第二,构建自主可控的基础大模型,保障我国重要行业智能应用的系统安全;

第三,提升大模型的智能上界与普惠性是提高大模型基础设施水平的关键。

从这个意义上看,“自主可控”并不只是一个技术目标,也对应着AI基础设施建设中的长期能力。而对于正在进入智能体时代的AI产业而言,模型、算力、数据、工具与安全能力之间的关系也正在变得更加紧密。

从模型出发,向基础设施延伸;从智能出发,以安全为底座。这或许正是可信智能时代需要回答的核心问题之一,也是智谱团队接下来的发展路径。

相关阅读

为可信智能时代筑基:2026 CSA大中华区大会暨AI+安全大会聚焦基础设施安全与产业实践


免责声明:

本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。

任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。

本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我。

本文转载自:国际云安全联盟CSA上海代表处 张晓兵 张晓兵《智谱AI科学家许斌:从追赶到先进,智谱要走一条普惠的可信智能之路》

评论:0   参与:  0