“AI大牛股”公开技术细节。
今日下午,“全球大模型第一股”智谱正式发布了GLM-5技术报告。智谱表示,GLM-5能够实现性能的大幅跃升,主要得益于四大技术创新。GLM-5在真实世界编程任务中展现出前所未有的能力,在处理端到端软件工程挑战方面超越了此前所有开源基线。
股价表现方面,周五(2月20日),智谱股价单日大涨42.72%,报725港元/股,股价再创新高,总市值达3232亿港元,上市43天股价累计涨幅已超500%。消息面上,在发布GLM-5后,由于供不应求,智谱宣布上调GLM Coding Plan套餐价格,中国区涨价30%,海外版涨价超100%。
智谱最新发布
2月22日下午,据智谱官微消息,智谱推出了GLM-5,这是一款旨在推动编程范式从“VibeCoding”(氛围编程)转向“AgenticEngineering”(智能体工程)的下一代基础模型。GLM-5在前代模型GLM-4.5的智能体、推理与编程(Agentic,ReasoningandCoding,ARC)能力基础上,***用稀疏注意力(DeepSeekSparseAttention,DSA)以大幅降低推理成本,同时保持长上下文能力无损。
为了让模型更好地与各类任务对齐,智谱构建了一套新型异步强化学习(RL)基础设施,通过将生成过程与训练过程解耦,从而大幅提升了后训练的迭代效率。此外,智谱还提出了全新的异步Agent强化学习算法,进一步提升强化学习的效果,使模型能够更有效地从复杂、长程交互中学习。
智谱称,基于上述创新,GLM-5在主流的开放基准测试中实现了SOTA性能。最关键的是,GLM-5在真实世界编程任务中展现出前所未有的能力,在处理端到端软件工程挑战方面超越了此前所有开源基线。
智谱指出,GLM-5在性能与计算效率上实现了跃升,不仅在ArtificialAnalysis.ai、LMArena文本与代码等主要榜单中均达到SOTA水平,更重塑了真实世界的编程标准。它突破了SWE-bench等传统静态测评的考察边界,在处理复杂的端到端软件开发任务时,展现出了前所未有的强大能力。
四大技术创新
据GLM-5技术报告,GLM-5能够实现性能的大幅跃升,主要得益于以下四大技术创新:
第一,引入DSA稀疏注意力机制(DeepSeekSparseAttention,DSA)。这一全新架构极大降低了训练与推理成本。此前的GLM-4.5依赖标准MoE架构提升效率,而DSA机制则使GLM-5能够根据Token的重要性动态分配注意力***。在不折损长上下文理解和推理深度的前提下,算力开销得以大幅削减。得益于此, 智谱将模型参数规模成功扩展至744B(7440亿),同时将训练Token规模提升至28.5T(28.5万亿)。
第二,构建全新的异步RL基础设施。基于GLM-4.5时期slime框架“训练与推理解耦”的设计, 智谱的新基建进一步实现了“生成与训练”的深度解耦,将GPU利用率推向极致。该系统支持模型开展大规模的智能体(Agent)轨迹探索,大幅减缓了以往拖慢迭代速度的同步瓶颈,让RL后训练流程的效率实现了质的飞跃。
第三,提出全新的异步AgentRL算法。该算法旨在全面提升模型的自主决策质量。GLM-4.5曾依靠迭代自蒸馏和结果监督来训练Agent;而在GLM-5中, 智谱研发的异步算法使模型能够从多样化的长周期交互中持续学习。这一算法针对动态环境下的规划与自我纠错能力进行了深度优化,这也正是GLM-5能够在真实编程场景中表现卓越的底层逻辑。
第四,全面拥抱国产算力生态。从模型发布伊始,GLM-5就原生适配了中国GPU生态。 智谱已完成从底层内核到上层推理框架的深度优化,全面兼容七大主流国产芯片平台:华为昇腾、摩尔线程、海光、寒武纪、昆仑芯、天数智芯与燧原。
智谱表示,“凭借上述进步,GLM-5不仅是一个更强大的模型,更是下一代AI Agent 更高效、更实用的基础模型。我们向社区开源GLM-5,以进一步推动高效的、面向 Agent 的通用人工智能的发展。”
智谱致歉
昨日(2月21日)晚间,智谱在“智谱开放平台”微信公众号发布GLM Coding Plan致歉信,并公布处理和补偿方案。
智谱称,这次改版主要犯了三个错:规则透明度不够、GLM-5灰度节奏太慢、老用户升级机制设计粗糙。
据了解,GLM Coding Plan上线即售罄,国产AI编程模型的付费套餐被抢空,在行业中颇为罕见。
需求火爆导致GLM Coding Plan的用户体验受到影响。在致歉信中,智谱解释称,其近期遭受灰产号池和黄牛党冲击,恶意占用了公司大量***。同时,GLM-5发布后,流量超出预期,公司扩容节奏没有跟上,不得已将GLM-5按照Max、Pro、Lite的顺序逐步开放。
目前Max用户已经全面开放,Pro用户虽已开放,但高峰期可能会因集群负载较高遇到限流,Lite用户将会在节后非高峰期逐步灰度开放。
针对受到影响的Lite和Pro用户,智谱支持自主申请退款。
此前在2月12日,智谱发布新一代旗舰模型GLM-5,并在海外走红。在Coding与Agent能力上,GLM-5取得开源SOTA表现,在真实编程场景的使用体感逼近Claude Opus4.5,擅长复杂系统工程与长程Agent任务。
在发布GLM-5后,由于供不应求,智谱宣布上调GLM Coding Plan套餐价格,中国区涨价30%,海外版涨价超100%,成为国内首家对大模型商业化服务进行提价的AI原生企业。
责编:杨喻程
排版:汪云鹏
校对:苏焕文返回搜狐,查看更多
月销量跌至45辆!被耗尽的小米SU7 Ultra || 深度_销售_林露_崇义...
跟Claude掰腕子,智谱MiniMax双模齐发_模型_agent_Bench...
印度一大学买宇树科技机器狗冒充自研,光速露馅_加尔戈蒂亚斯_社交_媒体...
我把Agent拉进群聊,它竟然开始带队干活?全球首个AI社交通用平台来了!_亲朋好友_***_需求...
苹果2026爆发式更新:换模Mac、重塑iPhone形态,为下一个十年铺路?_Pro_芯片_Studio...
它的使用起源于对航空安全的严格要求,尤其是在现代航空业面对的恐怖主义威胁日益增多的背景下,痕量检测技术已成为机场安检系统中的重要组成部分。 纸片随后会被放入专门的检测设备中,这些设备可以通过分析纸片上的化学反…...
马斯克深夜「破防」:中国AI将不战而胜,美国唯一的希望在太空?_机器人_ChatGPT_企业...
贴脸嘲讽ChatGPT后,这家公司又发了个最强模型。_Opus_Claude_上下文...
能够在这样的高成本结构下实现季度盈利,本身就说明其运营效率、成本控制和收入结构正在发生质的变化,这绝非偶然,而是多年试错与战略调整后的阶段性成果。正是这种双轨并行的策略,使得蔚来在2025年实现了销量的爆发式…...
寻找桌面Agent红利下的卖铲人_OpenClaw_运行_agent...
千问日活逼近,豆包为什么还敢把红包留到春晚?_模型_字节_阿里...
21 岁,他以姚班第一的成绩力压清华一众顶尖学霸,成为2016年十位清华大学特等奖学金获得者之一。 进入大学后,陈立杰的志趣从竞赛转向了科研,当时最为人津津乐道的是,本科生的他选修了研究生课程《高等理论计算…...
这意味着原本成本就不高的AI漫剧,每分钟的制作成本将从万元跌至千元,整整打了一折。" 她知道自己在训练AI,直到AI可以取代自己,这就是所谓的被AI“炼丹”了。联想到那些被压价的抽卡师,蔺林猜测公司现金流…...
彩虹YH-1000S无人运输机由中国航天科技集团十一院研制,以2025年5月首飞的YH-1000无人运输机为基础研制,重点开展技术升级优化,最大亮点是首飞挂载了与新能源汽车头部企业联合研发的大功率混合动力总…...
组团上春晚、宇树和智元争第一,机器人的集体焦虑:量产和上市迎新一轮***_企业_松延_科技...
但不可否认的是,这一玩法为拼多多低价拉新:仅用一百元,就可以给拼多多带来数十甚至上百名好友(包括新用户)的点击、下载和注册。 根据研究机构QuestMobile于2025年12月底发布的报告,在统计周期(2…...
中国第一大忽悠,又“杀”回来了_贾跃亭_机器人_生态化...
叮咚改道,美团“补仓”_前置_零售_盈利...
贴脸嘲讽ChatGPT后,这家公司又发了个最强模型。_Opus_Claude_上下文...
王兴兴:现阶段机器人技术与10岁小孩接近 大规模应用还需时间_宇树_科技_卫诗...
搜狐科技:2025年国内商业航天发射占比达54%,2026年又迎来低轨组网、可回收火箭攻坚的关键年,您认为商业航天的“火”是产业质变的必然吗? 霍亮:中国商业航天已不再是几家火箭公司的故事,而是覆盖了火箭研…...
年销5500台全球第一,谁在买宇树的人形机器人?_市场_产业_行业...
阿里巴巴蔡崇信:我也被马云「开除」过_业务_团队_首席...
博主在高铁上,手里拿着一个空气检测仪,上面的二氧化碳数值从一开始的2-300ppm(百万分率,常用的浓度单位,表示一种物质在一百万份另一种物质中的数量),结果下一个场景,大家歪七扭八地昏睡着,检测仪上的数字…...
粤IP*******|网站地图粤IP*******|网站地图 地址: 备案号: