本文自南都。
***写 | 南都N***记者 林文琪
2月21日,“全球大模型第一股”智谱AI(02513.HK)发布致歉信称,GLM-5发布后GLM Coding Plan存在透明度不够、GLM-5灰度节奏太慢、老用户升级机制设计粗糙三大问题,表示“挨打要立正”,并提出了相应的处理和补偿方案。致歉信提到,GLM-5发布后,流量超出预期,智谱扩容节奏没有跟上,不得已将GLM-5按照Max、Pro、Lite的顺序逐步开放。
值得一提的是,截至最新交易日(2月20日),智谱股价暴涨42.72%至725港元,市值突破3200亿港元。
2月12日,智谱发布新模型GLM-5,该模型Coding与Agent能力上取得开源SOTA表现。智谱方面表示,GLM系列模型受到全球开发者喜爱,在GLM Coding Plan全球爆量后官方不得不启动限售活动。
GLM Coding Plan是智谱重押的业务模式。此前智谱CEO张鹏在接受媒体***访时披露,智谱面向全球开发者的模型业务(GLM Coding Plan)年度经常性收入(ARR)已超过1亿元人民币,约合1400万美元。
2月16日,智谱也发文表示,由于全球范围内对GLM-5的需求激增,并且访问量突破了既有规划的上限,导致服务出现排队、响应延迟及卡顿现象,影响到部分用户的体验,对此内部已经多次对国产芯片集群进行扩容,并限量发售了GLM Coding Plan套餐,但依然无法彻底解决当前供不应求的局面。
为此,智谱启动“算力合伙人”招募***:对于芯片厂商,智谱愿开放核心技术接口联合开展针对 GLM-5 的底层优化,共同打造极致的软硬一体化性能标杆;对于算力伙伴与推理服务商,如果拥有大规模、高稳定性的算力池,或具备卓越的推理分发能力,智谱期待共建更高并发、更低延迟的推理网络。
不过2月21日,智谱就该业务向开发者致歉。智谱在致歉信中提到,GLM-5发布后,有老用户反馈消耗变快了。智谱表示,“GLM-5的参数规模是GLM-4.7的两倍以上,定位是效果逼近Claude Opus 4.5的‘大杯’模型,适合复杂任务。为了让更多用户能把GLM-5用在真正需要的场景,我们设计了分层使用策略:日常简单任务优先用GLM-4.7,GLM-5按高峰期3倍、非高峰期2倍的消耗计算。尽管我们提前对消耗倍数做了准备,但没提前算清楚账给到大家,这是我们的失误。”
在体验方面,智谱也表示,近期GLM Coding Plan遭受灰产号池和黄牛党冲击,恶意占用了大量***。与此同时GLM-5发布后,流量超出预期,智谱扩容节奏没有跟上,不得已将GLM-5按照Max、Pro、Lite的顺序逐步开放。目前Max用户已经全面开放,Pro用户虽已开放,但高峰期可能会因集群负载较高遇到限流,Lite用户将会在节后非高峰期逐步灰度开放。
针对受到影响的Lite和Pro用户(不分新老),智谱支持自主申请退款。退款遵循2026年1月1日至2月21日,“智谱全部请客”的原则。
附致歉信全文:
返回搜狐,查看更多
{dede:pagebreak/}
张雷获国际能源界顶级殊荣:为文明新繁荣,打造永续、智能、普惠的未来能源底座_全球_人类_中国
阿里平哥头自研AI芯片“真武”正式上线_模型_通云_服务
春晚总导演于蕾发声:春晚接受观众意见,40年来一直是传统_数据_方式_总台
出货量超寒武纪,阿里系芯片公司揭开神秘面纱_达摩_中天_市场
憋了这么久,三星终于甩出了“王炸”,全球首发2nm手机芯片!_Exynos_系统调度_核心
AI这块蛋糕,英伟达只吃奶油_OpenAI_Triton_NVLink
“透明玻璃”光芯片诞生!有望用于精密测量、AI算力和量子计算_损耗_光子_光纤
是“Seedance 时刻”,但字节的野心可以更大些_***_杨立昆_复用
“2分钟科幻片成本330元”:影视圈被Seedance 2.0 打懵了_***_Mia_镜头
马斯克又改口:先造月球城市 再登陆火星_SpaceX_美国_建设
中国第一大忽悠,又“杀”回来了_贾跃亭_机器人_生态化
硅谷最新调研:2026 年,AI Agent 到底会走向哪?_智能_组织_生产方式
2025年全球畅销手机榜出炉:苹果独占七席,iPhone 16系列包揽前三_市场_榜单_Ultra
机器人全面“入侵”央视春晚,成最忙的特别风景,网友心情矛盾:自豪又担忧_表演_节目_蔡明
壕炸天!吉比特送出千万房产,游戏大厂年会狂撒钱_公司_世纪华通_业绩
中国AI半导体加速“脱英伟达”,半导体国内自给率到2026年将提高至8成_张建中_份额_产品