最近智谱官方发了份公告,透露了不少有意思的信息。简单来说,随着 GLM-4.7 正式上线,GLM Coding Plan 的用户量一下子冲得很猛,直接把算力资源压得有点喘不过气。不少用户在高峰期(尤其是工作日下午三点到六点)遇到了限流提示、响应变慢甚至推理卡顿的情况——说白了,就是人太多,服务器有点扛不住了。

技术团队的反应还算快,已经紧急启动算力扩容。但为了稳住现有用户的体验,官方同步推出了几项临时调整:
- GLM Coding Plan 即日起限量发售——每天的可售配额砍到原来的20%,优先保证老用户的算力供给,让编程体验别受太大影响。这个限售从1月23日早上10点正式开始,之后每天10点更新额度。已经开通自动续订的用户完全不受影响,照常运行。什么时候恢复不限量?得看扩容进度,官方会另行通知。
- 加强流量治理,升级异常行为识别能力。简单说就是,那些恶意刷量、高频低质量的调用会被重点盯防,该限就限,该封就封,坚决不让非理性占用拖累整体服务。
公告里还有一段挺真诚的话:"我们正全力推进更先进、更高性能的新一代模型研发,并同步加快基础设施建设节奏。更卓越的 GLM Coding Plan 将在不久后如期而至。短期的限量调控,是为了兑现长期稳定的高品质服务承诺。"——翻译成大白话就是:好产品马上来,现在忍一忍,后面会更香。