智谱GLM:AI在十万卡国产集群上自建推理系统 两周推理吞吐大幅提升
今日,智谱GLM团队披露递归自我改进方向首个工程化实践进展,也就是让AI自己动手改进自己的运行系统。具体来说,由GLM-5.3驱动的Infra Agent在超过10万张国产芯片组成的集群上,从零搭建并调试推理服务,不到两周把整体处理速度提升到原来的3倍,硬件利用效率和单Token成本接近与主流英伟达GPU相当水平。这套系统已投入线-Flash以匿名模型Ox-Alpha在OpenCode、OpenRouter上线天Token调用量超过62万亿。这是国内大模型厂商首次公开将“AI自我改进”用于生产环境,意味着AI不再只是写代码,还能参与整个推理系统的工程闭环。
特别
光刻胶,接下来怕是要“火”了!日本三巨头突然官宣:10月1日起,面向全球客户的光刻胶价格全线%。更狠的是,现货价直接跳涨38%
美联储主席回应加息:美国通胀太高且持续过长;特朗普:美国利率必须降,而且要快!美股应声下跌,白宫:加息决定“相当不幸”
小米澎湃HyperOS 4 Beta版第三批机型开推,覆盖REDMI K100 Pro系列等
华硕海外推出新款TUF Gaming 16 2026游戏本,RTX 5050显卡、144Hz屏幕
