GLM-5.3-FlashX 上线:200 tokens/s
GLM-5.3-FlashX 上线:200 tokens/s智谱上线 GLM-5.3-FlashX 模型,推理速度最高达 200 tokens/s,较 GLM-5.3-Flash 提速 5 倍、提价 2.5 倍,API 同步开放,该模型在 10 万张国产芯片提供的推理算力基础上,由 GLM-5.3 驱动 Agent 在两周内完成端到端构建并通过 Infra 侧优化将吞吐提升至初始基线的 3 倍。
搜索
智谱上线 GLM-5.3-FlashX 模型,推理速度最高达 200 tokens/s,较 GLM-5.3-Flash 提速 5 倍、提价 2.5 倍,API 同步开放,该模型在 10 万张国产芯片提供的推理算力基础上,由 GLM-5.3 驱动 Agent 在两周内完成端到端构建并通过 Infra 侧优化将吞吐提升至初始基线的 3 倍。
智谱创始人唐杰发文披露RSI最新进展,称由GLM-5.3驱动的Infra Agent在超过10万卡国产芯片集群上不到两周内完成GLM-5.3 Flash生产级推理服务搭建,将端到端吞吐提升至初始基线的3倍,表明RSI最小闭环已经形成但距离递归自我改进仍很遥远。
智谱首席科学家唐杰发布 GLM-5.3-Flash 推理系统优化成果,模型仅用两周在超 10 万颗国产 AI 加速器集群上完成生产部署,端到端吞吐提升 3.2 倍,并由 GLM-5.3 驱动的 Infra Agent 参与瓶颈分析与代码修改,标志着智谱首个 RSI(递归自我改进)早期形态的落地。
上市不到九个月,智谱一口气再融335亿元。
智谱宣布完成约50亿美元融资,募资净额约60%将用于下一代GLM基础模型及完全自训练体系(含递归式自我改进RSI)的研发,并支撑算力基础设施建设,同时约15%用于业务拓展与战略投资,约25%用于优化资本结构与补充营运资金。
智谱在天猫开设旗舰店,上架GLM Coding Plan Token订阅套餐,成为首家将核心Token产品搬上传统电商货架的上市大模型公司。
中国大模型商业化的一次分层。
这几天 ox-alpha 用爽了吧...正如很多人猜的那样,这个模型来自智谱,正式名称为 glm-5.3-flash,支持多模态,但很多人没猜到的是:这个乱杀的模型只有 321B,且与 glm-5.3 不同,是完全的新架构
一对清华师生,两家AI公司。十多年前,唐杰和杨植麟还只是清华实验室里的一对师生。如今,唐杰联合创办了智谱AI,杨植麟带领月之暗面(Moonshot AI)。智谱港股上市后市值一度突破1万亿港元,月之暗面则在2026年完成F轮融资后估值达到350亿美元。
8月26日,据彭博社报道,智谱AI确认,近期匿名上线的Ox Alpha由其开发,是GLM系列的新一代模型。Ox意为“牛”,恰逢电影《牛来》走红,因此中文开发者社区把Ox Alpha叫作“牛来大模型”。