服务端检索
24小时新闻
本页 25 / 共 55 条市场新闻0
全部25 条
智谱GLM团队披露递归自我改进工程化实践:GLM-5.3驱动的Infra Agent在超10万张国产芯片集群上从零搭建推理服务,不到两周处理速度提升至3倍,GLM-5.3-Flash以匿名模型Ox-Alpha上线6天Token调用量超62万
打开永久阅读页 ↗打开后标记为已读
J/K 切换S 收藏F 专注模式
重要度82
影响方向正向
影响强度+85
分析置信72%
2026年9月17日,智谱创始人兼首席科学家唐杰披露了智谱在递归自我改进方向的首个工程化实践。由GLM-5.3驱动的Infra Agent完成了GLM-5.3-Flash推理基础设施的设计、调试与优化,实现模型对自身运行系统的反向改进。这是国内大模型厂商首次公开将“AI自我改进”用于生产环境的案例。
Infra Agent在超过10万张国产芯片组成的集群上从零完成生产级推理服务搭建,不到两周将端到端吞吐提升至初始基线的3倍,硬件利用效率与单Token成本达到主流NVIDIA GPU相当水平,并支持1M上下文窗口与
关联行业
影响路径
智谱首次公开将AI自我改进用于生产环境,验证智能体可自主优化推理基础设施,提升大模型研发与部署效率,强化人工智能产业向自动化研发演进。
模型自我改进与工程闭环推理效率提升与成本下降行业竞争与研发范式变化