ComputerRL: Scaling End-to-End Online Reinforcement Learning for Computer Use Agents https://arxiv.org/abs/2508.14040 MobileRL: Advancing Mobile Use Agents With Adaptive Online Reinforcement Learning https://github.com/Xiao9905/AutoGLM/blob/main/static/papers/mobilerl_0820.pdf AgentRL: Reinforcing Multi-task LLM Agents From Zero (Upcoming)
智谱发布 AutoGLM 2.0:全球首个手机 Agent、云端自主完成任务
智谱宣布推出 AutoGLM 2.0,声称将 Agent 应用提升到新的高度:
智谱称,即刻起,人人都可使用 AutoGLM。该公司还将快速迭代推出新功能(“定时任务” 很快上线,AI 每天主动替你干活)。
在 AutoGLM 1.0 中,智谱已探索过让 AI 代替用户完成部分手机操作,但只在有限场景下生效。
据介绍,随着 AutoGLM 2.0 的发布,它已经成长为一名执行型助手,能够在「云端」自主完成多样化的任务。在生活场景中,用户只需一句话,就能让 AutoGLM 操作美团、京东、小红书、抖音等几十个高频应用:点外卖、订机票、查房源,例如帮你买「秋天的第一杯奶茶」。在办公场景中,它同样能跨网站执行全流程工作,操作网页版的飞书、网易邮箱、知乎、微博、抖音、微头条等网站:从信息检索到内容撰写,再到生成视频、PPT 或播客,并直接完成小红书、抖音等社交媒体平台内容发布。
智谱称,“这意味着,AI 不再是一个 “聊天工具”,而是一个能真正替你干活的全能代理人。不仅能给出答案,还能把任务完整执行,帮助用户节省时间与精力,彻底改变人与 AI 的协作方式。”
在 AutoGLM 2.0 中,智谱为 AI 配备了专属智能体手机 / 智能体电脑,让它可以在云端自主干活、完成任务,而无需占用用户的本地设备,期间用户可以使用其他 App(如刷抖音、打游戏)。
据介绍,AutoGLM 由智谱最新开源 SOTA 语言模型 GLM-4.5 与视觉推理模型 GLM-4.5V 驱动。AutoGLM 将基座模型原生能力发挥到极致,并结合在「端到端异步强化学习」方面的多项突破成果,可以完成推理、编码、研究、Agentic 与 GUI 操作等多类任务,并可根据需求灵活调用最合适的「大脑」完成执行。
在Device Use 基准测试(涵盖手机、电脑和网页操作)中,AutoGLM 表现优于ChatGPT Agent、UI-TARS-1.5 和 Claude Sonnet 4,展现出更强的鲁棒性与通用性,处于主流 Agent 的SOTA水平。
智谱称,已将 AutoGLM 的操作执行能力封装为 API,开发者只需简单接入,即可将这一能力无缝融入各类硬件设备,从 AI 眼镜等可穿戴设备到传统家电。AutoGLM 首次让硬件具备完整的手机级操作能力,无需在端侧堆叠复杂系统或大容量电池。例如,可以通过智能眼镜点一杯咖啡。
今日起,AutoGLM 移动端 API 申请通道及开发者生态共建计划正式上线。除手机与电脑外,手表、眼镜、家电等设备都能成为 Agent 驱动的智能助手。
传送门:https://autoglm.zhipuai.cn/misc/developer-apply
更多技术细节,请参阅GLM团队的三篇最新技术论文:
ComputerRL: Scaling End-to-End Online Reinforcement Learning for Computer Use Agents
https://arxiv.org/abs/2508.14040
MobileRL: Advancing Mobile Use Agents With Adaptive Online Reinforcement Learning
https://github.com/Xiao9905/AutoGLM/blob/main/static/papers/mobilerl_0820.pdf
AgentRL: Reinforcing Multi-task LLM Agents From Zero (Upcoming)