返回顶部
返回首页 会员充值 我的足迹 返回上一页
具身智能
情绪经济
商业航天
十五五
银发经济

智谱AutoGLM功能

2024年11月29日,智谱在OpenDay推出升级版AutoGLM,完成了从手机端到Web端再到桌面端的三端Agent布局。手机端可自主执行超过50步的长步骤操作、跨APP协同;Web端开启“全自动”上网新体验,支持数十个网站无人驾驶;桌面端GLM-PC启动内测,基于视觉多模态模型实现通用Agent技术探索。财通证券最新测评报告对AutoGLM手机端和Web端进行了系统性实测,并对基座模型能力和Agent产业前景进行了展望。

三端Agent布局——手机+Web+PC全覆盖

智谱AutoGLM的三端布局覆盖了用户的核心数字场景:手机端AutoGLM可理解超长指令、执行超长任务,覆盖微信、小红书、美团、抖音、微博、饿了么等常用应用,并可跨APP协同;Web端智谱清言插件依托Agent智能体实现“无人驾驶”全自动上网,支持数十个网站的自动化操作;桌面端GLM-PC已启动内测,基于视觉多模态模型实现对电脑的通用操作。智谱CEO张鹏在发布会现场表示,未来随着GLM团队继续加速Agent模型产品研发,将很大程度上改变人机交互形式,用户一句话操作电脑和手机的范式转变指日可待。

Web端AutoGLM-Web——全自动上网新体验

智谱清言插件分为通用模式(页面总结、智能写作、网页翻译等)和高级模式(AutoGLM全自动上网、站内高级检索、多链接总结、GitHub Issue问答)。用户无需手动搭建workflow,仅通过自然语言指令即可快速完成复杂任务。Agent具备判断和自我纠错能力,能够持续与用户交互反馈并调用多种工具精准完成操作。财通证券对知乎、微博、豆瓣、贴吧、谷歌/百度/必应、Arxiv、谷歌学术、百度学术、GitHub、网易等进行了系统性测评。

基座模型竞争力——GLM-4-Plus比肩GPT-4

智谱基座模型在当前大模型领域表现出较强竞争力。2024年8月发布的GLM-4-Plus通过多种方式构造海量高质量数据,利用PPO等多项技术有效提升模型推理、指令遵循等方面表现,并更好地反映人类偏好。在多项基准测试中比肩GPT-4、Llama3.1等第一梯队模型。GLM-4-9B-Chat在SuperCLUE Agent总榜(2024年10-12月)以69.62分排名第三,仅次于百度ERNIE-4-8k和电信TeleChat2。任务规划69.76分、工具使用65.97分、长期记忆74.5分,各项表现均衡。

产业展望——Agent适配的四个发展方向

Agent要对众多App和网站实现适配,未来可行的产业路径包括四个方向:模块化适配框架——针对通用功能模块(搜索、导航、购物车等)开发适配方案,通过配置文件快速适配不同平台;自动化适配工具——利用机器学习和自动化测试技术学习交互逻辑,自动识别和适配新应用;开放平台与合作生态——与开发者合作共同开发适配插件或API接口,获取更多适配数据和反馈;用户自定义适配——允许用户根据自己的需求和习惯对适配行为进行定制。多路径探索将推动AI Agent在适配领域的创新,加速人机交互方式变革。
智谱AutoGLM三端布局
端侧产品核心能力状态
手机端AutoGLM50步长任务、跨APP协同内测中
Web端智谱清言插件全自动上网、多网站适配内测中
桌面端GLM-PC视觉多模态、通用Agent内测启动
点击阅读报告原文: 计算机行业专题报告:智谱AutoGLM人机交互范式的创新与探索-250107(44页)
相关报告