财新传媒

香港科技大学王帅:GUI与API不是对手——智能体技术路线的融合之道

2026年03月26日 11:49 来源于 财新会

  王帅,香港科技大学计算机科学及工程学系副教授

  2026年3月底,在一场AI智能体技术路径与治理创新圆桌研讨会上,香港科技大学计算机科学及工程学系副教授王帅用一个生动的比喻,为在场专家勾勒出AI智能体的技术本质:“如果认为大模型只是云端的大脑,那么终端智能体就是给大脑接上了‘手和脚’。”在他看来,我们正在经历一场从“对话”到“行动”的根本性转变,即AI不再只是陪人聊天,而是要真正帮人干活了。

  作为长期从事计算机安全与AI可信研究的学者,王帅对智能体的技术路径、安全机制与产业前景有着系统的思考。他从技术演进的宏观视角出发,提出了一个核心判断:GUI与API不是对手,而是互补;与其争论哪条路线更危险,不如确保每条路线都达到应有的安全水位。

  技术路径的抉择:GUI与API的优劣分野

  王帅指出,过去大模型停留在云端,做文本认知和生成;现在的终端智能体让AI具备了执行能力。“核心转变是:AI不再只是陪你聊天,而是要真正帮你干活了。我们正在进入向‘可靠智能体’过渡的新周期。”

  在手机智能体的技术实现上,王帅将当前主流方案分为两条路径。GUI(图形用户界面)路线是“AI通过看屏幕来理解手机界面”,识别图标和按钮,模拟人类的点击和滑动操作。API路线则是通过标准化接口直接调用App功能,效率高、结构化好,但需要App开发者主动开放接口。

(GUI vs API:对比与关系,来源:香港科技大学计算机科学及工程学系副教授王帅)

  他总结GUI路线有三大优势。第一,适用范围更广,不依赖App开放接口,能快速打破“生态孤岛”,让长尾应用也能被智能体调用。第二,透明度更高,操作过程映射在屏幕上,“所见即所得”天然有助于建立用户信任。第三,生态更开放,接入门槛低,“小而美”的服务也有机会被发现和调用,避免大平台垄断。

  王帅强调,不应将GUI与API这两条路线对立起来。相反,它们各自都有独特的优势与需要补全的短板,未来趋势是取长补短、走向融合。

  安全治理:从自我纠错到外围架构

  针对公众对智能体安全的担忧,王帅提出了一个形象的比喻。“交通安全不能只指望每个司机都不犯错,要靠完善的交规、红绿灯和监控系统。智能体安全也一样,不能只靠智能体‘自我纠错’,需要完善的‘安全围栏’和一体化防御机制。突破关键不是‘自我纠错’,而是外围架构的成熟。”

  他进一步提出了智能体产品发布前的“三条安全铁律”。第一,控制权前置,涉及支付、隐私授权等关键节点,必须把控制权交还给用户。第二,数据最小化,端侧能处理的不上云,云端处理后“用完即删”。第三,防御性执行,遇到不确定的界面或模糊指令,默认“安全拒绝”或“弹窗确认”,绝不为了彰显智能而强行操作。

  王帅特别强调,安全问题的工具箱其实已经相当充实——事前知情授权、事中实时可控、事后可追溯,这些机制在技术上都已成熟。“关键在于是否落地执行,而不是技术路线本身。”

  对于我国智能体产业的未来发展,王帅呼吁行业从“路线之争”转向共同提高安全水位线,并提出了几点建议。一是模型极致瘦身,端侧部署轻量级“小模型”,专做屏幕解析、本地脱敏等基础工作,不需要硬跑“全能大模型”。二是端云明确分工,能在端侧处理的不上云,必须上云的“用完即删”。三是标准共建,从各自为战走向标准共建,建立透明、可审计的“端云协同安全标准”。四是第三方审计,将独立的合规检测标准纳入智能体产品入网的“强制国标”,不能只靠企业自律。

  “与其争论哪条路线更危险,不如确保每条路线都达到应有的安全水位。”王帅总结。

 

点击【查看专题】,浏览更多内容。