1、智谱AI的“AutoGLM”:它能够模拟人类操作手机和网页的AI智能体。
2、Anthropic的“Computer Use”:这是一个AI智能体产品,它能够接收指令后,AI亲自接管设备,包括点击、输入等交互功能。例如,它能够完成“填写公司表格数据”的任务,通过查找数据、搜索信息并输入表格。
3、微软的OmniParser:这是一个基于纯视觉的GUI屏幕解析工具,能够自主操作,如在交付给它一个收集素食餐厅的任务时,OmniParser通过解析界面元素,在网页中定位到“餐厅”字样,并完成勾选。
4、谷歌的“Project Jarvis”:这是一个同类产品,有望在12月上线,预计也具有类似的自主操作能力。
5、荣耀的AI智能体YOYO:荣耀CEO展示的AI智能体YOYO能够自主处理任务,如只需对手机说一句“订2000杯咖啡”,YOYO就帮他在附近下单成功。
未来会有更多的产品,这是趋势。
网友回复
python如何调用openai的api实现知识讲解类动画讲解视频的合成?
html如何直接调用openai的api实现海报可视化设计及文本描述生成可编辑海报?
f12前端调试如何找出按钮点击事件触发的那段代码进行调试?
abcjs如何将曲谱播放后导出mid和wav格式音频下载?
python如何将曲子文本生成音乐mp3或wav、mid文件
python中mp3、wav音乐如何转成mid格式?
js在HTML中如何将曲谱生成音乐在线播放并下载本地?
python如何实现在windows上通过键盘来模拟鼠标操作?
python如何给win10电脑增加文件或文件夹右键自定义菜单?
python如何将音乐mp3文件解析获取曲调数据?