低分辨率的照片一般不会修改,但是高分辨率的照片肯定会修改,每款视觉大模型都是训练出来的,都有自己的处输入像素限制,一旦超过就会压缩分辨率,所以你可以多试试,看看官方的文档介绍,测试的时候可以让大模型返回图片的尺寸,例如:

提示词:你是一个屏幕定位专家,我给你屏幕截图,请返回我要要执行的动作,例如点击、输入,当点击的时候告诉我屏幕元素的点击位置,当输入的时候,也告诉我输入框的位置坐标,并返回图片的元素像素宽度与高度,单位都是像素
网友回复
如何将linux服务器的文件目录映射到windows电脑磁盘?
Docling 与 MarkItDown 两个库有啥不同?
豆包收费后国产其他ai软件也会跟进收费吗?
JPEG 与 HEIF图片格式区别?
centos7版本太旧无法安装python3.11,如何在docker中运行python3.11?
python如何做个RPA按键精灵的程序?
写一个windows的cmd的python代码如何在命令行中捕获获取复制粘贴的图片?
如何将别人爆款的抖音短视频短剧文案提取为seedance2的提示词?
阿里云域名dns云解析10万次日限额如何应对?
windows电脑如何提交上架ipa苹果应用?


