官网演示中可以通过点提示、画框提示、全选、语音输入等方式来实现图像分割。
首先选择或者上传一张照片,如下图,选择了这张沙发的照片。
点击进去以后就是这个界面,左边的菜单栏可以选择不同的提示方式。
第一种方式,点提示,将鼠标移到画面中任何一个物体上就可以选中,还可以多次点选,添加更多的物品。
选择Box,也就是画框的形式,针对图像中任意物体画框就能选中直接进行分割。
选择Everything,全选画面,就会将整张图进行分割!
最后一种方式,文本输入,类似现在的ChatGPT输入方式,只需要用文字输入你的要求,就能自动识别。
这种方式在演示中没有,但是在官方实例中出现了,比如输入Cat,就能自动识别出图里的所有猫。
CV领域的分割大模型,是一种用于像素级别的图像分割任务的深度学习模型。简单来说,它可以将输入的图像分成若干个区域或像素,每个区域或像素代表一个不同的类别或对象。