选项
首页
快讯
内容
AnthonyPerez
AnthonyPerez
2026-04-16

谷歌DeepMind推出TIPSv2,旨在解决AI视觉模型的一个关键弱点:尽管具备强大的全局图像理解能力,但对细微细节的定位能力较弱。该新方法通过全域监督将零样本分割性能提升了141个百分点,减少了42个训练参数,并采用了多粒度文本描述。该模型在分割任务中创下了新的基准,并在检索与分类任务中表现优于更大规模的模型。代码和权重均已开源。

谷歌DeepMind推出TIPSv2,旨在解决AI视觉模型的一个关键弱点:尽管具备强大的全局图像理解能力,但对细微细节的定位能力较弱。该新方法通过全域监督将零样本分割性能提升了141个百分点,减少了42个训练参数,并采用了多粒度文本描述。该模型在分割任务中创下了新的基准,并在检索与分类任务中表现优于更大规模的模型。代码和权重均已开源。
评论 (0)
0/300
OR