问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
能不能找一找细粒度图像检索领域的论文,技术路径是dinov2和LoRA就行
我找到几篇符合DINOv2+LoRA技术路径的细粒度图像检索/细粒度视觉任务相关的论文和研究哦,你可以参考下:
【医学场景细粒度图像检索】《提高基础模型在胃肠道内镜图像中的图像检索性能》(2025年12月)
这篇就是典型的细粒度检索应用,核心方案是用DINOv2提取通用的纹理、几何特征,搭配LoRA低秩适配微调,只需要训练0.615M参数量就能让计算效率提升92倍,最终在胃肠道内镜的细粒度解剖位、病变检索任务上Recall@1达到97.71%,mAP96.74%,性能比传统CNN架构高12-18个百分点。
链接:https://www.ebiotrade.com/newsf/2025-12/20251219172339353.htm
【农业细粒度视觉检索/分类】《农业视觉基础模型:DINOv2与知识蒸馏在作物病害及杂草识别中的创新应用》(2025年8月,发表于Computers and Electronics in Agriculture)
针对作物叶片、病斑这类细粒度农业图像,研究用DINOv2提取多尺度特征后搭配LoRA微调,在小规模杂草叶片数据集上的分类/检索准确率比传统ImageNet预训练模型高15.2%,还能适配边缘设备部署。
链接:https://m.ebiotrade.com/newsf/2025-8/20250823082426013.htm
【DINOv2基础原始论文】《DINOv2: Learning Robust Visual Features without Supervision》(2023年Meta团队出品)
这是DINOv2的开山之作,你如果要做相关研究可以先吃透这篇的基础原理,论文地址:https://arxiv.org/pdf/2304.07193.pdf
如果你需要特定场景(比如通用物体、零售商品、遥感图像这类)的相关细分论文,也可以告诉我哦,我再帮你找更精准的~
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。