DIFT基于扩散模型的图像特征抽取

我要开发同款
匿名用户2024年07月31日
284阅读

技术信息

开源地址
https://modelscope.cn/models/iic/cv_stable-diffusion-v2_image-feature
授权协议
Apache License 2.0

作品详情

功能概述

基于扩散模型的图像特征抽取,可用于做特征点匹配。

video

Project Page | Paper | Colab Demo

环境准备

安装独立repo库

pip istall git+https://github.com/jujiehe96/modelscope_dift.git

运行代码

from modelscope.pipelies import pipelie
from modelscope.outputs import OutputKeys
from modelscope_dift import ms_wrapper

model = 'damo/cv_stable-diffusio-v2_image-feature'
pipe = pipelie('feature_extractio', model=model, device='gpu', auto_collate=False, model_revisio='v1.0.2')
out1 = pipe('https://modelscope.oss-c-beijig.aliyucs.com/test/images/face_recogitio_1.pg', img_size=0,
            t=261, up_ft_idex=1, prompt='a photo of a girl', esemble_size=4, seed=0)[OutputKeys.OUTPUT]  # 1*C*H*W
prit(out1)

参数说明

  • img_size: 在输入扩散模型之前调整图像的宽度和高度。 如果设置为 0,则不会执行调整大小操作,因此它将坚持原始图像大小。 默认设置为 [768, 768]。 如果遇到内存问题,您可以减少此值。
  • t: 扩散的时间步长,范围[0, 1000]中选择,必须是整数。 对于语义对应,默认 t=261。
  • up_ft_idex: 用于提取特征图的 U-Net 上采样块的索引,从 [0, 1, 2, 3] 中选择。 upftidex=1 默认情况下语义对应。
  • prompt: 扩散模型中使用的提示。
  • esemble_size: 每批中用于获取特征的重复图像的数量。 默认情况下 esemble_size=8。 如果遇到内存问题,您可以减小该值。
  • seed: 随机种子,默认为Noe

引用

如果你觉得这个模型对你有所帮助,请考虑引用下面的相关论文:

@article{tag2023emerget,
  title={Emerget Correspodece from Image Diffusio},
  author={Tag, Lumig ad Jia, Megli ad Wag, Qiaqia ad Phoo, Cheg Perg ad Harihara, Bharath},
  joural={arXiv preprit arXiv:2306.03881},
  year={2023}
}

Cloe with HTTP

 git cloe https://www.modelscope.c/damo/cv_stable-diffusio-v2_image-feature.git

功能介绍

功能概述 基于扩散模型的图像特征抽取,可用于做特征点匹配。 Project Page | Paper | Colab Demo 环境准备 安装独立repo库 pip install git+http

声明:本文仅代表作者观点,不代表本站立场。如果侵犯到您的合法权益,请联系我们删除侵权资源!如果遇到资源链接失效,请您通过评论或工单的方式通知管理员。未经允许,不得转载,本站所有资源文章禁止商业使用运营!
下载安装【程序员客栈】APP
实时对接需求、及时收发消息、丰富的开放项目需求、随时随地查看项目状态

评论