基于开放词汇视觉基础模型的零训练场景适配系统:通过文字和少量正负样例,让固定摄像头或批量图片快速获得新的目标检测能力。
点击空白处退出提示
基于开放词汇视觉基础模型的零训练场景适配系统:通过文字和少量正负样例,让固定摄像头或批量图片快速获得新的目标检测能力。
文本提示与提示图会话复用;
跨图片样例特征缓存;
正例、负例样例复核;
三层多尺度特征匹配;
全图与重叠切片推理;
密集目标重复框融合;
单图与批量接口;
内部置信度和候选来源诊断。
电动车、自行车识别需求;
固定摄像头快速适配需求;
传统模型需要采集、标注和训练周期的问题;
新场景快速验证的业务价值。



评论