一种基于特征强化和融合的视频描述方法

AITNT
正文
推荐专利
一种基于特征强化和融合的视频描述方法
申请号:CN202410780291
申请日期:2024-06-17
公开号:CN118609028A
公开日期:2024-09-06
类型:发明专利
摘要
本文提供了一种基于特征强化和融合的视频描述方法,包括步骤:多模态特征提取,提取外观特征、运动特征和对象特征;语义特征提取,外观特征和运动特征串联输入到语义检测器提取语义特征;特征增强,利用局部和全局特征为模型提供正确的细节引导,放大相似物体的特征差异,提高目标主体编码特征的准确性;多模态特征融合,以外观特征为引导,筛选运动特征和对象特征中与内容更相关的视觉信息,并对特征进行融合,形成统一的多模态融合特征;特征解码,利用Transformer模型的解码器部分对编码进行解码;最后,生成视频描述内容。与现有的视频描述方法相比,通过特征增强,使得视频重点区域特征的定位识别更精确;同时通过跨模态融合网络,提升解码器的语义解码准确度,使得生成的视频描述更加准确。
技术关键词
运动特征 语义特征提取 多模态特征融合 融合特征 编码特征 Softmax分类器 解码器 强化特征 支路 视频帧 输出特征 对象 空洞 检测器 视觉
系统为您推荐了相关专利信息
1
2D视频数字人手势生成方法
手势生成方法 视频 信号提取器 图片 解码器
2
一种基于多模态深度神经网络的故障监测方法及装置
故障监测方法 多模态特征 多任务学习网络 深度神经网络 可见光视频
3
一种面向物理动态视觉理解的体素分割系统及方法
网格 物体 分割系统 动态 语义标签
4
基于多模态融合的中医辅诊大模型微调训练方法及装置
编码特征 多模态 嵌入特征 融合特征 数据
5
碳纤维蜂窝材料内部缺陷检测方法
材料内部缺陷检测 碳纤维蜂窝 拼接单元 频域特征 包裹相位
添加客服微信openai178,进AITNT官方交流群
驱动智慧未来:提供一站式AI转型解决方案
沪ICP备2023015588号