首页|期刊导航|南京邮电大学学报(自然科学版)|混合专家协同的多步无监督视频动作定位方法

混合专家协同的多步无监督视频动作定位方法OA

中文摘要

针对时序动作定位中存在的伪标签噪声累积、跨模态特征融合僵化及前景背景特征纠缠三大技术瓶颈,提出一种基于混合专家协同的迭代优化框架。该框架包含三大创新模块:其一,设计了标签优化模块,通过改进的相互邻域机制提纯聚类伪标签,抑制噪声传播;其二,构建了双分支混合专家网络(DB-MoE),利用门控机制动态融合RGB与光流特征;其三,提出了动态分离混合专家网络(DS-MoE),通过显式解耦实现前景与背景表征的分离。在THUMOS''14和ActivityNet v1.2基准数据集上的大量实验证明,文中方法的性能超越了现有主流方案,达到了领先水平。

徐钰栋;彭潮海;龙春福;徐文斌;洪雷;唐昊煜

乐清市电力实业有限公司,浙江温州325600乐清市电力实业有限公司,浙江温州325600乐清市电力实业有限公司,浙江温州325600乐清市电力实业有限公司,浙江温州325600乐清市电力实业有限公司,浙江温州325600山东大学软件学院,山东济南250101

信息技术与安全科学

视频动作定位混合专家机制特征解耦视频理解

《南京邮电大学学报(自然科学版)》 2026 (4)

P.128-136,9

温州图盛控股集团有限公司科技项目(CF058809002023001)资助项目。

10.14132/j.cnki.1673-5439.2026.04.014

评论