•   按检索    检索词:    高级检索
     排序:相关度 OA 时间 被引次数 点击次数 下载次数 共有10000条符合的查询结果,以下是第551-560项 搜索用时 73 毫秒
[首页] « 上一页 [51] [52] [53] [54] [55] 56 [57] [58] [59] [60] [61] 下一页 » 末  页»
551.
  
海量遥感数据的获取和AI大模型的发展极大程度地推动了智能化遥感图像解译的下游应用落地。“预训练+微调”是视觉语言基础大模型适配下游领域的经典范式,能有效将基础模型的知识迁移至新任务中。尽管遥感大模型发展如火如荼且在下游任务中表现突出,扩展的模型规模和高昂的训练成本使其难以适用于资… …   相似文献
552.
  
目的 随着电影内容的复杂化与多样化,电影场景分割成为理解影片结构和支持多媒体应用的重要任务。为提升镜头特征提取和特征关联的有效性,增强镜头序列的上下文感知能力,提出一种混合架构电影场景分割方法(hybrid architecture scene segmentation netw… …   相似文献
553.
  
目的 虹膜呈现攻击检测(presentation attack detection, PAD)是确保虹膜识别系统安全可靠的关键技术之一。针对现有检测方法在跨域场景下泛化性不足、难以有效检测合成虹膜的问题,提出一种基于空间域与频域特征融合的虹膜PAD模型。利用频域信息对环境变化的鲁… …   相似文献
554.
  
目的 由于现有的基于卷积神经网络的检测方法往往局限于观察全局或局部时空特征,难以获取更全面的伪造线索,从而限制了检测方法的泛化能力。为了解决这一问题,本文提出一种基于多域特征融合的多分支网络框架(multi-branch multi-division,MBMD),综合利用频率域、… …   相似文献
555.
  
语音翻译作为促进全球信息交流与消除语言障碍的关键技术,在国际会议、在线教育等多元场景中应用日益广泛。大语言模型凭借其强大的文本理解与生成能力,为语音翻译领域带来了新的突破契机。其中,思维链技术通过引导大语言模型先生成源语言转录再进行翻译,虽提升了性能,但也易导致模型过度依赖中间文… …   相似文献
556.
  
在生成式人工智能的迅猛发展推动下,基于Transformer架构的大规模预训练模型呈现出参数规模的指数级增长。面对数百亿甚至千亿级参数模型的训练需求,传统的单模态并行方法在计算效率、内存占用和通信开销等方面面临严峻挑战,从而促使混合并行技术逐渐成为大规模分布式训练的主流范式。本文… …   相似文献
557.
现有多模态虚假新闻检测方法在图像多层次频域信息利用和模态间信息深度交融方面存在局限,难以充分挖掘图像的潜在特征及多模态特征之间的相关性,进而影响检测性能。虚假新闻图像在传播过程中通常经历多次压缩或篡改操作,从而引发频域异常响应。传统方法多依赖傅里叶变换提取频域特征,但其全局频域分… …   相似文献
558.
随着智能家居行业的发展和信息安全需求的增加,设计时需考虑的信息安全因素逐渐变得复杂。标准文本中虽包含大量智能家居信息安全的设计要求,但文本之间缺乏结构关系,无法进行有效切割来提升大语言模型的知识抽取性能。为此,针对标准文本提出了一种大语言模型结合按标题切割策略-提示工程知识抽取方… …   相似文献
559.
人类多模态情绪识别将文本、视觉和声音等各种异构模态数据用于感知并理解人类情感。与单一模态相比,多模态数据中的互补信息有助于更稳健地理解情感。然而,在实际多模态场景中常存在不完全或缺失模态信息,严重阻碍对多模态特征的理解,从而导致情绪识别精度下降。针对以往的多模态情绪识别方法未能有… …   相似文献
560.
目前,弱监督视频异常检测(WVAD)已经成为视频异常检测的主流方法之一。然而,现有方法存在将各视频段视为独立同分布的示例,忽略了视频级时空依赖关系的问题。针对上述问题,提出了一种三维重排MLP驱动的跨维度特征交互式弱监督视频异常检测方法(r MLP-WVAD)。使用I3D编码器提… …   相似文献
[首页] « 上一页 [51] [52] [53] [54] [55] 56 [57] [58] [59] [60] [61] 下一页 » 末  页»