logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

【CVPR 2025】轻量化结构感知+Mamba模块,即插即用,轻量且准确!

本文提出了一种轻量级结构感知视觉Mamba网络SCSegamba,用于实现结构裂缝的高质量像素级分割。针对现有方法在裂缝形态建模和计算效率方面的不足,该网络通过结构感知视觉状态空间模块(SAVSS)整合轻量级门控瓶颈卷积(GBC)和结构感知扫描策略(SASS),在保持低计算成本的同时有效捕捉裂缝的形态和纹理特征。其中,GBC通过低秩近似和门控机制降低计算复杂度,SASS则通过多方向扫描增强拓扑结构

文章图片
#人工智能#计算机视觉#机器学习 +2
盘点|CVPR 2026中常用的注意力机制模块

在AI研究中,模型创新与性能突破是持续的挑战。「注意力机制」为此提供了一个强大的破局点。它不仅是能够捕捉长距离依赖、即插即用的性能增强器,更已成为论文创新的重要源泉。其天然的可视化能力,能将“黑箱”模型变得透明可信,为实验分析提供坚实的论据。无论是作为核心贡献还是辅助模块,对注意力的巧妙运用,都能显著提升论文的说服力与深度。为了帮助大家更好的应用,本文盘点了CVPR中适用面较广的注意力机制模块,因

文章图片
#人工智能#深度学习
爆火的即插即用模块怎么拼?深度学习缝合秘籍曝光,创新故事讲透就稳了

深度学习模块融合创新研究:本文系统分析了单一模块在特征提取和泛化性上的局限,以及现有模块组合方法在计算效率和协同性上的不足。提出新型融合框架,通过动态权重调整和功能互补机制,实现模块间高效协同,在多个标准数据集上准确率提升3.2%-5.8%,处理速度提升15%-20%。研究还展示了其在医疗影像识别和自动驾驶等实际应用中的价值。文中列举了三篇高分论文的创新

文章图片
#深度学习#人工智能#机器学习 +2
【ACL 2025】大语言模型 + 知识图谱双加持!即插即用,SeedBench 准确率暴涨 15% 刷新 AI SOTA!

本文提出ROGRAG框架,通过多阶段检索机制和增量知识图谱构建优化GraphRAG系统。该框架整合双层次检索(模糊匹配实体和关系)与逻辑形式检索(结构化推理),结合论证检查验证,显著提升了检索鲁棒性。实验表明,ROGRAG在SeedBench上使Qwen2.5-7B-Instruct的准确率从60%提升至75%,优于主流方法。消融研究验证了各组件有效性,特别是增量知识图谱构建使节点数增加40%,准

#人工智能#语言模型#知识图谱
TGRS 即插即用 | GLVMamba双剑合璧!让模型兼具全局视野与局部精度,代码已开源!

本文提出GLVMamba模型,一种用于遥感图像分割的全局-局部视觉状态空间方法。核心创新包括:1)设计GLVSS模块,通过并行卷积分支和移位窗口机制,融合Mamba的全局建模能力与CNN局部特征提取优势;2)构建尺度感知金字塔池化模块(SCPP),自适应融合多尺度特征以解决"孔洞"和误检问题。模型采用编码器-解码器架构,其中编码器使用ResNet18+SCPP提取特征,解码器通

文章图片
#transformer#深度学习#人工智能 +1
SCI一区 即插即用 | 清华开源FCB模块,用CNN架构实现全局感受野!

本文提出一种新型傅里叶卷积块(FCB)用于MRI重建,通过频域操作实现全局感受野,有效解决传统CNN感受野受限问题。创新点包括:1)将FCB与深度可分离卷积结合降低计算成本;2)采用两阶段训练策略,先学习局部特征再重参数化为频域核进行微调。实验表明,该模块可嵌入多种网络架构,在8-12倍高加速率下显著提升重建质量,PSNR和SSIM指标优于传统方法。FCB作为高效全局视野插件,能有效消除MRI欠采

文章图片
#cnn#人工智能#神经网络
【TCSVT 2025】边缘-高斯多模态融合LEGNet,轻量遥感目标检测架构,即插即用!

本文介绍了一种名为LEGNet(Lightweight Edge-Gaussian Driven Network)的轻量级骨干网络,专门用于低质量遥感图像中的目标检测任务。遥感目标检测(RSOD)常常受到低空间分辨率、传感器噪声、运动模糊和光照不良等因素的干扰,导致特征区分度降低,目标表示模糊,前景与背景难以分离。现有的RSOD方法在低质量目标的鲁棒检测方面存在局限性。

文章图片
#目标检测#人工智能#计算机视觉 +2
爆火的即插即用模块怎么拼?深度学习缝合秘籍曝光,创新故事讲透就稳了

深度学习模块融合创新研究:本文系统分析了单一模块在特征提取和泛化性上的局限,以及现有模块组合方法在计算效率和协同性上的不足。提出新型融合框架,通过动态权重调整和功能互补机制,实现模块间高效协同,在多个标准数据集上准确率提升3.2%-5.8%,处理速度提升15%-20%。研究还展示了其在医疗影像识别和自动驾驶等实际应用中的价值。文中列举了三篇高分论文的创新

文章图片
#深度学习#人工智能#机器学习 +2
CVPR 即插即用 | PConv:重新定义高效卷积,一个让模型“跑”得更快、更省的新范式

本文提出了一种新型卷积算子PConv和高速网络FasterNet。核心创新在于:1)突破传统单纯优化FLOPs的思路,提出提升每秒浮点运算次数(FLOPS)才是加速关键;2)设计部分卷积(PConv),仅处理1/4输入通道,大幅减少计算量和内存访问;3)构建简洁的FasterNet架构,在多个硬件平台实现顶尖推理速度。PConv通过利用通道冗余性,结合后续PWConv形成T形计算模式,比DWCon

文章图片
#transformer#深度学习#人工智能 +1
【无标题】

华南理工大学团队提出轻量级半监督多模态情感分析模型Semi-IIN,仅需1.6M参数即实现SOTA性能。该模型创新性地采用双分支掩码注意力机制(IntraMA和InterMA)阻断模态间噪声干扰,并通过动态门控自适应融合模态内/间特征。结合Top-k置信度过滤的半监督自训练策略,有效利用无标签数据提升性能。实验显示,在MOSI/MOSEI数据集上不仅训练速度提升40倍,关键指标也全面超越现有方法,

文章图片
#人工智能#深度学习#神经网络 +2
    共 22 条
  • 1
  • 2
  • 3
  • 请选择