<?xml version="1.0" encoding="utf-8" standalone="yes" ?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>注意力机制 | ViLab</title>
    <link>https://vilab.team/tag/%E6%B3%A8%E6%84%8F%E5%8A%9B%E6%9C%BA%E5%88%B6/</link>
      <atom:link href="https://vilab.team/tag/%E6%B3%A8%E6%84%8F%E5%8A%9B%E6%9C%BA%E5%88%B6/index.xml" rel="self" type="application/rss+xml" />
    <description>注意力机制</description>
    <generator>Hugo Blox Builder (https://hugoblox.com)</generator><language>en-us</language><lastBuildDate>Mon, 29 Jun 2026 00:00:00 +0000</lastBuildDate>
    <image>
      <url>https://vilab.team/media/icon_hu2896232876136423579.png</url>
      <title>注意力机制</title>
      <link>https://vilab.team/tag/%E6%B3%A8%E6%84%8F%E5%8A%9B%E6%9C%BA%E5%88%B6/</link>
    </image>
    
    <item>
      <title>Token-Wise Attention-Guided Semantic Quality Assessment for Compressed Visual Features</title>
      <link>https://vilab.team/publication/token-wise-attention-guided-semantic-quality-assessment-for-/</link>
      <pubDate>Mon, 29 Jun 2026 00:00:00 +0000</pubDate>
      <guid>https://vilab.team/publication/token-wise-attention-guided-semantic-quality-assessment-for-/</guid>
      <description>&lt;p&gt;本文针对协作与分布式智能系统中压缩中间特征的语义质量评估问题，提出了一种基于Token级注意力引导的评估方法。该方法利用原始与重建Token之间的内在对应关系，在Token层面进行质量度量，以减少跨Token干扰；同时通过注意力机制区分不同Token对下游任务的重要性，从而更准确地反映压缩特征的语义效用。实验表明，该方法在多种特征编解码器上均优于传统相似性度量，具有良好的鲁棒性。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>祝贺实验室科研成果发表于 QoMEX 2026！</title>
      <link>https://vilab.team/event/%E7%A5%9D%E8%B4%BA%E5%AE%9E%E9%AA%8C%E5%AE%A4%E7%A7%91%E7%A0%94%E6%88%90%E6%9E%9C%E5%8F%91%E8%A1%A8%E4%BA%8E-qomex/</link>
      <pubDate>Mon, 29 Jun 2026 00:00:00 +0000</pubDate>
      <guid>https://vilab.team/event/%E7%A5%9D%E8%B4%BA%E5%AE%9E%E9%AA%8C%E5%AE%A4%E7%A7%91%E7%A0%94%E6%88%90%E6%9E%9C%E5%8F%91%E8%A1%A8%E4%BA%8E-qomex/</guid>
      <description>&lt;p&gt;热烈祝贺柯诗恩同学！论文《Token-Wise Attention-Guided Semantic Quality Assessment for Compressed Visual Features》已发表在 &lt;em&gt;QoMEX 2026&lt;/em&gt;。&lt;/p&gt;
&lt;h2 id=&#34;token-wise-attention-guided-semantic-quality-assessment-for-compressed-visual-features&#34;&gt;Token-Wise Attention-Guided Semantic Quality Assessment for Compressed Visual Features&lt;/h2&gt;
&lt;p&gt;&lt;strong&gt;祝贺柯诗恩同学！该论文已发表在 &lt;em&gt;QoMEX&lt;/em&gt;。&lt;/strong&gt;&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;&lt;strong&gt;作者：&lt;/strong&gt; Shien Ke、Changsheng Gao、Hadi Amirpour、Zhihua Wang、Xiaoyan Sun&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;发表载体：&lt;/strong&gt; &lt;em&gt;QoMEX&lt;/em&gt;&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;发表时间：&lt;/strong&gt; 2026年6月29日&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;相关链接：&lt;/strong&gt; &lt;a href=&#34;https://ieeexplore.ieee.org/abstract/document/11618326/&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;论文链接&lt;/a&gt;&lt;/li&gt;
&lt;/ul&gt;
&lt;h3 id=&#34;论文介绍&#34;&gt;论文介绍&lt;/h3&gt;
&lt;p&gt;本文针对协作与分布式智能系统中压缩中间特征的语义质量评估问题，提出了一种基于Token级注意力引导的评估方法。该方法利用原始与重建Token之间的内在对应关系，在Token层面进行质量度量，以减少跨Token干扰；同时通过注意力机制区分不同Token对下游任务的重要性，从而更准确地反映压缩特征的语义效用。实验表明，该方法在多种特征编解码器上均优于传统相似性度量，具有良好的鲁棒性。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>SSCM: A Spatial-Semantic Consistent Model for Multi-Contrast MRI Super-Resolution</title>
      <link>https://vilab.team/publication/sscm-a-spatial-semantic-consistent-model-for-multi-contrast-/</link>
      <pubDate>Sun, 03 May 2026 00:00:00 +0000</pubDate>
      <guid>https://vilab.team/publication/sscm-a-spatial-semantic-consistent-model-for-multi-contrast-/</guid>
      <description>&lt;p&gt;本文提出空间语义一致模型（SSCM），用于多对比度磁共振成像超分辨率。该方法通过动态空间扭曲模块实现对比度间空间对齐，利用语义感知令牌聚合块建模长程依赖，并结合空间-频率融合块恢复高频细节，从而在结构差异和运动干扰下保持解剖结构的空间语义一致性。实验表明SSCM在效率和性能上优于现有方法。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>RiO-DETR: DETR for Real-time Oriented Object Detection</title>
      <link>https://vilab.team/publication/rio-detr-detr-for-real-time-oriented-object-detection/</link>
      <pubDate>Tue, 10 Mar 2026 00:00:00 +0000</pubDate>
      <guid>https://vilab.team/publication/rio-detr-detr-for-real-time-oriented-object-detection/</guid>
      <description>&lt;p&gt;本文提出RiO-DETR，一种面向实时旋转目标检测的DETR框架。针对方向语义依赖、角度周期性和搜索空间扩大等挑战，设计了内容驱动的角度估计、旋转校正正交注意力、解耦周期细化以及定向密集O2O机制，在保持实时效率的同时提升角度收敛速度与检测精度。在DOTA-1.0、DIOR-R和FAIR-1M-2.0上的实验表明，该方法实现了新的速度-精度平衡。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>祝贺实验室科研成果发表于 ECCV 2026！</title>
      <link>https://vilab.team/event/%E7%A5%9D%E8%B4%BA%E5%AE%9E%E9%AA%8C%E5%AE%A4%E7%A7%91%E7%A0%94%E6%88%90%E6%9E%9C%E5%8F%91%E8%A1%A8%E4%BA%8E-eccv-2026-2/</link>
      <pubDate>Tue, 10 Mar 2026 00:00:00 +0000</pubDate>
      <guid>https://vilab.team/event/%E7%A5%9D%E8%B4%BA%E5%AE%9E%E9%AA%8C%E5%AE%A4%E7%A7%91%E7%A0%94%E6%88%90%E6%9E%9C%E5%8F%91%E8%A1%A8%E4%BA%8E-eccv-2026-2/</guid>
      <description>&lt;p&gt;热烈祝贺胡张驰同学！论文《RiO-DETR: DETR for Real-time Oriented Object Detection》已发表在 ECCV 2026 Oral。&lt;/p&gt;
&lt;h2 id=&#34;rio-detr-detr-for-real-time-oriented-object-detection&#34;&gt;RiO-DETR: DETR for Real-time Oriented Object Detection&lt;/h2&gt;
&lt;p&gt;&lt;strong&gt;祝贺胡张驰同学！该论文已发表在 ECCV 2026。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;















&lt;figure  &gt;
  &lt;div class=&#34;d-flex justify-content-center&#34;&gt;
    &lt;div class=&#34;w-100&#34; &gt;&lt;img alt=&#34;RiO-DETR: DETR for Real-time Oriented Object Detection&#34; srcset=&#34;
               /event/%E7%A5%9D%E8%B4%BA%E5%AE%9E%E9%AA%8C%E5%AE%A4%E7%A7%91%E7%A0%94%E6%88%90%E6%9E%9C%E5%8F%91%E8%A1%A8%E4%BA%8E-eccv-2026-2/images/paper-01_hu3774487554520496472.webp 400w,
               /event/%E7%A5%9D%E8%B4%BA%E5%AE%9E%E9%AA%8C%E5%AE%A4%E7%A7%91%E7%A0%94%E6%88%90%E6%9E%9C%E5%8F%91%E8%A1%A8%E4%BA%8E-eccv-2026-2/images/paper-01_hu7272795672146682259.webp 760w,
               /event/%E7%A5%9D%E8%B4%BA%E5%AE%9E%E9%AA%8C%E5%AE%A4%E7%A7%91%E7%A0%94%E6%88%90%E6%9E%9C%E5%8F%91%E8%A1%A8%E4%BA%8E-eccv-2026-2/images/paper-01_hu2318532274489056445.webp 1200w&#34;
               src=&#34;https://vilab.team/event/%E7%A5%9D%E8%B4%BA%E5%AE%9E%E9%AA%8C%E5%AE%A4%E7%A7%91%E7%A0%94%E6%88%90%E6%9E%9C%E5%8F%91%E8%A1%A8%E4%BA%8E-eccv-2026-2/images/paper-01_hu3774487554520496472.webp&#34;
               width=&#34;760&#34;
               height=&#34;393&#34;
               loading=&#34;lazy&#34; data-zoomable /&gt;&lt;/div&gt;
  &lt;/div&gt;&lt;/figure&gt;
&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;&lt;strong&gt;作者：&lt;/strong&gt; Zhangchi Hu、Yifan Zhao、Yansong Peng、Wenzhang Sun、Xiangchen Yin、Jie Chen、Peixi Wu、Hebei Li、Xinghao Wang、Dongsheng Jiang、Xiaoyan Sun&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;发表载体：&lt;/strong&gt; ECCV 2026&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;发表时间：&lt;/strong&gt; 2026年3月10日&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;相关链接：&lt;/strong&gt; &lt;a href=&#34;https://arxiv.org/abs/2603.09411&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;论文链接&lt;/a&gt; · &lt;a href=&#34;https://arxiv.org/pdf/2603.09411&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;PDF&lt;/a&gt; · &lt;a href=&#34;https://github.com/RicePasteM/RiO-DETR&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;代码&lt;/a&gt;&lt;/li&gt;
&lt;/ul&gt;
&lt;h3 id=&#34;论文介绍&#34;&gt;论文介绍&lt;/h3&gt;
&lt;p&gt;本文提出RiO-DETR，一种面向实时旋转目标检测的DETR框架。针对方向语义依赖、角度周期性和搜索空间扩大等挑战，设计了内容驱动的角度估计、旋转校正正交注意力、解耦周期细化以及定向密集O2O机制，在保持实时效率的同时提升角度收敛速度与检测精度。在DOTA-1.0、DIOR-R和FAIR-1M-2.0上的实验表明，该方法实现了新的速度-精度平衡。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>祝贺实验室科研成果发表于 ECCV 2026！</title>
      <link>https://vilab.team/event/%E7%A5%9D%E8%B4%BA%E5%AE%9E%E9%AA%8C%E5%AE%A4%E7%A7%91%E7%A0%94%E6%88%90%E6%9E%9C%E5%8F%91%E8%A1%A8%E4%BA%8E-eccv-2026/</link>
      <pubDate>Tue, 10 Mar 2026 00:00:00 +0000</pubDate>
      <guid>https://vilab.team/event/%E7%A5%9D%E8%B4%BA%E5%AE%9E%E9%AA%8C%E5%AE%A4%E7%A7%91%E7%A0%94%E6%88%90%E6%9E%9C%E5%8F%91%E8%A1%A8%E4%BA%8E-eccv-2026/</guid>
      <description>&lt;p&gt;热烈祝贺胡张驰同学！论文《RiO-DETR: DETR for Real-time Oriented Object Detection》已发表在 ECCV 2026。&lt;/p&gt;
&lt;h2 id=&#34;rio-detr-detr-for-real-time-oriented-object-detection&#34;&gt;RiO-DETR: DETR for Real-time Oriented Object Detection&lt;/h2&gt;
&lt;p&gt;&lt;strong&gt;祝贺胡张驰同学！该论文已发表在 ECCV 2026。&lt;/strong&gt;&lt;/p&gt;
&lt;p&gt;















&lt;figure  &gt;
  &lt;div class=&#34;d-flex justify-content-center&#34;&gt;
    &lt;div class=&#34;w-100&#34; &gt;&lt;img alt=&#34;RiO-DETR: DETR for Real-time Oriented Object Detection&#34; srcset=&#34;
               /event/%E7%A5%9D%E8%B4%BA%E5%AE%9E%E9%AA%8C%E5%AE%A4%E7%A7%91%E7%A0%94%E6%88%90%E6%9E%9C%E5%8F%91%E8%A1%A8%E4%BA%8E-eccv-2026/images/paper-01_hu3774487554520496472.webp 400w,
               /event/%E7%A5%9D%E8%B4%BA%E5%AE%9E%E9%AA%8C%E5%AE%A4%E7%A7%91%E7%A0%94%E6%88%90%E6%9E%9C%E5%8F%91%E8%A1%A8%E4%BA%8E-eccv-2026/images/paper-01_hu7272795672146682259.webp 760w,
               /event/%E7%A5%9D%E8%B4%BA%E5%AE%9E%E9%AA%8C%E5%AE%A4%E7%A7%91%E7%A0%94%E6%88%90%E6%9E%9C%E5%8F%91%E8%A1%A8%E4%BA%8E-eccv-2026/images/paper-01_hu2318532274489056445.webp 1200w&#34;
               src=&#34;https://vilab.team/event/%E7%A5%9D%E8%B4%BA%E5%AE%9E%E9%AA%8C%E5%AE%A4%E7%A7%91%E7%A0%94%E6%88%90%E6%9E%9C%E5%8F%91%E8%A1%A8%E4%BA%8E-eccv-2026/images/paper-01_hu3774487554520496472.webp&#34;
               width=&#34;760&#34;
               height=&#34;393&#34;
               loading=&#34;lazy&#34; data-zoomable /&gt;&lt;/div&gt;
  &lt;/div&gt;&lt;/figure&gt;
&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;&lt;strong&gt;作者：&lt;/strong&gt; Zhangchi Hu、Yifan Zhao、Yansong Peng、Wenzhang Sun、Xiangchen Yin、Jie Chen、Peixi Wu、Hebei Li、Xinghao Wang、Dongsheng Jiang、Xiaoyan Sun&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;发表载体：&lt;/strong&gt; ECCV 2026&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;发表时间：&lt;/strong&gt; 2026年3月10日&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;相关链接：&lt;/strong&gt; &lt;a href=&#34;https://arxiv.org/abs/2603.09411&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;论文链接&lt;/a&gt; · &lt;a href=&#34;https://arxiv.org/pdf/2603.09411&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;PDF&lt;/a&gt; · &lt;a href=&#34;https://github.com/RicePasteM/RiO-DETR&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;代码&lt;/a&gt;&lt;/li&gt;
&lt;/ul&gt;
&lt;h3 id=&#34;论文介绍&#34;&gt;论文介绍&lt;/h3&gt;
&lt;p&gt;本文提出RiO-DETR，一种面向实时旋转目标检测的DETR框架。针对方向语义依赖、角度周期性和搜索空间扩大等挑战，设计了内容驱动的角度估计、旋转校正正交注意力、解耦周期细化以及定向密集O2O机制，在保持实时效率的同时提升角度收敛速度与检测精度。在DOTA-1.0、DIOR-R和FAIR-1M-2.0上的实验表明，该方法实现了新的速度-精度平衡。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>Dome-DETR: DETR with density-oriented feature-query manipulation for efficient tiny object detection</title>
      <link>https://vilab.team/publication/dome-detr-detr-with-density-oriented-feature-query-manipulat/</link>
      <pubDate>Mon, 27 Oct 2025 00:00:00 +0000</pubDate>
      <guid>https://vilab.team/publication/dome-detr-detr-with-density-oriented-feature-query-manipulat/</guid>
      <description>&lt;p&gt;本文提出 Dome-DETR，一种面向微小物体检测的高效框架。针对现有方法特征利用不充分和计算成本高的问题，引入轻量级密度聚焦提取器（DeFE）生成紧凑前景掩码，并基于掩码的窗口注意力稀疏化（MWAS）将计算资源集中于关键区域。同时提出渐进自适应查询初始化（PAQI），自适应调节查询分布，提升检测效率与精度。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>Event-based head pose estimation: Benchmark and method</title>
      <link>https://vilab.team/publication/event-based-head-pose-estimation-benchmark-and-method/</link>
      <pubDate>Sun, 29 Sep 2024 00:00:00 +0000</pubDate>
      <guid>https://vilab.team/publication/event-based-head-pose-estimation-benchmark-and-method/</guid>
      <description>&lt;p&gt;本文针对传统RGB方法在剧烈运动和极端光照下头部姿态估计困难的问题，引入事件相机的高时间分辨率与高动态范围优势。作者构建了两个大规模事件头部姿态数据集，包含282个序列，覆盖不同分辨率与场景；并提出事件头部姿态估计网络EV-HPE，设计了事件时空融合模块和事件运动感知注意力模块，有效结合事件流时空信息，提升姿态估计精度与鲁棒性。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>A micro-expression recognition system with event cameras</title>
      <link>https://vilab.team/publication/a-micro-expression-recognition-system-with-event-cameras/</link>
      <pubDate>Mon, 15 Jul 2024 00:00:00 +0000</pubDate>
      <guid>https://vilab.team/publication/a-micro-expression-recognition-system-with-event-cameras/</guid>
      <description>&lt;p&gt;本文提出了一种基于事件相机的微表情识别系统。针对微表情持续时间短、幅度微弱、难以用传统相机捕捉的问题，系统利用事件相机的高时间分辨率特性，设计了事件增强运动提取器（EEME）以放大细微运动，并引入事件引导注意力（EGA）聚焦关键面部区域，从而提升微表情识别的准确性与鲁棒性。该系统为情感计算领域提供了有效工具。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>Estme: Event-driven spatio-temporal motion enhancement for micro-expression recognition</title>
      <link>https://vilab.team/publication/estme-event-driven-spatio-temporal-motion-enhancement-for-mi/</link>
      <pubDate>Mon, 15 Jul 2024 00:00:00 +0000</pubDate>
      <guid>https://vilab.team/publication/estme-event-driven-spatio-temporal-motion-enhancement-for-mi/</guid>
      <description>&lt;p&gt;本文针对微表情识别中动作幅度小、持续时间短、难以捕捉的问题，提出了一种事件驱动的时空运动增强网络。该方法引入事件相机捕获的高时间分辨率事件信号，设计事件增强运动提取模块以增强细微运动细节，并利用事件引导注意力模块聚焦特定区域的微小变化，从而获取更精确的空间特征。在合成和真实数据集上的实验结果表明，该方法在微表情识别任务上具有优越性能。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>Scene adaptive sparse transformer for event-based object detection</title>
      <link>https://vilab.team/publication/scene-adaptive-sparse-transformer-for-event-based-object-det/</link>
      <pubDate>Sun, 16 Jun 2024 00:00:00 +0000</pubDate>
      <guid>https://vilab.team/publication/scene-adaptive-sparse-transformer-for-event-based-object-det/</guid>
      <description>&lt;p&gt;本文针对事件相机目标检测中Transformer计算成本过高的问题，提出场景自适应稀疏Transformer（SAST）。该方法通过窗口-令牌协同稀疏化与场景特定稀疏优化，在保持低计算量的同时实现高检测性能，并能根据场景复杂度自适应调整稀疏程度，有效平衡了检测精度与效率。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>Panacea: Panoramic and controllable video generation for autonomous driving</title>
      <link>https://vilab.team/publication/panacea-panoramic-and-controllable-video-generation-for-auto/</link>
      <pubDate>Mon, 01 Jan 2024 00:00:00 +0000</pubDate>
      <guid>https://vilab.team/publication/panacea-panoramic-and-controllable-video-generation-for-auto/</guid>
      <description>&lt;p&gt;本文提出Panacea，一种面向自动驾驶场景的全景可控视频生成方法。该方法通过创新的4D注意力机制和两阶段生成流程，有效解决了生成视频中的时间与跨视角一致性问题；同时引入ControlNet框架，利用鸟瞰图（BEV）布局对生成内容进行精细控制。在nuScenes数据集上的实验表明，Panacea能够生成高质量的多视角驾驶视频，为BEV感知任务提供丰富的训练数据增强，推动自动驾驶感知技术的发展。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>Attention-guided contrastive masked image modeling for transformer-based self-supervised learning</title>
      <link>https://vilab.team/publication/attention-guided-contrastive-masked-image-modeling-for-trans/</link>
      <pubDate>Sun, 08 Oct 2023 00:00:00 +0000</pubDate>
      <guid>https://vilab.team/publication/attention-guided-contrastive-masked-image-modeling-for-trans/</guid>
      <description>&lt;p&gt;本文提出注意力引导的对比掩码图像建模方法（ACoMIM），融合对比学习与掩码图像建模两种自监督范式，并利用视觉Transformer的注意力机制提升表征能力。该方法包含两个预训练任务：一是根据注意力引导预测掩码区域的特征，二是比较掩码图像与未掩码图像的全局特征。两个任务相互补充，有效缓解了图像信息稀疏与分布不均的问题，在多种下游任务上验证了方法的有效性。&lt;/p&gt;
</description>
    </item>
    
    <item>
      <title>Eoformer: Edge-oriented transformer for brain tumor segmentation</title>
      <link>https://vilab.team/publication/eoformer-edge-oriented-transformer-for-brain-tumor-segmentat/</link>
      <pubDate>Sun, 01 Oct 2023 00:00:00 +0000</pubDate>
      <guid>https://vilab.team/publication/eoformer-edge-oriented-transformer-for-brain-tumor-segmentat/</guid>
      <description>&lt;p&gt;本文提出边缘导向Transformer（EoFormer），用于脑肿瘤MRI图像分割。该方法采用CNN-Transformer混合编码器，CNN提取局部低级特征，Transformer建模长距离依赖以生成全局高级特征；解码器集成边缘导向Sobel与Laplacian锐化模块，增强边缘信息。同时引入高效注意力与重参数化技术，提升特征表示能力与分割精度。&lt;/p&gt;
</description>
    </item>
    
  </channel>
</rss>
