SteerSeg: Attention Steering for Reasoning Video Segmentation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cheraghian, Ali, Dastmalchi, Hamidreza, Khamis, Abdelwahed, Saberi, Morteza, An, Aijun, Petersson, Lars |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Adapt-As-You-Walk Through the Clouds: Training-Free Online Test-Time Adaptation of 3D Vision-Language Foundation Models
par: Tamjidi, Mehran, et autres
Publié: (2025)
par: Tamjidi, Mehran, et autres
Publié: (2025)
Fighting Hallucinations with Counterfactuals: Diffusion-Guided Perturbations for LVLM Hallucination Suppression
par: Dastmalchi, Hamidreza, et autres
Publié: (2026)
par: Dastmalchi, Hamidreza, et autres
Publié: (2026)
Test-Time Adaptation of 3D Point Clouds via Denoising Diffusion Models
par: Dastmalchi, Hamidreza, et autres
Publié: (2024)
par: Dastmalchi, Hamidreza, et autres
Publié: (2024)
ETTA: Efficient Test-Time Adaptation for Vision-Language Models through Dynamic Embedding Updates
par: Dastmalchi, Hamidreza, et autres
Publié: (2025)
par: Dastmalchi, Hamidreza, et autres
Publié: (2025)
Foundation Model-Powered 3D Few-Shot Class Incremental Learning via Training-free Adaptor
par: Ahmadi, Sahar, et autres
Publié: (2024)
par: Ahmadi, Sahar, et autres
Publié: (2024)
HIME: Mitigating Object Hallucinations in LVLMs via Hallucination Insensitivity Model Editing
par: Akl, Ahmed, et autres
Publié: (2026)
par: Akl, Ahmed, et autres
Publié: (2026)
MoKD: Multi-Task Optimization for Knowledge Distillation
par: Hayder, Zeeshan, et autres
Publié: (2025)
par: Hayder, Zeeshan, et autres
Publié: (2025)
TPCL: Task Progressive Curriculum Learning for Robust Visual Question Answering
par: Akl, Ahmed, et autres
Publié: (2024)
par: Akl, Ahmed, et autres
Publié: (2024)
Component-Aware Sketch-to-Image Generation Using Self-Attention Encoding and Coordinate-Preserving Fusion
par: Zia, Ali, et autres
Publié: (2026)
par: Zia, Ali, et autres
Publié: (2026)
CountSteer: Steering Attention for Object Counting in Diffusion Models
par: Boo, Hyemin, et autres
Publié: (2025)
par: Boo, Hyemin, et autres
Publié: (2025)
Test-Time Adaptation for Anomaly Segmentation via Topology-Aware Optimal Transport Chaining
par: Zia, Ali, et autres
Publié: (2026)
par: Zia, Ali, et autres
Publié: (2026)
RCoT-Seg: Reinforced Chain-of-Thought for Video Reasoning and Segmentation
par: Wen, Junwei, et autres
Publié: (2026)
par: Wen, Junwei, et autres
Publié: (2026)
Split-Fuse-Transport: Annotation-Free Saliency via Dual Clustering and Optimal Transport Alignment
par: Ramzan, Muhammad Umer, et autres
Publié: (2025)
par: Ramzan, Muhammad Umer, et autres
Publié: (2025)
Locally-Focused Face Representation for Sketch-to-Image Generation Using Noise-Induced Refinement
par: Ramzan, Muhammad Umer, et autres
Publié: (2024)
par: Ramzan, Muhammad Umer, et autres
Publié: (2024)
MuSteerNet: Human Reaction Generation from Videos via Observation-Reaction Mutual Steering
par: Zhou, Yuan, et autres
Publié: (2026)
par: Zhou, Yuan, et autres
Publié: (2026)
VideoSeg-R1:Reasoning Video Object Segmentation via Reinforcement Learning
par: Xu, Zishan, et autres
Publié: (2025)
par: Xu, Zishan, et autres
Publié: (2025)
Steering Video Diffusion Transformers with Massive Activations
par: Cheng, Xianhang, et autres
Publié: (2026)
par: Cheng, Xianhang, et autres
Publié: (2026)
A Review on Coarse to Fine-Grained Animal Action Recognition
par: Zia, Ali, et autres
Publié: (2025)
par: Zia, Ali, et autres
Publié: (2025)
Feudal Steering: Hierarchical Learning for Steering Angle Prediction
par: Johnson, Faith, et autres
Publié: (2020)
par: Johnson, Faith, et autres
Publié: (2020)
ACS-SegNet: An Attention-Based CNN-SegFormer Segmentation Network for Tissue Segmentation in Histopathology
par: Torbati, Nima, et autres
Publié: (2025)
par: Torbati, Nima, et autres
Publié: (2025)
Enhancing Accuracy and Robustness of Steering Angle Prediction with Attention Mechanism
par: Nadella, Swetha, et autres
Publié: (2022)
par: Nadella, Swetha, et autres
Publié: (2022)
Backpropagation-free Network for 3D Test-time Adaptation
par: Wang, Yanshuo, et autres
Publié: (2024)
par: Wang, Yanshuo, et autres
Publié: (2024)
SteerFlow: Steering Rectified Flows for Faithful Inversion-Based Image Editing
par: Dao, Thinh, et autres
Publié: (2026)
par: Dao, Thinh, et autres
Publié: (2026)
Decoupled Seg Tokens Make Stronger Reasoning Video Segmenter and Grounder
par: Jisheng, Dang, et autres
Publié: (2025)
par: Jisheng, Dang, et autres
Publié: (2025)
Adaptive Segmentation-Based Initialization for Steered Mixture of Experts Image Regression
par: Li, Yi-Hsin, et autres
Publié: (2024)
par: Li, Yi-Hsin, et autres
Publié: (2024)
Attention Misses Visual Risk: Risk-Adaptive Steering for Multimodal Safety Alignment
par: Park, Jonghyun, et autres
Publié: (2025)
par: Park, Jonghyun, et autres
Publié: (2025)
One Token to Seg Them All: Language Instructed Reasoning Segmentation in Videos
par: Bai, Zechen, et autres
Publié: (2024)
par: Bai, Zechen, et autres
Publié: (2024)
AnchorSeg: Language Grounded Query Banks for Reasoning Segmentation
par: Qian, Rui, et autres
Publié: (2026)
par: Qian, Rui, et autres
Publié: (2026)
Seg-ReSearch: Segmentation with Interleaved Reasoning and External Search
par: Liang, Tianming, et autres
Publié: (2026)
par: Liang, Tianming, et autres
Publié: (2026)
MedSeg-R: Medical Image Segmentation with Clinical Reasoning
par: Shao, Hao, et autres
Publié: (2025)
par: Shao, Hao, et autres
Publié: (2025)
CASP: Few-Shot Class-Incremental Learning with CLS Token Attention Steering Prompts
par: Huang, Shuai, et autres
Publié: (2026)
par: Huang, Shuai, et autres
Publié: (2026)
Causally Steered Diffusion for Automated Video Counterfactual Generation
par: Spyrou, Nikos, et autres
Publié: (2025)
par: Spyrou, Nikos, et autres
Publié: (2025)
Causal Physics Steering in Video World Models via Concept Activation Vectors
par: Alam, Nahid
Publié: (2026)
par: Alam, Nahid
Publié: (2026)
Astrolabe: Steering Forward-Process Reinforcement Learning for Distilled Autoregressive Video Models
par: Zhang, Songchun, et autres
Publié: (2026)
par: Zhang, Songchun, et autres
Publié: (2026)
FlowDirector: Training-Free Flow Steering for Precise Text-to-Video Editing
par: Li, Guangzhao, et autres
Publié: (2025)
par: Li, Guangzhao, et autres
Publié: (2025)
SteerX: Creating Any Camera-Free 3D and 4D Scenes with Geometric Steering
par: Park, Byeongjun, et autres
Publié: (2025)
par: Park, Byeongjun, et autres
Publié: (2025)
ContextSeg: Sketch Semantic Segmentation by Querying the Context with Attention
par: Wang, Jiawei, et autres
Publié: (2023)
par: Wang, Jiawei, et autres
Publié: (2023)
SegLLM: Multi-round Reasoning Segmentation
par: Wang, XuDong, et autres
Publié: (2024)
par: Wang, XuDong, et autres
Publié: (2024)
SteeredMarigold: Steering Diffusion Towards Depth Completion of Largely Incomplete Depth Maps
par: Gregorek, Jakub, et autres
Publié: (2024)
par: Gregorek, Jakub, et autres
Publié: (2024)
CoT-Seg: Rethinking Segmentation with Chain-of-Thought Reasoning and Self-Correction
par: Kao, Shiu-hong, et autres
Publié: (2026)
par: Kao, Shiu-hong, et autres
Publié: (2026)
Documents similaires
-
Adapt-As-You-Walk Through the Clouds: Training-Free Online Test-Time Adaptation of 3D Vision-Language Foundation Models
par: Tamjidi, Mehran, et autres
Publié: (2025) -
Fighting Hallucinations with Counterfactuals: Diffusion-Guided Perturbations for LVLM Hallucination Suppression
par: Dastmalchi, Hamidreza, et autres
Publié: (2026) -
Test-Time Adaptation of 3D Point Clouds via Denoising Diffusion Models
par: Dastmalchi, Hamidreza, et autres
Publié: (2024) -
ETTA: Efficient Test-Time Adaptation for Vision-Language Models through Dynamic Embedding Updates
par: Dastmalchi, Hamidreza, et autres
Publié: (2025) -
Foundation Model-Powered 3D Few-Shot Class Incremental Learning via Training-free Adaptor
par: Ahmadi, Sahar, et autres
Publié: (2024)