Align and Surpass Human Camouflaged Perception: Visual Refocus Reinforcement Fine-Tuning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Shen, Ruolin, Ji, Xiaozhong, WU, Kai, Zhang, Jiangning, He, Yijun, Yang, HaiHua, Hu, Xiaobin, Sun, Xiaoyu |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
SkillGraph: Self-Evolving Multi-Agent Collaboration with Multimodal Graph Topology
von: Nie, Zheng, et al.
Veröffentlicht: (2026)
von: Nie, Zheng, et al.
Veröffentlicht: (2026)
Med-CMR: A Fine-Grained Benchmark Integrating Visual Evidence and Clinical Logic for Medical Complex Multimodal Reasoning
von: Gong, Haozhen, et al.
Veröffentlicht: (2025)
von: Gong, Haozhen, et al.
Veröffentlicht: (2025)
Sonic: Shifting Focus to Global Audio Perception in Portrait Animation
von: Ji, Xiaozhong, et al.
Veröffentlicht: (2024)
von: Ji, Xiaozhong, et al.
Veröffentlicht: (2024)
Towards Fine-Grained Robustness: Attention-Guided Test-Time Prompt Tuning for Vision-Language Models
von: Hai, Jia-Wei, et al.
Veröffentlicht: (2026)
von: Hai, Jia-Wei, et al.
Veröffentlicht: (2026)
Human-MME: A Holistic Evaluation Benchmark for Human-Centric Multimodal Large Language Models
von: Liu, Yuansen, et al.
Veröffentlicht: (2025)
von: Liu, Yuansen, et al.
Veröffentlicht: (2025)
Improving Medical Visual Reinforcement Fine-Tuning via Perception and Reasoning Augmentation
von: Yang, Guangjing, et al.
Veröffentlicht: (2026)
von: Yang, Guangjing, et al.
Veröffentlicht: (2026)
On the Suitability of Reinforcement Fine-Tuning to Visual Tasks
von: Chen, Xiaxu, et al.
Veröffentlicht: (2025)
von: Chen, Xiaxu, et al.
Veröffentlicht: (2025)
Simulate, Refocus and Ensemble: An Attention-Refocusing Scheme for Domain Generalization
von: Wang, Ziyi, et al.
Veröffentlicht: (2025)
von: Wang, Ziyi, et al.
Veröffentlicht: (2025)
DiffuMatting: Synthesizing Arbitrary Objects with Matting-level Annotation
von: Hu, Xiaobin, et al.
Veröffentlicht: (2024)
von: Hu, Xiaobin, et al.
Veröffentlicht: (2024)
UniM-OV3D: Uni-Modality Open-Vocabulary 3D Scene Understanding with Fine-Grained Feature Representation
von: He, Qingdong, et al.
Veröffentlicht: (2024)
von: He, Qingdong, et al.
Veröffentlicht: (2024)
Reinforcement Fine-Tuning of Flow-Matching Policies for Vision-Language-Action Models
von: Lyu, Mingyang, et al.
Veröffentlicht: (2025)
von: Lyu, Mingyang, et al.
Veröffentlicht: (2025)
Visual-RFT: Visual Reinforcement Fine-Tuning
von: Liu, Ziyu, et al.
Veröffentlicht: (2025)
von: Liu, Ziyu, et al.
Veröffentlicht: (2025)
Multi-modal Instruction Tuned LLMs with Fine-grained Visual Perception
von: He, Junwen, et al.
Veröffentlicht: (2024)
von: He, Junwen, et al.
Veröffentlicht: (2024)
Visual Agentic Reinforcement Fine-Tuning
von: Liu, Ziyu, et al.
Veröffentlicht: (2025)
von: Liu, Ziyu, et al.
Veröffentlicht: (2025)
FeRA: Frequency-Energy Constrained Routing for Effective Diffusion Adaptation Fine-Tuning
von: Yin, Bo, et al.
Veröffentlicht: (2025)
von: Yin, Bo, et al.
Veröffentlicht: (2025)
Mainstream Culture Refocused
von: Zhong, Xueping
Veröffentlicht: (2019)
von: Zhong, Xueping
Veröffentlicht: (2019)
ASFT: Aligned Supervised Fine-Tuning through Absolute Likelihood
von: Wang, Ruoyu, et al.
Veröffentlicht: (2024)
von: Wang, Ruoyu, et al.
Veröffentlicht: (2024)
PointSeg: A Training-Free Paradigm for 3D Scene Segmentation via Foundation Models
von: He, Qingdong, et al.
Veröffentlicht: (2024)
von: He, Qingdong, et al.
Veröffentlicht: (2024)
Reason-RFT: Reinforcement Fine-Tuning for Visual Reasoning of Vision Language Models
von: Tan, Huajie, et al.
Veröffentlicht: (2025)
von: Tan, Huajie, et al.
Veröffentlicht: (2025)
Illusions in Humans and AI: How Visual Perception Aligns and Diverges
von: Yang, Jianyi, et al.
Veröffentlicht: (2025)
von: Yang, Jianyi, et al.
Veröffentlicht: (2025)
MVPBench: A Benchmark and Fine-Tuning Framework for Aligning Large Language Models with Diverse Human Values
von: Liang, Yao, et al.
Veröffentlicht: (2025)
von: Liang, Yao, et al.
Veröffentlicht: (2025)
Robust Reinforcement Learning from Human Feedback for Large Language Models Fine-Tuning
von: Ye, Kai, et al.
Veröffentlicht: (2025)
von: Ye, Kai, et al.
Veröffentlicht: (2025)
Teaching AI to Handle Exceptions: Supervised Fine-Tuning with Human-Aligned Judgment
von: DiSorbo, Matthew DosSantos, et al.
Veröffentlicht: (2025)
von: DiSorbo, Matthew DosSantos, et al.
Veröffentlicht: (2025)
Chain of Visual Perception: Harnessing Multimodal Large Language Models for Zero-shot Camouflaged Object Detection
von: Tang, Lv, et al.
Veröffentlicht: (2023)
von: Tang, Lv, et al.
Veröffentlicht: (2023)
AlignSum: Data Pyramid Hierarchical Fine-tuning for Aligning with Human Summarization Preference
von: Han, Yang, et al.
Veröffentlicht: (2024)
von: Han, Yang, et al.
Veröffentlicht: (2024)
Learning to Refocus with Video Diffusion Models
von: Tedla, SaiKiran, et al.
Veröffentlicht: (2025)
von: Tedla, SaiKiran, et al.
Veröffentlicht: (2025)
Robustifying Point Cloud Networks by Refocusing
von: Levi, Meir Yossef, et al.
Veröffentlicht: (2023)
von: Levi, Meir Yossef, et al.
Veröffentlicht: (2023)
DiffCamera: Arbitrary Refocusing on Images
von: Wang, Yiyang, et al.
Veröffentlicht: (2025)
von: Wang, Yiyang, et al.
Veröffentlicht: (2025)
Refocusing spacetimes need not be strongly refocusing
von: Bauermeister, Friedrich
Veröffentlicht: (2026)
von: Bauermeister, Friedrich
Veröffentlicht: (2026)
Zero-Training Task-Specific Model Synthesis for Few-Shot Medical Image Classification
von: Qin, Yao, et al.
Veröffentlicht: (2025)
von: Qin, Yao, et al.
Veröffentlicht: (2025)
Aligning LLMs with Biomedical Knowledge using Balanced Fine-Tuning
von: Tang, Zhenchao, et al.
Veröffentlicht: (2025)
von: Tang, Zhenchao, et al.
Veröffentlicht: (2025)
VPD-100K: Towards Generalizable and Fine-grained Visual Privacy Protection
von: Hu, Xiaobin, et al.
Veröffentlicht: (2026)
von: Hu, Xiaobin, et al.
Veröffentlicht: (2026)
VideoChat-R1: Enhancing Spatio-Temporal Perception via Reinforcement Fine-Tuning
von: Li, Xinhao, et al.
Veröffentlicht: (2025)
von: Li, Xinhao, et al.
Veröffentlicht: (2025)
China: Surpassing the “Middle Income Trap”
von: Zhou, Shaojie, et al.
Veröffentlicht: (2020)
von: Zhou, Shaojie, et al.
Veröffentlicht: (2020)
Dynamic Adversarial Fine-Tuning Reorganizes Refusal Geometry
von: Lan, Wenhao, et al.
Veröffentlicht: (2026)
von: Lan, Wenhao, et al.
Veröffentlicht: (2026)
Highly Thermally Conductive Aramid Nanofiber Composite Films with Synchronous Visible/Infrared Camouflages and Information Encryption
von: Yixin Han, et al.
Veröffentlicht: (2024)
von: Yixin Han, et al.
Veröffentlicht: (2024)
Highly Thermally Conductive Aramid Nanofiber Composite Films with Synchronous Visible/Infrared Camouflages and Information Encryption
von: Yixin Han, et al.
Veröffentlicht: (2024)
von: Yixin Han, et al.
Veröffentlicht: (2024)
Camouflaged Physical Objects: The Intentionality of Perception
von: Manuel LIZ
Veröffentlicht: (2006)
von: Manuel LIZ
Veröffentlicht: (2006)
Hybrid Reinforcement Learning Framework for Mixed-Variable Problems
von: Zhai, Haoyan, et al.
Veröffentlicht: (2024)
von: Zhai, Haoyan, et al.
Veröffentlicht: (2024)
Aligning Human Motion Generation with Human Perceptions
von: Wang, Haoru, et al.
Veröffentlicht: (2024)
von: Wang, Haoru, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
SkillGraph: Self-Evolving Multi-Agent Collaboration with Multimodal Graph Topology
von: Nie, Zheng, et al.
Veröffentlicht: (2026) -
Med-CMR: A Fine-Grained Benchmark Integrating Visual Evidence and Clinical Logic for Medical Complex Multimodal Reasoning
von: Gong, Haozhen, et al.
Veröffentlicht: (2025) -
Sonic: Shifting Focus to Global Audio Perception in Portrait Animation
von: Ji, Xiaozhong, et al.
Veröffentlicht: (2024) -
Towards Fine-Grained Robustness: Attention-Guided Test-Time Prompt Tuning for Vision-Language Models
von: Hai, Jia-Wei, et al.
Veröffentlicht: (2026) -
Human-MME: A Holistic Evaluation Benchmark for Human-Centric Multimodal Large Language Models
von: Liu, Yuansen, et al.
Veröffentlicht: (2025)