Align and Surpass Human Camouflaged Perception: Visual Refocus Reinforcement Fine-Tuning
Fuente:
arXiv
Salvato in:
| Autori principali: | Shen, Ruolin, Ji, Xiaozhong, WU, Kai, Zhang, Jiangning, He, Yijun, Yang, HaiHua, Hu, Xiaobin, Sun, Xiaoyu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SkillGraph: Self-Evolving Multi-Agent Collaboration with Multimodal Graph Topology
di: Nie, Zheng, et al.
Pubblicazione: (2026)
di: Nie, Zheng, et al.
Pubblicazione: (2026)
Med-CMR: A Fine-Grained Benchmark Integrating Visual Evidence and Clinical Logic for Medical Complex Multimodal Reasoning
di: Gong, Haozhen, et al.
Pubblicazione: (2025)
di: Gong, Haozhen, et al.
Pubblicazione: (2025)
Sonic: Shifting Focus to Global Audio Perception in Portrait Animation
di: Ji, Xiaozhong, et al.
Pubblicazione: (2024)
di: Ji, Xiaozhong, et al.
Pubblicazione: (2024)
Towards Fine-Grained Robustness: Attention-Guided Test-Time Prompt Tuning for Vision-Language Models
di: Hai, Jia-Wei, et al.
Pubblicazione: (2026)
di: Hai, Jia-Wei, et al.
Pubblicazione: (2026)
Human-MME: A Holistic Evaluation Benchmark for Human-Centric Multimodal Large Language Models
di: Liu, Yuansen, et al.
Pubblicazione: (2025)
di: Liu, Yuansen, et al.
Pubblicazione: (2025)
Improving Medical Visual Reinforcement Fine-Tuning via Perception and Reasoning Augmentation
di: Yang, Guangjing, et al.
Pubblicazione: (2026)
di: Yang, Guangjing, et al.
Pubblicazione: (2026)
On the Suitability of Reinforcement Fine-Tuning to Visual Tasks
di: Chen, Xiaxu, et al.
Pubblicazione: (2025)
di: Chen, Xiaxu, et al.
Pubblicazione: (2025)
Simulate, Refocus and Ensemble: An Attention-Refocusing Scheme for Domain Generalization
di: Wang, Ziyi, et al.
Pubblicazione: (2025)
di: Wang, Ziyi, et al.
Pubblicazione: (2025)
DiffuMatting: Synthesizing Arbitrary Objects with Matting-level Annotation
di: Hu, Xiaobin, et al.
Pubblicazione: (2024)
di: Hu, Xiaobin, et al.
Pubblicazione: (2024)
UniM-OV3D: Uni-Modality Open-Vocabulary 3D Scene Understanding with Fine-Grained Feature Representation
di: He, Qingdong, et al.
Pubblicazione: (2024)
di: He, Qingdong, et al.
Pubblicazione: (2024)
Reinforcement Fine-Tuning of Flow-Matching Policies for Vision-Language-Action Models
di: Lyu, Mingyang, et al.
Pubblicazione: (2025)
di: Lyu, Mingyang, et al.
Pubblicazione: (2025)
Visual-RFT: Visual Reinforcement Fine-Tuning
di: Liu, Ziyu, et al.
Pubblicazione: (2025)
di: Liu, Ziyu, et al.
Pubblicazione: (2025)
Multi-modal Instruction Tuned LLMs with Fine-grained Visual Perception
di: He, Junwen, et al.
Pubblicazione: (2024)
di: He, Junwen, et al.
Pubblicazione: (2024)
Visual Agentic Reinforcement Fine-Tuning
di: Liu, Ziyu, et al.
Pubblicazione: (2025)
di: Liu, Ziyu, et al.
Pubblicazione: (2025)
FeRA: Frequency-Energy Constrained Routing for Effective Diffusion Adaptation Fine-Tuning
di: Yin, Bo, et al.
Pubblicazione: (2025)
di: Yin, Bo, et al.
Pubblicazione: (2025)
Mainstream Culture Refocused
di: Zhong, Xueping
Pubblicazione: (2019)
di: Zhong, Xueping
Pubblicazione: (2019)
ASFT: Aligned Supervised Fine-Tuning through Absolute Likelihood
di: Wang, Ruoyu, et al.
Pubblicazione: (2024)
di: Wang, Ruoyu, et al.
Pubblicazione: (2024)
PointSeg: A Training-Free Paradigm for 3D Scene Segmentation via Foundation Models
di: He, Qingdong, et al.
Pubblicazione: (2024)
di: He, Qingdong, et al.
Pubblicazione: (2024)
Reason-RFT: Reinforcement Fine-Tuning for Visual Reasoning of Vision Language Models
di: Tan, Huajie, et al.
Pubblicazione: (2025)
di: Tan, Huajie, et al.
Pubblicazione: (2025)
Illusions in Humans and AI: How Visual Perception Aligns and Diverges
di: Yang, Jianyi, et al.
Pubblicazione: (2025)
di: Yang, Jianyi, et al.
Pubblicazione: (2025)
MVPBench: A Benchmark and Fine-Tuning Framework for Aligning Large Language Models with Diverse Human Values
di: Liang, Yao, et al.
Pubblicazione: (2025)
di: Liang, Yao, et al.
Pubblicazione: (2025)
Robust Reinforcement Learning from Human Feedback for Large Language Models Fine-Tuning
di: Ye, Kai, et al.
Pubblicazione: (2025)
di: Ye, Kai, et al.
Pubblicazione: (2025)
Teaching AI to Handle Exceptions: Supervised Fine-Tuning with Human-Aligned Judgment
di: DiSorbo, Matthew DosSantos, et al.
Pubblicazione: (2025)
di: DiSorbo, Matthew DosSantos, et al.
Pubblicazione: (2025)
Chain of Visual Perception: Harnessing Multimodal Large Language Models for Zero-shot Camouflaged Object Detection
di: Tang, Lv, et al.
Pubblicazione: (2023)
di: Tang, Lv, et al.
Pubblicazione: (2023)
AlignSum: Data Pyramid Hierarchical Fine-tuning for Aligning with Human Summarization Preference
di: Han, Yang, et al.
Pubblicazione: (2024)
di: Han, Yang, et al.
Pubblicazione: (2024)
Learning to Refocus with Video Diffusion Models
di: Tedla, SaiKiran, et al.
Pubblicazione: (2025)
di: Tedla, SaiKiran, et al.
Pubblicazione: (2025)
Robustifying Point Cloud Networks by Refocusing
di: Levi, Meir Yossef, et al.
Pubblicazione: (2023)
di: Levi, Meir Yossef, et al.
Pubblicazione: (2023)
DiffCamera: Arbitrary Refocusing on Images
di: Wang, Yiyang, et al.
Pubblicazione: (2025)
di: Wang, Yiyang, et al.
Pubblicazione: (2025)
Refocusing spacetimes need not be strongly refocusing
di: Bauermeister, Friedrich
Pubblicazione: (2026)
di: Bauermeister, Friedrich
Pubblicazione: (2026)
Zero-Training Task-Specific Model Synthesis for Few-Shot Medical Image Classification
di: Qin, Yao, et al.
Pubblicazione: (2025)
di: Qin, Yao, et al.
Pubblicazione: (2025)
Aligning LLMs with Biomedical Knowledge using Balanced Fine-Tuning
di: Tang, Zhenchao, et al.
Pubblicazione: (2025)
di: Tang, Zhenchao, et al.
Pubblicazione: (2025)
VPD-100K: Towards Generalizable and Fine-grained Visual Privacy Protection
di: Hu, Xiaobin, et al.
Pubblicazione: (2026)
di: Hu, Xiaobin, et al.
Pubblicazione: (2026)
VideoChat-R1: Enhancing Spatio-Temporal Perception via Reinforcement Fine-Tuning
di: Li, Xinhao, et al.
Pubblicazione: (2025)
di: Li, Xinhao, et al.
Pubblicazione: (2025)
China: Surpassing the “Middle Income Trap”
di: Zhou, Shaojie, et al.
Pubblicazione: (2020)
di: Zhou, Shaojie, et al.
Pubblicazione: (2020)
Dynamic Adversarial Fine-Tuning Reorganizes Refusal Geometry
di: Lan, Wenhao, et al.
Pubblicazione: (2026)
di: Lan, Wenhao, et al.
Pubblicazione: (2026)
Highly Thermally Conductive Aramid Nanofiber Composite Films with Synchronous Visible/Infrared Camouflages and Information Encryption
di: Yixin Han, et al.
Pubblicazione: (2024)
di: Yixin Han, et al.
Pubblicazione: (2024)
Highly Thermally Conductive Aramid Nanofiber Composite Films with Synchronous Visible/Infrared Camouflages and Information Encryption
di: Yixin Han, et al.
Pubblicazione: (2024)
di: Yixin Han, et al.
Pubblicazione: (2024)
Camouflaged Physical Objects: The Intentionality of Perception
di: Manuel LIZ
Pubblicazione: (2006)
di: Manuel LIZ
Pubblicazione: (2006)
Hybrid Reinforcement Learning Framework for Mixed-Variable Problems
di: Zhai, Haoyan, et al.
Pubblicazione: (2024)
di: Zhai, Haoyan, et al.
Pubblicazione: (2024)
Aligning Human Motion Generation with Human Perceptions
di: Wang, Haoru, et al.
Pubblicazione: (2024)
di: Wang, Haoru, et al.
Pubblicazione: (2024)
Documenti analoghi
-
SkillGraph: Self-Evolving Multi-Agent Collaboration with Multimodal Graph Topology
di: Nie, Zheng, et al.
Pubblicazione: (2026) -
Med-CMR: A Fine-Grained Benchmark Integrating Visual Evidence and Clinical Logic for Medical Complex Multimodal Reasoning
di: Gong, Haozhen, et al.
Pubblicazione: (2025) -
Sonic: Shifting Focus to Global Audio Perception in Portrait Animation
di: Ji, Xiaozhong, et al.
Pubblicazione: (2024) -
Towards Fine-Grained Robustness: Attention-Guided Test-Time Prompt Tuning for Vision-Language Models
di: Hai, Jia-Wei, et al.
Pubblicazione: (2026) -
Human-MME: A Holistic Evaluation Benchmark for Human-Centric Multimodal Large Language Models
di: Liu, Yuansen, et al.
Pubblicazione: (2025)