ReasonEdit: Editing Vision-Language Models using Human Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Qiu, Jiaxing, Hou, Kaihua, Daneshjou, Roxana, Alaa, Ahmed, Hartvigsen, Thomas |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Test-Time Hinting for Black-Box Vision-Language Models
par: Hou, Kaihua, et autres
Publié: (2026)
par: Hou, Kaihua, et autres
Publié: (2026)
ReasonEdit: Towards Reasoning-Enhanced Image Editing Models
par: Yin, Fukun, et autres
Publié: (2025)
par: Yin, Fukun, et autres
Publié: (2025)
BiasICL: In-Context Learning and Demographic Biases of Vision Language Models
par: Xu, Sonnet, et autres
Publié: (2025)
par: Xu, Sonnet, et autres
Publié: (2025)
ReasonEdit: Towards Interpretable Image Editing Evaluation via Reinforcement Learning
par: Chen, Honghua, et autres
Publié: (2026)
par: Chen, Honghua, et autres
Publié: (2026)
Prompt Triage: Structured Optimization Enhances Vision-Language Model Performance on Medical Imaging Benchmarks
par: Singhvi, Arnav, et autres
Publié: (2025)
par: Singhvi, Arnav, et autres
Publié: (2025)
DualEdit: Dual Editing for Knowledge Updating in Vision-Language Models
par: Shi, Zhiyi, et autres
Publié: (2025)
par: Shi, Zhiyi, et autres
Publié: (2025)
Distilling 3D Spatial Reasoning into a Lightweight Vision-Language Model with CoT
par: Asfour, Alaa, et autres
Publié: (2026)
par: Asfour, Alaa, et autres
Publié: (2026)
TextEditBench: Evaluating Reasoning-aware Text Editing Beyond Rendering
par: Gui, Rui, et autres
Publié: (2025)
par: Gui, Rui, et autres
Publié: (2025)
HP-Edit: A Human-Preference Post-Training Framework for Image Editing
par: Li, Fan, et autres
Publié: (2026)
par: Li, Fan, et autres
Publié: (2026)
Reason-RFT: Reinforcement Fine-Tuning for Visual Reasoning of Vision Language Models
par: Tan, Huajie, et autres
Publié: (2025)
par: Tan, Huajie, et autres
Publié: (2025)
Identifying Implicit Social Biases in Vision-Language Models
par: Hamidieh, Kimia, et autres
Publié: (2024)
par: Hamidieh, Kimia, et autres
Publié: (2024)
Prompting Large Vision-Language Models for Compositional Reasoning
par: Ossowski, Timothy, et autres
Publié: (2024)
par: Ossowski, Timothy, et autres
Publié: (2024)
Jailbreaks on Vision Language Model via Multimodal Reasoning
par: Noheria, Aarush, et autres
Publié: (2026)
par: Noheria, Aarush, et autres
Publié: (2026)
Natural Language Supervision for Low-light Image Enhancement
par: Tang, Jiahui, et autres
Publié: (2025)
par: Tang, Jiahui, et autres
Publié: (2025)
Perception Before Reasoning: Two-Stage Reinforcement Learning for Visual Reasoning in Vision-Language Models
par: Chen, Yan, et autres
Publié: (2025)
par: Chen, Yan, et autres
Publié: (2025)
MSRAMIE: Multimodal Structured Reasoning Agent for Multi-instruction Image Editing
par: Qiu, Zhaoyuan, et autres
Publié: (2026)
par: Qiu, Zhaoyuan, et autres
Publié: (2026)
SUREON: A Benchmark and Vision-Language-Model for Surgical Reasoning
par: Perez, Alejandra, et autres
Publié: (2026)
par: Perez, Alejandra, et autres
Publié: (2026)
EditReward: A Human-Aligned Reward Model for Instruction-Guided Image Editing
par: Wu, Keming, et autres
Publié: (2025)
par: Wu, Keming, et autres
Publié: (2025)
MHPR: Multidimensional Human Perception and Reasoning Benchmark for Large Vision-Languate Models
par: Wang, Kangkang, et autres
Publié: (2026)
par: Wang, Kangkang, et autres
Publié: (2026)
A Survey on Vision Autoregressive Model
par: Jiang, Kai, et autres
Publié: (2024)
par: Jiang, Kai, et autres
Publié: (2024)
Reasoning under Vision: Understanding Visual-Spatial Cognition in Vision-Language Models for CAPTCHA
par: Song, Python, et autres
Publié: (2025)
par: Song, Python, et autres
Publié: (2025)
Infection-Reasoner: A Compact Vision-Language Model for Wound Infection Classification with Evidence-Grounded Clinical Reasoning
par: Busaranuvong, Palawat, et autres
Publié: (2026)
par: Busaranuvong, Palawat, et autres
Publié: (2026)
FRIEDA: Benchmarking Multi-Step Cartographic Reasoning in Vision-Language Models
par: Pyo, Jiyoon, et autres
Publié: (2025)
par: Pyo, Jiyoon, et autres
Publié: (2025)
Think or Not? Selective Reasoning via Reinforcement Learning for Vision-Language Models
par: Wang, Jiaqi, et autres
Publié: (2025)
par: Wang, Jiaqi, et autres
Publié: (2025)
DRScaffold: Boosting Dense-Scene Reasoning in Lightweight Vision Language Models
par: Shi, Xinrui, et autres
Publié: (2026)
par: Shi, Xinrui, et autres
Publié: (2026)
On the Cultural Anachronism and Temporal Reasoning in Vision Language Models
par: Ranjan, Mukul, et autres
Publié: (2026)
par: Ranjan, Mukul, et autres
Publié: (2026)
Reward Design for Physical Reasoning in Vision-Language Models
par: Lilienthal, Derek, et autres
Publié: (2026)
par: Lilienthal, Derek, et autres
Publié: (2026)
SpotEdit: Selective Region Editing in Diffusion Transformers
par: Qin, Zhibin, et autres
Publié: (2025)
par: Qin, Zhibin, et autres
Publié: (2025)
BrushEdit: All-In-One Image Inpainting and Editing
par: Li, Yaowei, et autres
Publié: (2024)
par: Li, Yaowei, et autres
Publié: (2024)
OmniEdit: Building Image Editing Generalist Models Through Specialist Supervision
par: Wei, Cong, et autres
Publié: (2024)
par: Wei, Cong, et autres
Publié: (2024)
Locatability-Guided Adaptive Reasoning for Image Geo-Localization with Vision-Language Models
par: Yu, Bo, et autres
Publié: (2026)
par: Yu, Bo, et autres
Publié: (2026)
3DReasonKnee: Advancing Grounded Reasoning in Medical Vision Language Models
par: Sambara, Sraavya, et autres
Publié: (2025)
par: Sambara, Sraavya, et autres
Publié: (2025)
More Thought, Less Accuracy? On the Dual Nature of Reasoning in Vision-Language Models
par: Tian, Xinyu, et autres
Publié: (2025)
par: Tian, Xinyu, et autres
Publié: (2025)
CompareBench: A Benchmark for Visual Comparison Reasoning in Vision-Language Models
par: Cai, Jie, et autres
Publié: (2025)
par: Cai, Jie, et autres
Publié: (2025)
Counting Circuits: Mechanistic Interpretability of Visual Reasoning in Large Vision-Language Models
par: Che, Liwei, et autres
Publié: (2026)
par: Che, Liwei, et autres
Publié: (2026)
SpaRE: Enhancing Spatial Reasoning in Vision-Language Models with Synthetic Data
par: Ogezi, Michael, et autres
Publié: (2025)
par: Ogezi, Michael, et autres
Publié: (2025)
Reinforcing Spatial Reasoning in Vision-Language Models with Interwoven Thinking and Visual Drawing
par: Wu, Junfei, et autres
Publié: (2025)
par: Wu, Junfei, et autres
Publié: (2025)
3D-Layout-R1: Structured Reasoning for Language-Instructed Spatial Editing
par: Zhen, Haoyu, et autres
Publié: (2026)
par: Zhen, Haoyu, et autres
Publié: (2026)
Benchmarking Multi-Image Understanding in Vision and Language Models: Perception, Knowledge, Reasoning, and Multi-Hop Reasoning
par: Zhao, Bingchen, et autres
Publié: (2024)
par: Zhao, Bingchen, et autres
Publié: (2024)
R1-ShareVL: Incentivizing Reasoning Capability of Multimodal Large Language Models via Share-GRPO
par: Yao, Huanjin, et autres
Publié: (2025)
par: Yao, Huanjin, et autres
Publié: (2025)
Documents similaires
-
Test-Time Hinting for Black-Box Vision-Language Models
par: Hou, Kaihua, et autres
Publié: (2026) -
ReasonEdit: Towards Reasoning-Enhanced Image Editing Models
par: Yin, Fukun, et autres
Publié: (2025) -
BiasICL: In-Context Learning and Demographic Biases of Vision Language Models
par: Xu, Sonnet, et autres
Publié: (2025) -
ReasonEdit: Towards Interpretable Image Editing Evaluation via Reinforcement Learning
par: Chen, Honghua, et autres
Publié: (2026) -
Prompt Triage: Structured Optimization Enhances Vision-Language Model Performance on Medical Imaging Benchmarks
par: Singhvi, Arnav, et autres
Publié: (2025)