TikArt: Stabilizing Aperture-Guided Fine-Grained Visual Reasoning with Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Ding, Hao, Yang, Zhichuan, Ge, Weijie, Gao, Ziqin, Lu, Chaoyi, Zhao, Lei |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Integrating Fine-Grained Audio-Visual Evidence for Robust Multimodal Emotion Reasoning
von: Zhao, Zhixian, et al.
Veröffentlicht: (2026)
von: Zhao, Zhixian, et al.
Veröffentlicht: (2026)
TaxonRL: Reinforcement Learning with Intermediate Rewards for Interpretable Fine-Grained Visual Reasoning
von: von Klinski, Maximilian, et al.
Veröffentlicht: (2026)
von: von Klinski, Maximilian, et al.
Veröffentlicht: (2026)
Align then Adapt: Rethinking Parameter-Efficient Transfer Learning in 4D Perception
von: Sun, Yiding, et al.
Veröffentlicht: (2026)
von: Sun, Yiding, et al.
Veröffentlicht: (2026)
Cross-Hierarchical Bidirectional Consistency Learning for Fine-Grained Visual Classification
von: Gao, Pengxiang, et al.
Veröffentlicht: (2025)
von: Gao, Pengxiang, et al.
Veröffentlicht: (2025)
PointRFT: Explicit Reinforcement Fine-tuning for Point Cloud Few-shot Learning
von: Wang, Yankai, et al.
Veröffentlicht: (2026)
von: Wang, Yankai, et al.
Veröffentlicht: (2026)
VISCO: Benchmarking Fine-Grained Critique and Correction Towards Self-Improvement in Visual Reasoning
von: Wu, Xueqing, et al.
Veröffentlicht: (2024)
von: Wu, Xueqing, et al.
Veröffentlicht: (2024)
FineRS: Fine-grained Reasoning and Segmentation of Small Objects with Reinforcement Learning
von: Zhang, Lu, et al.
Veröffentlicht: (2025)
von: Zhang, Lu, et al.
Veröffentlicht: (2025)
Reason-RFT: Reinforcement Fine-Tuning for Visual Reasoning of Vision Language Models
von: Tan, Huajie, et al.
Veröffentlicht: (2025)
von: Tan, Huajie, et al.
Veröffentlicht: (2025)
PROPA: Toward Process-level Optimization in Visual Reasoning via Reinforcement Learning
von: Jiang, Yanbei, et al.
Veröffentlicht: (2025)
von: Jiang, Yanbei, et al.
Veröffentlicht: (2025)
UniVG-R1: Reasoning Guided Universal Visual Grounding with Reinforcement Learning
von: Bai, Sule, et al.
Veröffentlicht: (2025)
von: Bai, Sule, et al.
Veröffentlicht: (2025)
HOLO: Homography-Guided Pose Estimator Network for Fine-Grained Visual Localization on SD Maps
von: Zhong, Xuchang, et al.
Veröffentlicht: (2026)
von: Zhong, Xuchang, et al.
Veröffentlicht: (2026)
Generalizable Whole Slide Image Classification with Fine-Grained Visual-Semantic Interaction
von: Li, Hao, et al.
Veröffentlicht: (2024)
von: Li, Hao, et al.
Veröffentlicht: (2024)
Visual Reasoning through Tool-supervised Reinforcement Learning
von: Dong, Qihua, et al.
Veröffentlicht: (2026)
von: Dong, Qihua, et al.
Veröffentlicht: (2026)
Sam-Guided Enhanced Fine-Grained Encoding with Mixed Semantic Learning for Medical Image Captioning
von: Zhang, Zhenyu, et al.
Veröffentlicht: (2023)
von: Zhang, Zhenyu, et al.
Veröffentlicht: (2023)
ASPO: Adaptive Sentence-Level Preference Optimization for Fine-Grained Multimodal Reasoning
von: Wang, Yeyuan, et al.
Veröffentlicht: (2025)
von: Wang, Yeyuan, et al.
Veröffentlicht: (2025)
Improving Medical Visual Reinforcement Fine-Tuning via Perception and Reasoning Augmentation
von: Yang, Guangjing, et al.
Veröffentlicht: (2026)
von: Yang, Guangjing, et al.
Veröffentlicht: (2026)
Lang2Act: Fine-Grained Visual Reasoning through Self-Emergent Linguistic Toolchains
von: Xiong, Yuqi, et al.
Veröffentlicht: (2026)
von: Xiong, Yuqi, et al.
Veröffentlicht: (2026)
R-AVST: Empowering Video-LLMs with Fine-Grained Spatio-Temporal Reasoning in Complex Audio-Visual Scenarios
von: Zhu, Lu, et al.
Veröffentlicht: (2025)
von: Zhu, Lu, et al.
Veröffentlicht: (2025)
Corrected with the Latest Version: Make Robust Asynchronous Federated Learning Possible
von: Lu, Chaoyi, et al.
Veröffentlicht: (2025)
von: Lu, Chaoyi, et al.
Veröffentlicht: (2025)
Visually-Guided Controllable Medical Image Generation via Fine-Grained Semantic Disentanglement
von: Huang, Xin, et al.
Veröffentlicht: (2026)
von: Huang, Xin, et al.
Veröffentlicht: (2026)
VER-Bench: Evaluating MLLMs on Reasoning with Fine-Grained Visual Evidence
von: Qiang, Chenhui, et al.
Veröffentlicht: (2025)
von: Qiang, Chenhui, et al.
Veröffentlicht: (2025)
TikZilla: Scaling Text-to-TikZ with High-Quality Data and Reinforcement Learning
von: Greisinger, Christian, et al.
Veröffentlicht: (2026)
von: Greisinger, Christian, et al.
Veröffentlicht: (2026)
Guiding the Inner Eye: A Framework for Hierarchical and Flexible Visual Grounded Reasoning
von: Wei, Zhaoyang, et al.
Veröffentlicht: (2025)
von: Wei, Zhaoyang, et al.
Veröffentlicht: (2025)
Fine-Grained VLM Fine-tuning via Latent Hierarchical Adapter Learning
von: Zhao, Yumiao, et al.
Veröffentlicht: (2025)
von: Zhao, Yumiao, et al.
Veröffentlicht: (2025)
Fine-Grained Representation for Lane Topology Reasoning
von: Xu, Guoqing, et al.
Veröffentlicht: (2025)
von: Xu, Guoqing, et al.
Veröffentlicht: (2025)
Fine-Grained Instruction-Guided Graph Reasoning for Vision-and-Language Navigation
von: Liu, Yaohua, et al.
Veröffentlicht: (2025)
von: Liu, Yaohua, et al.
Veröffentlicht: (2025)
ReasonMap: Towards Fine-Grained Visual Reasoning from Transit Maps
von: Feng, Sicheng, et al.
Veröffentlicht: (2025)
von: Feng, Sicheng, et al.
Veröffentlicht: (2025)
VistaGEN: Consistent Driving Video Generation with Fine-Grained Control Using Multiview Visual-Language Reasoning
von: Chen, Li-Heng, et al.
Veröffentlicht: (2026)
von: Chen, Li-Heng, et al.
Veröffentlicht: (2026)
AURA: A Fine-Grained Benchmark and Decomposed Metric for Audio-Visual Reasoning
von: Galougah, Siminfar Samakoush, et al.
Veröffentlicht: (2025)
von: Galougah, Siminfar Samakoush, et al.
Veröffentlicht: (2025)
Expert Knowledge-Guided Decision Calibration for Accurate Fine-Grained Tree Species Classification
von: Long, Chen, et al.
Veröffentlicht: (2026)
von: Long, Chen, et al.
Veröffentlicht: (2026)
Heterogeneous Uncertainty-Guided Composed Image Retrieval with Fine-Grained Probabilistic Learning
von: Tang, Haomiao, et al.
Veröffentlicht: (2026)
von: Tang, Haomiao, et al.
Veröffentlicht: (2026)
Uncertainty Guided Refinement for Fine-Grained Salient Object Detection
von: Yuan, Yao, et al.
Veröffentlicht: (2025)
von: Yuan, Yao, et al.
Veröffentlicht: (2025)
Unveiling Fine-Grained Visual Traces: Evaluating Multimodal Interleaved Reasoning Chains in Multimodal STEM Tasks
von: Jin, Jing, et al.
Veröffentlicht: (2026)
von: Jin, Jing, et al.
Veröffentlicht: (2026)
Grounded Reinforcement Learning for Visual Reasoning
von: Sarch, Gabriel, et al.
Veröffentlicht: (2025)
von: Sarch, Gabriel, et al.
Veröffentlicht: (2025)
LoDisc: Learning Global-Local Discriminative Features for Self-Supervised Fine-Grained Visual Recognition
von: Shi, Jialu, et al.
Veröffentlicht: (2024)
von: Shi, Jialu, et al.
Veröffentlicht: (2024)
Learning Only with Images: Visual Reinforcement Learning with Reasoning, Rendering, and Visual Feedback
von: Chen, Yang, et al.
Veröffentlicht: (2025)
von: Chen, Yang, et al.
Veröffentlicht: (2025)
Learning Contrastive Self-Distillation for Ultra-Fine-Grained Visual Categorization Targeting Limited Samples
von: Fang, Ziye, et al.
Veröffentlicht: (2023)
von: Fang, Ziye, et al.
Veröffentlicht: (2023)
Head-Aware Visual Cropping: Enhancing Fine-Grained VQA with Attention-Guided Subimage
von: Xie, Junfei, et al.
Veröffentlicht: (2026)
von: Xie, Junfei, et al.
Veröffentlicht: (2026)
Discovering Fine-Grained Visual-Concept Relations by Disentangled Optimal Transport Concept Bottleneck Models
von: Xie, Yan, et al.
Veröffentlicht: (2025)
von: Xie, Yan, et al.
Veröffentlicht: (2025)
ReAlign: Optimizing the Visual Document Retriever with Reasoning-Guided Fine-Grained Alignment
von: Yang, Hao, et al.
Veröffentlicht: (2026)
von: Yang, Hao, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Integrating Fine-Grained Audio-Visual Evidence for Robust Multimodal Emotion Reasoning
von: Zhao, Zhixian, et al.
Veröffentlicht: (2026) -
TaxonRL: Reinforcement Learning with Intermediate Rewards for Interpretable Fine-Grained Visual Reasoning
von: von Klinski, Maximilian, et al.
Veröffentlicht: (2026) -
Align then Adapt: Rethinking Parameter-Efficient Transfer Learning in 4D Perception
von: Sun, Yiding, et al.
Veröffentlicht: (2026) -
Cross-Hierarchical Bidirectional Consistency Learning for Fine-Grained Visual Classification
von: Gao, Pengxiang, et al.
Veröffentlicht: (2025) -
PointRFT: Explicit Reinforcement Fine-tuning for Point Cloud Few-shot Learning
von: Wang, Yankai, et al.
Veröffentlicht: (2026)