FIRE: A Dataset for Feedback Integration and Refinement Evaluation of Multimodal Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Pengxiang, Gao, Zhi, Zhang, Bofei, Yuan, Tao, Wu, Yuwei, Harandi, Mehrtash, Jia, Yunde, Zhu, Song-Chun, Li, Qing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Modality Alignment across Trees on Heterogeneous Hyperbolic Manifolds
di: Wu, Wei, et al.
Pubblicazione: (2025)
di: Wu, Wei, et al.
Pubblicazione: (2025)
Curvature Learning for Generalization of Hyperbolic Neural Networks
di: Fan, Xiaomeng, et al.
Pubblicazione: (2025)
di: Fan, Xiaomeng, et al.
Pubblicazione: (2025)
Geometry-aware Distance Measure for Diverse Hierarchical Structures in Hyperbolic Spaces
di: Li, Pengxiang, et al.
Pubblicazione: (2025)
di: Li, Pengxiang, et al.
Pubblicazione: (2025)
Iterative Tool Usage Exploration for Multimodal Agents via Step-wise Preference Tuning
di: Li, Pengxiang, et al.
Pubblicazione: (2025)
di: Li, Pengxiang, et al.
Pubblicazione: (2025)
Multi-modal Agent Tuning: Building a VLM-Driven Agent for Efficient Tool Usage
di: Gao, Zhi, et al.
Pubblicazione: (2024)
di: Gao, Zhi, et al.
Pubblicazione: (2024)
A Set-to-Set Distance Measure in Hyperbolic Space
di: Li, Pengxiang, et al.
Pubblicazione: (2025)
di: Li, Pengxiang, et al.
Pubblicazione: (2025)
Adaptive Chain-of-Focus Reasoning via Dynamic Visual Search and Zooming for Efficient VLMs
di: Zhang, Xintong, et al.
Pubblicazione: (2025)
di: Zhang, Xintong, et al.
Pubblicazione: (2025)
MIRROR: Multimodal Iterative Reasoning via Reflection on Visual Regions
di: Zhang, Haoyu, et al.
Pubblicazione: (2026)
di: Zhang, Haoyu, et al.
Pubblicazione: (2026)
MUNBa: Machine Unlearning via Nash Bargaining
di: Wu, Jing, et al.
Pubblicazione: (2024)
di: Wu, Jing, et al.
Pubblicazione: (2024)
Scissorhands: Scrub Data Influence via Connection Sensitivity in Networks
di: Wu, Jing, et al.
Pubblicazione: (2024)
di: Wu, Jing, et al.
Pubblicazione: (2024)
TongUI: Internet-Scale Trajectories from Multimodal Web Tutorials for Generalized GUI Agents
di: Zhang, Bofei, et al.
Pubblicazione: (2025)
di: Zhang, Bofei, et al.
Pubblicazione: (2025)
Large-Scale Riemannian Meta-Optimization via Subspace Adaptation
di: Yu, Peilin, et al.
Pubblicazione: (2025)
di: Yu, Peilin, et al.
Pubblicazione: (2025)
AdaptMMBench: Benchmarking Adaptive Multimodal Reasoning for Mode Selection and Reasoning Process
di: Zhang, Xintong, et al.
Pubblicazione: (2026)
di: Zhang, Xintong, et al.
Pubblicazione: (2026)
How Far Can We Compress Instant-NGP-Based NeRF?
di: Chen, Yihang, et al.
Pubblicazione: (2024)
di: Chen, Yihang, et al.
Pubblicazione: (2024)
Erasing Undesirable Influence in Diffusion Models
di: Wu, Jing, et al.
Pubblicazione: (2024)
di: Wu, Jing, et al.
Pubblicazione: (2024)
Hyperbolic Dual Feature Augmentation for Open-Environment
di: Yu, Peilin, et al.
Pubblicazione: (2025)
di: Yu, Peilin, et al.
Pubblicazione: (2025)
Adaptive Model Ensemble for Continual Learning
di: Mao, Yuchuan, et al.
Pubblicazione: (2025)
di: Mao, Yuchuan, et al.
Pubblicazione: (2025)
Beyond the Seen: Bounded Distribution Estimation for Open-Vocabulary Learning
di: Fan, Xiaomeng, et al.
Pubblicazione: (2025)
di: Fan, Xiaomeng, et al.
Pubblicazione: (2025)
Multi-Sourced Compositional Generalization in Visual Question Answering
di: Li, Chuanhao, et al.
Pubblicazione: (2025)
di: Li, Chuanhao, et al.
Pubblicazione: (2025)
Temporally Consistent Stereo Matching
di: Zeng, Jiaxi, et al.
Pubblicazione: (2024)
di: Zeng, Jiaxi, et al.
Pubblicazione: (2024)
MoKD: Multi-Task Optimization for Knowledge Distillation
di: Hayder, Zeeshan, et al.
Pubblicazione: (2025)
di: Hayder, Zeeshan, et al.
Pubblicazione: (2025)
Efficient Multi-turn RL for GUI Agents via Decoupled Training and Adaptive Data Curation
di: Li, Pengxiang, et al.
Pubblicazione: (2025)
di: Li, Pengxiang, et al.
Pubblicazione: (2025)
HAC++: Towards 100X Compression of 3D Gaussian Splatting
di: Chen, Yihang, et al.
Pubblicazione: (2025)
di: Chen, Yihang, et al.
Pubblicazione: (2025)
HAC: Hash-grid Assisted Context for 3D Gaussian Splatting Compression
di: Chen, Yihang, et al.
Pubblicazione: (2024)
di: Chen, Yihang, et al.
Pubblicazione: (2024)
Fast Feedforward 3D Gaussian Splatting Compression
di: Chen, Yihang, et al.
Pubblicazione: (2024)
di: Chen, Yihang, et al.
Pubblicazione: (2024)
PCGS: Progressive Compression of 3D Gaussian Splatting
di: Chen, Yihang, et al.
Pubblicazione: (2025)
di: Chen, Yihang, et al.
Pubblicazione: (2025)
Composition-Incremental Learning for Compositional Generalization
di: Li, Zhen, et al.
Pubblicazione: (2025)
di: Li, Zhen, et al.
Pubblicazione: (2025)
Facial Expression Generation Aligned with Human Preference for Natural Dyadic Interaction
di: Chen, Xu, et al.
Pubblicazione: (2026)
di: Chen, Xu, et al.
Pubblicazione: (2026)
Fine-Grained 3D Facial Reconstruction for Micro-Expressions
di: Sun, Che, et al.
Pubblicazione: (2026)
di: Sun, Che, et al.
Pubblicazione: (2026)
Learning from Noisy Labels with Contrastive Co-Transformer
di: Han, Yan, et al.
Pubblicazione: (2025)
di: Han, Yan, et al.
Pubblicazione: (2025)
Multi-Label Stereo Matching for Transparent Scene Depth Estimation
di: Liu, Zhidan, et al.
Pubblicazione: (2025)
di: Liu, Zhidan, et al.
Pubblicazione: (2025)
Memory-Centric Embodied Question Answering
di: Zhai, Mingliang, et al.
Pubblicazione: (2025)
di: Zhai, Mingliang, et al.
Pubblicazione: (2025)
LongSplat: Online Generalizable 3D Gaussian Splatting from Long Sequence Images
di: Huang, Guichen, et al.
Pubblicazione: (2025)
di: Huang, Guichen, et al.
Pubblicazione: (2025)
Flashbacks to Harmonize Stability and Plasticity in Continual Learning
di: Mahmoodi, Leila, et al.
Pubblicazione: (2025)
di: Mahmoodi, Leila, et al.
Pubblicazione: (2025)
Consistency of Compositional Generalization across Multiple Levels
di: Li, Chuanhao, et al.
Pubblicazione: (2024)
di: Li, Chuanhao, et al.
Pubblicazione: (2024)
CL-MRI: Self-Supervised Contrastive Learning to Improve the Accuracy of Undersampled MRI Reconstruction
di: Ekanayake, Mevan, et al.
Pubblicazione: (2023)
di: Ekanayake, Mevan, et al.
Pubblicazione: (2023)
SeCo-INR: Semantically Conditioned Implicit Neural Representations for Improved Medical Image Super-Resolution
di: Ekanayake, Mevan, et al.
Pubblicazione: (2024)
di: Ekanayake, Mevan, et al.
Pubblicazione: (2024)
IMU: Influence-guided Machine Unlearning
di: Fan, Xindi, et al.
Pubblicazione: (2025)
di: Fan, Xindi, et al.
Pubblicazione: (2025)
Diving into the Fusion of Monocular Priors for Generalized Stereo Matching
di: Yao, Chengtang, et al.
Pubblicazione: (2025)
di: Yao, Chengtang, et al.
Pubblicazione: (2025)
3D Visual Illusion Depth Estimation
di: Yao, Chengtang, et al.
Pubblicazione: (2025)
di: Yao, Chengtang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Modality Alignment across Trees on Heterogeneous Hyperbolic Manifolds
di: Wu, Wei, et al.
Pubblicazione: (2025) -
Curvature Learning for Generalization of Hyperbolic Neural Networks
di: Fan, Xiaomeng, et al.
Pubblicazione: (2025) -
Geometry-aware Distance Measure for Diverse Hierarchical Structures in Hyperbolic Spaces
di: Li, Pengxiang, et al.
Pubblicazione: (2025) -
Iterative Tool Usage Exploration for Multimodal Agents via Step-wise Preference Tuning
di: Li, Pengxiang, et al.
Pubblicazione: (2025) -
Multi-modal Agent Tuning: Building a VLM-Driven Agent for Efficient Tool Usage
di: Gao, Zhi, et al.
Pubblicazione: (2024)