Enregistré dans:
| Auteurs principaux: | Du, Zhou, Yuan, Zhaoquan, Wu, Xiao, Xu, Changsheng |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2606.02168 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Disentangled Representation Learning via Modular Compositional Bias
par: Jung, Whie, et autres
Publié: (2025)
par: Jung, Whie, et autres
Publié: (2025)
SURE-VQA: Systematic Understanding of Robustness Evaluation in Medical VQA Tasks
par: Kahl, Kim-Celine, et autres
Publié: (2024)
par: Kahl, Kim-Celine, et autres
Publié: (2024)
Multi-Task Learning for Visually Grounded Reasoning in Gastrointestinal VQA
par: Safwan, Itbaan, et autres
Publié: (2025)
par: Safwan, Itbaan, et autres
Publié: (2025)
WorldVQA: Measuring Atomic World Knowledge in Multimodal Large Language Models
par: Zhou, Runjie, et autres
Publié: (2026)
par: Zhou, Runjie, et autres
Publié: (2026)
WildFireVQA: A Large-Scale Radiometric Thermal VQA Benchmark for Aerial Wildfire Monitoring
par: Habibpour, Mobin, et autres
Publié: (2026)
par: Habibpour, Mobin, et autres
Publié: (2026)
Learning Color Equivariant Representations
par: Yang, Yulong, et autres
Publié: (2024)
par: Yang, Yulong, et autres
Publié: (2024)
HAMMR: HierArchical MultiModal React agents for generic VQA
par: Castrejon, Lluis, et autres
Publié: (2024)
par: Castrejon, Lluis, et autres
Publié: (2024)
Cluster-Aware Similarity Diffusion for Instance Retrieval
par: Luo, Jifei, et autres
Publié: (2024)
par: Luo, Jifei, et autres
Publié: (2024)
Enhancing Vietnamese VQA through Curriculum Learning on Raw and Augmented Text Representations
par: Nguyen, Khoi Anh, et autres
Publié: (2025)
par: Nguyen, Khoi Anh, et autres
Publié: (2025)
VQA-Levels: A Hierarchical Approach for Classifying Questions in VQA
par: Madaka, Madhuri Latha, et autres
Publié: (2025)
par: Madaka, Madhuri Latha, et autres
Publié: (2025)
Unexplored flaws in multiple-choice VQA evaluations
par: Rosenthal, Fabio, et autres
Publié: (2025)
par: Rosenthal, Fabio, et autres
Publié: (2025)
BERT-VQA: Visual Question Answering on Plots
par: Vu, Tai, et autres
Publié: (2025)
par: Vu, Tai, et autres
Publié: (2025)
Equivariant neural networks and equivarification
par: Bao, Erkao, et autres
Publié: (2019)
par: Bao, Erkao, et autres
Publié: (2019)
Tripod: Three Complementary Inductive Biases for Disentangled Representation Learning
par: Hsu, Kyle, et autres
Publié: (2024)
par: Hsu, Kyle, et autres
Publié: (2024)
Disentangle and Regularize: Sign Language Production with Articulator-Based Disentanglement and Channel-Aware Regularization
par: Tasyurek, Sumeyye Meryem, et autres
Publié: (2025)
par: Tasyurek, Sumeyye Meryem, et autres
Publié: (2025)
USO: Unified Style and Subject-Driven Generation via Disentangled and Reward Learning
par: Wu, Shaojin, et autres
Publié: (2025)
par: Wu, Shaojin, et autres
Publié: (2025)
Improving Medical VQA through Trajectory-Aware Process Supervision
par: Gulluk, Halil Ibrahim, et autres
Publié: (2026)
par: Gulluk, Halil Ibrahim, et autres
Publié: (2026)
Soft Equivariance Regularization for Invariant Self-Supervised Learning
par: Lee, Joohyung, et autres
Publié: (2026)
par: Lee, Joohyung, et autres
Publié: (2026)
RotaTouille: Rotation Equivariant Deep Learning for Contours
par: Gardaa, Odin Hoff, et autres
Publié: (2025)
par: Gardaa, Odin Hoff, et autres
Publié: (2025)
EqvAfford: SE(3) Equivariance for Point-Level Affordance Learning
par: Chen, Yue, et autres
Publié: (2024)
par: Chen, Yue, et autres
Publié: (2024)
Attribute Diversity Determines the Systematicity Gap in VQA
par: Berlot-Attwell, Ian, et autres
Publié: (2023)
par: Berlot-Attwell, Ian, et autres
Publié: (2023)
DRESS: Disentangled Representation-based Self-Supervised Meta-Learning for Diverse Tasks
par: Cui, Wei, et autres
Publié: (2025)
par: Cui, Wei, et autres
Publié: (2025)
Overconfidence and Calibration in Medical VQA: Empirical Findings and Hallucination-Aware Mitigation
par: Byun, Ji Young, et autres
Publié: (2026)
par: Byun, Ji Young, et autres
Publié: (2026)
Current Symmetry Group Equivariant Convolution Frameworks for Representation Learning
par: Basheer, Ramzan, et autres
Publié: (2024)
par: Basheer, Ramzan, et autres
Publié: (2024)
Disentangled Representation Learning with Transmitted Information Bottleneck
par: Dang, Zhuohang, et autres
Publié: (2023)
par: Dang, Zhuohang, et autres
Publié: (2023)
Disentangled Representation Learning with the Gromov-Monge Gap
par: Uscidda, Théo, et autres
Publié: (2024)
par: Uscidda, Théo, et autres
Publié: (2024)
SA-DVAE: Improving Zero-Shot Skeleton-Based Action Recognition by Disentangled Variational Autoencoders
par: Li, Sheng-Wei, et autres
Publié: (2024)
par: Li, Sheng-Wei, et autres
Publié: (2024)
ProtoVQA: An Adaptable Prototypical Framework for Explainable Fine-Grained Visual Question Answering
par: Diao, Xingjian, et autres
Publié: (2025)
par: Diao, Xingjian, et autres
Publié: (2025)
BloomVQA: Assessing Hierarchical Multi-modal Comprehension
par: Gong, Yunye, et autres
Publié: (2023)
par: Gong, Yunye, et autres
Publié: (2023)
Tunable Soft Equivariance with Guarantees
par: Rahman, Md Ashiqur, et autres
Publié: (2026)
par: Rahman, Md Ashiqur, et autres
Publié: (2026)
Diffeomorphism-Equivariant Neural Networks
par: Oettinger, Josephine Elisabeth, et autres
Publié: (2026)
par: Oettinger, Josephine Elisabeth, et autres
Publié: (2026)
Multi-Task Model Merging via Adaptive Weight Disentanglement
par: Xiong, Feng, et autres
Publié: (2024)
par: Xiong, Feng, et autres
Publié: (2024)
Disentangled 3D Scene Generation with Layout Learning
par: Epstein, Dave, et autres
Publié: (2024)
par: Epstein, Dave, et autres
Publié: (2024)
Multi-view Disentanglement for Reinforcement Learning with Multiple Cameras
par: Dunion, Mhairi, et autres
Publié: (2024)
par: Dunion, Mhairi, et autres
Publié: (2024)
LatentGAN Autoencoder: Learning Disentangled Latent Distribution
par: Kalwar, Sanket, et autres
Publié: (2022)
par: Kalwar, Sanket, et autres
Publié: (2022)
Bridging the Semantic Gaps: Improving Medical VQA Consistency with LLM-Augmented Question Sets
par: Ma, Yongpei, et autres
Publié: (2025)
par: Ma, Yongpei, et autres
Publié: (2025)
NeurIPS 2023 Competition: Privacy Preserving Federated Learning Document VQA
par: Tobaben, Marlon, et autres
Publié: (2024)
par: Tobaben, Marlon, et autres
Publié: (2024)
Bases of Steerable Kernels for Equivariant CNNs: From 2D Rotations to the Lorentz Group
par: Garbarz, Alan
Publié: (2026)
par: Garbarz, Alan
Publié: (2026)
The Lie Derivative for Measuring Learned Equivariance
par: Gruver, Nate, et autres
Publié: (2022)
par: Gruver, Nate, et autres
Publié: (2022)
Isometric Representation Learning for Disentangled Latent Space of Diffusion Models
par: Hahm, Jaehoon, et autres
Publié: (2024)
par: Hahm, Jaehoon, et autres
Publié: (2024)
Documents similaires
-
Disentangled Representation Learning via Modular Compositional Bias
par: Jung, Whie, et autres
Publié: (2025) -
SURE-VQA: Systematic Understanding of Robustness Evaluation in Medical VQA Tasks
par: Kahl, Kim-Celine, et autres
Publié: (2024) -
Multi-Task Learning for Visually Grounded Reasoning in Gastrointestinal VQA
par: Safwan, Itbaan, et autres
Publié: (2025) -
WorldVQA: Measuring Atomic World Knowledge in Multimodal Large Language Models
par: Zhou, Runjie, et autres
Publié: (2026) -
WildFireVQA: A Large-Scale Radiometric Thermal VQA Benchmark for Aerial Wildfire Monitoring
par: Habibpour, Mobin, et autres
Publié: (2026)