Predictive Reasoning with Augmented Anomaly Contrastive Learning for Compositional Visual Relations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Chengtai, He, Yuting, Ren, Jianfeng, Bai, Ruibin, Zhao, Yitian, Yu, Heng, Jiang, Xudong |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multi-View Spectrogram Transformer for Respiratory Sound Classification
par: He, Wentao, et autres
Publié: (2023)
par: He, Wentao, et autres
Publié: (2023)
ERL-MPP: Evolutionary Reinforcement Learning with Multi-head Puzzle Perception for Solving Large-scale Jigsaw Puzzles of Eroded Gaps
par: Song, Xingke, et autres
Publié: (2025)
par: Song, Xingke, et autres
Publié: (2025)
Visual Perturbation and Adaptive Hard Negative Contrastive Learning for Compositional Reasoning in Vision-Language Models
par: Huang, Xin, et autres
Publié: (2025)
par: Huang, Xin, et autres
Publié: (2025)
LP$^{2}$DH: A Locality-Preserving Pixel-Difference Hashing Framework for Dynamic Texture Recognition
par: Ding, Ruxin, et autres
Publié: (2026)
par: Ding, Ruxin, et autres
Publié: (2026)
SignReasoner: Compositional Reasoning for Complex Traffic Sign Understanding via Functional Structure Units
par: Wang, Ruibin, et autres
Publié: (2026)
par: Wang, Ruibin, et autres
Publié: (2026)
MotionMERGE: A Multi-granular Framework for Human Motion Editing, Reasoning, Generation, and Explanation
par: Wu, Bizhu, et autres
Publié: (2026)
par: Wu, Bizhu, et autres
Publié: (2026)
MiCo: Multi-image Contrast for Reinforcement Visual Reasoning
par: Chen, Xi, et autres
Publié: (2025)
par: Chen, Xi, et autres
Publié: (2025)
Vector Contrastive Learning For Pixel-Wise Pretraining In Medical Vision
par: He, Yuting, et autres
Publié: (2025)
par: He, Yuting, et autres
Publié: (2025)
Face recognition on point cloud with cgan-top for denoising
par: Liu, Junyu, et autres
Publié: (2025)
par: Liu, Junyu, et autres
Publié: (2025)
MathSticks: A Benchmark for Visual Symbolic Compositional Reasoning with Matchstick Puzzles
par: Ji, Yuheng, et autres
Publié: (2025)
par: Ji, Yuheng, et autres
Publié: (2025)
Weakly Supervised Video Anomaly Detection with Anomaly-Connected Components and Intention Reasoning
par: Wang, Yu, et autres
Publié: (2026)
par: Wang, Yu, et autres
Publié: (2026)
FineMotion: A Dataset and Benchmark with both Spatial and Temporal Annotation for Fine-grained Motion Generation and Editing
par: Wu, Bizhu, et autres
Publié: (2025)
par: Wu, Bizhu, et autres
Publié: (2025)
MG-MotionLLM: A Unified Framework for Motion Comprehension and Generation across Multiple Granularities
par: Wu, Bizhu, et autres
Publié: (2025)
par: Wu, Bizhu, et autres
Publié: (2025)
Continuous Vision-Language-Action Co-Learning with Semantic-Physical Alignment for Behavioral Cloning
par: Qi, Xiuxiu, et autres
Publié: (2025)
par: Qi, Xiuxiu, et autres
Publié: (2025)
A Survey of Mix-based Data Augmentation: Taxonomy, Methods, Applications, and Explainability
par: Cao, Chengtai, et autres
Publié: (2022)
par: Cao, Chengtai, et autres
Publié: (2022)
Semantic Visual Anomaly Detection and Reasoning in AI-Generated Images
par: Tan, Chuangchuang, et autres
Publié: (2025)
par: Tan, Chuangchuang, et autres
Publié: (2025)
Unsupervised Industrial Anomaly Detection via Pattern Generative and Contrastive Networks
par: Huang, Jianfeng, et autres
Publié: (2022)
par: Huang, Jianfeng, et autres
Publié: (2022)
SiamNAS: Siamese Surrogate Model for Dominance Relation Prediction in Multi-objective Neural Architecture Search
par: Zhou, Yuyang, et autres
Publié: (2025)
par: Zhou, Yuyang, et autres
Publié: (2025)
Contrastive Visual Data Augmentation
par: Zhou, Yu, et autres
Publié: (2025)
par: Zhou, Yu, et autres
Publié: (2025)
Visual Attention Prompted Prediction and Learning
par: Zhang, Yifei, et autres
Publié: (2023)
par: Zhang, Yifei, et autres
Publié: (2023)
Contrastive Cross-Bag Augmentation for Multiple Instance Learning-based Whole Slide Image Classification
par: Zhang, Bo, et autres
Publié: (2025)
par: Zhang, Bo, et autres
Publié: (2025)
Surgical-VQLA++: Adversarial Contrastive Learning for Calibrated Robust Visual Question-Localized Answering in Robotic Surgery
par: Bai, Long, et autres
Publié: (2024)
par: Bai, Long, et autres
Publié: (2024)
DIRCR: Dual-Inference Rule-Contrastive Reasoning for Solving RAVENs
par: Zhang, Jiachen, et autres
Publié: (2026)
par: Zhang, Jiachen, et autres
Publié: (2026)
VisualTrans: A Benchmark for Real-World Visual Transformation Reasoning
par: Ji, Yuheng, et autres
Publié: (2025)
par: Ji, Yuheng, et autres
Publié: (2025)
Enhancing Visual Document Understanding with Contrastive Learning in Large Visual-Language Models
par: Li, Xin, et autres
Publié: (2024)
par: Li, Xin, et autres
Publié: (2024)
TR2M: Transferring Monocular Relative Depth to Metric Depth with Language Descriptions and Dual-Level Scale-Oriented Contrast
par: Cui, Beilei, et autres
Publié: (2025)
par: Cui, Beilei, et autres
Publié: (2025)
Contrastive Augmented Transformer with Domain-specific Enhancement for Robust Multi-scenario Metal Surface Defect Detection
par: Liua, Yiyao, et autres
Publié: (2026)
par: Liua, Yiyao, et autres
Publié: (2026)
Scale Contrastive Learning with Selective Attentions for Blind Image Quality Assessment
par: Hu, Runze, et autres
Publié: (2024)
par: Hu, Runze, et autres
Publié: (2024)
CoLVR: Enhancing Exploratory Latent Visual Reasoning via Contrastive Optimization
par: Ding, Ziyang, et autres
Publié: (2026)
par: Ding, Ziyang, et autres
Publié: (2026)
Open-set Anomaly Segmentation in Complex Scenarios
par: Xia, Song, et autres
Publié: (2025)
par: Xia, Song, et autres
Publié: (2025)
GazeXplain: Learning to Predict Natural Language Explanations of Visual Scanpaths
par: Chen, Xianyu, et autres
Publié: (2024)
par: Chen, Xianyu, et autres
Publié: (2024)
Compositional Image Retrieval via Instruction-Aware Contrastive Learning
par: Zhong, Wenliang, et autres
Publié: (2024)
par: Zhong, Wenliang, et autres
Publié: (2024)
TOMCAT: Test-time Comprehensive Knowledge Accumulation for Compositional Zero-Shot Learning
par: Yan, Xudong, et autres
Publié: (2025)
par: Yan, Xudong, et autres
Publié: (2025)
Structure Over Scale: Learning Visual Reasoning from Pedagogical Video
par: Galoaa, Bishoy, et autres
Publié: (2026)
par: Galoaa, Bishoy, et autres
Publié: (2026)
Thinking With Videos: Multimodal Tool-Augmented Reinforcement Learning for Long Video Reasoning
par: Zhang, Haoji, et autres
Publié: (2025)
par: Zhang, Haoji, et autres
Publié: (2025)
The Composite Visual-Laser Navigation Method Applied in Indoor Poultry Farming Environments
par: Lu, Jiafan, et autres
Publié: (2025)
par: Lu, Jiafan, et autres
Publié: (2025)
Hallucination Augmented Contrastive Learning for Multimodal Large Language Model
par: Jiang, Chaoya, et autres
Publié: (2023)
par: Jiang, Chaoya, et autres
Publié: (2023)
VGent: Visual Grounding via Modular Design for Disentangling Reasoning and Prediction
par: Kang, Weitai, et autres
Publié: (2025)
par: Kang, Weitai, et autres
Publié: (2025)
MRI Contrast Enhancement Kinetics World Model
par: Kong, Jindi, et autres
Publié: (2026)
par: Kong, Jindi, et autres
Publié: (2026)
History-Augmented Contrastive Learning With Soft Mixture of Experts for Blind Super-Resolution of Planetary Remote Sensing Images
par: Zhao, Hui-Jia, et autres
Publié: (2025)
par: Zhao, Hui-Jia, et autres
Publié: (2025)
Documents similaires
-
Multi-View Spectrogram Transformer for Respiratory Sound Classification
par: He, Wentao, et autres
Publié: (2023) -
ERL-MPP: Evolutionary Reinforcement Learning with Multi-head Puzzle Perception for Solving Large-scale Jigsaw Puzzles of Eroded Gaps
par: Song, Xingke, et autres
Publié: (2025) -
Visual Perturbation and Adaptive Hard Negative Contrastive Learning for Compositional Reasoning in Vision-Language Models
par: Huang, Xin, et autres
Publié: (2025) -
LP$^{2}$DH: A Locality-Preserving Pixel-Difference Hashing Framework for Dynamic Texture Recognition
par: Ding, Ruxin, et autres
Publié: (2026) -
SignReasoner: Compositional Reasoning for Complex Traffic Sign Understanding via Functional Structure Units
par: Wang, Ruibin, et autres
Publié: (2026)