Discovering Hidden Visual Concepts Beyond Linguistic Input in Infant Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Ke, Xueyi, Tsutsui, Satoshi, Zhang, Yayun, Wen, Bihan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Integrating Clinical Knowledge into Concept Bottleneck Models
di: Pang, Winnie, et al.
Pubblicazione: (2024)
di: Pang, Winnie, et al.
Pubblicazione: (2024)
Towards Robust and Reliable Concept Representations: Reliability-Enhanced Concept Embedding Model
di: Cai, Yuxuan, et al.
Pubblicazione: (2025)
di: Cai, Yuxuan, et al.
Pubblicazione: (2025)
WBCAtt+: Fine-Grained Pixel-Level Morphological Annotations for White Blood Cell Images
di: Tsutsui, Satoshi, et al.
Pubblicazione: (2026)
di: Tsutsui, Satoshi, et al.
Pubblicazione: (2026)
Training-Free Text-Guided Image Editing with Visual Autoregressive Model
di: Wang, Yufei, et al.
Pubblicazione: (2025)
di: Wang, Yufei, et al.
Pubblicazione: (2025)
Beyond Visual Safety: Jailbreaking Multimodal Large Language Models for Harmful Image Generation via Semantic-Agnostic Inputs
di: Yu, Mingyu, et al.
Pubblicazione: (2026)
di: Yu, Mingyu, et al.
Pubblicazione: (2026)
Discovering the Hidden Role of Gini Index In Prompt-based Classification
di: Lin, Ruixi
Pubblicazione: (2026)
di: Lin, Ruixi
Pubblicazione: (2026)
Discover-then-Name: Task-Agnostic Concept Bottlenecks via Automated Concept Discovery
di: Rao, Sukrut, et al.
Pubblicazione: (2024)
di: Rao, Sukrut, et al.
Pubblicazione: (2024)
Beyond Fixed Anchors: Precisely Erasing Concepts with Sibling Exclusive Counterparts
di: Zhang, Tong, et al.
Pubblicazione: (2025)
di: Zhang, Tong, et al.
Pubblicazione: (2025)
Visual Data Diagnosis and Debiasing with Concept Graphs
di: Chakraborty, Rwiddhi, et al.
Pubblicazione: (2024)
di: Chakraborty, Rwiddhi, et al.
Pubblicazione: (2024)
Unbiased Visual Reasoning with Controlled Visual Inputs
di: Li, Zhaonan, et al.
Pubblicazione: (2025)
di: Li, Zhaonan, et al.
Pubblicazione: (2025)
DP-IQA: Utilizing Diffusion Prior for Blind Image Quality Assessment in the Wild
di: Fu, Honghao, et al.
Pubblicazione: (2024)
di: Fu, Honghao, et al.
Pubblicazione: (2024)
Survey on Hand Gesture Recognition from Visual Input
di: Linardakis, Manousos, et al.
Pubblicazione: (2025)
di: Linardakis, Manousos, et al.
Pubblicazione: (2025)
Single-Input Multi-Output Model Merging: Leveraging Foundation Models for Dense Multi-Task Learning
di: Giraldo, Juan Garcia, et al.
Pubblicazione: (2025)
di: Giraldo, Juan Garcia, et al.
Pubblicazione: (2025)
ConceptScope: Characterizing Dataset Bias via Disentangled Visual Concepts
di: Choi, Jinho, et al.
Pubblicazione: (2025)
di: Choi, Jinho, et al.
Pubblicazione: (2025)
DTL: Disentangled Transfer Learning for Visual Recognition
di: Fu, Minghao, et al.
Pubblicazione: (2023)
di: Fu, Minghao, et al.
Pubblicazione: (2023)
Dynamic-Aware Video Distillation: Optimizing Temporal Resolution Based on Video Semantics
di: Zhao, Yinjie, et al.
Pubblicazione: (2025)
di: Zhao, Yinjie, et al.
Pubblicazione: (2025)
Machine Intelligence that Understands Visual and Linguistic Information and Interacts with Humans and Environments
di: Nguyen, Van Quang
Pubblicazione: (2026)
di: Nguyen, Van Quang
Pubblicazione: (2026)
Generation and Detection of Sign Language Deepfakes - A Linguistic and Visual Analysis
di: Naeem, Shahzeb, et al.
Pubblicazione: (2024)
di: Naeem, Shahzeb, et al.
Pubblicazione: (2024)
VDC: Versatile Data Cleanser based on Visual-Linguistic Inconsistency by Multimodal Large Language Models
di: Zhu, Zihao, et al.
Pubblicazione: (2023)
di: Zhu, Zihao, et al.
Pubblicazione: (2023)
LostPaw: Finding Lost Pets using a Contrastive Learning-based Transformer with Visual Input
di: Voinea, Andrei, et al.
Pubblicazione: (2023)
di: Voinea, Andrei, et al.
Pubblicazione: (2023)
Representation Learning of Point Cloud Upsampling in Global and Local Inputs
di: Zhang, Tongxu, et al.
Pubblicazione: (2025)
di: Zhang, Tongxu, et al.
Pubblicazione: (2025)
Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs
di: Zhang, Qizhe, et al.
Pubblicazione: (2024)
di: Zhang, Qizhe, et al.
Pubblicazione: (2024)
ContextGS: Compact 3D Gaussian Splatting with Anchor Level Context Model
di: Wang, Yufei, et al.
Pubblicazione: (2024)
di: Wang, Yufei, et al.
Pubblicazione: (2024)
Can we Constrain Concept Bottleneck Models to Learn Semantically Meaningful Input Features?
di: Furby, Jack, et al.
Pubblicazione: (2024)
di: Furby, Jack, et al.
Pubblicazione: (2024)
OmniEval: A Benchmark for Evaluating Omni-modal Models with Visual, Auditory, and Textual Inputs
di: Zhang, Yiman, et al.
Pubblicazione: (2025)
di: Zhang, Yiman, et al.
Pubblicazione: (2025)
Multimodal Learning for Fake News Detection in Short Videos Using Linguistically Verified Data and Heterogeneous Modality Fusion
di: Li, Shanghong, et al.
Pubblicazione: (2025)
di: Li, Shanghong, et al.
Pubblicazione: (2025)
VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models
di: Balakrishnan, Ravikumar, et al.
Pubblicazione: (2025)
di: Balakrishnan, Ravikumar, et al.
Pubblicazione: (2025)
VISOR: Visual Input-based Steering for Output Redirection in Vision-Language Models
di: Phute, Mansi, et al.
Pubblicazione: (2025)
di: Phute, Mansi, et al.
Pubblicazione: (2025)
Enhancing Contrastive Learning for Geolocalization by Discovering Hard Negatives on Semivariograms
di: Chen, Boyi, et al.
Pubblicazione: (2025)
di: Chen, Boyi, et al.
Pubblicazione: (2025)
Can VLMs Truly Forget? Benchmarking Training-Free Visual Concept Unlearning
di: Tan, Zhangyun, et al.
Pubblicazione: (2026)
di: Tan, Zhangyun, et al.
Pubblicazione: (2026)
AUVIC: Adversarial Unlearning of Visual Concepts for Multi-modal Large Language Models
di: Chen, Haokun, et al.
Pubblicazione: (2025)
di: Chen, Haokun, et al.
Pubblicazione: (2025)
Saliency-Guided Representation with Consistency Policy Learning for Visual Unsupervised Reinforcement Learning
di: Sun, Jingbo, et al.
Pubblicazione: (2026)
di: Sun, Jingbo, et al.
Pubblicazione: (2026)
OmniPrism: Learning Disentangled Visual Concept for Image Generation
di: Li, Yangyang, et al.
Pubblicazione: (2024)
di: Li, Yangyang, et al.
Pubblicazione: (2024)
Evolving Storytelling: Benchmarks and Methods for New Character Customization with Diffusion Models
di: Wang, Xiyu, et al.
Pubblicazione: (2024)
di: Wang, Xiyu, et al.
Pubblicazione: (2024)
Beyond Visual Memory: Mechanistic Diagnostics of Latent Visual Reasoning
di: Guo, Garvin, et al.
Pubblicazione: (2026)
di: Guo, Garvin, et al.
Pubblicazione: (2026)
StreamingTOM: Streaming Token Compression for Efficient Video Understanding
di: Chen, Xueyi, et al.
Pubblicazione: (2025)
di: Chen, Xueyi, et al.
Pubblicazione: (2025)
An Image is Worth Multiple Words: Discovering Object Level Concepts using Multi-Concept Prompt Learning
di: Jin, Chen, et al.
Pubblicazione: (2023)
di: Jin, Chen, et al.
Pubblicazione: (2023)
Explainable Visual Anomaly Detection via Concept Bottleneck Models
di: Stropeni, Arianna, et al.
Pubblicazione: (2025)
di: Stropeni, Arianna, et al.
Pubblicazione: (2025)
Explaining How Visual, Textual and Multimodal Encoders Share Concepts
di: Cornet, Clément, et al.
Pubblicazione: (2025)
di: Cornet, Clément, et al.
Pubblicazione: (2025)
Lang2Act: Fine-Grained Visual Reasoning through Self-Emergent Linguistic Toolchains
di: Xiong, Yuqi, et al.
Pubblicazione: (2026)
di: Xiong, Yuqi, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Integrating Clinical Knowledge into Concept Bottleneck Models
di: Pang, Winnie, et al.
Pubblicazione: (2024) -
Towards Robust and Reliable Concept Representations: Reliability-Enhanced Concept Embedding Model
di: Cai, Yuxuan, et al.
Pubblicazione: (2025) -
WBCAtt+: Fine-Grained Pixel-Level Morphological Annotations for White Blood Cell Images
di: Tsutsui, Satoshi, et al.
Pubblicazione: (2026) -
Training-Free Text-Guided Image Editing with Visual Autoregressive Model
di: Wang, Yufei, et al.
Pubblicazione: (2025) -
Beyond Visual Safety: Jailbreaking Multimodal Large Language Models for Harmful Image Generation via Semantic-Agnostic Inputs
di: Yu, Mingyu, et al.
Pubblicazione: (2026)