Opinion: Learning Intuitive Physics May Require More than Visual Data
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Su, Ellen, Legris, Solim, Gureckis, Todd M., Ren, Mengye |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Seeking the Unfamiliar but Memorable: Conceptual Creativity as Meta-Learning
par: Ren, Mengye
Publié: (2026)
par: Ren, Mengye
Publié: (2026)
Midway Network: Learning Representations for Recognition and Motion from Latent Dynamics
par: Hoang, Christopher, et autres
Publié: (2025)
par: Hoang, Christopher, et autres
Publié: (2025)
Memory Storyboard: Leveraging Temporal Segmentation for Streaming Self-Supervised Learning from Egocentric Videos
par: Yang, Yanlai, et autres
Publié: (2025)
par: Yang, Yanlai, et autres
Publié: (2025)
Nearly Solved? Robust Deepfake Detection Requires More than Visual Forensics
par: Levy, Guy, et autres
Publié: (2024)
par: Levy, Guy, et autres
Publié: (2024)
Integrating Present and Past in Unsupervised Continual Learning
par: Zhang, Yipeng, et autres
Publié: (2024)
par: Zhang, Yipeng, et autres
Publié: (2024)
LifelongMemory: Leveraging LLMs for Answering Queries in Long-form Egocentric Videos
par: Wang, Ying, et autres
Publié: (2023)
par: Wang, Ying, et autres
Publié: (2023)
Not (yet) the whole story: Evaluating Visual Storytelling Requires More than Measuring Coherence, Grounding, and Repetition
par: Surikuchi, Aditya K, et autres
Publié: (2024)
par: Surikuchi, Aditya K, et autres
Publié: (2024)
Learning to Play Video Games with Intuitive Physics Priors
par: Jaiswal, Abhishek, et autres
Publié: (2024)
par: Jaiswal, Abhishek, et autres
Publié: (2024)
Focus Your Attention: Towards Data-Intuitive Lightweight Vision Transformers
par: Gaurav, Suyash, et autres
Publié: (2025)
par: Gaurav, Suyash, et autres
Publié: (2025)
PooDLe: Pooled and dense self-supervised learning from naturalistic videos
par: Wang, Alex N., et autres
Publié: (2024)
par: Wang, Alex N., et autres
Publié: (2024)
More than the Sum of Its Parts: Ensembling Backbone Networks for Few-Shot Segmentation
par: Catalano, Nico, et autres
Publié: (2024)
par: Catalano, Nico, et autres
Publié: (2024)
Generation is Required for Data-Efficient Perception
par: Brady, Jack, et autres
Publié: (2025)
par: Brady, Jack, et autres
Publié: (2025)
Better, Not Just More: Data-Centric Machine Learning for Earth Observation
par: Roscher, Ribana, et autres
Publié: (2023)
par: Roscher, Ribana, et autres
Publié: (2023)
SEED: Towards More Accurate Semantic Evaluation for Visual Brain Decoding
par: Park, Juhyeon, et autres
Publié: (2025)
par: Park, Juhyeon, et autres
Publié: (2025)
CANVAS: Commonsense-Aware Navigation System for Intuitive Human-Robot Interaction
par: Choi, Suhwan, et autres
Publié: (2024)
par: Choi, Suhwan, et autres
Publié: (2024)
A General Framework for Inference-time Scaling and Steering of Diffusion Models
par: Singhal, Raghav, et autres
Publié: (2025)
par: Singhal, Raghav, et autres
Publié: (2025)
Tab2Visual: Overcoming Limited Data in Tabular Data Classification Using Deep Learning with Visual Representations
par: Mamdouh, Ahmed, et autres
Publié: (2025)
par: Mamdouh, Ahmed, et autres
Publié: (2025)
On-Device Continual Learning for Unsupervised Visual Anomaly Detection in Dynamic Manufacturing
par: Ren, Haoyu, et autres
Publié: (2025)
par: Ren, Haoyu, et autres
Publié: (2025)
Learning Semantic Proxies from Visual Prompts for Parameter-Efficient Fine-Tuning in Deep Metric Learning
par: Ren, Li, et autres
Publié: (2024)
par: Ren, Li, et autres
Publié: (2024)
Self-Consistent Model-based Adaptation for Visual Reinforcement Learning
par: Zhou, Xinning, et autres
Publié: (2025)
par: Zhou, Xinning, et autres
Publié: (2025)
Adaptive Deviation Learning for Visual Anomaly Detection with Data Contamination
par: Das, Anindya Sundar, et autres
Publié: (2024)
par: Das, Anindya Sundar, et autres
Publié: (2024)
Is Exchangeability better than I.I.D to handle Data Distribution Shifts while Pooling Data for Data-scarce Medical image segmentation?
par: Roy, Ayush, et autres
Publié: (2025)
par: Roy, Ayush, et autres
Publié: (2025)
Learning from Synthetic Data for Visual Grounding
par: He, Ruozhen, et autres
Publié: (2024)
par: He, Ruozhen, et autres
Publié: (2024)
Less-to-More Generalization: Unlocking More Controllability by In-Context Generation
par: Wu, Shaojin, et autres
Publié: (2025)
par: Wu, Shaojin, et autres
Publié: (2025)
Less is More: Rethinking Few-Shot Learning and Recurrent Neural Nets
par: Pereg, Deborah, et autres
Publié: (2022)
par: Pereg, Deborah, et autres
Publié: (2022)
CAUSAL3D: A Comprehensive Benchmark for Causal Learning from Visual Data
par: Liu, Disheng, et autres
Publié: (2025)
par: Liu, Disheng, et autres
Publié: (2025)
Deep Learning in Image Classification: Evaluating VGG19's Performance on Complex Visual Data
par: He, Weijie, et autres
Publié: (2024)
par: He, Weijie, et autres
Publié: (2024)
DreamSim: Learning New Dimensions of Human Visual Similarity using Synthetic Data
par: Fu, Stephanie, et autres
Publié: (2023)
par: Fu, Stephanie, et autres
Publié: (2023)
Data Agent: Learning to Select Data via End-to-End Dynamic Optimization
par: Yang, Suorong, et autres
Publié: (2026)
par: Yang, Suorong, et autres
Publié: (2026)
Self-supervised learning of video representations from a child's perspective
par: Orhan, A. Emin, et autres
Publié: (2024)
par: Orhan, A. Emin, et autres
Publié: (2024)
C-Flat++: Towards a More Efficient and Powerful Framework for Continual Learning
par: Li, Wei, et autres
Publié: (2025)
par: Li, Wei, et autres
Publié: (2025)
V-GRPO: Online Reinforcement Learning for Denoising Generative Models Is Easier than You Think
par: Tang, Bingda, et autres
Publié: (2026)
par: Tang, Bingda, et autres
Publié: (2026)
A Recipe for Unbounded Data Augmentation in Visual Reinforcement Learning
par: Almuzairee, Abdulaziz, et autres
Publié: (2024)
par: Almuzairee, Abdulaziz, et autres
Publié: (2024)
Robustness of Visual Explanations to Common Data Augmentation
par: Tětková, Lenka, et autres
Publié: (2023)
par: Tětková, Lenka, et autres
Publié: (2023)
Forget Less, Retain More: A Lightweight Regularizer for Rehearsal-Based Continual Learning
par: Alssum, Lama, et autres
Publié: (2025)
par: Alssum, Lama, et autres
Publié: (2025)
Fewer is More: A Deep Graph Metric Learning Perspective Using Fewer Proxies
par: Zhu, Yuehua, et autres
Publié: (2020)
par: Zhu, Yuehua, et autres
Publié: (2020)
Explore More, Learn Better: Parallel MLLM Embeddings under Mutual Information Minimization
par: Wang, Zhicheng, et autres
Publié: (2025)
par: Wang, Zhicheng, et autres
Publié: (2025)
More Than Memory Savings: Zeroth-Order Optimization Mitigates Forgetting in Continual Learning
par: Yu, Wanhao, et autres
Publié: (2025)
par: Yu, Wanhao, et autres
Publié: (2025)
Continual Learning: Less Forgetting, More OOD Generalization via Adaptive Contrastive Replay
par: Rezaei, Hossein, et autres
Publié: (2024)
par: Rezaei, Hossein, et autres
Publié: (2024)
Latent Diffusion Inversion Requires Understanding the Latent Space
par: Rao, Mingxing, et autres
Publié: (2025)
par: Rao, Mingxing, et autres
Publié: (2025)
Documents similaires
-
Seeking the Unfamiliar but Memorable: Conceptual Creativity as Meta-Learning
par: Ren, Mengye
Publié: (2026) -
Midway Network: Learning Representations for Recognition and Motion from Latent Dynamics
par: Hoang, Christopher, et autres
Publié: (2025) -
Memory Storyboard: Leveraging Temporal Segmentation for Streaming Self-Supervised Learning from Egocentric Videos
par: Yang, Yanlai, et autres
Publié: (2025) -
Nearly Solved? Robust Deepfake Detection Requires More than Visual Forensics
par: Levy, Guy, et autres
Publié: (2024) -
Integrating Present and Past in Unsupervised Continual Learning
par: Zhang, Yipeng, et autres
Publié: (2024)