Re-evaluating the Need for Multimodal Signals in Unsupervised Grammar Induction
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Boyi, Corona, Rodolfo, Mangalam, Karttikeya, Chen, Catherine, Flaherty, Daniel, Belongie, Serge, Weinberger, Kilian Q., Malik, Jitendra, Darrell, Trevor, Klein, Dan |
|---|---|
| Format: | Preprint |
| Publié: |
2022
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
xT: Nested Tokenization for Larger Context in Large Images
par: Gupta, Ritwik, et autres
Publié: (2024)
par: Gupta, Ritwik, et autres
Publié: (2024)
Adaptive Human Trajectory Prediction via Latent Corridors
par: Thakkar, Neerja, et autres
Publié: (2023)
par: Thakkar, Neerja, et autres
Publié: (2023)
Dr$^2$Net: Dynamic Reversible Dual-Residual Networks for Memory-Efficient Finetuning
par: Zhao, Chen, et autres
Publié: (2024)
par: Zhao, Chen, et autres
Publié: (2024)
Which One? Leveraging Context Between Objects and Multiple Views for Language Grounding
par: Mitra, Chancharik, et autres
Publié: (2023)
par: Mitra, Chancharik, et autres
Publié: (2023)
Learning Humanoid Locomotion over Challenging Terrain
par: Radosavovic, Ilija, et autres
Publié: (2024)
par: Radosavovic, Ilija, et autres
Publié: (2024)
Enough Coin Flips Can Make LLMs Act Bayesian
par: Gupta, Ritwik, et autres
Publié: (2025)
par: Gupta, Ritwik, et autres
Publié: (2025)
LLM-grounded Diffusion: Enhancing Prompt Understanding of Text-to-Image Diffusion Models with Large Language Models
par: Lian, Long, et autres
Publié: (2023)
par: Lian, Long, et autres
Publié: (2023)
Structural Optimization Ambiguity and Simplicity Bias in Unsupervised Neural Grammar Induction
par: Park, Jinwook, et autres
Publié: (2024)
par: Park, Jinwook, et autres
Publié: (2024)
Interactive Task Planning with Language Models
par: Li, Boyi, et autres
Publié: (2023)
par: Li, Boyi, et autres
Publié: (2023)
PhysConvex: Physics-Informed 3D Dynamic Convex Radiance Fields for Reconstruction and Simulation
par: Wang, Dan, et autres
Publié: (2026)
par: Wang, Dan, et autres
Publié: (2026)
Whole-Body Conditioned Egocentric Video Prediction
par: Bai, Yutong, et autres
Publié: (2025)
par: Bai, Yutong, et autres
Publié: (2025)
Mist: Efficient Distributed Training of Large Language Models via Memory-Parallelism Co-Optimization
par: Zhu, Zhanda, et autres
Publié: (2025)
par: Zhu, Zhanda, et autres
Publié: (2025)
The Sound of Simulation: Learning Multimodal Sim-to-Real Robot Policies with Generative Audio
par: Wang, Renhao, et autres
Publié: (2025)
par: Wang, Renhao, et autres
Publié: (2025)
FoundationMotion: Auto-Labeling and Reasoning about Spatial Movement in Videos
par: Gan, Yulu, et autres
Publié: (2025)
par: Gan, Yulu, et autres
Publié: (2025)
Probability Distribution Collapse: A Critical Bottleneck to Compact Unsupervised Neural Grammar Induction
par: Park, Jinwook, et autres
Publié: (2025)
par: Park, Jinwook, et autres
Publié: (2025)
LLM-grounded Video Diffusion Models
par: Lian, Long, et autres
Publié: (2023)
par: Lian, Long, et autres
Publié: (2023)
Unlearning-based Neural Interpretations
par: Choi, Ching Lam, et autres
Publié: (2024)
par: Choi, Ching Lam, et autres
Publié: (2024)
Large Vision-Language Models for Knowledge-Grounded Data Annotation of Memes
par: Deng, Shiling, et autres
Publié: (2025)
par: Deng, Shiling, et autres
Publié: (2025)
Humanoid Locomotion as Next Token Prediction
par: Radosavovic, Ilija, et autres
Publié: (2024)
par: Radosavovic, Ilija, et autres
Publié: (2024)
Analyzing The Language of Visual Tokens
par: Chan, David M., et autres
Publié: (2024)
par: Chan, David M., et autres
Publié: (2024)
Is Meta-Learning Out? Rethinking Unsupervised Few-Shot Classification with Limited Entropy
par: Guan, Yunchuan, et autres
Publié: (2025)
par: Guan, Yunchuan, et autres
Publié: (2025)
RAIGen: Rare Attribute Identification in Text-to-Image Generative Models
par: Sreelatha, Silpa Vadakkeeveetil, et autres
Publié: (2026)
par: Sreelatha, Silpa Vadakkeeveetil, et autres
Publié: (2026)
A Critique on Nazism: A Study of The Dog Beneath the Skin and Rhinoceros
par: B. Mangalam
Publié: (2017)
par: B. Mangalam
Publié: (2017)
Violence Against Marginalized Women: Literary Representations in Tamil
par: B. Mangalam
Publié: (2020)
par: B. Mangalam
Publié: (2020)
Negotiating Literary Transactions: Translation as Mapping Empowerment through Dissemination
par: Mangalam B.
Publié: (2021)
par: Mangalam B.
Publié: (2021)
Negotiating Literary Transactions: Translation as Mapping Empowerment through Dissemination
par: B. Mangalam
Publié: (2021)
par: B. Mangalam
Publié: (2021)
Pose Priors from Language Models
par: Subramanian, Sanjay, et autres
Publié: (2024)
par: Subramanian, Sanjay, et autres
Publié: (2024)
Diffusion Guided Language Modeling
par: Lovelace, Justin, et autres
Publié: (2024)
par: Lovelace, Justin, et autres
Publié: (2024)
Grammar Induction from Visual, Speech and Text
par: Zhao, Yu, et autres
Publié: (2024)
par: Zhao, Yu, et autres
Publié: (2024)
Greedy Grammar Induction with Indirect Negative Evidence
par: Potashnik, Joseph
Publié: (2023)
par: Potashnik, Joseph
Publié: (2023)
Leveraging Grammar Induction for Language Understanding and Generation
par: Kai, Jushi, et autres
Publié: (2024)
par: Kai, Jushi, et autres
Publié: (2024)
From Generated Human Videos to Physically Plausible Robot Trajectories
par: Ni, James, et autres
Publié: (2025)
par: Ni, James, et autres
Publié: (2025)
MMEarth-Bench: Global Model Adaptation via Multimodal Test-Time Training
par: Gordon, Lucia, et autres
Publié: (2026)
par: Gordon, Lucia, et autres
Publié: (2026)
When Do We Not Need Larger Vision Models?
par: Shi, Baifeng, et autres
Publié: (2024)
par: Shi, Baifeng, et autres
Publié: (2024)
Graders should cheat: privileged information enables expert-level automated evaluations
par: Zhou, Jin Peng, et autres
Publié: (2025)
par: Zhou, Jin Peng, et autres
Publié: (2025)
Adaptive Moments are Surprisingly Effective for Plug-and-Play Diffusion Sampling
par: Belardi, Christian, et autres
Publié: (2026)
par: Belardi, Christian, et autres
Publié: (2026)
LLM2LLM: Boosting LLMs with Novel Iterative Data Enhancement
par: Lee, Nicholas, et autres
Publié: (2024)
par: Lee, Nicholas, et autres
Publié: (2024)
Synthesizing Moving People with 3D Control
par: Li, Boyi, et autres
Publié: (2024)
par: Li, Boyi, et autres
Publié: (2024)
V. S. Naipaul’s Exploration of India: A Reading of Land, People and the Self
par: Dr. B Mangalam
Publié: (2021)
par: Dr. B Mangalam
Publié: (2021)
HiddenObjects: Scalable Diffusion-Distilled Spatial Priors for Object Placement
par: Schouten, Marco, et autres
Publié: (2026)
par: Schouten, Marco, et autres
Publié: (2026)
Documents similaires
-
xT: Nested Tokenization for Larger Context in Large Images
par: Gupta, Ritwik, et autres
Publié: (2024) -
Adaptive Human Trajectory Prediction via Latent Corridors
par: Thakkar, Neerja, et autres
Publié: (2023) -
Dr$^2$Net: Dynamic Reversible Dual-Residual Networks for Memory-Efficient Finetuning
par: Zhao, Chen, et autres
Publié: (2024) -
Which One? Leveraging Context Between Objects and Multiple Views for Language Grounding
par: Mitra, Chancharik, et autres
Publié: (2023) -
Learning Humanoid Locomotion over Challenging Terrain
par: Radosavovic, Ilija, et autres
Publié: (2024)