Neural-Symbolic Recursive Machine for Systematic Generalization
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Qing, Zhu, Yixin, Liang, Yitao, Wu, Ying Nian, Zhu, Song-Chun, Huang, Siyuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2022
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
An Embodied Generalist Agent in 3D World
di: Huang, Jiangyong, et al.
Pubblicazione: (2023)
di: Huang, Jiangyong, et al.
Pubblicazione: (2023)
Decompositional Neural Scene Reconstruction with Generative Diffusion Prior
di: Ni, Junfeng, et al.
Pubblicazione: (2025)
di: Ni, Junfeng, et al.
Pubblicazione: (2025)
PhyRecon: Physically Plausible Neural Scene Reconstruction
di: Ni, Junfeng, et al.
Pubblicazione: (2024)
di: Ni, Junfeng, et al.
Pubblicazione: (2024)
EMemBench: Interactive Benchmarking of Episodic Memory for VLM Agents
di: Li, Xinze, et al.
Pubblicazione: (2026)
di: Li, Xinze, et al.
Pubblicazione: (2026)
SceneVerse: Scaling 3D Vision-Language Learning for Grounded Scene Understanding
di: Jia, Baoxiong, et al.
Pubblicazione: (2024)
di: Jia, Baoxiong, et al.
Pubblicazione: (2024)
Masked Point-Entity Contrast for Open-Vocabulary 3D Scene Understanding
di: Wang, Yan, et al.
Pubblicazione: (2025)
di: Wang, Yan, et al.
Pubblicazione: (2025)
LatentExplainer: Explaining Latent Representations in Deep Generative Models with Multimodal Large Language Models
di: Zhu, Mengdan, et al.
Pubblicazione: (2024)
di: Zhu, Mengdan, et al.
Pubblicazione: (2024)
G4Splat: Geometry-Guided Gaussian Splatting with Generative Prior
di: Ni, Junfeng, et al.
Pubblicazione: (2025)
di: Ni, Junfeng, et al.
Pubblicazione: (2025)
Kiki or Bouba? Sound Symbolism in Vision-and-Language Models
di: Alper, Morris, et al.
Pubblicazione: (2023)
di: Alper, Morris, et al.
Pubblicazione: (2023)
Text-to-Image Cross-Modal Generation: A Systematic Review
di: Żelaszczyk, Maciej, et al.
Pubblicazione: (2024)
di: Żelaszczyk, Maciej, et al.
Pubblicazione: (2024)
Till the Layers Collapse: Compressing a Deep Neural Network through the Lenses of Batch Normalization Layers
di: Liao, Zhu, et al.
Pubblicazione: (2024)
di: Liao, Zhu, et al.
Pubblicazione: (2024)
MCU: An Evaluation Framework for Open-Ended Game Agents
di: Zheng, Xinyue, et al.
Pubblicazione: (2023)
di: Zheng, Xinyue, et al.
Pubblicazione: (2023)
AnySkill: Learning Open-Vocabulary Physical Skill for Interactive Agents
di: Cui, Jieming, et al.
Pubblicazione: (2024)
di: Cui, Jieming, et al.
Pubblicazione: (2024)
Neuro-Symbolic Concepts
di: Mao, Jiayuan, et al.
Pubblicazione: (2025)
di: Mao, Jiayuan, et al.
Pubblicazione: (2025)
Revisiting Generalization Power of a DNN in Terms of Symbolic Interactions
di: Cheng, Lei, et al.
Pubblicazione: (2025)
di: Cheng, Lei, et al.
Pubblicazione: (2025)
The Mechanistic Emergence of Symbol Grounding in Language Models
di: Wu, Shuyu, et al.
Pubblicazione: (2025)
di: Wu, Shuyu, et al.
Pubblicazione: (2025)
Recursive Visual Programming
di: Ge, Jiaxin, et al.
Pubblicazione: (2023)
di: Ge, Jiaxin, et al.
Pubblicazione: (2023)
Cross-modal RAG: Sub-dimensional Text-to-Image Retrieval-Augmented Generation
di: Zhu, Mengdan, et al.
Pubblicazione: (2025)
di: Zhu, Mengdan, et al.
Pubblicazione: (2025)
Contextual Experience Replay for Self-Improvement of Language Agents
di: Liu, Yitao, et al.
Pubblicazione: (2025)
di: Liu, Yitao, et al.
Pubblicazione: (2025)
LEO-VL: Efficient Scene Representation for Scalable 3D Vision-Language Learning
di: Huang, Jiangyong, et al.
Pubblicazione: (2025)
di: Huang, Jiangyong, et al.
Pubblicazione: (2025)
DreamReward: Text-to-3D Generation with Human Preference
di: Ye, Junliang, et al.
Pubblicazione: (2024)
di: Ye, Junliang, et al.
Pubblicazione: (2024)
VCode: a Multimodal Coding Benchmark with SVG as Symbolic Visual Representation
di: Lin, Kevin Qinghong, et al.
Pubblicazione: (2025)
di: Lin, Kevin Qinghong, et al.
Pubblicazione: (2025)
A Systematic Review of Deep Learning-based Research on Radiology Report Generation
di: Liu, Chang, et al.
Pubblicazione: (2023)
di: Liu, Chang, et al.
Pubblicazione: (2023)
Generating Storytelling Images with Rich Chains-of-Reasoning
di: Song, Xiujie, et al.
Pubblicazione: (2025)
di: Song, Xiujie, et al.
Pubblicazione: (2025)
RIV: Recursive Introspection Mask Diffusion Vision Language Model
di: Li, YuQian, et al.
Pubblicazione: (2025)
di: Li, YuQian, et al.
Pubblicazione: (2025)
Verbalized Machine Learning: Revisiting Machine Learning with Language Models
di: Xiao, Tim Z., et al.
Pubblicazione: (2024)
di: Xiao, Tim Z., et al.
Pubblicazione: (2024)
CharXiv: Charting Gaps in Realistic Chart Understanding in Multimodal LLMs
di: Wang, Zirui, et al.
Pubblicazione: (2024)
di: Wang, Zirui, et al.
Pubblicazione: (2024)
AiGen-FoodReview: A Multimodal Dataset of Machine-Generated Restaurant Reviews and Images on Social Media
di: Gambetti, Alessandro, et al.
Pubblicazione: (2024)
di: Gambetti, Alessandro, et al.
Pubblicazione: (2024)
The Curse of Recursion: Training on Generated Data Makes Models Forget
di: Shumailov, Ilia, et al.
Pubblicazione: (2023)
di: Shumailov, Ilia, et al.
Pubblicazione: (2023)
Geometry-Aware Losses for Structure-Preserving Text-to-Sign Language Generation
di: Wu, Zetian, et al.
Pubblicazione: (2025)
di: Wu, Zetian, et al.
Pubblicazione: (2025)
Attribute Diversity Determines the Systematicity Gap in VQA
di: Berlot-Attwell, Ian, et al.
Pubblicazione: (2023)
di: Berlot-Attwell, Ian, et al.
Pubblicazione: (2023)
Fine-Grained Alignment in Vision-and-Language Navigation through Bayesian Optimization
di: Song, Yuhang, et al.
Pubblicazione: (2024)
di: Song, Yuhang, et al.
Pubblicazione: (2024)
VisRet: Visualization Improves Knowledge-Intensive Text-to-Image Retrieval
di: Wu, Di, et al.
Pubblicazione: (2025)
di: Wu, Di, et al.
Pubblicazione: (2025)
Which Client is Reliable?: A Reliable and Personalized Prompt-based Federated Learning for Medical Image Question Answering
di: Zhu, He, et al.
Pubblicazione: (2024)
di: Zhu, He, et al.
Pubblicazione: (2024)
Unveiling the Mist over 3D Vision-Language Understanding: Object-centric Evaluation with Chain-of-Analysis
di: Huang, Jiangyong, et al.
Pubblicazione: (2025)
di: Huang, Jiangyong, et al.
Pubblicazione: (2025)
MJ-Bench: Is Your Multimodal Reward Model Really a Good Judge for Text-to-Image Generation?
di: Chen, Zhaorun, et al.
Pubblicazione: (2024)
di: Chen, Zhaorun, et al.
Pubblicazione: (2024)
Learning Concept-Based Causal Transition and Symbolic Reasoning for Visual Planning
di: Qian, Yilue, et al.
Pubblicazione: (2023)
di: Qian, Yilue, et al.
Pubblicazione: (2023)
On Domain-Adaptive Post-Training for Multimodal Large Language Models
di: Cheng, Daixuan, et al.
Pubblicazione: (2024)
di: Cheng, Daixuan, et al.
Pubblicazione: (2024)
Generative Technology for Human Emotion Recognition: A Scope Review
di: Ma, Fei, et al.
Pubblicazione: (2024)
di: Ma, Fei, et al.
Pubblicazione: (2024)
Self-Supervised Visual Preference Alignment
di: Zhu, Ke, et al.
Pubblicazione: (2024)
di: Zhu, Ke, et al.
Pubblicazione: (2024)
Documenti analoghi
-
An Embodied Generalist Agent in 3D World
di: Huang, Jiangyong, et al.
Pubblicazione: (2023) -
Decompositional Neural Scene Reconstruction with Generative Diffusion Prior
di: Ni, Junfeng, et al.
Pubblicazione: (2025) -
PhyRecon: Physically Plausible Neural Scene Reconstruction
di: Ni, Junfeng, et al.
Pubblicazione: (2024) -
EMemBench: Interactive Benchmarking of Episodic Memory for VLM Agents
di: Li, Xinze, et al.
Pubblicazione: (2026) -
SceneVerse: Scaling 3D Vision-Language Learning for Grounded Scene Understanding
di: Jia, Baoxiong, et al.
Pubblicazione: (2024)