Mapping High-level Semantic Regions in Indoor Environments without Object Recognition
Fuente:
arXiv
Salvato in:
| Autori principali: | Bigazzi, Roberto, Baraldi, Lorenzo, Kousik, Shreyas, Cucchiara, Rita, Pavone, Marco |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Personalized Instance-based Navigation Toward User-Specific Objects in Realistic Environments
di: Barsellotti, Luca, et al.
Pubblicazione: (2024)
di: Barsellotti, Luca, et al.
Pubblicazione: (2024)
AIGeN: An Adversarial Approach for Instruction Generation in VLN
di: Rawal, Niyati, et al.
Pubblicazione: (2024)
di: Rawal, Niyati, et al.
Pubblicazione: (2024)
Spot the Difference: A Novel Task for Embodied Agents in Changing Environments
di: Landi, Federico, et al.
Pubblicazione: (2022)
di: Landi, Federico, et al.
Pubblicazione: (2022)
Embodied Agents for Efficient Exploration and Smart Scene Description
di: Bigazzi, Roberto, et al.
Pubblicazione: (2023)
di: Bigazzi, Roberto, et al.
Pubblicazione: (2023)
Embodied Navigation at the Art Gallery
di: Bigazzi, Roberto, et al.
Pubblicazione: (2022)
di: Bigazzi, Roberto, et al.
Pubblicazione: (2022)
Explore and Explain: Self-supervised Navigation and Recounting
di: Bigazzi, Roberto, et al.
Pubblicazione: (2020)
di: Bigazzi, Roberto, et al.
Pubblicazione: (2020)
Autonomous Embodied Agents: When Robotics Meets Deep Learning Reasoning
di: Bigazzi, Roberto
Pubblicazione: (2025)
di: Bigazzi, Roberto
Pubblicazione: (2025)
Learning to Mask and Permute Visual Tokens for Vision Transformer Pre-Training
di: Baraldi, Lorenzo, et al.
Pubblicazione: (2023)
di: Baraldi, Lorenzo, et al.
Pubblicazione: (2023)
UNMuTe: Unifying Navigation and Multimodal Dialogue-like Text Generation
di: Rawal, Niyati, et al.
Pubblicazione: (2024)
di: Rawal, Niyati, et al.
Pubblicazione: (2024)
Contrasting Deepfakes Diffusion via Contrastive Learning and Global-Local Similarities
di: Baraldi, Lorenzo, et al.
Pubblicazione: (2024)
di: Baraldi, Lorenzo, et al.
Pubblicazione: (2024)
Tiny Inference-Time Scaling with Latent Verifiers
di: Bucciarelli, Davide, et al.
Pubblicazione: (2026)
di: Bucciarelli, Davide, et al.
Pubblicazione: (2026)
Optimizing Resource Consumption in Diffusion Models through Hallucination Early Detection
di: Betti, Federico, et al.
Pubblicazione: (2024)
di: Betti, Federico, et al.
Pubblicazione: (2024)
Hallucination Early Detection in Diffusion Models
di: Betti, Federico, et al.
Pubblicazione: (2026)
di: Betti, Federico, et al.
Pubblicazione: (2026)
BRIDGE: Bridging Gaps in Image Captioning Evaluation with Stronger Visual Cues
di: Sarto, Sara, et al.
Pubblicazione: (2024)
di: Sarto, Sara, et al.
Pubblicazione: (2024)
Category-level Neural Field for Reconstruction of Partially Observed Objects in Indoor Environment
di: Lee, Taekbeom, et al.
Pubblicazione: (2024)
di: Lee, Taekbeom, et al.
Pubblicazione: (2024)
Object Navigation with Structure-Semantic Reasoning-Based Multi-level Map and Multimodal Decision-Making LLM
di: Yan, Chongshang, et al.
Pubblicazione: (2025)
di: Yan, Chongshang, et al.
Pubblicazione: (2025)
Mitigating Hallucinations in Multimodal LLMs via Object-aware Preference Optimization
di: Compagnoni, Alberto, et al.
Pubblicazione: (2025)
di: Compagnoni, Alberto, et al.
Pubblicazione: (2025)
SLAM for Indoor Mapping of Wide Area Construction Environments
di: Ress, Vincent, et al.
Pubblicazione: (2024)
di: Ress, Vincent, et al.
Pubblicazione: (2024)
What Changed? Detecting and Evaluating Instruction-Guided Image Edits with Multimodal Large Language Models
di: Baraldi, Lorenzo, et al.
Pubblicazione: (2025)
di: Baraldi, Lorenzo, et al.
Pubblicazione: (2025)
RaTA-Tool: Retrieval-based Tool Selection with Multimodal Large Language Models
di: Mattioli, Gabriele, et al.
Pubblicazione: (2026)
di: Mattioli, Gabriele, et al.
Pubblicazione: (2026)
Multi-Class Unlearning for Image Classification via Weight Filtering
di: Poppi, Samuele, et al.
Pubblicazione: (2023)
di: Poppi, Samuele, et al.
Pubblicazione: (2023)
Parents and Children: Distinguishing Multimodal DeepFakes from Natural Images
di: Amoroso, Roberto, et al.
Pubblicazione: (2023)
di: Amoroso, Roberto, et al.
Pubblicazione: (2023)
The Safety Challenge of World Models for Embodied AI Agents: A Review
di: Baraldi, Lorenzo, et al.
Pubblicazione: (2025)
di: Baraldi, Lorenzo, et al.
Pubblicazione: (2025)
FindAnything: Open-Vocabulary and Object-Centric Mapping for Robot Exploration in Any Environment
di: Laina, Sebastián Barbas, et al.
Pubblicazione: (2025)
di: Laina, Sebastián Barbas, et al.
Pubblicazione: (2025)
Open-vocabulary Mobile Manipulation in Unseen Dynamic Environments with 3D Semantic Maps
di: Qiu, Dicong, et al.
Pubblicazione: (2024)
di: Qiu, Dicong, et al.
Pubblicazione: (2024)
Fluent and Accurate Image Captioning with a Self-Trained Reward Model
di: Moratelli, Nicholas, et al.
Pubblicazione: (2024)
di: Moratelli, Nicholas, et al.
Pubblicazione: (2024)
Training-Free Open-Vocabulary Segmentation with Offline Diffusion-Augmented Prototype Generation
di: Barsellotti, Luca, et al.
Pubblicazione: (2024)
di: Barsellotti, Luca, et al.
Pubblicazione: (2024)
Recurrence-Enhanced Vision-and-Language Transformers for Robust Multimodal Document Retrieval
di: Caffagni, Davide, et al.
Pubblicazione: (2025)
di: Caffagni, Davide, et al.
Pubblicazione: (2025)
Positive-Augmented Contrastive Learning for Vision-and-Language Evaluation and Training
di: Sarto, Sara, et al.
Pubblicazione: (2024)
di: Sarto, Sara, et al.
Pubblicazione: (2024)
Towards Retrieval-Augmented Architectures for Image Captioning
di: Sarto, Sara, et al.
Pubblicazione: (2024)
di: Sarto, Sara, et al.
Pubblicazione: (2024)
Recurrence Meets Transformers for Universal Multimodal Retrieval
di: Caffagni, Davide, et al.
Pubblicazione: (2025)
di: Caffagni, Davide, et al.
Pubblicazione: (2025)
Causal Graphical Models for Vision-Language Compositional Understanding
di: Parascandolo, Fiorenzo, et al.
Pubblicazione: (2024)
di: Parascandolo, Fiorenzo, et al.
Pubblicazione: (2024)
Augmenting Multimodal LLMs with Self-Reflective Tokens for Knowledge-based Visual Question Answering
di: Cocchi, Federico, et al.
Pubblicazione: (2024)
di: Cocchi, Federico, et al.
Pubblicazione: (2024)
Revisiting Image Captioning Training Paradigm via Direct CLIP-based Optimization
di: Moratelli, Nicholas, et al.
Pubblicazione: (2024)
di: Moratelli, Nicholas, et al.
Pubblicazione: (2024)
Hyperbolic Safety-Aware Vision-Language Models
di: Poppi, Tobia, et al.
Pubblicazione: (2025)
di: Poppi, Tobia, et al.
Pubblicazione: (2025)
Personalizing Multimodal Large Language Models for Image Captioning: An Experimental Analysis
di: Bucciarelli, Davide, et al.
Pubblicazione: (2024)
di: Bucciarelli, Davide, et al.
Pubblicazione: (2024)
Object-Oriented Material Classification and 3D Clustering for Improved Semantic Perception and Mapping in Mobile Robots
di: Ravipati, Siva Krishna, et al.
Pubblicazione: (2024)
di: Ravipati, Siva Krishna, et al.
Pubblicazione: (2024)
Trajectory Forecasting through Low-Rank Adaptation of Discrete Latent Codes
di: Benaglia, Riccardo, et al.
Pubblicazione: (2024)
di: Benaglia, Riccardo, et al.
Pubblicazione: (2024)
On the Application of Efficient Neural Mapping to Real-Time Indoor Localisation for Unmanned Ground Vehicles
di: Holder, Christopher J., et al.
Pubblicazione: (2022)
di: Holder, Christopher J., et al.
Pubblicazione: (2022)
ContraMap: Contrastive Uncertainty Mapping for Robot Environment Representation
di: Le, Chi Cuong, et al.
Pubblicazione: (2026)
di: Le, Chi Cuong, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Personalized Instance-based Navigation Toward User-Specific Objects in Realistic Environments
di: Barsellotti, Luca, et al.
Pubblicazione: (2024) -
AIGeN: An Adversarial Approach for Instruction Generation in VLN
di: Rawal, Niyati, et al.
Pubblicazione: (2024) -
Spot the Difference: A Novel Task for Embodied Agents in Changing Environments
di: Landi, Federico, et al.
Pubblicazione: (2022) -
Embodied Agents for Efficient Exploration and Smart Scene Description
di: Bigazzi, Roberto, et al.
Pubblicazione: (2023) -
Embodied Navigation at the Art Gallery
di: Bigazzi, Roberto, et al.
Pubblicazione: (2022)