Deterministic World Models for Verification of Closed-loop Vision-based Systems
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Geng, Yuang, Zhou, Zhuoyang, Zhang, Zhongzheng, Pan, Siyuan, Tran, Hoang-Dung, Ruchkin, Ivan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MLE-UVAD: Minimal Latent Entropy Autoencoder for Fully Unsupervised Video Anomaly Detection
par: Geng, Yuang, et autres
Publié: (2026)
par: Geng, Yuang, et autres
Publié: (2026)
Four Principles for Physically Interpretable World Models
par: Peper, Jordan, et autres
Publié: (2025)
par: Peper, Jordan, et autres
Publié: (2025)
Evaluating Precise Geolocation Inference Capabilities of Vision Language Models
par: Jay, Neel, et autres
Publié: (2025)
par: Jay, Neel, et autres
Publié: (2025)
Ultrasound Vision-Language Alignment via Contrastive Learning
par: Lyu, Zhuoyang, et autres
Publié: (2026)
par: Lyu, Zhuoyang, et autres
Publié: (2026)
Language-Enhanced Latent Representations for Out-of-Distribution Detection in Autonomous Driving
par: Mao, Zhenjiang, et autres
Publié: (2024)
par: Mao, Zhenjiang, et autres
Publié: (2024)
Hypergraph Laplacian Eigenmaps and Face Recognition Problems
par: Tran, Loc Hoang
Publié: (2024)
par: Tran, Loc Hoang
Publié: (2024)
KOPPA: Improving Prompt-based Continual Learning with Key-Query Orthogonal Projection and Prototype-based One-Versus-All
par: Tran, Quyen, et autres
Publié: (2023)
par: Tran, Quyen, et autres
Publié: (2023)
Space Syntax-guided Post-training for Residential Floor Plan Generation
par: Jiang, Zhuoyang, et autres
Publié: (2026)
par: Jiang, Zhuoyang, et autres
Publié: (2026)
Learned Image Compression with Text Quality Enhancement
par: Lai, Chih-Yu, et autres
Publié: (2024)
par: Lai, Chih-Yu, et autres
Publié: (2024)
Active Intelligence in Video Avatars via Closed-loop World Modeling
par: He, Xuanhua, et autres
Publié: (2025)
par: He, Xuanhua, et autres
Publié: (2025)
Enhancing Domain Adaptation through Prompt Gradient Alignment
par: Phan, Hoang, et autres
Publié: (2024)
par: Phan, Hoang, et autres
Publié: (2024)
Continual Visual Reinforcement Learning with A Life-Long World Model
par: Pan, Minting, et autres
Publié: (2023)
par: Pan, Minting, et autres
Publié: (2023)
Gradient-Aligned Calibration for Post-Training Quantization of Diffusion Models
par: Hoang, Dung Anh, et autres
Publié: (2026)
par: Hoang, Dung Anh, et autres
Publié: (2026)
Provably Improving Generalization of Few-Shot Models with Synthetic Data
par: Nguyen, Lan-Cuong, et autres
Publié: (2025)
par: Nguyen, Lan-Cuong, et autres
Publié: (2025)
Cloning Deterministic Worlds: The Critical Role of Latent Geometry in Long-Horizon World Models
par: Xia, Zaishuo, et autres
Publié: (2025)
par: Xia, Zaishuo, et autres
Publié: (2025)
Geometric Regularity in Deterministic Sampling Dynamics of Diffusion-based Generative Models
par: Chen, Defang, et autres
Publié: (2025)
par: Chen, Defang, et autres
Publié: (2025)
Robust Self-Training with Closed-loop Label Correction for Learning from Noisy Labels
par: Lin, Zhanhui, et autres
Publié: (2026)
par: Lin, Zhanhui, et autres
Publié: (2026)
AdaWorld: Learning Adaptable World Models with Latent Actions
par: Gao, Shenyuan, et autres
Publié: (2025)
par: Gao, Shenyuan, et autres
Publié: (2025)
Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models
par: Le, Quang-Hung, et autres
Publié: (2024)
par: Le, Quang-Hung, et autres
Publié: (2024)
EfficientViT-SAM: Accelerated Segment Anything Model Without Accuracy Loss
par: Zhang, Zhuoyang, et autres
Publié: (2024)
par: Zhang, Zhuoyang, et autres
Publié: (2024)
Consistent3D: Towards Consistent High-Fidelity Text-to-3D Generation with Deterministic Sampling Prior
par: Wu, Zike, et autres
Publié: (2024)
par: Wu, Zike, et autres
Publié: (2024)
Doe-1: Closed-Loop Autonomous Driving with Large World Model
par: Zheng, Wenzhao, et autres
Publié: (2024)
par: Zheng, Wenzhao, et autres
Publié: (2024)
LLM-attacker: Enhancing Closed-loop Adversarial Scenario Generation for Autonomous Driving with Large Language Models
par: Mei, Yuewen, et autres
Publié: (2025)
par: Mei, Yuewen, et autres
Publié: (2025)
Pix2Fact: When Vision Is Not Enough -- Benchmarking Fine-Grained VQA with Web Verification on High-Resolution Real-World Scenes
par: Jiang, Yifan, et autres
Publié: (2026)
par: Jiang, Yifan, et autres
Publié: (2026)
PVI: Plug-in Visual Injection for Vision-Language-Action Models
par: Zhang, Zezhou, et autres
Publié: (2026)
par: Zhang, Zezhou, et autres
Publié: (2026)
Zero-shot Safety Prediction for Autonomous Robots with Foundation World Models
par: Mao, Zhenjiang, et autres
Publié: (2024)
par: Mao, Zhenjiang, et autres
Publié: (2024)
Attention Guided Alignment in Efficient Vision-Language Models
par: Mahajan, Shweta, et autres
Publié: (2025)
par: Mahajan, Shweta, et autres
Publié: (2025)
Vision Verification Enhanced Fusion of VLMs for Efficient Visual Reasoning
par: Tekin, Selim Furkan, et autres
Publié: (2026)
par: Tekin, Selim Furkan, et autres
Publié: (2026)
Maximising the Utility of Validation Sets for Imbalanced Noisy-label Meta-learning
par: Hoang, Dung Anh, et autres
Publié: (2022)
par: Hoang, Dung Anh, et autres
Publié: (2022)
Sharpness-Aware Data Generation for Zero-shot Quantization
par: Hoang-Anh, Dung, et autres
Publié: (2025)
par: Hoang-Anh, Dung, et autres
Publié: (2025)
MOOSE: Pay Attention to Temporal Dynamics for Video Understanding via Optical Flows
par: Nguyen, Hong, et autres
Publié: (2025)
par: Nguyen, Hong, et autres
Publié: (2025)
CAKE: Real-time Action Detection via Motion Distillation and Background-aware Contrastive Learning
par: Hoang, Hieu, et autres
Publié: (2026)
par: Hoang, Hieu, et autres
Publié: (2026)
Navigation World Models
par: Bar, Amir, et autres
Publié: (2024)
par: Bar, Amir, et autres
Publié: (2024)
Stochastic Sampling from Deterministic Flow Models
par: Singh, Saurabh, et autres
Publié: (2024)
par: Singh, Saurabh, et autres
Publié: (2024)
Reading $\neq$ Seeing: Diagnosing and Closing the Typography Gap in Vision-Language Models
par: Zhou, Heng, et autres
Publié: (2026)
par: Zhou, Heng, et autres
Publié: (2026)
Continual Retinal Vision-Language Pre-training upon Incremental Imaging Modalities
par: Yao, Yuang, et autres
Publié: (2025)
par: Yao, Yuang, et autres
Publié: (2025)
Universal Camouflage Attack on Vision-Language Models for Autonomous Driving
par: Kong, Dehong, et autres
Publié: (2025)
par: Kong, Dehong, et autres
Publié: (2025)
Self-Supervised Weight Templates for Scalable Vision Model Initialization
par: Xie, Yucheng, et autres
Publié: (2026)
par: Xie, Yucheng, et autres
Publié: (2026)
RefDecoder: Enhancing Visual Generation with Conditional Video Decoding
par: Fan, Xiang, et autres
Publié: (2026)
par: Fan, Xiang, et autres
Publié: (2026)
Generalization Bounds for Robust Contrastive Learning: From Theory to Practice
par: Tran, Ngoc N., et autres
Publié: (2023)
par: Tran, Ngoc N., et autres
Publié: (2023)
Documents similaires
-
MLE-UVAD: Minimal Latent Entropy Autoencoder for Fully Unsupervised Video Anomaly Detection
par: Geng, Yuang, et autres
Publié: (2026) -
Four Principles for Physically Interpretable World Models
par: Peper, Jordan, et autres
Publié: (2025) -
Evaluating Precise Geolocation Inference Capabilities of Vision Language Models
par: Jay, Neel, et autres
Publié: (2025) -
Ultrasound Vision-Language Alignment via Contrastive Learning
par: Lyu, Zhuoyang, et autres
Publié: (2026) -
Language-Enhanced Latent Representations for Out-of-Distribution Detection in Autonomous Driving
par: Mao, Zhenjiang, et autres
Publié: (2024)