COMBAT: Conditional World Models for Behavioral Agent Training
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Agarwal, Anmol, Meshram, Pranay, Singh, Sumer, Suman, Saurav, Lapp, Andrew, Matiana, Shahbuland, Castricato, Louis, Frazier, Spencer |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
QAL: A Loss for Recall Precision Balance in 3D Reconstruction
par: Meshram, Pranay, et autres
Publié: (2025)
par: Meshram, Pranay, et autres
Publié: (2025)
Empir3D : A Framework for Multi-Dimensional Point Cloud Assessment
par: Turkar, Yash, et autres
Publié: (2023)
par: Turkar, Yash, et autres
Publié: (2023)
Humanoid World Models: Open World Foundation Models for Humanoid Robotics
par: Ali, Muhammad Qasim, et autres
Publié: (2025)
par: Ali, Muhammad Qasim, et autres
Publié: (2025)
Low-Compute Watermark Removal via Dual-Domain Natural Projection
par: Meshram, Pragati Shuddhodhan, et autres
Publié: (2025)
par: Meshram, Pragati Shuddhodhan, et autres
Publié: (2025)
Exploiting Contextual Uncertainty of Visual Data for Efficient Training of Deep Models
par: Agarwal, Sharat
Publié: (2024)
par: Agarwal, Sharat
Publié: (2024)
Explainable Gait Abnormality Detection Using Dual-Dataset CNN-LSTM Models
par: Agarwal, Parth, et autres
Publié: (2025)
par: Agarwal, Parth, et autres
Publié: (2025)
WorldBench: Disambiguating Physics for Diagnostic Evaluation of World Models
par: Upadhyay, Rishi, et autres
Publié: (2026)
par: Upadhyay, Rishi, et autres
Publié: (2026)
Reconstruction or Semantics? What Makes a Latent Space Useful for Robotic World Models
par: Nilaksh, et autres
Publié: (2026)
par: Nilaksh, et autres
Publié: (2026)
WorldAgents: Can Foundation Image Models be Agents for 3D World Models?
par: Erkoç, Ziya, et autres
Publié: (2026)
par: Erkoç, Ziya, et autres
Publié: (2026)
Probing the effectiveness of World Models for Spatial Reasoning through Test-time Scaling
par: Jha, Saurav, et autres
Publié: (2025)
par: Jha, Saurav, et autres
Publié: (2025)
SparseWorld-TC: Trajectory-Conditioned Sparse Occupancy World Model
par: Du, Jiayuan, et autres
Publié: (2025)
par: Du, Jiayuan, et autres
Publié: (2025)
TIDE: Training Locally Interpretable Domain Generalization Models Enables Test-time Correction
par: Agarwal, Aishwarya, et autres
Publié: (2024)
par: Agarwal, Aishwarya, et autres
Publié: (2024)
Post-Training and Test-Time Scaling of Generative Agent Behavior Models for Interactive Autonomous Driving
par: Seong, Hyunki, et autres
Publié: (2025)
par: Seong, Hyunki, et autres
Publié: (2025)
World Guidance: World Modeling in Condition Space for Action Generation
par: Su, Yue, et autres
Publié: (2026)
par: Su, Yue, et autres
Publié: (2026)
WebGym: Scaling Training Environments for Visual Web Agents with Realistic Tasks
par: Bai, Hao, et autres
Publié: (2026)
par: Bai, Hao, et autres
Publié: (2026)
CLAP4CLIP: Continual Learning with Probabilistic Finetuning for Vision-Language Models
par: Jha, Saurav, et autres
Publié: (2024)
par: Jha, Saurav, et autres
Publié: (2024)
Snowy Scenes,Clear Detections: A Robust Model for Traffic Light Detection in Adverse Weather Conditions
par: Garg, Shivank, et autres
Publié: (2024)
par: Garg, Shivank, et autres
Publié: (2024)
Transfer Learning-Based CNN Models for Plant Species Identification Using Leaf Venation Patterns
par: Bharadwaj, Bandita, et autres
Publié: (2025)
par: Bharadwaj, Bandita, et autres
Publié: (2025)
fine-CLIP: Enhancing Zero-Shot Fine-Grained Surgical Action Recognition with Vision-Language Models
par: Sharma, Saurav, et autres
Publié: (2025)
par: Sharma, Saurav, et autres
Publié: (2025)
PatrolVision: Automated License Plate Recognition in the wild
par: Singhal, Anmol Singhal Navya
Publié: (2025)
par: Singhal, Anmol Singhal Navya
Publié: (2025)
Attention Isn't All You Need for Emotion Recognition:Domain Features Outperform Transformers on the EAV Dataset
par: Guragain, Anmol
Publié: (2026)
par: Guragain, Anmol
Publié: (2026)
3D Universal Lesion Detection and Tagging in CT with Self-Training
par: Frazier, Jared, et autres
Publié: (2025)
par: Frazier, Jared, et autres
Publié: (2025)
What's in the Flow? Exploiting Temporal Motion Cues for Unsupervised Generic Event Boundary Detection
par: Gothe, Sourabh Vasant, et autres
Publié: (2024)
par: Gothe, Sourabh Vasant, et autres
Publié: (2024)
MultiWorld: Scalable Multi-Agent Multi-View Video World Models
par: Wu, Haoyu, et autres
Publié: (2026)
par: Wu, Haoyu, et autres
Publié: (2026)
Gamma-World: Generative Multi-Agent World Modeling Beyond Two Players
par: Liu, Fangfu, et autres
Publié: (2026)
par: Liu, Fangfu, et autres
Publié: (2026)
World2Act: Latent Action Post-Training from World Model Dynamics
par: Vuong, An Dinh, et autres
Publié: (2026)
par: Vuong, An Dinh, et autres
Publié: (2026)
Towards Driver Behavior Understanding: Weakly-Supervised Risk Perception in Driving Scenes
par: Agarwal, Nakul, et autres
Publié: (2026)
par: Agarwal, Nakul, et autres
Publié: (2026)
ECoDepth: Effective Conditioning of Diffusion Models for Monocular Depth Estimation
par: Patni, Suraj, et autres
Publié: (2024)
par: Patni, Suraj, et autres
Publié: (2024)
Surgical Vision World Model
par: Koju, Saurabh, et autres
Publié: (2025)
par: Koju, Saurabh, et autres
Publié: (2025)
Optimizing Multitask Industrial Processes with Predictive Action Guidance
par: Mehta, Naval Kishore, et autres
Publié: (2025)
par: Mehta, Naval Kishore, et autres
Publié: (2025)
Class Confidence Aware Reweighting for Long Tailed Learning
par: Jagati, Brainard Philemon, et autres
Publié: (2026)
par: Jagati, Brainard Philemon, et autres
Publié: (2026)
Improving Training-free Conditional Diffusion Model via Fisher Information
par: Song, Kaiyu, et autres
Publié: (2024)
par: Song, Kaiyu, et autres
Publié: (2024)
Automatic Report Generation for Histopathology images using pre-trained Vision Transformers and BERT
par: Sengupta, Saurav, et autres
Publié: (2023)
par: Sengupta, Saurav, et autres
Publié: (2023)
MWM: Mobile World Models for Action-Conditioned Consistent Prediction
par: Yan, Han, et autres
Publié: (2026)
par: Yan, Han, et autres
Publié: (2026)
Training-free Color-Style Disentanglement for Constrained Text-to-Image Synthesis
par: Agarwal, Aishwarya, et autres
Publié: (2024)
par: Agarwal, Aishwarya, et autres
Publié: (2024)
LOME: Learning Human-Object Manipulation with Action-Conditioned Egocentric World Model
par: Gao, Quankai, et autres
Publié: (2026)
par: Gao, Quankai, et autres
Publié: (2026)
Language-Conditioned World Modeling for Visual Navigation
par: Dong, Yifei, et autres
Publié: (2026)
par: Dong, Yifei, et autres
Publié: (2026)
ConditionVideo: Training-Free Condition-Guided Text-to-Video Generation
par: Peng, Bo, et autres
Publié: (2023)
par: Peng, Bo, et autres
Publié: (2023)
DWaste: Greener AI for Waste Sorting using Mobile and Edge Devices
par: Kunwar, Suman
Publié: (2025)
par: Kunwar, Suman
Publié: (2025)
The Garbage Dataset (GD): A Multi-Class Image Benchmark for Automated Waste Segregation
par: Kunwar, Suman
Publié: (2026)
par: Kunwar, Suman
Publié: (2026)
Documents similaires
-
QAL: A Loss for Recall Precision Balance in 3D Reconstruction
par: Meshram, Pranay, et autres
Publié: (2025) -
Empir3D : A Framework for Multi-Dimensional Point Cloud Assessment
par: Turkar, Yash, et autres
Publié: (2023) -
Humanoid World Models: Open World Foundation Models for Humanoid Robotics
par: Ali, Muhammad Qasim, et autres
Publié: (2025) -
Low-Compute Watermark Removal via Dual-Domain Natural Projection
par: Meshram, Pragati Shuddhodhan, et autres
Publié: (2025) -
Exploiting Contextual Uncertainty of Visual Data for Efficient Training of Deep Models
par: Agarwal, Sharat
Publié: (2024)