HorizonWeaver: Generalizable Multi-Level Semantic Editing for Driving Scenes
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Soroco, Mauricio, Pittaluga, Francesco, Tasneem, Zaid, Aich, Abhishek, Zhuang, Bingbing, Chen, Wuyang, Chandraker, Manmohan, Jiang, Ziyu |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HorizonForge: Driving Scene Editing with Any Trajectories and Any Vehicles
par: Wang, Yifan, et autres
Publié: (2026)
par: Wang, Yifan, et autres
Publié: (2026)
LangDriveCTRL: Natural Language Controllable Driving Scene Editing with Multi-modal Agents
par: He, Yun, et autres
Publié: (2025)
par: He, Yun, et autres
Publié: (2025)
RAD-LAD: Rule and Language Grounded Autonomous Driving in Real-Time
par: Ghosh, Anurag, et autres
Publié: (2026)
par: Ghosh, Anurag, et autres
Publié: (2026)
AutoScape: Geometry-Consistent Long-Horizon Scene Generation
par: Chen, Jiacheng, et autres
Publié: (2025)
par: Chen, Jiacheng, et autres
Publié: (2025)
LidaRF: Delving into Lidar for Neural Radiance Field on Street Scenes
par: Sun, Shanlin, et autres
Publié: (2024)
par: Sun, Shanlin, et autres
Publié: (2024)
Drive-1-to-3: Enriching Diffusion Priors for Novel View Synthesis of Real Vehicles
par: Lin, Chuang, et autres
Publié: (2024)
par: Lin, Chuang, et autres
Publié: (2024)
Progressive Token Length Scaling in Transformer Encoders for Efficient Universal Segmentation
par: Aich, Abhishek, et autres
Publié: (2024)
par: Aich, Abhishek, et autres
Publié: (2024)
What to Test Next: Interpretable Coverage Gap Discovery in Driving VLMs
par: Aich, Abhishek, et autres
Publié: (2026)
par: Aich, Abhishek, et autres
Publié: (2026)
iFinder: Structured Zero-Shot Vision-Based LLM Grounding for Dash-Cam Video Reasoning
par: Yao, Manyi, et autres
Publié: (2025)
par: Yao, Manyi, et autres
Publié: (2025)
LLM-Assist: Enhancing Closed-Loop Planning with Language-Based Reasoning
par: Sharan, S P, et autres
Publié: (2023)
par: Sharan, S P, et autres
Publié: (2023)
LANGTRAJ: Diffusion Model and Dataset for Language-Conditioned Trajectory Simulation
par: Chang, Wei-Jer, et autres
Publié: (2025)
par: Chang, Wei-Jer, et autres
Publié: (2025)
SAFE-SIM: Safety-Critical Closed-Loop Traffic Simulation with Diffusion-Controllable Adversaries
par: Chang, Wei-Jer, et autres
Publié: (2023)
par: Chang, Wei-Jer, et autres
Publié: (2023)
Instantaneous Perception of Moving Objects in 3D
par: Liu, Di, et autres
Publié: (2024)
par: Liu, Di, et autres
Publié: (2024)
PhyCo: Learning Controllable Physical Priors for Generative Motion
par: Narayanan, Sriram, et autres
Publié: (2026)
par: Narayanan, Sriram, et autres
Publié: (2026)
Image-Specific Adaptation of Transformer Encoders for Compute-Efficient Segmentation
par: Yao, Manyi, et autres
Publié: (2024)
par: Yao, Manyi, et autres
Publié: (2024)
Learning Data-Efficient and Generalizable Neural Operators via Fundamental Physics Knowledge
par: Ma, Siying, et autres
Publié: (2026)
par: Ma, Siying, et autres
Publié: (2026)
Tuned Contrastive Learning
par: Animesh, Chaitanya, et autres
Publié: (2023)
par: Animesh, Chaitanya, et autres
Publié: (2023)
Rolling Sink: Bridging Limited-Horizon Training and Open-Ended Testing in Autoregressive Video Diffusion
par: Li, Haodong, et autres
Publié: (2026)
par: Li, Haodong, et autres
Publié: (2026)
Data-Efficient Inference of Neural Fluid Fields via SciML Foundation Model
par: Liu, Yuqiu, et autres
Publié: (2024)
par: Liu, Yuqiu, et autres
Publié: (2024)
Self-Training Large Language Models for Improved Visual Program Synthesis With Visual Reinforcement
par: Khan, Zaid, et autres
Publié: (2024)
par: Khan, Zaid, et autres
Publié: (2024)
UDA-Bench: Revisiting Common Assumptions in Unsupervised Domain Adaptation Using a Standardized Framework
par: Kalluri, Tarun, et autres
Publié: (2024)
par: Kalluri, Tarun, et autres
Publié: (2024)
Locally Orderless Images for Optimization in Differentiable Rendering
par: Mehta, Ishit, et autres
Publié: (2025)
par: Mehta, Ishit, et autres
Publié: (2025)
NERFIFY: A Multi-Agent Framework for Turning NeRF Papers into Code
par: Jain, Seemandhar, et autres
Publié: (2026)
par: Jain, Seemandhar, et autres
Publié: (2026)
PDE-Controller: LLMs for Autoformalization and Reasoning of PDEs
par: Soroco, Mauricio, et autres
Publié: (2025)
par: Soroco, Mauricio, et autres
Publié: (2025)
Tell, Don't Show!: Language Guidance Eases Transfer Across Domains in Images and Videos
par: Kalluri, Tarun, et autres
Publié: (2024)
par: Kalluri, Tarun, et autres
Publié: (2024)
SceneCrafter: Controllable Multi-View Driving Scene Editing
par: Zhu, Zehao, et autres
Publié: (2025)
par: Zhu, Zehao, et autres
Publié: (2025)
Resolving Inconsistent Semantics in Multi-Dataset Image Segmentation
par: Zhangli, Qilong, et autres
Publié: (2024)
par: Zhangli, Qilong, et autres
Publié: (2024)
AIDE: An Automatic Data Engine for Object Detection in Autonomous Driving
par: Liang, Mingfu, et autres
Publié: (2024)
par: Liang, Mingfu, et autres
Publié: (2024)
A Minimalist Prompt for Zero-Shot Policy Learning
par: Song, Meng, et autres
Publié: (2024)
par: Song, Meng, et autres
Publié: (2024)
Mapillary Vistas Validation for Fine-Grained Traffic Signs: A Benchmark Revealing Vision-Language Model Limitations
par: Garg, Sparsh, et autres
Publié: (2025)
par: Garg, Sparsh, et autres
Publié: (2025)
Grounded World Model for Semantically Generalizable Planning
par: Li, Quanyi, et autres
Publié: (2026)
par: Li, Quanyi, et autres
Publié: (2026)
DriveX: Omni Scene Modeling for Learning Generalizable World Knowledge in Autonomous Driving
par: Shi, Chen, et autres
Publié: (2025)
par: Shi, Chen, et autres
Publié: (2025)
Materialist: Physically Based Editing Using Single-Image Inverse Rendering
par: Wang, Lezhong, et autres
Publié: (2025)
par: Wang, Lezhong, et autres
Publié: (2025)
MoVieDrive: Urban Scene Synthesis with Multi-Modal Multi-View Video Diffusion Transformer
par: Wu, Guile, et autres
Publié: (2025)
par: Wu, Guile, et autres
Publié: (2025)
Open-world Instance Segmentation: Top-down Learning with Bottom-up Supervision
par: Kalluri, Tarun, et autres
Publié: (2023)
par: Kalluri, Tarun, et autres
Publié: (2023)
Temperamento, car cter y personalidad / Gustavo Pittaluga
par: Pittaluga, Gustavo
Publié: (1954)
par: Pittaluga, Gustavo
Publié: (1954)
La Revolución Soviética desde el exilio: Mijail Yaroshevsky
par: Roberto Pittaluga
Publié: (2017)
par: Roberto Pittaluga
Publié: (2017)
Notas para una historia de la izquierda
par: Roberto Pittaluga
Publié: (2020)
par: Roberto Pittaluga
Publié: (2020)
DWIM: Towards Tool-aware Visual Reasoning via Discrepancy-aware Workflow Generation & Instruct-Masking Tuning
par: Ke, Fucai, et autres
Publié: (2025)
par: Ke, Fucai, et autres
Publié: (2025)
DecentNeRFs: Decentralized Neural Radiance Fields from Crowdsourced Images
par: Tasneem, Zaid, et autres
Publié: (2024)
par: Tasneem, Zaid, et autres
Publié: (2024)
Documents similaires
-
HorizonForge: Driving Scene Editing with Any Trajectories and Any Vehicles
par: Wang, Yifan, et autres
Publié: (2026) -
LangDriveCTRL: Natural Language Controllable Driving Scene Editing with Multi-modal Agents
par: He, Yun, et autres
Publié: (2025) -
RAD-LAD: Rule and Language Grounded Autonomous Driving in Real-Time
par: Ghosh, Anurag, et autres
Publié: (2026) -
AutoScape: Geometry-Consistent Long-Horizon Scene Generation
par: Chen, Jiacheng, et autres
Publié: (2025) -
LidaRF: Delving into Lidar for Neural Radiance Field on Street Scenes
par: Sun, Shanlin, et autres
Publié: (2024)