SuperPADL: Scaling Language-Directed Physics-Based Control with Progressive Supervised Distillation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Juravsky, Jordan, Guo, Yunrong, Fidler, Sanja, Peng, Xue Bin |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
3D-PreMise: Can Large Language Models Generate 3D Shapes with Sharp Features and Parametric Control?
par: Yuan, Zeqing, et autres
Publié: (2024)
par: Yuan, Zeqing, et autres
Publié: (2024)
SCube: Instant Large-Scale Scene Reconstruction using VoxSplats
par: Ren, Xuanchi, et autres
Publié: (2024)
par: Ren, Xuanchi, et autres
Publié: (2024)
PARC: Physics-based Augmentation with Reinforcement Learning for Character Controllers
par: Xu, Michael, et autres
Publié: (2025)
par: Xu, Michael, et autres
Publié: (2025)
From Pixels to Policies: Reinforcing Spatial Reasoning in Language Models for Content-Aware Layout Design
par: Li, Sha, et autres
Publié: (2026)
par: Li, Sha, et autres
Publié: (2026)
LuxDiT: Lighting Estimation with Video Diffusion Transformer
par: Liang, Ruofan, et autres
Publié: (2025)
par: Liang, Ruofan, et autres
Publié: (2025)
Photorealistic Object Insertion with Diffusion-Guided Inverse Rendering
par: Liang, Ruofan, et autres
Publié: (2024)
par: Liang, Ruofan, et autres
Publié: (2024)
VideoPanda: Video Panoramic Diffusion with Multi-view Attention
par: Xie, Kevin, et autres
Publié: (2025)
par: Xie, Kevin, et autres
Publié: (2025)
InfiniCube: Unbounded and Controllable Dynamic 3D Driving Scene Generation with World-Guided Video Models
par: Lu, Yifan, et autres
Publié: (2024)
par: Lu, Yifan, et autres
Publié: (2024)
MoRight: Motion Control Done Right
par: Liu, Shaowei, et autres
Publié: (2026)
par: Liu, Shaowei, et autres
Publié: (2026)
RLZero: Direct Policy Inference from Language Without In-Domain Supervision
par: Sikchi, Harshit, et autres
Publié: (2024)
par: Sikchi, Harshit, et autres
Publié: (2024)
SMP: Reusable Score-Matching Motion Priors for Physics-Based Character Control
par: Mu, Yuxuan, et autres
Publié: (2025)
par: Mu, Yuxuan, et autres
Publié: (2025)
From Words to Worlds: Transforming One-line Prompt into Immersive Multi-modal Digital Stories with Communicative LLM Agent
par: Sohn, Samuel S., et autres
Publié: (2024)
par: Sohn, Samuel S., et autres
Publié: (2024)
Cutscene Agent: An LLM Agent Framework for Automated 3D Cutscene Generation
par: He, Lanshan, et autres
Publié: (2026)
par: He, Lanshan, et autres
Publié: (2026)
QQJ: Quantifying Qualitative Judgment for Scalable and Human-Aligned Evaluation of Generative AI
par: Veysi, Marjan, et autres
Publié: (2026)
par: Veysi, Marjan, et autres
Publié: (2026)
MaskedManipulator: Versatile Whole-Body Manipulation
par: Tessler, Chen, et autres
Publié: (2025)
par: Tessler, Chen, et autres
Publié: (2025)
Physics-Based Motion Imitation with Adversarial Differential Discriminators
par: Zhang, Ziyu, et autres
Publié: (2025)
par: Zhang, Ziyu, et autres
Publié: (2025)
Near-realtime Facial Animation by Deep 3D Simulation Super-Resolution
par: Park, Hyojoon, et autres
Publié: (2023)
par: Park, Hyojoon, et autres
Publié: (2023)
Generative Detail Enhancement for Physically Based Materials
par: Hadadan, Saeed, et autres
Publié: (2025)
par: Hadadan, Saeed, et autres
Publié: (2025)
Feed-Forward Bullet-Time Reconstruction of Dynamic Scenes from Monocular Videos
par: Liang, Hanxue, et autres
Publié: (2024)
par: Liang, Hanxue, et autres
Publié: (2024)
Real-time Animation Generation and Control on Rigged Models via Large Language Models
par: Huang, Han, et autres
Publié: (2023)
par: Huang, Han, et autres
Publié: (2023)
DreaMark: Rooting Watermark in Score Distillation Sampling Generated Neural Radiance Fields
par: Zhu, Xingyu, et autres
Publié: (2024)
par: Zhu, Xingyu, et autres
Publié: (2024)
Narrative-to-Scene Generation: An LLM-Driven Pipeline for 2D Game Environments
par: Chen, Yi-Chun, et autres
Publié: (2025)
par: Chen, Yi-Chun, et autres
Publié: (2025)
Interactive Character Control with Auto-Regressive Motion Diffusion Models
par: Shi, Yi, et autres
Publié: (2023)
par: Shi, Yi, et autres
Publié: (2023)
Balancing Preservation and Modification: A Region and Semantic Aware Metric for Instruction-Based Image Editing
par: Li, Zhuoying, et autres
Publié: (2025)
par: Li, Zhuoying, et autres
Publié: (2025)
Pro3D-Editor : A Progressive-Views Perspective for Consistent and Precise 3D Editing
par: Zheng, Yang, et autres
Publié: (2025)
par: Zheng, Yang, et autres
Publié: (2025)
Progress and Prospects in 3D Generative AI: A Technical Overview including 3D human
par: Bai, Song, et autres
Publié: (2024)
par: Bai, Song, et autres
Publié: (2024)
Versatile Physics-based Character Control with Hybrid Latent Representation
par: Bae, Jinseok, et autres
Publié: (2025)
par: Bae, Jinseok, et autres
Publié: (2025)
STREAMINGGS: Voxel-Based Streaming 3D Gaussian Splatting with Memory Optimization and Architectural Support
par: Zhang, Chenqi, et autres
Publié: (2025)
par: Zhang, Chenqi, et autres
Publié: (2025)
HistCAD: A Constraint-Aware Parametric History-Based CAD Representation, Dataset, and Benchmark with Industrial Complexity
par: Dong, Xintong, et autres
Publié: (2025)
par: Dong, Xintong, et autres
Publié: (2025)
Grounding Language in Multi-Perspective Referential Communication
par: Tang, Zineng, et autres
Publié: (2024)
par: Tang, Zineng, et autres
Publié: (2024)
DreamCraft: Text-Guided Generation of Functional 3D Environments in Minecraft
par: Earle, Sam, et autres
Publié: (2024)
par: Earle, Sam, et autres
Publié: (2024)
Modern Information Technologies in Scientific Research and Educational Activities
par: Malakhov, Kyrylo, et autres
Publié: (2024)
par: Malakhov, Kyrylo, et autres
Publié: (2024)
Harnessing Adaptive Topology Representations for Zero-Shot Graph Question Answering
par: Wei, Yanbin, et autres
Publié: (2025)
par: Wei, Yanbin, et autres
Publié: (2025)
FPGS: Feed-Forward Semantic-aware Photorealistic Style Transfer of Large-Scale Gaussian Splatting
par: Kim, GeonU, et autres
Publié: (2025)
par: Kim, GeonU, et autres
Publié: (2025)
MUSIC: Learning Muscle-Driven Dexterous Hand Control
par: Xu, Pei, et autres
Publié: (2026)
par: Xu, Pei, et autres
Publié: (2026)
Progressive Rendering Distillation: Adapting Stable Diffusion for Instant Text-to-Mesh Generation without 3D Data
par: Ma, Zhiyuan, et autres
Publié: (2025)
par: Ma, Zhiyuan, et autres
Publié: (2025)
PlaMo: Plan and Move in Rich 3D Physical Environments
par: Hallak, Assaf, et autres
Publié: (2024)
par: Hallak, Assaf, et autres
Publié: (2024)
Causal Reasoning Elicits Controllable 3D Scene Generation
par: Chen, Shen, et autres
Publié: (2025)
par: Chen, Shen, et autres
Publié: (2025)
3DMeshNet: A Three-Dimensional Differential Neural Network for Structured Mesh Generation
par: Peng, Jiaming, et autres
Publié: (2024)
par: Peng, Jiaming, et autres
Publié: (2024)
LLM Gesticulator: Leveraging Large Language Models for Scalable and Controllable Co-Speech Gesture Synthesis
par: Pang, Haozhou, et autres
Publié: (2024)
par: Pang, Haozhou, et autres
Publié: (2024)
Documents similaires
-
3D-PreMise: Can Large Language Models Generate 3D Shapes with Sharp Features and Parametric Control?
par: Yuan, Zeqing, et autres
Publié: (2024) -
SCube: Instant Large-Scale Scene Reconstruction using VoxSplats
par: Ren, Xuanchi, et autres
Publié: (2024) -
PARC: Physics-based Augmentation with Reinforcement Learning for Character Controllers
par: Xu, Michael, et autres
Publié: (2025) -
From Pixels to Policies: Reinforcing Spatial Reasoning in Language Models for Content-Aware Layout Design
par: Li, Sha, et autres
Publié: (2026) -
LuxDiT: Lighting Estimation with Video Diffusion Transformer
par: Liang, Ruofan, et autres
Publié: (2025)