DreamReward: Text-to-3D Generation with Human Preference
Fuente:
arXiv
Guardado en:
| Autores principales: | Ye, Junliang, Liu, Fangfu, Li, Qixiu, Wang, Zhengyi, Wang, Yikai, Wang, Xinzhou, Duan, Yueqi, Zhu, Jun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Vidu4D: Single Generated Video to High-Fidelity 4D Reconstruction with Dynamic Gaussian Surfels
por: Wang, Yikai, et al.
Publicado: (2024)
por: Wang, Yikai, et al.
Publicado: (2024)
AnimatableDreamer: Text-Guided Non-rigid 3D Model Generation and Reconstruction with Canonical Score Distillation
por: Wang, Xinzhou, et al.
Publicado: (2023)
por: Wang, Xinzhou, et al.
Publicado: (2023)
VideoScene: Distilling Video Diffusion Model to Generate 3D Scenes in One Step
por: Wang, Hanyang, et al.
Publicado: (2025)
por: Wang, Hanyang, et al.
Publicado: (2025)
ReconX: Reconstruct Any Scene from Sparse Views with Video Diffusion Model
por: Liu, Fangfu, et al.
Publicado: (2024)
por: Liu, Fangfu, et al.
Publicado: (2024)
ShapeLLM-Omni: A Native Multimodal LLM for 3D Generation and Understanding
por: Ye, Junliang, et al.
Publicado: (2025)
por: Ye, Junliang, et al.
Publicado: (2025)
DimensionX: Create Any 3D and 4D Scenes from a Single Image with Controllable Video Diffusion
por: Sun, Wenqiang, et al.
Publicado: (2024)
por: Sun, Wenqiang, et al.
Publicado: (2024)
DreamCinema: Cinematic Transfer with Free Camera and 3D Character
por: Chen, Weiliang, et al.
Publicado: (2024)
por: Chen, Weiliang, et al.
Publicado: (2024)
Make-Your-3D: Fast and Consistent Subject-Driven 3D Content Generation
por: Liu, Fangfu, et al.
Publicado: (2024)
por: Liu, Fangfu, et al.
Publicado: (2024)
FlexiDreamer: Single Image-to-3D Generation with FlexiCubes
por: Zhao, Ruowen, et al.
Publicado: (2024)
por: Zhao, Ruowen, et al.
Publicado: (2024)
OnlineX: Unified Online 3D Reconstruction and Understanding with Active-to-Stable State Evolution
por: Xia, Chong, et al.
Publicado: (2026)
por: Xia, Chong, et al.
Publicado: (2026)
DeepMesh: Auto-Regressive Artist-mesh Creation with Reinforcement Learning
por: Zhao, Ruowen, et al.
Publicado: (2025)
por: Zhao, Ruowen, et al.
Publicado: (2025)
V3D: Video Diffusion Models are Effective 3D Generators
por: Chen, Zilong, et al.
Publicado: (2024)
por: Chen, Zilong, et al.
Publicado: (2024)
DreamCS: Geometry-Aware Text-to-3D Generation with Unpaired 3D Reward Supervision
por: Zou, Xiandong, et al.
Publicado: (2025)
por: Zou, Xiandong, et al.
Publicado: (2025)
ScenePainter: Semantically Consistent Perpetual 3D Scene Generation with Concept Relation Alignment
por: Xia, Chong, et al.
Publicado: (2025)
por: Xia, Chong, et al.
Publicado: (2025)
LangScene-X: Reconstruct Generalizable 3D Language-Embedded Scenes with TriMap Video Diffusion
por: Liu, Fangfu, et al.
Publicado: (2025)
por: Liu, Fangfu, et al.
Publicado: (2025)
Physics3D: Learning Physical Properties of 3D Gaussians via Video Diffusion
por: Liu, Fangfu, et al.
Publicado: (2024)
por: Liu, Fangfu, et al.
Publicado: (2024)
SimRecon: SimReady Compositional Scene Reconstruction from Real Videos
por: Xia, Chong, et al.
Publicado: (2026)
por: Xia, Chong, et al.
Publicado: (2026)
NANO3D: A Training-Free Approach for Efficient 3D Editing Without Masks
por: Ye, Junliang, et al.
Publicado: (2025)
por: Ye, Junliang, et al.
Publicado: (2025)
Video4DGen: Enhancing Video and 4D Generation through Mutual Optimization
por: Wang, Yikai, et al.
Publicado: (2025)
por: Wang, Yikai, et al.
Publicado: (2025)
LLaMA-Mesh: Unifying 3D Mesh Generation with Language Models
por: Wang, Zhengyi, et al.
Publicado: (2024)
por: Wang, Zhengyi, et al.
Publicado: (2024)
Isotropic3D: Image-to-3D Generation Based on a Single CLIP Embedding
por: Liu, Pengkun, et al.
Publicado: (2024)
por: Liu, Pengkun, et al.
Publicado: (2024)
CRPO: Confidence-Reward Driven Preference Optimization for Machine Translation
por: Cui, Guofeng, et al.
Publicado: (2025)
por: Cui, Guofeng, et al.
Publicado: (2025)
Preference Score Distillation: Leveraging 2D Rewards to Align Text-to-3D Generation with Human Preference
por: Leng, Jiaqi, et al.
Publicado: (2026)
por: Leng, Jiaqi, et al.
Publicado: (2026)
Video-T1: Test-Time Scaling for Video Generation
por: Liu, Fangfu, et al.
Publicado: (2025)
por: Liu, Fangfu, et al.
Publicado: (2025)
Omni-Reward: Towards Generalist Omni-Modal Reward Modeling with Free-Form Preferences
por: Jin, Zhuoran, et al.
Publicado: (2025)
por: Jin, Zhuoran, et al.
Publicado: (2025)
VisualPRM: An Effective Process Reward Model for Multimodal Reasoning
por: Wang, Weiyun, et al.
Publicado: (2025)
por: Wang, Weiyun, et al.
Publicado: (2025)
RoVRM: A Robust Visual Reward Model Optimized via Auxiliary Textual Preference Data
por: Wang, Chenglong, et al.
Publicado: (2024)
por: Wang, Chenglong, et al.
Publicado: (2024)
Text-to-3D using Gaussian Splatting
por: Chen, Zilong, et al.
Publicado: (2023)
por: Chen, Zilong, et al.
Publicado: (2023)
Gaussian Graph Network: Learning Efficient and Generalizable Gaussian Representations from Multi-view Images
por: Zhang, Shengjun, et al.
Publicado: (2025)
por: Zhang, Shengjun, et al.
Publicado: (2025)
Multimodal LLMs as Customized Reward Models for Text-to-Image Generation
por: Zhou, Shijie, et al.
Publicado: (2025)
por: Zhou, Shijie, et al.
Publicado: (2025)
DreamArtist++: Controllable One-Shot Text-to-Image Generation via Positive-Negative Adapter
por: Dong, Ziyi, et al.
Publicado: (2022)
por: Dong, Ziyi, et al.
Publicado: (2022)
MJ-Bench: Is Your Multimodal Reward Model Really a Good Judge for Text-to-Image Generation?
por: Chen, Zhaorun, et al.
Publicado: (2024)
por: Chen, Zhaorun, et al.
Publicado: (2024)
Unique3D: High-Quality and Efficient 3D Mesh Generation from a Single Image
por: Wu, Kailu, et al.
Publicado: (2024)
por: Wu, Kailu, et al.
Publicado: (2024)
SegHist: A General Segmentation-based Framework for Chinese Historical Document Text Line Detection
por: Hu, Xingjian, et al.
Publicado: (2024)
por: Hu, Xingjian, et al.
Publicado: (2024)
Dream-VL & Dream-VLA: Open Vision-Language and Vision-Language-Action Models with Diffusion Language Model Backbone
por: Ye, Jiacheng, et al.
Publicado: (2025)
por: Ye, Jiacheng, et al.
Publicado: (2025)
CFG-Ctrl: Control-Based Classifier-Free Diffusion Guidance
por: Wang, Hanyang, et al.
Publicado: (2026)
por: Wang, Hanyang, et al.
Publicado: (2026)
VL-RewardBench: A Challenging Benchmark for Vision-Language Generative Reward Models
por: Li, Lei, et al.
Publicado: (2024)
por: Li, Lei, et al.
Publicado: (2024)
Universal Prompt Optimizer for Safe Text-to-Image Generation
por: Wu, Zongyu, et al.
Publicado: (2024)
por: Wu, Zongyu, et al.
Publicado: (2024)
Multimodal RewardBench 2: Evaluating Omni Reward Models for Interleaved Text and Image
por: Hu, Yushi, et al.
Publicado: (2025)
por: Hu, Yushi, et al.
Publicado: (2025)
Gamma-World: Generative Multi-Agent World Modeling Beyond Two Players
por: Liu, Fangfu, et al.
Publicado: (2026)
por: Liu, Fangfu, et al.
Publicado: (2026)
Ejemplares similares
-
Vidu4D: Single Generated Video to High-Fidelity 4D Reconstruction with Dynamic Gaussian Surfels
por: Wang, Yikai, et al.
Publicado: (2024) -
AnimatableDreamer: Text-Guided Non-rigid 3D Model Generation and Reconstruction with Canonical Score Distillation
por: Wang, Xinzhou, et al.
Publicado: (2023) -
VideoScene: Distilling Video Diffusion Model to Generate 3D Scenes in One Step
por: Wang, Hanyang, et al.
Publicado: (2025) -
ReconX: Reconstruct Any Scene from Sparse Views with Video Diffusion Model
por: Liu, Fangfu, et al.
Publicado: (2024) -
ShapeLLM-Omni: A Native Multimodal LLM for 3D Generation and Understanding
por: Ye, Junliang, et al.
Publicado: (2025)