DreamBench++: A Human-Aligned Benchmark for Personalized Image Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Peng, Yuang, Cui, Yuxin, Tang, Haomiao, Qi, Zekun, Dong, Runpei, Bai, Jing, Han, Chunrui, Ge, Zheng, Zhang, Xiangyu, Xia, Shu-Tao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DreamLLM: Synergistic Multimodal Comprehension and Creation
por: Dong, Runpei, et al.
Publicado: (2023)
por: Dong, Runpei, et al.
Publicado: (2023)
Exploring Recurrent Long-term Temporal Fusion for Multi-view 3D Perception
por: Han, Chunrui, et al.
Publicado: (2023)
por: Han, Chunrui, et al.
Publicado: (2023)
ShapeLLM: Universal 3D Object Understanding for Embodied Interaction
por: Qi, Zekun, et al.
Publicado: (2024)
por: Qi, Zekun, et al.
Publicado: (2024)
Positional Prompt Tuning for Efficient 3D Representation Learning
por: Zhang, Shaochen, et al.
Publicado: (2024)
por: Zhang, Shaochen, et al.
Publicado: (2024)
DGAE: Diffusion-Guided Autoencoder for Efficient Latent Representation Learning
por: Liu, Dongxu, et al.
Publicado: (2025)
por: Liu, Dongxu, et al.
Publicado: (2025)
DreamVLA: A Vision-Language-Action Model Dreamed with Comprehensive World Knowledge
por: Zhang, Wenyao, et al.
Publicado: (2025)
por: Zhang, Wenyao, et al.
Publicado: (2025)
Personalized RewardBench: Evaluating Reward Models with Human Aligned Personalization
por: Ma, Qiyao, et al.
Publicado: (2026)
por: Ma, Qiyao, et al.
Publicado: (2026)
Video-Bench: Human-Aligned Video Generation Benchmark
por: Han, Hui, et al.
Publicado: (2025)
por: Han, Hui, et al.
Publicado: (2025)
Perception in Reflection
por: Wei, Yana, et al.
Publicado: (2025)
por: Wei, Yana, et al.
Publicado: (2025)
SpineBench: Benchmarking Multimodal LLMs for Spinal Pathology Analysis
por: Zhang, Chenghanyu, et al.
Publicado: (2025)
por: Zhang, Chenghanyu, et al.
Publicado: (2025)
EvoCodeBench: An Evolving Code Generation Benchmark Aligned with Real-World Code Repositories
por: Li, Jia, et al.
Publicado: (2024)
por: Li, Jia, et al.
Publicado: (2024)
Taming Teacher Forcing for Masked Autoregressive Video Generation
por: Zhou, Deyu, et al.
Publicado: (2025)
por: Zhou, Deyu, et al.
Publicado: (2025)
AlignBench: Benchmarking Chinese Alignment of Large Language Models
por: Liu, Xiao, et al.
Publicado: (2023)
por: Liu, Xiao, et al.
Publicado: (2023)
Secure and Scalable Face Retrieval via Cancelable Product Quantization
por: Tang, Haomiao, et al.
Publicado: (2025)
por: Tang, Haomiao, et al.
Publicado: (2025)
Video-SafetyBench: A Benchmark for Safety Evaluation of Video LVLMs
por: Liu, Xuannan, et al.
Publicado: (2025)
por: Liu, Xuannan, et al.
Publicado: (2025)
Thinking by Doing: Building Efficient World Model Reasoning in LLMs via Multi-turn Interaction
por: Shu, Bao, et al.
Publicado: (2025)
por: Shu, Bao, et al.
Publicado: (2025)
MMFakeBench: A Mixed-Source Multimodal Misinformation Detection Benchmark for LVLMs
por: Liu, Xuannan, et al.
Publicado: (2024)
por: Liu, Xuannan, et al.
Publicado: (2024)
AttnDreamBooth: Towards Text-Aligned Personalized Text-to-Image Generation
por: Pang, Lianyu, et al.
Publicado: (2024)
por: Pang, Lianyu, et al.
Publicado: (2024)
AVFakeBench: A Comprehensive Audio-Video Forgery Detection Benchmark for AV-LMMs
por: Xia, Shuhan, et al.
Publicado: (2025)
por: Xia, Shuhan, et al.
Publicado: (2025)
PSPA-Bench: A Personalized Benchmark for Smartphone GUI Agent
por: Nie, Hongyi, et al.
Publicado: (2026)
por: Nie, Hongyi, et al.
Publicado: (2026)
DreamDPO: Aligning Text-to-3D Generation with Human Preferences via Direct Preference Optimization
por: Zhou, Zhenglin, et al.
Publicado: (2025)
por: Zhou, Zhenglin, et al.
Publicado: (2025)
GEditBench v2: A Human-Aligned Benchmark for General Image Editing
por: Jiang, Zhangqi, et al.
Publicado: (2026)
por: Jiang, Zhangqi, et al.
Publicado: (2026)
BoRP: Bootstrapped Regression Probing for Scalable and Human-Aligned LLM Evaluation
por: Sun, Peng, et al.
Publicado: (2026)
por: Sun, Peng, et al.
Publicado: (2026)
Follow-Bench: A Unified Motion Planning Benchmark for Socially-Aware Robot Person Following
por: Ye, Hanjing, et al.
Publicado: (2025)
por: Ye, Hanjing, et al.
Publicado: (2025)
RubricBench: Aligning Model-Generated Rubrics with Human Standards
por: Zhang, Qiyuan, et al.
Publicado: (2026)
por: Zhang, Qiyuan, et al.
Publicado: (2026)
General OCR Theory: Towards OCR-2.0 via a Unified End-to-end Model
por: Wei, Haoran, et al.
Publicado: (2024)
por: Wei, Haoran, et al.
Publicado: (2024)
JobBench: Aligning Agent Work With Human Will
por: Li, Yuetai, et al.
Publicado: (2026)
por: Li, Yuetai, et al.
Publicado: (2026)
WebVR: Benchmarking Multimodal LLMs for WebPage Recreation from Videos via Human-Aligned Visual Rubrics
por: Dai, Yuhong, et al.
Publicado: (2026)
por: Dai, Yuhong, et al.
Publicado: (2026)
Perception-R1: Pioneering Perception Policy with Reinforcement Learning
por: Yu, En, et al.
Publicado: (2025)
por: Yu, En, et al.
Publicado: (2025)
Learning Getting-Up Policies for Real-World Humanoid Robots
por: He, Xialin, et al.
Publicado: (2025)
por: He, Xialin, et al.
Publicado: (2025)
Learning Humanoid End-Effector Control for Open-Vocabulary Visual Loco-Manipulation
por: Dong, Runpei, et al.
Publicado: (2026)
por: Dong, Runpei, et al.
Publicado: (2026)
CKDA: Cross-modality Knowledge Disentanglement and Alignment for Visible-Infrared Lifelong Person Re-identification
por: Cui, Zhenyu, et al.
Publicado: (2025)
por: Cui, Zhenyu, et al.
Publicado: (2025)
RealBench: A Repo-Level Code Generation Benchmark Aligned with Real-World Software Development Practices
por: Li, Jia, et al.
Publicado: (2026)
por: Li, Jia, et al.
Publicado: (2026)
Heterogeneous Uncertainty-Guided Composed Image Retrieval with Fine-Grained Probabilistic Learning
por: Tang, Haomiao, et al.
Publicado: (2026)
por: Tang, Haomiao, et al.
Publicado: (2026)
SHARE: Scene-Human Aligned Reconstruction
por: Li, Joshua, et al.
Publicado: (2025)
por: Li, Joshua, et al.
Publicado: (2025)
MedMemoryBench: Benchmarking Agent Memory in Personalized Healthcare
por: Wang, Yihao, et al.
Publicado: (2026)
por: Wang, Yihao, et al.
Publicado: (2026)
MTU-Bench: A Multi-granularity Tool-Use Benchmark for Large Language Models
por: Wang, Pei, et al.
Publicado: (2024)
por: Wang, Pei, et al.
Publicado: (2024)
EgoPlan-Bench: Benchmarking Multimodal Large Language Models for Human-Level Planning
por: Chen, Yi, et al.
Publicado: (2023)
por: Chen, Yi, et al.
Publicado: (2023)
Bi-C2R: Bidirectional Continual Compatible Representation for Re-indexing Free Lifelong Person Re-identification
por: Cui, Zhenyu, et al.
Publicado: (2025)
por: Cui, Zhenyu, et al.
Publicado: (2025)
Dreaming to Assist: Learning to Align with Human Objectives for Shared Control in High-Speed Racing
por: DeCastro, Jonathan, et al.
Publicado: (2024)
por: DeCastro, Jonathan, et al.
Publicado: (2024)
Ejemplares similares
-
DreamLLM: Synergistic Multimodal Comprehension and Creation
por: Dong, Runpei, et al.
Publicado: (2023) -
Exploring Recurrent Long-term Temporal Fusion for Multi-view 3D Perception
por: Han, Chunrui, et al.
Publicado: (2023) -
ShapeLLM: Universal 3D Object Understanding for Embodied Interaction
por: Qi, Zekun, et al.
Publicado: (2024) -
Positional Prompt Tuning for Efficient 3D Representation Learning
por: Zhang, Shaochen, et al.
Publicado: (2024) -
DGAE: Diffusion-Guided Autoencoder for Efficient Latent Representation Learning
por: Liu, Dongxu, et al.
Publicado: (2025)