Guardado en:
| Autores principales: | Yang, Yang, Meng, Feifan, Fang, Han, Zhang, Weiming |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2604.26348 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Latent Guidance in Diffusion Models for Perceptual Evaluations
por: Saini, Shreshth, et al.
Publicado: (2025)
por: Saini, Shreshth, et al.
Publicado: (2025)
T2SMark: Balancing Robustness and Diversity in Noise-as-Watermark for Diffusion Models
por: Yang, Jindong, et al.
Publicado: (2025)
por: Yang, Jindong, et al.
Publicado: (2025)
SKeDA: A Generative Watermarking Framework for Text-to-video Diffusion Models
por: Yang, Yang, et al.
Publicado: (2026)
por: Yang, Yang, et al.
Publicado: (2026)
Diffusion Model with Perceptual Loss
por: Lin, Shanchuan, et al.
Publicado: (2023)
por: Lin, Shanchuan, et al.
Publicado: (2023)
Scaling-up Perceptual Video Quality Assessment
por: Jia, Ziheng, et al.
Publicado: (2025)
por: Jia, Ziheng, et al.
Publicado: (2025)
EPiC: Efficient Video Camera Control Learning with Precise Anchor-Video Guidance
por: Wang, Zun, et al.
Publicado: (2025)
por: Wang, Zun, et al.
Publicado: (2025)
RefBench-PRO: Perceptual and Reasoning Oriented Benchmark for Referring Expression Comprehension
por: Gao, Tianyi, et al.
Publicado: (2025)
por: Gao, Tianyi, et al.
Publicado: (2025)
Scaling Properties of Diffusion Models for Perceptual Tasks
por: Ravishankar, Rahul, et al.
Publicado: (2024)
por: Ravishankar, Rahul, et al.
Publicado: (2024)
MAGREF: Masked Guidance for Any-Reference Video Generation with Subject Disentanglement
por: Deng, Yufan, et al.
Publicado: (2025)
por: Deng, Yufan, et al.
Publicado: (2025)
Gradient-Free Classifier Guidance for Diffusion Model Sampling
por: Shenoy, Rahul, et al.
Publicado: (2024)
por: Shenoy, Rahul, et al.
Publicado: (2024)
BudgetFusion: Perceptually-Guided Adaptive Diffusion Models
por: Li, Qinchan, et al.
Publicado: (2024)
por: Li, Qinchan, et al.
Publicado: (2024)
PixelGen: Improving Pixel Diffusion with Perceptual Supervision
por: Ma, Zehong, et al.
Publicado: (2026)
por: Ma, Zehong, et al.
Publicado: (2026)
Perceptual Evaluation of GANs and Diffusion Models for Generating X-rays
por: Schuit, Gregory, et al.
Publicado: (2025)
por: Schuit, Gregory, et al.
Publicado: (2025)
Predicting and Enhancing the Fairness of DNNs with the Curvature of Perceptual Manifolds
por: Ma, Yanbiao, et al.
Publicado: (2023)
por: Ma, Yanbiao, et al.
Publicado: (2023)
Refine-IQA: Multi-Stage Reinforcement Finetuning for Perceptual Image Quality Assessment
por: Jia, Ziheng, et al.
Publicado: (2025)
por: Jia, Ziheng, et al.
Publicado: (2025)
MAP-Diff: Multi-Anchor Guided Diffusion for Progressive 3D Whole-Body Low-Dose PET Denoising
por: Jing, Peiyuan, et al.
Publicado: (2026)
por: Jing, Peiyuan, et al.
Publicado: (2026)
Entropy Rectifying Guidance for Diffusion and Flow Models
por: Ifriqi, Tariq Berrada, et al.
Publicado: (2025)
por: Ifriqi, Tariq Berrada, et al.
Publicado: (2025)
Beyond Fixed Anchors: Precisely Erasing Concepts with Sibling Exclusive Counterparts
por: Zhang, Tong, et al.
Publicado: (2025)
por: Zhang, Tong, et al.
Publicado: (2025)
Frame Guidance: Training-Free Guidance for Frame-Level Control in Video Diffusion Models
por: Jang, Sangwon, et al.
Publicado: (2025)
por: Jang, Sangwon, et al.
Publicado: (2025)
Perceptual Group Tokenizer: Building Perception with Iterative Grouping
por: Deng, Zhiwei, et al.
Publicado: (2023)
por: Deng, Zhiwei, et al.
Publicado: (2023)
Unveiling and Mitigating Generalized Biases of DNNs through the Intrinsic Dimensions of Perceptual Manifolds
por: Ma, Yanbiao, et al.
Publicado: (2024)
por: Ma, Yanbiao, et al.
Publicado: (2024)
PMG: Progressive Motion Generation via Sparse Anchor Postures Curriculum Learning
por: Xi, Yingjie, et al.
Publicado: (2025)
por: Xi, Yingjie, et al.
Publicado: (2025)
How Much To Guide: Revisiting Adaptive Guidance in Classifier-Free Guidance Text-to-Vision Diffusion Models
por: Zhang, Huixuan, et al.
Publicado: (2025)
por: Zhang, Huixuan, et al.
Publicado: (2025)
TAR-TVG: Enhancing VLMs with Timestamp Anchor-Constrained Reasoning for Temporal Video Grounding
por: Guo, Chaohong, et al.
Publicado: (2025)
por: Guo, Chaohong, et al.
Publicado: (2025)
MotionShop: Zero-Shot Motion Transfer in Video Diffusion Models with Mixture of Score Guidance
por: Yesiltepe, Hidir, et al.
Publicado: (2024)
por: Yesiltepe, Hidir, et al.
Publicado: (2024)
Semantic Guidance Tuning for Text-To-Image Diffusion Models
por: Kang, Hyun, et al.
Publicado: (2023)
por: Kang, Hyun, et al.
Publicado: (2023)
Tell Me What to Track: Infusing Robust Language Guidance for Enhanced Referring Multi-Object Tracking
por: Huang, Wenjun, et al.
Publicado: (2024)
por: Huang, Wenjun, et al.
Publicado: (2024)
Inversion-DPO: Precise and Efficient Post-Training for Diffusion Models
por: Li, Zejian, et al.
Publicado: (2025)
por: Li, Zejian, et al.
Publicado: (2025)
Training-free Dense-Aligned Diffusion Guidance for Modular Conditional Image Synthesis
por: Wang, Zixuan, et al.
Publicado: (2025)
por: Wang, Zixuan, et al.
Publicado: (2025)
AttAnchor: Guiding Cross-Modal Token Alignment in VLMs with Attention Anchors
por: Zhang, Junyang, et al.
Publicado: (2025)
por: Zhang, Junyang, et al.
Publicado: (2025)
Causal Disentanglement-Inspired Degradation Representation Learning for Full-Reference Image Quality Assessment
por: Zhang, Zhen, et al.
Publicado: (2026)
por: Zhang, Zhen, et al.
Publicado: (2026)
Leveraging Geometric Visual Illusions as Perceptual Inductive Biases for Vision Models
por: Yang, Haobo, et al.
Publicado: (2025)
por: Yang, Haobo, et al.
Publicado: (2025)
Perceptual Quality-based Model Training under Annotator Label Uncertainty
por: Zhou, Chen, et al.
Publicado: (2024)
por: Zhou, Chen, et al.
Publicado: (2024)
Kaleido: Open-Sourced Multi-Subject Reference Video Generation Model
por: Zhang, Zhenxing, et al.
Publicado: (2025)
por: Zhang, Zhenxing, et al.
Publicado: (2025)
Parallel Rescaling: Rebalancing Consistency Guidance for Personalized Diffusion Models
por: Chae, JungWoo, et al.
Publicado: (2025)
por: Chae, JungWoo, et al.
Publicado: (2025)
Upsample Guidance: Scale Up Diffusion Models without Training
por: Hwang, Juno, et al.
Publicado: (2024)
por: Hwang, Juno, et al.
Publicado: (2024)
AnchorDiff: Training-Free Concept Grounding for MM-DiTs via Anchor-Based Graph Propagation
por: Zhang, Jian, et al.
Publicado: (2026)
por: Zhang, Jian, et al.
Publicado: (2026)
ContextGS: Compact 3D Gaussian Splatting with Anchor Level Context Model
por: Wang, Yufei, et al.
Publicado: (2024)
por: Wang, Yufei, et al.
Publicado: (2024)
A Simple Background Augmentation Method for Object Detection with Diffusion Model
por: Li, Yuhang, et al.
Publicado: (2024)
por: Li, Yuhang, et al.
Publicado: (2024)
Infusion: Preventing Customized Text-to-Image Diffusion from Overfitting
por: Zeng, Weili, et al.
Publicado: (2024)
por: Zeng, Weili, et al.
Publicado: (2024)
Ejemplares similares
-
Latent Guidance in Diffusion Models for Perceptual Evaluations
por: Saini, Shreshth, et al.
Publicado: (2025) -
T2SMark: Balancing Robustness and Diversity in Noise-as-Watermark for Diffusion Models
por: Yang, Jindong, et al.
Publicado: (2025) -
SKeDA: A Generative Watermarking Framework for Text-to-video Diffusion Models
por: Yang, Yang, et al.
Publicado: (2026) -
Diffusion Model with Perceptual Loss
por: Lin, Shanchuan, et al.
Publicado: (2023) -
Scaling-up Perceptual Video Quality Assessment
por: Jia, Ziheng, et al.
Publicado: (2025)