UENR-600K: A Large-Scale Physically Grounded Dataset for Nighttime Video Deraining
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Pei, Ci, Hai, Lin, Beibei, Song, Yiren, Shou, Mike Zheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
X-Humanoid: Robotize Human Videos to Generate Humanoid Videos at Scale
di: Yang, Pei, et al.
Pubblicazione: (2025)
di: Yang, Pei, et al.
Pubblicazione: (2025)
H2R-Grounder: A Paired-Data-Free Paradigm for Translating Human Interaction Videos into Physically Grounded Robot Videos
di: Ci, Hai, et al.
Pubblicazione: (2025)
di: Ci, Hai, et al.
Pubblicazione: (2025)
Steganalysis on Digital Watermarking: Is Your Defense Truly Impervious?
di: Yang, Pei, et al.
Pubblicazione: (2024)
di: Yang, Pei, et al.
Pubblicazione: (2024)
IDProtector: An Adversarial Noise Encoder to Protect Against ID-Preserving Image Generation
di: Song, Yiren, et al.
Pubblicazione: (2024)
di: Song, Yiren, et al.
Pubblicazione: (2024)
RingID: Rethinking Tree-Ring Watermarking for Enhanced Multi-Key Identification
di: Ci, Hai, et al.
Pubblicazione: (2024)
di: Ci, Hai, et al.
Pubblicazione: (2024)
WMAdapter: Adding WaterMark Control to Latent Diffusion Models
di: Ci, Hai, et al.
Pubblicazione: (2024)
di: Ci, Hai, et al.
Pubblicazione: (2024)
NightRain: Nighttime Video Deraining via Adaptive-Rain-Removal and Adaptive-Correction
di: Lin, Beibei, et al.
Pubblicazione: (2024)
di: Lin, Beibei, et al.
Pubblicazione: (2024)
Impossible Videos
di: Bai, Zechen, et al.
Pubblicazione: (2025)
di: Bai, Zechen, et al.
Pubblicazione: (2025)
RobotSeg: A Model and Dataset for Segmenting Robots in Image and Video
di: Mei, Haiyang, et al.
Pubblicazione: (2025)
di: Mei, Haiyang, et al.
Pubblicazione: (2025)
Anti-Reference: Universal and Immediate Defense Against Reference-Based Generation
di: Song, Yiren, et al.
Pubblicazione: (2024)
di: Song, Yiren, et al.
Pubblicazione: (2024)
OmniHumanoid: Streaming Cross-Embodiment Video Generation with Paired-Free Adaptation
di: Song, Yiren, et al.
Pubblicazione: (2026)
di: Song, Yiren, et al.
Pubblicazione: (2026)
Mitty: Diffusion-based Human-to-Robot Video Generation
di: Song, Yiren, et al.
Pubblicazione: (2025)
di: Song, Yiren, et al.
Pubblicazione: (2025)
VISTA: Triplet-Supervised Video Style Transfer with Diffusion Transformers
di: Song, Yiren, et al.
Pubblicazione: (2026)
di: Song, Yiren, et al.
Pubblicazione: (2026)
DiffSeg30k: A Multi-Turn Diffusion Editing Benchmark for Localized AIGC Detection
di: Ci, Hai, et al.
Pubblicazione: (2025)
di: Ci, Hai, et al.
Pubblicazione: (2025)
StreamingEffect: Real-Time Human-Centric Video Effect Generation
di: Song, Yiren, et al.
Pubblicazione: (2026)
di: Song, Yiren, et al.
Pubblicazione: (2026)
NDLPNet: A Location-Aware Nighttime Deraining Network and a Real-World Benchmark Dataset
di: Liu, Huichun, et al.
Pubblicazione: (2025)
di: Liu, Huichun, et al.
Pubblicazione: (2025)
Edit2Perceive: Image Editing Diffusion Models Are Strong Dense Perceivers
di: Shi, Yiqing, et al.
Pubblicazione: (2025)
di: Shi, Yiqing, et al.
Pubblicazione: (2025)
MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation
di: Song, Yiren, et al.
Pubblicazione: (2025)
di: Song, Yiren, et al.
Pubblicazione: (2025)
DiffSim: Taming Diffusion Models for Evaluating Visual Similarity
di: Song, Yiren, et al.
Pubblicazione: (2024)
di: Song, Yiren, et al.
Pubblicazione: (2024)
OmniConsistency: Learning Style-Agnostic Consistency from Paired Stylization Data
di: Song, Yiren, et al.
Pubblicazione: (2025)
di: Song, Yiren, et al.
Pubblicazione: (2025)
LayerTracer: Cognitive-Aligned Layered SVG Synthesis via Diffusion Transformer
di: Song, Yiren, et al.
Pubblicazione: (2025)
di: Song, Yiren, et al.
Pubblicazione: (2025)
WorldWander: Bridging Egocentric and Exocentric Worlds in Video Generation
di: Song, Quanjian, et al.
Pubblicazione: (2025)
di: Song, Quanjian, et al.
Pubblicazione: (2025)
Rethinking Nighttime Image Deraining via Learnable Color Space Transformation
di: Guan, Qiyuan, et al.
Pubblicazione: (2025)
di: Guan, Qiyuan, et al.
Pubblicazione: (2025)
Soap2Soap: Long Cinematic Video Remaking via Multi-Agent Collaboration
di: Song, Yiren, et al.
Pubblicazione: (2026)
di: Song, Yiren, et al.
Pubblicazione: (2026)
Seeing Beyond Haze: Generative Nighttime Image Dehazing
di: Lin, Beibei, et al.
Pubblicazione: (2025)
di: Lin, Beibei, et al.
Pubblicazione: (2025)
Image Watermarks are Removable Using Controllable Regeneration from Clean Noise
di: Liu, Yepeng, et al.
Pubblicazione: (2024)
di: Liu, Yepeng, et al.
Pubblicazione: (2024)
OmniPSD: Layered PSD Generation with Diffusion Transformer
di: Liu, Cheng, et al.
Pubblicazione: (2025)
di: Liu, Cheng, et al.
Pubblicazione: (2025)
ProcessPainter: Learn Painting Process from Sequence Data
di: Song, Yiren, et al.
Pubblicazione: (2024)
di: Song, Yiren, et al.
Pubblicazione: (2024)
PAI-Studio: Cinematic Video Background Replacement with Camera-Aware Motion
di: Gao, Heyuan, et al.
Pubblicazione: (2026)
di: Gao, Heyuan, et al.
Pubblicazione: (2026)
VLog: Video-Language Models by Generative Retrieval of Narration Vocabulary
di: Lin, Kevin Qinghong, et al.
Pubblicazione: (2025)
di: Lin, Kevin Qinghong, et al.
Pubblicazione: (2025)
SWEET: Sparse World Modeling with Image Editing for Embodied Task Execution
di: Song, Yiren, et al.
Pubblicazione: (2026)
di: Song, Yiren, et al.
Pubblicazione: (2026)
VideoMind: A Chain-of-LoRA Agent for Temporal-Grounded Video Reasoning
di: Liu, Ye, et al.
Pubblicazione: (2025)
di: Liu, Ye, et al.
Pubblicazione: (2025)
SynopGround: A Large-Scale Dataset for Multi-Paragraph Video Grounding from TV Dramas and Synopses
di: Tan, Chaolei, et al.
Pubblicazione: (2024)
di: Tan, Chaolei, et al.
Pubblicazione: (2024)
TPDiff: Temporal Pyramid Video Diffusion Model
di: Ran, Lingmin, et al.
Pubblicazione: (2025)
di: Ran, Lingmin, et al.
Pubblicazione: (2025)
OmniVTG: A Large-Scale Dataset and Training Paradigm for Open-World Video Temporal Grounding
di: Zheng, Minghang, et al.
Pubblicazione: (2026)
di: Zheng, Minghang, et al.
Pubblicazione: (2026)
Personalized Vision via Visual In-Context Learning
di: Jiang, Yuxin, et al.
Pubblicazione: (2025)
di: Jiang, Yuxin, et al.
Pubblicazione: (2025)
PANDA: Towards Generalist Video Anomaly Detection via Agentic AI Engineer
di: Yang, Zhiwei, et al.
Pubblicazione: (2025)
di: Yang, Zhiwei, et al.
Pubblicazione: (2025)
LiveCC: Learning Video LLM with Streaming Speech Transcription at Scale
di: Chen, Joya, et al.
Pubblicazione: (2025)
di: Chen, Joya, et al.
Pubblicazione: (2025)
Multi-human Interactive Talking Dataset
di: Zhu, Zeyu, et al.
Pubblicazione: (2025)
di: Zhu, Zeyu, et al.
Pubblicazione: (2025)
GlowGS: Generative Semantic Feature Learning for 3D Gaussian Splatting in Nighttime Glow Scenes
di: Lin, Beibei, et al.
Pubblicazione: (2026)
di: Lin, Beibei, et al.
Pubblicazione: (2026)
Documenti analoghi
-
X-Humanoid: Robotize Human Videos to Generate Humanoid Videos at Scale
di: Yang, Pei, et al.
Pubblicazione: (2025) -
H2R-Grounder: A Paired-Data-Free Paradigm for Translating Human Interaction Videos into Physically Grounded Robot Videos
di: Ci, Hai, et al.
Pubblicazione: (2025) -
Steganalysis on Digital Watermarking: Is Your Defense Truly Impervious?
di: Yang, Pei, et al.
Pubblicazione: (2024) -
IDProtector: An Adversarial Noise Encoder to Protect Against ID-Preserving Image Generation
di: Song, Yiren, et al.
Pubblicazione: (2024) -
RingID: Rethinking Tree-Ring Watermarking for Enhanced Multi-Key Identification
di: Ci, Hai, et al.
Pubblicazione: (2024)