Diffusion-based Visual Anagram as Multi-task Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xu, Zhiyuan, Chen, Yinhe, Gao, Huan-ang, Zhao, Weiyan, Zhang, Guiyu, Zhao, Hao |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FairDiff: Fair Segmentation with Point-Image Diffusion
par: Li, Wenyi, et autres
Publié: (2024)
par: Li, Wenyi, et autres
Publié: (2024)
Ctrl-U: Robust Conditional Image Generation via Uncertainty-aware Reward Modeling
par: Zhang, Guiyu, et autres
Publié: (2024)
par: Zhang, Guiyu, et autres
Publié: (2024)
Visual Anagrams: Generating Multi-View Optical Illusions with Diffusion Models
par: Geng, Daniel, et autres
Publié: (2023)
par: Geng, Daniel, et autres
Publié: (2023)
Dual-frame Fluid Motion Estimation with Test-time Optimization and Zero-divergence Loss
par: Zhang, Yifei, et autres
Publié: (2024)
par: Zhang, Yifei, et autres
Publié: (2024)
SCP-Diff: Spatial-Categorical Joint Prior for Diffusion Based Semantic Image Synthesis
par: Gao, Huan-ang, et autres
Publié: (2024)
par: Gao, Huan-ang, et autres
Publié: (2024)
Training-Free Model Merging for Multi-target Domain Adaptation
par: Li, Wenyi, et autres
Publié: (2024)
par: Li, Wenyi, et autres
Publié: (2024)
Challenger: Affordable Adversarial Driving Video Generation
par: Xu, Zhiyuan, et autres
Publié: (2025)
par: Xu, Zhiyuan, et autres
Publié: (2025)
Alias-free 4D Gaussian Splatting
par: Chen, Zilong, et autres
Publié: (2025)
par: Chen, Zilong, et autres
Publié: (2025)
AVD2: Accident Video Diffusion for Accident Video Description
par: Li, Cheng, et autres
Publié: (2025)
par: Li, Cheng, et autres
Publié: (2025)
Visual Anagrams Reveal Hidden Differences in Holistic Shape Processing Across Vision Models
par: Doshi, Fenil R., et autres
Publié: (2025)
par: Doshi, Fenil R., et autres
Publié: (2025)
PartRM: Modeling Part-Level Dynamics with Large Cross-State Reconstruction Model
par: Gao, Mingju, et autres
Publié: (2025)
par: Gao, Mingju, et autres
Publié: (2025)
FB-4D: Spatial-Temporal Coherent Dynamic 3D Content Generation with Feature Banks
par: Li, Jinwei, et autres
Publié: (2025)
par: Li, Jinwei, et autres
Publié: (2025)
SGOR: Outlier Removal by Leveraging Semantic and Geometric Information for Robust Point Cloud Registration
par: Zhao, Guiyu, et autres
Publié: (2024)
par: Zhao, Guiyu, et autres
Publié: (2024)
P-MapNet: Far-seeing Map Generator Enhanced by both SDMap and HDMap Priors
par: Jiang, Zhou, et autres
Publié: (2024)
par: Jiang, Zhou, et autres
Publié: (2024)
SA-GS: Scale-Adaptive Gaussian Splatting for Training-Free Anti-Aliasing
par: Song, Xiaowei, et autres
Publié: (2024)
par: Song, Xiaowei, et autres
Publié: (2024)
Progressive Correspondence Regenerator for Robust 3D Registration
par: Zhao, Guiyu, et autres
Publié: (2025)
par: Zhao, Guiyu, et autres
Publié: (2025)
RGM: Reconstructing High-fidelity 3D Car Assets with Relightable 3D-GS Generative Model from a Single Image
par: Chen, Xiaoxue, et autres
Publié: (2024)
par: Chen, Xiaoxue, et autres
Publié: (2024)
Benchmarking PhD-Level Coding in 3D Geometric Computer Vision
par: Li, Wenyi, et autres
Publié: (2026)
par: Li, Wenyi, et autres
Publié: (2026)
Afford-X: Generalizable and Slim Affordance Reasoning for Task-oriented Manipulation
par: Zhu, Xiaomeng, et autres
Publié: (2025)
par: Zhu, Xiaomeng, et autres
Publié: (2025)
VRHCF: Cross-Source Point Cloud Registration via Voxel Representation and Hierarchical Correspondence Filtering
par: Zhao, Guiyu, et autres
Publié: (2024)
par: Zhao, Guiyu, et autres
Publié: (2024)
Cross-PCR: A Robust Cross-Source Point Cloud Registration Framework
par: Zhao, Guiyu, et autres
Publié: (2024)
par: Zhao, Guiyu, et autres
Publié: (2024)
Rip-NeRF: Anti-aliasing Radiance Fields with Ripmap-Encoded Platonic Solids
par: Liu, Junchen, et autres
Publié: (2024)
par: Liu, Junchen, et autres
Publié: (2024)
Elite360M: Efficient 360 Multi-task Learning via Bi-projection Fusion and Cross-task Collaboration
par: Ai, Hao, et autres
Publié: (2024)
par: Ai, Hao, et autres
Publié: (2024)
Latency-aware Road Anomaly Segmentation in Videos: A Photorealistic Dataset and New Metrics
par: Tian, Beiwen, et autres
Publié: (2024)
par: Tian, Beiwen, et autres
Publié: (2024)
Prototype-Based Low Altitude UAV Semantic Segmentation
par: Zhang, Da, et autres
Publié: (2026)
par: Zhang, Da, et autres
Publié: (2026)
Cross-Layer Feature Pyramid Transformer for Small Object Detection in Aerial Images
par: Du, Zewen, et autres
Publié: (2024)
par: Du, Zewen, et autres
Publié: (2024)
PreAfford: Universal Affordance-Based Pre-Grasping for Diverse Objects and Environments
par: Ding, Kairui, et autres
Publié: (2024)
par: Ding, Kairui, et autres
Publié: (2024)
DICEPTION: A Generalist Diffusion Model for Visual Perceptual Tasks
par: Zhao, Canyu, et autres
Publié: (2025)
par: Zhao, Canyu, et autres
Publié: (2025)
Learning an Implicit Physics Model for Image-based Fluid Simulation
par: Jia, Emily Yue-Ting, et autres
Publié: (2025)
par: Jia, Emily Yue-Ting, et autres
Publié: (2025)
OpenDPR: Open-Vocabulary Change Detection via Vision-Centric Diffusion-Guided Prototype Retrieval for Remote Sensing Imagery
par: Guo, Qi, et autres
Publié: (2026)
par: Guo, Qi, et autres
Publié: (2026)
Ultraman: Single Image 3D Human Reconstruction with Ultra Speed and Detail
par: Chen, Mingjin, et autres
Publié: (2024)
par: Chen, Mingjin, et autres
Publié: (2024)
PAM: A Pose-Appearance-Motion Engine for Sim-to-Real HOI Video Generation
par: Gao, Mingju, et autres
Publié: (2026)
par: Gao, Mingju, et autres
Publié: (2026)
MultiTaskVIF: Segmentation-oriented visible and infrared image fusion via multi-task learning
par: Zhao, Zixian, et autres
Publié: (2025)
par: Zhao, Zixian, et autres
Publié: (2025)
Scene-Agnostic Object-Centric Representation Learning for 3D Gaussian Splatting
par: Hsu, Tsuheng, et autres
Publié: (2026)
par: Hsu, Tsuheng, et autres
Publié: (2026)
Self-Reflective Reinforcement Learning for Diffusion-based Image Reasoning Generation
par: Pan, Jiadong, et autres
Publié: (2025)
par: Pan, Jiadong, et autres
Publié: (2025)
Reusing Attention for One-stage Lane Topology Understanding
par: Li, Yang, et autres
Publié: (2025)
par: Li, Yang, et autres
Publié: (2025)
PTalker: Personalized Speech-Driven 3D Talking Head Animation via Style Disentanglement and Modality Alignment
par: Wang, Bin, et autres
Publié: (2025)
par: Wang, Bin, et autres
Publié: (2025)
Delving into Mapping Uncertainty for Mapless Trajectory Prediction
par: Zhang, Zongzheng, et autres
Publié: (2025)
par: Zhang, Zongzheng, et autres
Publié: (2025)
One Object, Multiple Lies: A Benchmark for Cross-task Adversarial Attack on Unified Vision-Language Models
par: Zhao, Jiale, et autres
Publié: (2025)
par: Zhao, Jiale, et autres
Publié: (2025)
AugRefer: Advancing 3D Visual Grounding via Cross-Modal Augmentation and Spatial Relation-based Referring
par: Wang, Xinyi, et autres
Publié: (2025)
par: Wang, Xinyi, et autres
Publié: (2025)
Documents similaires
-
FairDiff: Fair Segmentation with Point-Image Diffusion
par: Li, Wenyi, et autres
Publié: (2024) -
Ctrl-U: Robust Conditional Image Generation via Uncertainty-aware Reward Modeling
par: Zhang, Guiyu, et autres
Publié: (2024) -
Visual Anagrams: Generating Multi-View Optical Illusions with Diffusion Models
par: Geng, Daniel, et autres
Publié: (2023) -
Dual-frame Fluid Motion Estimation with Test-time Optimization and Zero-divergence Loss
par: Zhang, Yifei, et autres
Publié: (2024) -
SCP-Diff: Spatial-Categorical Joint Prior for Diffusion Based Semantic Image Synthesis
par: Gao, Huan-ang, et autres
Publié: (2024)