DeepLatent: Think with Images via Parallel Latent Visual Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Lu, Dongchen, Li, Zhimo, Shu, Mao, Cao, Huo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LanteRn: Latent Visual Structured Reasoning
di: Viveiros, André G., et al.
Pubblicazione: (2026)
di: Viveiros, André G., et al.
Pubblicazione: (2026)
ThinkAct: Vision-Language-Action Reasoning via Reinforced Visual Latent Planning
di: Huang, Chi-Pin, et al.
Pubblicazione: (2025)
di: Huang, Chi-Pin, et al.
Pubblicazione: (2025)
LatentHDR: Decoupling Exposure from Diffusion via Conditional Latent-to-Latent Mapping for Text/Image-to-Panoramic HDR
di: Fekri, Pedram, et al.
Pubblicazione: (2026)
di: Fekri, Pedram, et al.
Pubblicazione: (2026)
LatentUM: Unleashing the Potential of Interleaved Cross-Modal Reasoning via a Latent-Space Unified Model
di: Jin, Jiachun, et al.
Pubblicazione: (2026)
di: Jin, Jiachun, et al.
Pubblicazione: (2026)
Histopathology Image Normalization via Latent Manifold Compaction
di: Zhang, Xiaolong, et al.
Pubblicazione: (2026)
di: Zhang, Xiaolong, et al.
Pubblicazione: (2026)
What's Holding Back Latent Visual Reasoning?
di: Viveiros, André G., et al.
Pubblicazione: (2026)
di: Viveiros, André G., et al.
Pubblicazione: (2026)
LatentExplainer: Explaining Latent Representations in Deep Generative Models with Multimodal Large Language Models
di: Zhu, Mengdan, et al.
Pubblicazione: (2024)
di: Zhu, Mengdan, et al.
Pubblicazione: (2024)
Fast-ThinkAct: Efficient Vision-Language-Action Reasoning via Verbalizable Latent Planning
di: Huang, Chi-Pin, et al.
Pubblicazione: (2026)
di: Huang, Chi-Pin, et al.
Pubblicazione: (2026)
ReLaX: Reasoning with Latent Exploration for Large Reasoning Models
di: Zhang, Shimin, et al.
Pubblicazione: (2025)
di: Zhang, Shimin, et al.
Pubblicazione: (2025)
Guess What I Think: Streamlined EEG-to-Image Generation with Latent Diffusion Models
di: Lopez, Eleonora, et al.
Pubblicazione: (2024)
di: Lopez, Eleonora, et al.
Pubblicazione: (2024)
JLT: Clean-Latent Prediction in Latent Diffusion Transformers
di: Fu, Funing, et al.
Pubblicazione: (2026)
di: Fu, Funing, et al.
Pubblicazione: (2026)
Latent Diffusion Inversion Requires Understanding the Latent Space
di: Rao, Mingxing, et al.
Pubblicazione: (2025)
di: Rao, Mingxing, et al.
Pubblicazione: (2025)
LatentGAN Autoencoder: Learning Disentangled Latent Distribution
di: Kalwar, Sanket, et al.
Pubblicazione: (2022)
di: Kalwar, Sanket, et al.
Pubblicazione: (2022)
Control-oriented Clustering of Visual Latent Representation
di: Qi, Han, et al.
Pubblicazione: (2024)
di: Qi, Han, et al.
Pubblicazione: (2024)
Latent Forcing: Reordering the Diffusion Trajectory for Pixel-Space Image Generation
di: Baade, Alan, et al.
Pubblicazione: (2026)
di: Baade, Alan, et al.
Pubblicazione: (2026)
Latent Schrodinger Bridge: Prompting Latent Diffusion for Fast Unpaired Image-to-Image Translation
di: Kim, Jeongsol, et al.
Pubblicazione: (2024)
di: Kim, Jeongsol, et al.
Pubblicazione: (2024)
What's in a Latent? Leveraging Diffusion Latent Space for Domain Generalization
di: Thomas, Xavier, et al.
Pubblicazione: (2025)
di: Thomas, Xavier, et al.
Pubblicazione: (2025)
LatentDiff: Scaling Semantic Dataset Comparison to Millions of Images
di: Flora, James, et al.
Pubblicazione: (2026)
di: Flora, James, et al.
Pubblicazione: (2026)
An Approach Towards Learning K-means-friendly Deep Latent Representation
di: Roy, Debapriya
Pubblicazione: (2024)
di: Roy, Debapriya
Pubblicazione: (2024)
Orchid: Image Latent Diffusion for Joint Appearance and Geometry Generation
di: Krishnan, Akshay, et al.
Pubblicazione: (2025)
di: Krishnan, Akshay, et al.
Pubblicazione: (2025)
Evaluating the Efficiency of Latent Spaces via the Coupling-Matrix
di: Yavuz, Mehmet Can, et al.
Pubblicazione: (2025)
di: Yavuz, Mehmet Can, et al.
Pubblicazione: (2025)
Continuity-Preserving Convolutional Autoencoders for Learning Continuous Latent Dynamical Models from Images
di: Zhu, Aiqing, et al.
Pubblicazione: (2025)
di: Zhu, Aiqing, et al.
Pubblicazione: (2025)
Local Scale Equivariance with Latent Deep Equilibrium Canonicalizer
di: Rahman, Md Ashiqur, et al.
Pubblicazione: (2025)
di: Rahman, Md Ashiqur, et al.
Pubblicazione: (2025)
SLICE: Semantic Latent Injection via Compartmentalized Embedding for Image Watermarking
di: Gao, Zheng, et al.
Pubblicazione: (2026)
di: Gao, Zheng, et al.
Pubblicazione: (2026)
Aligning Latent Spaces with Flow Priors
di: Li, Yizhuo, et al.
Pubblicazione: (2025)
di: Li, Yizhuo, et al.
Pubblicazione: (2025)
DDLP: Unsupervised Object-Centric Video Prediction with Deep Dynamic Latent Particles
di: Daniel, Tal, et al.
Pubblicazione: (2023)
di: Daniel, Tal, et al.
Pubblicazione: (2023)
Unifying Image Counterfactuals and Feature Attributions with Latent-Space Adversarial Attacks
di: Goldwasser, Jeremy, et al.
Pubblicazione: (2025)
di: Goldwasser, Jeremy, et al.
Pubblicazione: (2025)
OlmoEarth: Stable Latent Image Modeling for Multimodal Earth Observation
di: Herzog, Henry, et al.
Pubblicazione: (2025)
di: Herzog, Henry, et al.
Pubblicazione: (2025)
Efficient Video Diffusion Models via Content-Frame Motion-Latent Decomposition
di: Yu, Sihyun, et al.
Pubblicazione: (2024)
di: Yu, Sihyun, et al.
Pubblicazione: (2024)
Disentanglement of Biological and Technical Factors via Latent Space Rotation in Clinical Imaging Improves Disease Pattern Discovery
di: Pan, Jeanny, et al.
Pubblicazione: (2025)
di: Pan, Jeanny, et al.
Pubblicazione: (2025)
LatentMan: Generating Consistent Animated Characters using Image Diffusion Models
di: Eldesokey, Abdelrahman, et al.
Pubblicazione: (2023)
di: Eldesokey, Abdelrahman, et al.
Pubblicazione: (2023)
Language-Enhanced Latent Representations for Out-of-Distribution Detection in Autonomous Driving
di: Mao, Zhenjiang, et al.
Pubblicazione: (2024)
di: Mao, Zhenjiang, et al.
Pubblicazione: (2024)
Equivariant Latent Alignment via Flow Matching under Group Symmetries
di: Kim, Sunghyun, et al.
Pubblicazione: (2026)
di: Kim, Sunghyun, et al.
Pubblicazione: (2026)
Generative Latent Diffusion for Efficient Spatiotemporal Data Reduction
di: Li, Xiao, et al.
Pubblicazione: (2025)
di: Li, Xiao, et al.
Pubblicazione: (2025)
Reliable Thinking with Images
di: Li, Haobin, et al.
Pubblicazione: (2026)
di: Li, Haobin, et al.
Pubblicazione: (2026)
Q-Tacit: Image Quality Assessment via Latent Visual Reasoning
di: Jiang, Yuxuan, et al.
Pubblicazione: (2026)
di: Jiang, Yuxuan, et al.
Pubblicazione: (2026)
Bridging Compressed Image Latents and Multimodal Large Language Models
di: Kao, Chia-Hao, et al.
Pubblicazione: (2024)
di: Kao, Chia-Hao, et al.
Pubblicazione: (2024)
FreqMark: Invisible Image Watermarking via Frequency Based Optimization in Latent Space
di: Guo, Yiyang, et al.
Pubblicazione: (2024)
di: Guo, Yiyang, et al.
Pubblicazione: (2024)
Gradient-Guided Exploration of Generative Model's Latent Space for Controlled Iris Image Augmentations
di: Mitcheff, Mahsa, et al.
Pubblicazione: (2025)
di: Mitcheff, Mahsa, et al.
Pubblicazione: (2025)
MedIL: Implicit Latent Spaces for Generating Heterogeneous Medical Images at Arbitrary Resolutions
di: Spears, Tyler, et al.
Pubblicazione: (2025)
di: Spears, Tyler, et al.
Pubblicazione: (2025)
Documenti analoghi
-
LanteRn: Latent Visual Structured Reasoning
di: Viveiros, André G., et al.
Pubblicazione: (2026) -
ThinkAct: Vision-Language-Action Reasoning via Reinforced Visual Latent Planning
di: Huang, Chi-Pin, et al.
Pubblicazione: (2025) -
LatentHDR: Decoupling Exposure from Diffusion via Conditional Latent-to-Latent Mapping for Text/Image-to-Panoramic HDR
di: Fekri, Pedram, et al.
Pubblicazione: (2026) -
LatentUM: Unleashing the Potential of Interleaved Cross-Modal Reasoning via a Latent-Space Unified Model
di: Jin, Jiachun, et al.
Pubblicazione: (2026) -
Histopathology Image Normalization via Latent Manifold Compaction
di: Zhang, Xiaolong, et al.
Pubblicazione: (2026)