Oracle Noise: Faster Semantic Spherical Alignment for Interpretable Latent Optimization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Haosen, Chen, Wenshuo, Wang, Lei, Liang, Shaofeng, Jia, Haozhe, Yue, Yutao |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Guided Path Sampling: Steering Diffusion Models Back on Track with Principled Path Guidance
par: Li, Haosen, et autres
Publié: (2025)
par: Li, Haosen, et autres
Publié: (2025)
$Z^2$-Sampling: Zero-Cost Zigzag Trajectories for Semantic Alignment in Diffusion Models
par: Li, Haosen, et autres
Publié: (2026)
par: Li, Haosen, et autres
Publié: (2026)
POLARIS: Projection-Orthogonal Least Squares for Robust and Adaptive Inversion in Diffusion Models
par: Chen, Wenshuo, et autres
Publié: (2025)
par: Chen, Wenshuo, et autres
Publié: (2025)
Delta Score Matters! Spatial Adaptive Multi Guidance in Diffusion Models
par: Li, Haosen, et autres
Publié: (2026)
par: Li, Haosen, et autres
Publié: (2026)
Learning to Think in Physics: Breaking Shortcut Learning in Scientific Diffusion via Representation Alignment
par: Jia, Haozhe, et autres
Publié: (2026)
par: Jia, Haozhe, et autres
Publié: (2026)
Physics-Informed Representation Alignment for Sparse Radio-Map Reconstruction
par: Jia, Haozhe, et autres
Publié: (2025)
par: Jia, Haozhe, et autres
Publié: (2025)
LUMA: Low-Dimension Unified Motion Alignment with Dual-Path Anchoring for Text-to-Motion Diffusion Model
par: Jia, Haozhe, et autres
Publié: (2025)
par: Jia, Haozhe, et autres
Publié: (2025)
Free-T2M: Robust Text-to-Motion Generation for Humanoid Robots via Frequency-Domain
par: Chen, Wenshuo, et autres
Publié: (2025)
par: Chen, Wenshuo, et autres
Publié: (2025)
Before the Body Moves: Learning Anticipatory Joint Intent for Language-Conditioned Humanoid Control
par: Jia, Haozhe, et autres
Publié: (2026)
par: Jia, Haozhe, et autres
Publié: (2026)
ECHO: Edge-Cloud Humanoid Orchestration for Language-to-Motion Control
par: Jia, Haozhe, et autres
Publié: (2026)
par: Jia, Haozhe, et autres
Publié: (2026)
CoEmoGen: Towards Semantically-Coherent and Scalable Emotional Image Content Generation
par: Yuan, Kaishen, et autres
Publié: (2025)
par: Yuan, Kaishen, et autres
Publié: (2025)
ANT: Adaptive Neural Temporal-Aware Text-to-Motion Model
par: Chen, Wenshuo, et autres
Publié: (2025)
par: Chen, Wenshuo, et autres
Publié: (2025)
RadioFlow: Efficient Radio Map Construction Framework with Flow Matching
par: Jia, Haozhe, et autres
Publié: (2025)
par: Jia, Haozhe, et autres
Publié: (2025)
HOTS3D: Hyper-Spherical Optimal Transport for Semantic Alignment of Text-to-3D Generation
par: Li, Zezeng, et autres
Publié: (2024)
par: Li, Zezeng, et autres
Publié: (2024)
OracleFusion: Assisting the Decipherment of Oracle Bone Script with Structurally Constrained Semantic Typography
par: Li, Caoshuo, et autres
Publié: (2025)
par: Li, Caoshuo, et autres
Publié: (2025)
Neural Electromagnetic Fields for High-Resolution Material Parameter Reconstruction
par: Chen, Zhe, et autres
Publié: (2026)
par: Chen, Zhe, et autres
Publié: (2026)
SPARS3R: Semantic Prior Alignment and Regularization for Sparse 3D Reconstruction
par: Tang, Yutao, et autres
Publié: (2024)
par: Tang, Yutao, et autres
Publié: (2024)
Less Data, Faster Convergence: Goal-Driven Data Optimization for Multimodal Instruction Tuning
par: Wu, Rujie, et autres
Publié: (2026)
par: Wu, Rujie, et autres
Publié: (2026)
PointAlign: Feature-Level Alignment Regularization for 3D Vision-Language Models
par: Su, Yuanhao, et autres
Publié: (2026)
par: Su, Yuanhao, et autres
Publié: (2026)
Adaptive Caching for Faster Video Generation with Diffusion Transformers
par: Kahatapitiya, Kumara, et autres
Publié: (2024)
par: Kahatapitiya, Kumara, et autres
Publié: (2024)
Guarding the Gate: ConceptGuard Battles Concept-Level Backdoors in Concept Bottleneck Models
par: Lai, Songning, et autres
Publié: (2024)
par: Lai, Songning, et autres
Publié: (2024)
VITAL: Visual-Semantic Dual Supervision for Enhanced and Interpretable Latent Reasoning in Medical MLLMs
par: Li, Qiaoru, et autres
Publié: (2026)
par: Li, Qiaoru, et autres
Publié: (2026)
Suppressing Prior-Comparison Hallucinations in Radiology Report Generation via Semantically Decoupled Latent Steering
par: Li, Ao, et autres
Publié: (2026)
par: Li, Ao, et autres
Publié: (2026)
Semantic-Enriched Latent Visual Reasoning
par: Xu, Tianrun, et autres
Publié: (2026)
par: Xu, Tianrun, et autres
Publié: (2026)
BioD2C: A Dual-level Semantic Consistency Constraint Framework for Biomedical VQA
par: Ji, Zhengyang, et autres
Publié: (2025)
par: Ji, Zhengyang, et autres
Publié: (2025)
Align-KD: Distilling Cross-Modal Alignment Knowledge for Mobile Vision-Language Model
par: Feng, Qianhan, et autres
Publié: (2024)
par: Feng, Qianhan, et autres
Publié: (2024)
Interpretable Oracle Bone Script Decipherment through Radical and Pictographic Analysis with LVLMs
par: Peng, Kaixin, et autres
Publié: (2025)
par: Peng, Kaixin, et autres
Publié: (2025)
Cognitive Disentanglement for Referring Multi-Object Tracking
par: Liang, Shaofeng, et autres
Publié: (2025)
par: Liang, Shaofeng, et autres
Publié: (2025)
Diff-Oracle: Deciphering Oracle Bone Scripts with Controllable Diffusion Model
par: Li, Jing, et autres
Publié: (2023)
par: Li, Jing, et autres
Publié: (2023)
Noise Matters: Optimizing Matching Noise for Diffusion Classifiers
par: Wang, Yanghao, et autres
Publié: (2025)
par: Wang, Yanghao, et autres
Publié: (2025)
DNAEdit: Direct Noise Alignment for Text-Guided Rectified Flow Editing
par: Xie, Chenxi, et autres
Publié: (2025)
par: Xie, Chenxi, et autres
Publié: (2025)
Adaptive Feature Selection for No-Reference Image Quality Assessment by Mitigating Semantic Noise Sensitivity
par: Li, Xudong, et autres
Publié: (2023)
par: Li, Xudong, et autres
Publié: (2023)
LatentUMM: Dual Latent Alignment for Unified Multimodal Models
par: Luo, Yinyi, et autres
Publié: (2026)
par: Luo, Yinyi, et autres
Publié: (2026)
GSAlign: Geometric and Semantic Alignment Network for Aerial-Ground Person Re-Identification
par: Li, Qiao, et autres
Publié: (2025)
par: Li, Qiao, et autres
Publié: (2025)
LIA-X: Interpretable Latent Portrait Animator
par: Wang, Yaohui, et autres
Publié: (2025)
par: Wang, Yaohui, et autres
Publié: (2025)
UniAlignment: Semantic Alignment for Unified Image Generation, Understanding, Manipulation and Perception
par: Song, Xinyang, et autres
Publié: (2025)
par: Song, Xinyang, et autres
Publié: (2025)
Know Your Step: Faster and Better Alignment for Flow Matching Models via Step-aware Advantages
par: Yue, Zhixiong, et autres
Publié: (2026)
par: Yue, Zhixiong, et autres
Publié: (2026)
Aligning Latent Geometry for Spherical Flow Matching in Image Generation
par: Meral, Tuna Han Salih, et autres
Publié: (2026)
par: Meral, Tuna Han Salih, et autres
Publié: (2026)
Faster Diffusion via Temporal Attention Decomposition
par: Liu, Haozhe, et autres
Publié: (2024)
par: Liu, Haozhe, et autres
Publié: (2024)
OracleAgent: A Multimodal Reasoning Agent for Oracle Bone Script Research
par: Li, Caoshuo, et autres
Publié: (2025)
par: Li, Caoshuo, et autres
Publié: (2025)
Documents similaires
-
Guided Path Sampling: Steering Diffusion Models Back on Track with Principled Path Guidance
par: Li, Haosen, et autres
Publié: (2025) -
$Z^2$-Sampling: Zero-Cost Zigzag Trajectories for Semantic Alignment in Diffusion Models
par: Li, Haosen, et autres
Publié: (2026) -
POLARIS: Projection-Orthogonal Least Squares for Robust and Adaptive Inversion in Diffusion Models
par: Chen, Wenshuo, et autres
Publié: (2025) -
Delta Score Matters! Spatial Adaptive Multi Guidance in Diffusion Models
par: Li, Haosen, et autres
Publié: (2026) -
Learning to Think in Physics: Breaking Shortcut Learning in Scientific Diffusion via Representation Alignment
par: Jia, Haozhe, et autres
Publié: (2026)