Scaling Non-Parametric Sampling with Representation
Fuente:
arXiv
Salvato in:
| Autori principali: | Lu, Vincent, Truong, Aaron, Yun, Zeyu, Chen, Yubei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Variance-Covariance Regularization Improves Representation Learning
di: Zhu, Jiachen, et al.
Pubblicazione: (2023)
di: Zhu, Jiachen, et al.
Pubblicazione: (2023)
Cloning Deterministic Worlds: The Critical Role of Latent Geometry in Long-Horizon World Models
di: Xia, Zaishuo, et al.
Pubblicazione: (2025)
di: Xia, Zaishuo, et al.
Pubblicazione: (2025)
URLOST: Unsupervised Representation Learning without Stationarity or Topology
di: Yun, Zeyu, et al.
Pubblicazione: (2023)
di: Yun, Zeyu, et al.
Pubblicazione: (2023)
On Multi-Step Theorem Prediction via Non-Parametric Structural Priors
di: Zhao, Junbo, et al.
Pubblicazione: (2026)
di: Zhao, Junbo, et al.
Pubblicazione: (2026)
CodeBind: Decoupled Representation Learning for Multimodal Alignment with Unified Compositional Codebook
di: Chen, Zeyu, et al.
Pubblicazione: (2026)
di: Chen, Zeyu, et al.
Pubblicazione: (2026)
DreamCAD: Scaling Multi-modal CAD Generation using Differentiable Parametric Surfaces
di: Khan, Mohammad Sadil, et al.
Pubblicazione: (2026)
di: Khan, Mohammad Sadil, et al.
Pubblicazione: (2026)
PartSDF: Part-Based Implicit Neural Representation for Composite 3D Shape Parametrization and Optimization
di: Talabot, Nicolas, et al.
Pubblicazione: (2025)
di: Talabot, Nicolas, et al.
Pubblicazione: (2025)
Can GPT tell us why these images are synthesized? Empowering Multimodal Large Language Models for Forensics
di: He, Yiran, et al.
Pubblicazione: (2025)
di: He, Yiran, et al.
Pubblicazione: (2025)
Geometry-Aware State Space Model: A New Paradigm for Whole-Slide Image Representation
di: Chai, Enhui, et al.
Pubblicazione: (2026)
di: Chai, Enhui, et al.
Pubblicazione: (2026)
ReStNet: A Reusable & Stitchable Network for Dynamic Adaptation on IoT Devices
di: Wang, Maoyu, et al.
Pubblicazione: (2025)
di: Wang, Maoyu, et al.
Pubblicazione: (2025)
Proximal Vision Transformer: Enhancing Feature Representation through Two-Stage Manifold Geometry
di: Yun, Haoyu, et al.
Pubblicazione: (2025)
di: Yun, Haoyu, et al.
Pubblicazione: (2025)
Scaling View Synthesis Transformers
di: Kim, Evan, et al.
Pubblicazione: (2026)
di: Kim, Evan, et al.
Pubblicazione: (2026)
Language Models Can See Better: Visual Contrastive Decoding For LLM Multimodal Reasoning
di: Pang, Yuqi, et al.
Pubblicazione: (2025)
di: Pang, Yuqi, et al.
Pubblicazione: (2025)
GAIS: Frame-Level Gated Audio-Visual Integration with Semantic Variance-Scaled Perturbation for Text-Video Retrieval
di: Yang, Bowen, et al.
Pubblicazione: (2025)
di: Yang, Bowen, et al.
Pubblicazione: (2025)
MoTiC: Momentum Tightness and Contrast for Few-Shot Class-Incremental Learning
di: He, Zeyu, et al.
Pubblicazione: (2025)
di: He, Zeyu, et al.
Pubblicazione: (2025)
Contrastive Representation Distillation via Multi-Scale Feature Decoupling
di: Wang, Cuipeng, et al.
Pubblicazione: (2025)
di: Wang, Cuipeng, et al.
Pubblicazione: (2025)
Gen4Gen: Generative Data Pipeline for Generative Multi-Concept Composition
di: Yeh, Chun-Hsiao, et al.
Pubblicazione: (2024)
di: Yeh, Chun-Hsiao, et al.
Pubblicazione: (2024)
HexPlane Representation for 3D Semantic Scene Understanding
di: Chen, Zeren, et al.
Pubblicazione: (2025)
di: Chen, Zeren, et al.
Pubblicazione: (2025)
Diffusion Models and Representation Learning: A Survey
di: Fuest, Michael, et al.
Pubblicazione: (2024)
di: Fuest, Michael, et al.
Pubblicazione: (2024)
KineST: A Kinematics-guided Spatiotemporal State Space Model for Human Motion Tracking from Sparse Signals
di: Zhao, Shuting, et al.
Pubblicazione: (2025)
di: Zhao, Shuting, et al.
Pubblicazione: (2025)
Diffusion-Based Visual Art Creation: A Survey and New Perspectives
di: Wang, Bingyuan, et al.
Pubblicazione: (2024)
di: Wang, Bingyuan, et al.
Pubblicazione: (2024)
SOMA: Unifying Parametric Human Body Models
di: Saito, Jun, et al.
Pubblicazione: (2026)
di: Saito, Jun, et al.
Pubblicazione: (2026)
A Large-Scale Multimodal Dataset and Benchmarks for Human Activity Scene Understanding and Reasoning
di: Jiang, Siyang, et al.
Pubblicazione: (2025)
di: Jiang, Siyang, et al.
Pubblicazione: (2025)
A Large-Scale Empirical Study on Improving the Fairness of Image Classification Models
di: Yang, Junjie, et al.
Pubblicazione: (2024)
di: Yang, Junjie, et al.
Pubblicazione: (2024)
Score-Regularized Joint Sampling with Importance Weights for Flow Matching
di: Liu, Xinshuang, et al.
Pubblicazione: (2025)
di: Liu, Xinshuang, et al.
Pubblicazione: (2025)
BotaCLIP: Contrastive Learning for Botany-Aware Representation of Earth Observation Data
di: Cerna, Selene, et al.
Pubblicazione: (2025)
di: Cerna, Selene, et al.
Pubblicazione: (2025)
Superclass-Guided Representation Disentanglement for Spurious Correlation Mitigation
di: Liu, Chenruo, et al.
Pubblicazione: (2025)
di: Liu, Chenruo, et al.
Pubblicazione: (2025)
Equal is Not Always Fair: A New Perspective on Hyperspectral Representation Non-Uniformity
di: Quan, Wuzhou, et al.
Pubblicazione: (2025)
di: Quan, Wuzhou, et al.
Pubblicazione: (2025)
Non-negative Subspace Feature Representation for Few-shot Learning in Medical Imaging
di: Fan, Keqiang, et al.
Pubblicazione: (2024)
di: Fan, Keqiang, et al.
Pubblicazione: (2024)
Continual Gesture Learning without Data via Synthetic Feature Sampling
di: Lu, Zhenyu, et al.
Pubblicazione: (2024)
di: Lu, Zhenyu, et al.
Pubblicazione: (2024)
SEMT: Static-Expansion-Mesh Transformer Network Architecture for Remote Sensing Image Captioning
di: Truong, Khang, et al.
Pubblicazione: (2025)
di: Truong, Khang, et al.
Pubblicazione: (2025)
D-CoDe: Scaling Image-Pretrained VLMs to Video via Dynamic Compression and Question Decomposition
di: Huang, Yiyang, et al.
Pubblicazione: (2025)
di: Huang, Yiyang, et al.
Pubblicazione: (2025)
Scaling Language-Centric Omnimodal Representation Learning
di: Xiao, Chenghao, et al.
Pubblicazione: (2025)
di: Xiao, Chenghao, et al.
Pubblicazione: (2025)
Surveillance Video-Based Traffic Accident Detection Using Transformer Architecture
di: Singh, Tanu, et al.
Pubblicazione: (2025)
di: Singh, Tanu, et al.
Pubblicazione: (2025)
Explaining Human Comparisons using Alignment-Importance Heatmaps
di: Truong, Nhut, et al.
Pubblicazione: (2024)
di: Truong, Nhut, et al.
Pubblicazione: (2024)
SegMaFormer: A Hybrid State-Space and Transformer Model for Efficient Segmentation
di: Nguyen, Duy D., et al.
Pubblicazione: (2026)
di: Nguyen, Duy D., et al.
Pubblicazione: (2026)
LangXAI: Integrating Large Vision Models for Generating Textual Explanations to Enhance Explainability in Visual Perception Tasks
di: Nguyen, Truong Thanh Hung, et al.
Pubblicazione: (2024)
di: Nguyen, Truong Thanh Hung, et al.
Pubblicazione: (2024)
Scaling Image Tokenizers with Grouped Spherical Quantization
di: Wang, Jiangtao, et al.
Pubblicazione: (2024)
di: Wang, Jiangtao, et al.
Pubblicazione: (2024)
Unsupervised Video Continual Learning via Non-Parametric Deep Embedded Clustering
di: Kurpukdee, Nattapong, et al.
Pubblicazione: (2025)
di: Kurpukdee, Nattapong, et al.
Pubblicazione: (2025)
SurgVisAgent: Multimodal Agentic Model for Versatile Surgical Visual Enhancement
di: Lei, Zeyu, et al.
Pubblicazione: (2025)
di: Lei, Zeyu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Variance-Covariance Regularization Improves Representation Learning
di: Zhu, Jiachen, et al.
Pubblicazione: (2023) -
Cloning Deterministic Worlds: The Critical Role of Latent Geometry in Long-Horizon World Models
di: Xia, Zaishuo, et al.
Pubblicazione: (2025) -
URLOST: Unsupervised Representation Learning without Stationarity or Topology
di: Yun, Zeyu, et al.
Pubblicazione: (2023) -
On Multi-Step Theorem Prediction via Non-Parametric Structural Priors
di: Zhao, Junbo, et al.
Pubblicazione: (2026) -
CodeBind: Decoupled Representation Learning for Multimodal Alignment with Unified Compositional Codebook
di: Chen, Zeyu, et al.
Pubblicazione: (2026)