Masked Completion via Structured Diffusion with White-Box Transformers
Fuente:
arXiv
Guardado en:
| Autores principales: | Pai, Druv, Wu, Ziyang, Buchanan, Sam, Yu, Yaodong, Ma, Yi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
White-Box Transformers via Sparse Rate Reduction: Compression Is All There Is?
por: Yu, Yaodong, et al.
Publicado: (2023)
por: Yu, Yaodong, et al.
Publicado: (2023)
On the Edge of Memorization in Diffusion Models
por: Buchanan, Sam, et al.
Publicado: (2025)
por: Buchanan, Sam, et al.
Publicado: (2025)
Attention-Only Transformers via Unrolled Subspace Denoising
por: Wang, Peng, et al.
Publicado: (2025)
por: Wang, Peng, et al.
Publicado: (2025)
Token Statistics Transformer: Linear-Time Attention via Variational Rate Reduction
por: Wu, Ziyang, et al.
Publicado: (2024)
por: Wu, Ziyang, et al.
Publicado: (2024)
Scaling White-Box Transformers for Vision
por: Yang, Jinrui, et al.
Publicado: (2024)
por: Yang, Jinrui, et al.
Publicado: (2024)
A Global Geometric Analysis of Maximal Coding Rate Reduction
por: Wang, Peng, et al.
Publicado: (2024)
por: Wang, Peng, et al.
Publicado: (2024)
Active-Dormant Attention Heads: Mechanistically Demystifying Extreme-Token Phenomena in LLMs
por: Guo, Tianyu, et al.
Publicado: (2024)
por: Guo, Tianyu, et al.
Publicado: (2024)
White-Box Diffusion Transformer for single-cell RNA-seq generation
por: Cui, Zhuorui, et al.
Publicado: (2024)
por: Cui, Zhuorui, et al.
Publicado: (2024)
Diffusion-BBO: Diffusion-Based Inverse Modeling for Online Black-Box Optimization
por: Wu, Dongxia, et al.
Publicado: (2024)
por: Wu, Dongxia, et al.
Publicado: (2024)
Unlocking Interpretability for RF Sensing: A Complex-Valued White-Box Transformer
por: Zhang, Xie, et al.
Publicado: (2025)
por: Zhang, Xie, et al.
Publicado: (2025)
Beyond Masked and Unmasked: Discrete Diffusion Models via Partial Masking
por: Chao, Chen-Hao, et al.
Publicado: (2025)
por: Chao, Chen-Hao, et al.
Publicado: (2025)
Where to Mask: Structure-Guided Masking for Graph Masked Autoencoders
por: Liu, Chuang, et al.
Publicado: (2024)
por: Liu, Chuang, et al.
Publicado: (2024)
Independent and Decentralized Learning in Markov Potential Games
por: Maheshwari, Chinmay, et al.
Publicado: (2022)
por: Maheshwari, Chinmay, et al.
Publicado: (2022)
Beyond Scores: Proximal Diffusion Models
por: Fang, Zhenghan, et al.
Publicado: (2025)
por: Fang, Zhenghan, et al.
Publicado: (2025)
Learning Generation Orders for Masked Discrete Diffusion Models via Variational Inference
por: Fox, David, et al.
Publicado: (2026)
por: Fox, David, et al.
Publicado: (2026)
Canonical Factors for Hybrid Neural Fields
por: Yi, Brent, et al.
Publicado: (2023)
por: Yi, Brent, et al.
Publicado: (2023)
Masked BRep Autoencoder via Hierarchical Graph Transformer
por: Li, Yifei, et al.
Publicado: (2026)
por: Li, Yifei, et al.
Publicado: (2026)
Learning Expressive Random Feature Models via Parametrized Activations
por: Ma, Zailin, et al.
Publicado: (2024)
por: Ma, Zailin, et al.
Publicado: (2024)
Robust Guided Diffusion for Offline Black-Box Optimization
por: Chen, Can Sam, et al.
Publicado: (2024)
por: Chen, Can Sam, et al.
Publicado: (2024)
Are Linear Regression Models White Box and Interpretable?
por: Salih, Ahmed M, et al.
Publicado: (2024)
por: Salih, Ahmed M, et al.
Publicado: (2024)
Benchmarking Instance-Centric Counterfactual Algorithms for XAI: From White Box to Black Box
por: Moreira, Catarina, et al.
Publicado: (2022)
por: Moreira, Catarina, et al.
Publicado: (2022)
A Diffusion Model for Regular Time Series Generation from Irregular Data with Completion and Masking
por: Fadlon, Gal, et al.
Publicado: (2025)
por: Fadlon, Gal, et al.
Publicado: (2025)
Mask Is What DLLM Needs: A Masked Data Training Paradigm for Diffusion LLMs
por: Ma, Linrui, et al.
Publicado: (2026)
por: Ma, Linrui, et al.
Publicado: (2026)
Operational Feature Fingerprints of Graph Datasets via a White-Box Signal-Subspace Probe
por: Xiong, Yuchen, et al.
Publicado: (2026)
por: Xiong, Yuchen, et al.
Publicado: (2026)
On the Role of Attention Masks and LayerNorm in Transformers
por: Wu, Xinyi, et al.
Publicado: (2024)
por: Wu, Xinyi, et al.
Publicado: (2024)
Turning Black Box into White Box: Dataset Distillation Leaks
por: Chen, Huajie, et al.
Publicado: (2026)
por: Chen, Huajie, et al.
Publicado: (2026)
Integrating White and Black Box Techniques for Interpretable Machine Learning
por: Vernon, Eric M., et al.
Publicado: (2024)
por: Vernon, Eric M., et al.
Publicado: (2024)
On the Trainability of Masked Diffusion Language Models via Blockwise Locality
por: Wang, Yuxiang, et al.
Publicado: (2026)
por: Wang, Yuxiang, et al.
Publicado: (2026)
On the Generalization Properties of Learning the Random Feature Models with Learnable Activation Functions
por: Ma, Zailin, et al.
Publicado: (2025)
por: Ma, Zailin, et al.
Publicado: (2025)
DUEL: Exact Likelihood for Masked Diffusion via Deterministic Unmasking
por: Turok, Gilad, et al.
Publicado: (2026)
por: Turok, Gilad, et al.
Publicado: (2026)
EdgeMask-DG*: Learning Domain-Invariant Graph Structures via Adversarial Edge Masking
por: Bhattacharya, Rishabh, et al.
Publicado: (2026)
por: Bhattacharya, Rishabh, et al.
Publicado: (2026)
Self-Speculative Masked Diffusions
por: Campbell, Andrew, et al.
Publicado: (2025)
por: Campbell, Andrew, et al.
Publicado: (2025)
Fast Training of Diffusion Models with Masked Transformers
por: Zheng, Hongkai, et al.
Publicado: (2023)
por: Zheng, Hongkai, et al.
Publicado: (2023)
Curriculum Learning for Efficient Chain-of-Thought Distillation via Structure-Aware Masking and GRPO
por: Yu, Bowen, et al.
Publicado: (2026)
por: Yu, Bowen, et al.
Publicado: (2026)
Differentially Private Representation Learning via Image Captioning
por: Sander, Tom, et al.
Publicado: (2024)
por: Sander, Tom, et al.
Publicado: (2024)
What's in a Prior? Learned Proximal Networks for Inverse Problems
por: Fang, Zhenghan, et al.
Publicado: (2023)
por: Fang, Zhenghan, et al.
Publicado: (2023)
Towards White Box Deep Learning
por: Satkiewicz, Maciej
Publicado: (2024)
por: Satkiewicz, Maciej
Publicado: (2024)
From Black-Box to White-Box: Control-Theoretic Neural Network Interpretability
por: Moon, Jihoon
Publicado: (2025)
por: Moon, Jihoon
Publicado: (2025)
Collab-RAG: Boosting Retrieval-Augmented Generation for Complex Question Answering via White-Box and Black-Box LLM Collaboration
por: Xu, Ran, et al.
Publicado: (2025)
por: Xu, Ran, et al.
Publicado: (2025)
Backdooring Masked Diffusion Language Models
por: Cao, Daniel Yiming, et al.
Publicado: (2026)
por: Cao, Daniel Yiming, et al.
Publicado: (2026)
Ejemplares similares
-
White-Box Transformers via Sparse Rate Reduction: Compression Is All There Is?
por: Yu, Yaodong, et al.
Publicado: (2023) -
On the Edge of Memorization in Diffusion Models
por: Buchanan, Sam, et al.
Publicado: (2025) -
Attention-Only Transformers via Unrolled Subspace Denoising
por: Wang, Peng, et al.
Publicado: (2025) -
Token Statistics Transformer: Linear-Time Attention via Variational Rate Reduction
por: Wu, Ziyang, et al.
Publicado: (2024) -
Scaling White-Box Transformers for Vision
por: Yang, Jinrui, et al.
Publicado: (2024)