Leveraging Pretrained Language Models as Energy Functions for Glauber Dynamics Text Diffusion
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kathuria, Tarun, Kumar, Sachin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Revisiting Multilingual Data Mixtures in Language Model Pretraining
par: Foroutan, Negar, et autres
Publié: (2025)
par: Foroutan, Negar, et autres
Publié: (2025)
Glauber Generative Model: Discrete Diffusion Models via Binary Classification
par: Varma, Harshit, et autres
Publié: (2024)
par: Varma, Harshit, et autres
Publié: (2024)
Mixing Times of Glauber Dynamics on Masked Language Models
par: Sana, Suvadip, et autres
Publié: (2026)
par: Sana, Suvadip, et autres
Publié: (2026)
Meta-Tool: Efficient Few-Shot Tool Adaptation for Small Language Models
par: Kumar, Sachin
Publié: (2026)
par: Kumar, Sachin
Publié: (2026)
Energy-Based Diffusion Language Models for Text Generation
par: Xu, Minkai, et autres
Publié: (2024)
par: Xu, Minkai, et autres
Publié: (2024)
Local and Mixing-Based Algorithms for Gaussian Graphical Model Selection from Glauber Dynamics
par: Tirukkonda, Vignesh, et autres
Publié: (2024)
par: Tirukkonda, Vignesh, et autres
Publié: (2024)
Dissecting embedding method: learning higher-order structures from data
par: Tupikina, Liubov, et autres
Publié: (2024)
par: Tupikina, Liubov, et autres
Publié: (2024)
Forget to Flourish: Leveraging Machine-Unlearning on Pretrained Language Models for Privacy Leakage
par: Rashid, Md Rafi Ur, et autres
Publié: (2024)
par: Rashid, Md Rafi Ur, et autres
Publié: (2024)
SCM: Sleep-Consolidated Memory with Algorithmic Forgetting for Large Language Models
par: Shinde, Saish Sachin
Publié: (2026)
par: Shinde, Saish Sachin
Publié: (2026)
Distilled Pretraining: A modern lens of Data, In-Context Learning and Test-Time Scaling
par: Goyal, Sachin, et autres
Publié: (2025)
par: Goyal, Sachin, et autres
Publié: (2025)
Generalizable and Stable Finetuning of Pretrained Language Models on Low-Resource Texts
par: Somayajula, Sai Ashish, et autres
Publié: (2024)
par: Somayajula, Sai Ashish, et autres
Publié: (2024)
P^3SUM: Preserving Author's Perspective in News Summarization with Diffusion Language Models
par: Liu, Yuhan, et autres
Publié: (2023)
par: Liu, Yuhan, et autres
Publié: (2023)
When Should We Introduce Safety Interventions During Pretraining?
par: Sam, Dylan, et autres
Publié: (2026)
par: Sam, Dylan, et autres
Publié: (2026)
NoteContrast: Contrastive Language-Diagnostic Pretraining for Medical Text
par: Kailas, Prajwal, et autres
Publié: (2024)
par: Kailas, Prajwal, et autres
Publié: (2024)
Advantage Weighted Matching: Aligning RL with Pretraining in Diffusion Models
par: Xue, Shuchen, et autres
Publié: (2025)
par: Xue, Shuchen, et autres
Publié: (2025)
A Granular Study of Safety Pretraining under Model Abliteration
par: Agnihotri, Shashank, et autres
Publié: (2025)
par: Agnihotri, Shashank, et autres
Publié: (2025)
Analyzing Similarity Metrics for Data Selection for Language Model Pretraining
par: Sam, Dylan, et autres
Publié: (2025)
par: Sam, Dylan, et autres
Publié: (2025)
Benchmarking Optimizers for Large Language Model Pretraining
par: Semenov, Andrei, et autres
Publié: (2025)
par: Semenov, Andrei, et autres
Publié: (2025)
Unsupervised Diffusion Solver for Combinatorial Optimization via Combinatorial Adjoint Matching
par: Feng, Shengyu, et autres
Publié: (2026)
par: Feng, Shengyu, et autres
Publié: (2026)
Sharpness-Aware Pretraining Mitigates Catastrophic Forgetting
par: Watts, Ishaan, et autres
Publié: (2026)
par: Watts, Ishaan, et autres
Publié: (2026)
Loss Functions in Diffusion Models: A Comparative Study
par: Kumar, Dibyanshu, et autres
Publié: (2025)
par: Kumar, Dibyanshu, et autres
Publié: (2025)
Leveraging Large Language Models for Node Generation in Few-Shot Learning on Text-Attributed Graphs
par: Yu, Jianxiang, et autres
Publié: (2023)
par: Yu, Jianxiang, et autres
Publié: (2023)
Dynamic Loss-Based Sample Reweighting for Improved Large Language Model Pretraining
par: Sow, Daouda, et autres
Publié: (2025)
par: Sow, Daouda, et autres
Publié: (2025)
To Memorize or to Retrieve: Scaling Laws for RAG-Considerate Pretraining
par: Singh, Karan, et autres
Publié: (2026)
par: Singh, Karan, et autres
Publié: (2026)
Pretrained-Guided Conditional Diffusion Models for Microbiome Data Analysis
par: Shi, Xinyuan, et autres
Publié: (2024)
par: Shi, Xinyuan, et autres
Publié: (2024)
Pretraining Scaling Laws for Generative Evaluations of Language Models
par: Schaeffer, Rylan, et autres
Publié: (2025)
par: Schaeffer, Rylan, et autres
Publié: (2025)
Diffusion-Guided Pretraining for Brain Graph Foundation Models
par: Wei, Xinxu, et autres
Publié: (2026)
par: Wei, Xinxu, et autres
Publié: (2026)
AVID: Adapting Video Diffusion Models to World Models
par: Rigter, Marc, et autres
Publié: (2024)
par: Rigter, Marc, et autres
Publié: (2024)
Rethinking Specificity in SBDD: Leveraging Delta Score and Energy-Guided Diffusion
par: Gao, Bowen, et autres
Publié: (2024)
par: Gao, Bowen, et autres
Publié: (2024)
Analyzing Memorization in Large Language Models through the Lens of Model Attribution
par: Menta, Tarun Ram, et autres
Publié: (2025)
par: Menta, Tarun Ram, et autres
Publié: (2025)
Energy Efficient Protein Language Models: Leveraging Small Language Models with LoRA for Controllable Protein Generation
par: Shah, Aayush, et autres
Publié: (2024)
par: Shah, Aayush, et autres
Publié: (2024)
Energy Considerations for Large Pretrained Neural Networks
par: Mei, Leo, et autres
Publié: (2025)
par: Mei, Leo, et autres
Publié: (2025)
Discrete Diffusion Language Model for Efficient Text Summarization
par: Dat, Do Huu, et autres
Publié: (2024)
par: Dat, Do Huu, et autres
Publié: (2024)
Latent Diffusion Pretraining for Crystal Property Prediction
par: Mukherjee, Shrimon, et autres
Publié: (2026)
par: Mukherjee, Shrimon, et autres
Publié: (2026)
EdiText: Controllable Coarse-to-Fine Text Editing with Diffusion Language Models
par: Lee, Che Hyun, et autres
Publié: (2025)
par: Lee, Che Hyun, et autres
Publié: (2025)
In-Context Symbolic Regression: Leveraging Large Language Models for Function Discovery
par: Merler, Matteo, et autres
Publié: (2024)
par: Merler, Matteo, et autres
Publié: (2024)
WhisTLE: Deeply Supervised, Text-Only Domain Adaptation for Pretrained Speech Recognition Transformers
par: Pandey, Akshat, et autres
Publié: (2025)
par: Pandey, Akshat, et autres
Publié: (2025)
Tracing the Representation Geometry of Language Models from Pretraining to Post-training
par: Li, Melody Zixuan, et autres
Publié: (2025)
par: Li, Melody Zixuan, et autres
Publié: (2025)
Pretrained Image-Text Models are Secretly Video Captioners
par: Zhang, Chunhui, et autres
Publié: (2025)
par: Zhang, Chunhui, et autres
Publié: (2025)
Enhancing Sentiment Analysis in Bengali Texts: A Hybrid Approach Using Lexicon-Based Algorithm and Pretrained Language Model Bangla-BERT
par: Mahmud, Hemal, et autres
Publié: (2024)
par: Mahmud, Hemal, et autres
Publié: (2024)
Documents similaires
-
Revisiting Multilingual Data Mixtures in Language Model Pretraining
par: Foroutan, Negar, et autres
Publié: (2025) -
Glauber Generative Model: Discrete Diffusion Models via Binary Classification
par: Varma, Harshit, et autres
Publié: (2024) -
Mixing Times of Glauber Dynamics on Masked Language Models
par: Sana, Suvadip, et autres
Publié: (2026) -
Meta-Tool: Efficient Few-Shot Tool Adaptation for Small Language Models
par: Kumar, Sachin
Publié: (2026) -
Energy-Based Diffusion Language Models for Text Generation
par: Xu, Minkai, et autres
Publié: (2024)