Enregistré dans:
| Auteurs principaux: | Nguyen, Trung, Leng, Yan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2502.16385 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Offline Preference Optimization via Maximum Marginal Likelihood Estimation
par: Najafi, Saeed, et autres
Publié: (2025)
par: Najafi, Saeed, et autres
Publié: (2025)
The Linear Representation Hypothesis and the Geometry of Large Language Models
par: Park, Kiho, et autres
Publié: (2023)
par: Park, Kiho, et autres
Publié: (2023)
Lizard: An Efficient Linearization Framework for Large Language Models
par: Van Nguyen, Chien, et autres
Publié: (2025)
par: Van Nguyen, Chien, et autres
Publié: (2025)
Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models
par: Bello, Femi, et autres
Publié: (2025)
par: Bello, Femi, et autres
Publié: (2025)
Structured Pruning for Diverse Best-of-N Reasoning Optimization
par: Nguyen, Hieu Trung, et autres
Publié: (2025)
par: Nguyen, Hieu Trung, et autres
Publié: (2025)
Task-driven Layerwise Additive Activation Intervention
par: Nguyen, Hieu Trung, et autres
Publié: (2025)
par: Nguyen, Hieu Trung, et autres
Publié: (2025)
Exploring the Linear Subspace Hypothesis in Gender Bias Mitigation
par: Vargas, Francisco, et autres
Publié: (2020)
par: Vargas, Francisco, et autres
Publié: (2020)
How Many Features Can a Language Model Store Under the Linear Representation Hypothesis?
par: Garg, Nikhil, et autres
Publié: (2026)
par: Garg, Nikhil, et autres
Publié: (2026)
Towards Understanding Multi-Task Learning (Generalization) of LLMs via Detecting and Exploring Task-Specific Neurons
par: Leng, Yongqi, et autres
Publié: (2024)
par: Leng, Yongqi, et autres
Publié: (2024)
Explainable Disentangled Representation Learning for Generalizable Authorship Attribution in the Era of Generative AI
par: Man, Hieu, et autres
Publié: (2026)
par: Man, Hieu, et autres
Publié: (2026)
Optimizing Multi-Stage Language Models for Effective Text Retrieval
par: Trung, Quang Hoang, et autres
Publié: (2024)
par: Trung, Quang Hoang, et autres
Publié: (2024)
Adaptive Two-Phase Finetuning LLMs for Japanese Legal Text Retrieval
par: Trung, Quang Hoang, et autres
Publié: (2024)
par: Trung, Quang Hoang, et autres
Publié: (2024)
On the Origins of Linear Representations in Large Language Models
par: Jiang, Yibo, et autres
Publié: (2024)
par: Jiang, Yibo, et autres
Publié: (2024)
Reasoning Planning for Language Models
par: Nguyen, Bao, et autres
Publié: (2025)
par: Nguyen, Bao, et autres
Publié: (2025)
HypoBench: Towards Systematic and Principled Benchmarking for Hypothesis Generation
par: Liu, Haokun, et autres
Publié: (2025)
par: Liu, Haokun, et autres
Publié: (2025)
Momentum SVGD-EM for Accelerated Maximum Marginal Likelihood Estimation
par: Rozzio, Adam, et autres
Publié: (2026)
par: Rozzio, Adam, et autres
Publié: (2026)
Large Language Model-Enhanced Algorithm Selection: Towards Comprehensive Algorithm Representation
par: Wu, Xingyu, et autres
Publié: (2023)
par: Wu, Xingyu, et autres
Publié: (2023)
Don't Read Everything: A Curvature-Conditioned Query for Linear Attention
par: Le, Dong, et autres
Publié: (2026)
par: Le, Dong, et autres
Publié: (2026)
Mixture-of-Personas Language Models for Population Simulation
par: Bui, Ngoc, et autres
Publié: (2025)
par: Bui, Ngoc, et autres
Publié: (2025)
Adaptive Rollout Allocation for Online Reinforcement Learning with Verifiable Rewards
par: Nguyen, Hieu Trung, et autres
Publié: (2026)
par: Nguyen, Hieu Trung, et autres
Publié: (2026)
Towards Generalising Neural Topical Representations
par: Yang, Xiaohao, et autres
Publié: (2023)
par: Yang, Xiaohao, et autres
Publié: (2023)
NoveltyRank: A Retrieval-Augmented Framework for Conceptual Novelty Estimation in AI Research
par: Yan, Zhengxu, et autres
Publié: (2025)
par: Yan, Zhengxu, et autres
Publié: (2025)
Interacting Particle Langevin Algorithm for Maximum Marginal Likelihood Estimation
par: Akyildiz, Ö. Deniz, et autres
Publié: (2023)
par: Akyildiz, Ö. Deniz, et autres
Publié: (2023)
SEA: Sparse Linear Attention with Estimated Attention Mask
par: Lee, Heejun, et autres
Publié: (2023)
par: Lee, Heejun, et autres
Publié: (2023)
MIC: Maximizing Informational Capacity in Adaptive Representations via Isotropic Subspace Alignment
par: Hong, Dang Nguyen, et autres
Publié: (2026)
par: Hong, Dang Nguyen, et autres
Publié: (2026)
Large Language Models Encode Semantics and Alignment in Linearly Separable Representations
par: Saglam, Baturay, et autres
Publié: (2025)
par: Saglam, Baturay, et autres
Publié: (2025)
Cross-Tokenizer Likelihood Scoring Algorithms for Language Model Distillation
par: Phan, Buu, et autres
Publié: (2025)
par: Phan, Buu, et autres
Publié: (2025)
VITRO: Vocabulary Inversion for Time-series Representation Optimization
par: Bellos, Filippos, et autres
Publié: (2024)
par: Bellos, Filippos, et autres
Publié: (2024)
Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning
par: Xie, Wanyun, et autres
Publié: (2025)
par: Xie, Wanyun, et autres
Publié: (2025)
Scientific Hypothesis Generation and Validation: Methods, Datasets, and Future Directions
par: Kulkarni, Adithya, et autres
Publié: (2025)
par: Kulkarni, Adithya, et autres
Publié: (2025)
Exploiting LLMs for Automatic Hypothesis Assessment via a Logit-Based Calibrated Prior
par: Gong, Yue, et autres
Publié: (2025)
par: Gong, Yue, et autres
Publié: (2025)
Towards Efficient Active Learning in NLP via Pretrained Representations
par: Vysogorets, Artem, et autres
Publié: (2024)
par: Vysogorets, Artem, et autres
Publié: (2024)
ReCaLL: Membership Inference via Relative Conditional Log-Likelihoods
par: Xie, Roy, et autres
Publié: (2024)
par: Xie, Roy, et autres
Publié: (2024)
Revisiting the Superficial Alignment Hypothesis
par: Raghavendra, Mohit, et autres
Publié: (2024)
par: Raghavendra, Mohit, et autres
Publié: (2024)
Maximum Score Routing For Mixture-of-Experts
par: Dong, Bowen, et autres
Publié: (2025)
par: Dong, Bowen, et autres
Publié: (2025)
Failure Modes of Maximum Entropy RLHF
par: Çağatan, Ömer Veysel, et autres
Publié: (2025)
par: Çağatan, Ömer Veysel, et autres
Publié: (2025)
Disentangling the Roles of Representation and Selection in Data Pruning
par: Du, Yupei, et autres
Publié: (2025)
par: Du, Yupei, et autres
Publié: (2025)
Memories Retrieved from Many Paths: A Multi-Prefix Framework for Robust Detection of Training Data Leakage in Large Language Models
par: Dang, Trung Cuong, et autres
Publié: (2025)
par: Dang, Trung Cuong, et autres
Publié: (2025)
What Do Language Models Learn in Context? The Structured Task Hypothesis
par: Li, Jiaoda, et autres
Publié: (2024)
par: Li, Jiaoda, et autres
Publié: (2024)
Learning State-Tracking from Code Using Linear RNNs
par: Siems, Julien, et autres
Publié: (2026)
par: Siems, Julien, et autres
Publié: (2026)
Documents similaires
-
Offline Preference Optimization via Maximum Marginal Likelihood Estimation
par: Najafi, Saeed, et autres
Publié: (2025) -
The Linear Representation Hypothesis and the Geometry of Large Language Models
par: Park, Kiho, et autres
Publié: (2023) -
Lizard: An Efficient Linearization Framework for Large Language Models
par: Van Nguyen, Chien, et autres
Publié: (2025) -
Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models
par: Bello, Femi, et autres
Publié: (2025) -
Structured Pruning for Diverse Best-of-N Reasoning Optimization
par: Nguyen, Hieu Trung, et autres
Publié: (2025)