Exploring the Hidden Capacity of LLMs for One-Step Text Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mezentsev, Gleb, Oseledets, Ivan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SparseGrad: A Selective Method for Efficient Fine-tuning of MLP Layers
par: Chekalina, Viktoriia, et autres
Publié: (2024)
par: Chekalina, Viktoriia, et autres
Publié: (2024)
On the Spatial Structure of Mixture-of-Experts in Transformers
par: Bershatsky, Daniel, et autres
Publié: (2025)
par: Bershatsky, Daniel, et autres
Publié: (2025)
Large Language Model Hacking: Quantifying the Hidden Risks of Using LLMs for Text Annotation
par: Baumann, Joachim, et autres
Publié: (2025)
par: Baumann, Joachim, et autres
Publié: (2025)
LoTR: Low Tensor Rank Weight Adaptation
par: Bershatsky, Daniel, et autres
Publié: (2024)
par: Bershatsky, Daniel, et autres
Publié: (2024)
Direct-Inverse Prompting: Analyzing LLMs' Discriminative Capacity in Self-Improving Generation
par: Ahn, Jihyun Janice, et autres
Publié: (2024)
par: Ahn, Jihyun Janice, et autres
Publié: (2024)
Guided Score identity Distillation for Data-Free One-Step Text-to-Image Generation
par: Zhou, Mingyuan, et autres
Publié: (2024)
par: Zhou, Mingyuan, et autres
Publié: (2024)
Step-DPO: Step-wise Preference Optimization for Long-chain Reasoning of LLMs
par: Lai, Xin, et autres
Publié: (2024)
par: Lai, Xin, et autres
Publié: (2024)
Hidden in the Haystack: Smaller Needles are More Difficult for LLMs to Find
par: Bianchi, Owen, et autres
Publié: (2025)
par: Bianchi, Owen, et autres
Publié: (2025)
FS-DFM: Fast and Accurate Long Text Generation with Few-Step Diffusion Language Models
par: Monsefi, Amin Karimi, et autres
Publié: (2025)
par: Monsefi, Amin Karimi, et autres
Publié: (2025)
Counterfactual Evaluation Reveals Hidden Capability Profiles in Clinical LLMs and Agents
par: Turk, Matt
Publié: (2026)
par: Turk, Matt
Publié: (2026)
Your Transformer is Secretly Linear
par: Razzhigaev, Anton, et autres
Publié: (2024)
par: Razzhigaev, Anton, et autres
Publié: (2024)
Unraveling Text Generation in LLMs: A Stochastic Differential Equation Approach
par: Zhang, Yukun
Publié: (2024)
par: Zhang, Yukun
Publié: (2024)
Spotting LLMs With Binoculars: Zero-Shot Detection of Machine-Generated Text
par: Hans, Abhimanyu, et autres
Publié: (2024)
par: Hans, Abhimanyu, et autres
Publié: (2024)
The Hidden Signal of Verifier Strictness: Controlling and Improving Step-Wise Verification via Selective Latent Steering
par: Zhou, Yefan, et autres
Publié: (2026)
par: Zhou, Yefan, et autres
Publié: (2026)
From Associations to Activations: Comparing Behavioral and Hidden-State Semantic Geometry in LLMs
par: Schiekiera, Louis, et autres
Publié: (2026)
par: Schiekiera, Louis, et autres
Publié: (2026)
Text-ADBench: Text Anomaly Detection Benchmark based on LLMs Embedding
par: Xiao, Feng, et autres
Publié: (2025)
par: Xiao, Feng, et autres
Publié: (2025)
When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Generation
par: Goren, Shani, et autres
Publié: (2026)
par: Goren, Shani, et autres
Publié: (2026)
Teaching LLMs for Step-Level Automatic Math Correction via Reinforcement Learning
par: Li, Junsong, et autres
Publié: (2025)
par: Li, Junsong, et autres
Publié: (2025)
UProp: Investigating the Uncertainty Propagation of LLMs in Multi-Step Agentic Decision-Making
par: Duan, Jinhao, et autres
Publié: (2025)
par: Duan, Jinhao, et autres
Publié: (2025)
Reinforcement Learning for Diffusion LLMs with Entropy-Guided Step Selection and Stepwise Advantages
par: Kunde, Vishnu Teja, et autres
Publié: (2026)
par: Kunde, Vishnu Teja, et autres
Publié: (2026)
Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations
par: Wang, Peiyi, et autres
Publié: (2023)
par: Wang, Peiyi, et autres
Publié: (2023)
A Case Study Exploring the Current Landscape of Synthetic Medical Record Generation with Commercial LLMs
par: Lin, Yihan, et autres
Publié: (2025)
par: Lin, Yihan, et autres
Publié: (2025)
Self-Evaluating LLMs for Multi-Step Tasks: Stepwise Confidence Estimation for Failure Detection
par: Mavi, Vaibhav, et autres
Publié: (2025)
par: Mavi, Vaibhav, et autres
Publié: (2025)
StepFun-Formalizer: Unlocking the Autoformalization Potential of LLMs through Knowledge-Reasoning Fusion
par: Wu, Yutong, et autres
Publié: (2025)
par: Wu, Yutong, et autres
Publié: (2025)
SEUF: Is Unlearning One Expert Enough for Mixture-of-Experts LLMs?
par: Zhuang, Haomin, et autres
Publié: (2024)
par: Zhuang, Haomin, et autres
Publié: (2024)
Can LLMs Convert Graphs to Text-Attributed Graphs?
par: Wang, Zehong, et autres
Publié: (2024)
par: Wang, Zehong, et autres
Publié: (2024)
Comparing Specialised Small and General Large Language Models on Text Classification: 100 Labelled Samples to Achieve Break-Even Performance
par: Pecher, Branislav, et autres
Publié: (2024)
par: Pecher, Branislav, et autres
Publié: (2024)
Exploring Design Choices for Building Language-Specific LLMs
par: Tejaswi, Atula, et autres
Publié: (2024)
par: Tejaswi, Atula, et autres
Publié: (2024)
HuatuoGPT-II, One-stage Training for Medical Adaption of LLMs
par: Chen, Junying, et autres
Publié: (2023)
par: Chen, Junying, et autres
Publié: (2023)
Wings: Learning Multimodal LLMs without Text-only Forgetting
par: Zhang, Yi-Kai, et autres
Publié: (2024)
par: Zhang, Yi-Kai, et autres
Publié: (2024)
OneGen: Efficient One-Pass Unified Generation and Retrieval for LLMs
par: Zhang, Jintian, et autres
Publié: (2024)
par: Zhang, Jintian, et autres
Publié: (2024)
Scalable Cross-Entropy Loss for Sequential Recommendations with Large Item Catalogs
par: Mezentsev, Gleb, et autres
Publié: (2024)
par: Mezentsev, Gleb, et autres
Publié: (2024)
RECE: Reduced Cross-Entropy Loss for Large-Catalogue Sequential Recommenders
par: Gusak, Danil, et autres
Publié: (2024)
par: Gusak, Danil, et autres
Publié: (2024)
Better as Generators Than Classifiers: Leveraging LLMs and Synthetic Data for Low-Resource Multilingual Classification
par: Pecher, Branislav, et autres
Publié: (2026)
par: Pecher, Branislav, et autres
Publié: (2026)
Too Big to Think: Capacity, Memorization, and Generalization in Pre-Trained Transformers
par: Barron, Joshua, et autres
Publié: (2025)
par: Barron, Joshua, et autres
Publié: (2025)
Multi-Turn Code Generation Through Single-Step Rewards
par: Jain, Arnav Kumar, et autres
Publié: (2025)
par: Jain, Arnav Kumar, et autres
Publié: (2025)
PREF: Reference-Free Evaluation of Personalised Text Generation in LLMs
par: Fu, Xiao, et autres
Publié: (2025)
par: Fu, Xiao, et autres
Publié: (2025)
LaDiR: Latent Diffusion Enhances LLMs for Text Reasoning
par: Kang, Haoqiang, et autres
Publié: (2025)
par: Kang, Haoqiang, et autres
Publié: (2025)
Calibrating LLMs for Text-to-SQL Parsing by Leveraging Sub-clause Frequencies
par: Liu, Terrance, et autres
Publié: (2025)
par: Liu, Terrance, et autres
Publié: (2025)
LegalLens: Leveraging LLMs for Legal Violation Identification in Unstructured Text
par: Bernsohn, Dor, et autres
Publié: (2024)
par: Bernsohn, Dor, et autres
Publié: (2024)
Documents similaires
-
SparseGrad: A Selective Method for Efficient Fine-tuning of MLP Layers
par: Chekalina, Viktoriia, et autres
Publié: (2024) -
On the Spatial Structure of Mixture-of-Experts in Transformers
par: Bershatsky, Daniel, et autres
Publié: (2025) -
Large Language Model Hacking: Quantifying the Hidden Risks of Using LLMs for Text Annotation
par: Baumann, Joachim, et autres
Publié: (2025) -
LoTR: Low Tensor Rank Weight Adaptation
par: Bershatsky, Daniel, et autres
Publié: (2024) -
Direct-Inverse Prompting: Analyzing LLMs' Discriminative Capacity in Self-Improving Generation
par: Ahn, Jihyun Janice, et autres
Publié: (2024)