Fewer Truncations Improve Language Modeling
Fuente:
arXiv
Guardado en:
| Autores principales: | Ding, Hantian, Wang, Zijian, Paolini, Giovanni, Kumar, Varun, Deoras, Anoop, Roth, Dan, Soatto, Stefano |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Empowering Multi-Turn Tool-Integrated Agentic Reasoning with Group Turn Policy Optimization
por: Ding, Yifeng, et al.
Publicado: (2025)
por: Ding, Yifeng, et al.
Publicado: (2025)
Lightweight reranking for language model generations
por: Jain, Siddhartha, et al.
Publicado: (2023)
por: Jain, Siddhartha, et al.
Publicado: (2023)
Lossless Token Sequence Compression via Meta-Tokens
por: Harvill, John, et al.
Publicado: (2025)
por: Harvill, John, et al.
Publicado: (2025)
Meanings and Feelings of Large Language Models: Observability of Latent States in Generative AI
por: Liu, Tian Yu, et al.
Publicado: (2024)
por: Liu, Tian Yu, et al.
Publicado: (2024)
Experience Sharing in Mutual Reinforcement Learning for Heterogeneous Language Models
por: Liu, Xiaoze, et al.
Publicado: (2026)
por: Liu, Xiaoze, et al.
Publicado: (2026)
Training Language Model Agents to Find Vulnerabilities with CTF-Dojo
por: Zhuo, Terry Yue, et al.
Publicado: (2025)
por: Zhuo, Terry Yue, et al.
Publicado: (2025)
Private Language Models via Truncated Laplacian Mechanism
por: Huang, Tianhao, et al.
Publicado: (2024)
por: Huang, Tianhao, et al.
Publicado: (2024)
MURPHY: Feedback-Aware GRPO with Retrospective Credit Assignment for Multi-Turn Code Generation
por: Ekbote, Chanakya, et al.
Publicado: (2025)
por: Ekbote, Chanakya, et al.
Publicado: (2025)
PICASO: Permutation-Invariant Context Composition with State Space Models
por: Liu, Tian Yu, et al.
Publicado: (2025)
por: Liu, Tian Yu, et al.
Publicado: (2025)
Cyber-Zero: Training Cybersecurity Agents without Runtime
por: Zhuo, Terry Yue, et al.
Publicado: (2025)
por: Zhuo, Terry Yue, et al.
Publicado: (2025)
Planning-Aware Code Infilling via Horizon-Length Prediction
por: Ding, Yifeng, et al.
Publicado: (2024)
por: Ding, Yifeng, et al.
Publicado: (2024)
ExecTune: Effective Steering of Black-Box LLMs with Guide Models
por: Lingam, Vijay, et al.
Publicado: (2026)
por: Lingam, Vijay, et al.
Publicado: (2026)
Linear Spaces of Meanings: Compositional Structures in Vision-Language Models
por: Trager, Matthew, et al.
Publicado: (2023)
por: Trager, Matthew, et al.
Publicado: (2023)
ReEval: Automatic Hallucination Evaluation for Retrieval-Augmented Large Language Models via Transferable Adversarial Attacks
por: Yu, Xiaodong, et al.
Publicado: (2023)
por: Yu, Xiaodong, et al.
Publicado: (2023)
STAR: Spectral Truncation and Rescale for Model Merging
por: Lee, Yu-Ang, et al.
Publicado: (2025)
por: Lee, Yu-Ang, et al.
Publicado: (2025)
Attention Speaks Volumes: Localizing and Mitigating Bias in Language Models
por: Adiga, Rishabh, et al.
Publicado: (2024)
por: Adiga, Rishabh, et al.
Publicado: (2024)
From Instructions to Constraints: Language Model Alignment with Automatic Constraint Verification
por: Wang, Fei, et al.
Publicado: (2024)
por: Wang, Fei, et al.
Publicado: (2024)
Training Language Models via Neural Cellular Automata
por: Lee, Dan, et al.
Publicado: (2026)
por: Lee, Dan, et al.
Publicado: (2026)
SAIL: Self-Improving Efficient Online Alignment of Large Language Models
por: Ding, Mucong, et al.
Publicado: (2024)
por: Ding, Mucong, et al.
Publicado: (2024)
Improving Consistency in Retrieval-Augmented Systems with Group Similarity Rewards
por: Hamman, Faisal, et al.
Publicado: (2025)
por: Hamman, Faisal, et al.
Publicado: (2025)
Recursive Introspection: Teaching Language Model Agents How to Self-Improve
por: Qu, Yuxiao, et al.
Publicado: (2024)
por: Qu, Yuxiao, et al.
Publicado: (2024)
Min-$k$ Sampling: Decoupling Truncation from Temperature Scaling via Relative Logit Dynamics
por: Ding, Yuanhao, et al.
Publicado: (2026)
por: Ding, Yuanhao, et al.
Publicado: (2026)
Reducing Credit Assignment Variance via Counterfactual Reasoning Paths
por: Ding, Fei, et al.
Publicado: (2026)
por: Ding, Fei, et al.
Publicado: (2026)
SPaR: Self-Play with Tree-Search Refinement to Improve Instruction-Following in Large Language Models
por: Cheng, Jiale, et al.
Publicado: (2024)
por: Cheng, Jiale, et al.
Publicado: (2024)
Reasoning is Periodicity? Improving Large Language Models Through Effective Periodicity Modeling
por: Dong, Yihong, et al.
Publicado: (2025)
por: Dong, Yihong, et al.
Publicado: (2025)
Surveying the Effects of Quality, Diversity, and Complexity in Synthetic Data From Large Language Models
por: Havrilla, Alex, et al.
Publicado: (2024)
por: Havrilla, Alex, et al.
Publicado: (2024)
Soft Self-Consistency Improves Language Model Agents
por: Wang, Han, et al.
Publicado: (2024)
por: Wang, Han, et al.
Publicado: (2024)
Evaluating NL2SQL via SQL2NL
por: Safarzadeh, Mohammadtaher, et al.
Publicado: (2025)
por: Safarzadeh, Mohammadtaher, et al.
Publicado: (2025)
ROCKET: Rapid Optimization via Calibration-guided Knapsack Enhanced Truncation for Efficient Model Compression
por: Ali, Ammar, et al.
Publicado: (2026)
por: Ali, Ammar, et al.
Publicado: (2026)
Explaining Datasets in Words: Statistical Models with Natural Language Parameters
por: Zhong, Ruiqi, et al.
Publicado: (2024)
por: Zhong, Ruiqi, et al.
Publicado: (2024)
CoLa: Learning to Interactively Collaborate with Large Language Models
por: Sharma, Abhishek, et al.
Publicado: (2025)
por: Sharma, Abhishek, et al.
Publicado: (2025)
Introducing Background Temperature to Characterise Hidden Randomness in Large Language Models
por: Messina, Alberto, et al.
Publicado: (2026)
por: Messina, Alberto, et al.
Publicado: (2026)
LLMs Meet Finance: Fine-Tuning Foundation Models for the Open FinLLM Leaderboard
por: Rao, Varun, et al.
Publicado: (2025)
por: Rao, Varun, et al.
Publicado: (2025)
Improving Context-Aware Preference Modeling for Language Models
por: Pitis, Silviu, et al.
Publicado: (2024)
por: Pitis, Silviu, et al.
Publicado: (2024)
Relative Value Biases in Large Language Models
por: Hayes, William M., et al.
Publicado: (2024)
por: Hayes, William M., et al.
Publicado: (2024)
Large Language Models are Biased Reinforcement Learners
por: Hayes, William M., et al.
Publicado: (2024)
por: Hayes, William M., et al.
Publicado: (2024)
Structured Prompts Improve Evaluation of Language Models
por: Aali, Asad, et al.
Publicado: (2025)
por: Aali, Asad, et al.
Publicado: (2025)
Quantifying and Improving the Robustness of Retrieval-Augmented Language Models Against Spurious Features in Grounding Data
por: Yang, Shiping, et al.
Publicado: (2025)
por: Yang, Shiping, et al.
Publicado: (2025)
Logically Consistent Language Models via Neuro-Symbolic Integration
por: Calanzone, Diego, et al.
Publicado: (2024)
por: Calanzone, Diego, et al.
Publicado: (2024)
Attention Satisfies: A Constraint-Satisfaction Lens on Factual Errors of Language Models
por: Yuksekgonul, Mert, et al.
Publicado: (2023)
por: Yuksekgonul, Mert, et al.
Publicado: (2023)
Ejemplares similares
-
Empowering Multi-Turn Tool-Integrated Agentic Reasoning with Group Turn Policy Optimization
por: Ding, Yifeng, et al.
Publicado: (2025) -
Lightweight reranking for language model generations
por: Jain, Siddhartha, et al.
Publicado: (2023) -
Lossless Token Sequence Compression via Meta-Tokens
por: Harvill, John, et al.
Publicado: (2025) -
Meanings and Feelings of Large Language Models: Observability of Latent States in Generative AI
por: Liu, Tian Yu, et al.
Publicado: (2024) -
Experience Sharing in Mutual Reinforcement Learning for Heterogeneous Language Models
por: Liu, Xiaoze, et al.
Publicado: (2026)