Ruler: A Model-Agnostic Method to Control Generated Length for Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Jiaming, Zhang, Lei, Li, Yunshui, Liu, Ziqiang, bai, yuelin, Luo, Run, Chen, Longze, Yang, Min |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Long Context is Not Long at All: A Prospector of Long-Dependency Data for Large Language Models
di: Chen, Longze, et al.
Pubblicazione: (2024)
di: Chen, Longze, et al.
Pubblicazione: (2024)
Marathon: A Race Through the Realm of Long Context with Large Language Models
di: Zhang, Lei, et al.
Pubblicazione: (2023)
di: Zhang, Lei, et al.
Pubblicazione: (2023)
DEEM: Diffusion Models Serve as the Eyes of Large Language Models for Image Perception
di: Luo, Run, et al.
Pubblicazione: (2024)
di: Luo, Run, et al.
Pubblicazione: (2024)
STORYTELLER: An Enhanced Plot-Planning Framework for Coherent and Cohesive Story Generation
di: Li, Jiaming, et al.
Pubblicazione: (2025)
di: Li, Jiaming, et al.
Pubblicazione: (2025)
Hierarchical Context Pruning: Optimizing Real-World Code Completion with Repository-Level Pretrained Code LLMs
di: Zhang, Lei, et al.
Pubblicazione: (2024)
di: Zhang, Lei, et al.
Pubblicazione: (2024)
VCM: Vision Concept Modeling Based on Implicit Contrastive Learning with Vision-Language Instruction Fine-Tuning
di: Luo, Run, et al.
Pubblicazione: (2025)
di: Luo, Run, et al.
Pubblicazione: (2025)
MMEvol: Empowering Multimodal Large Language Models with Evol-Instruct
di: Luo, Run, et al.
Pubblicazione: (2024)
di: Luo, Run, et al.
Pubblicazione: (2024)
GUI-R1 : A Generalist R1-Style Vision-Language Action Model For GUI Agents
di: Luo, Run, et al.
Pubblicazione: (2025)
di: Luo, Run, et al.
Pubblicazione: (2025)
IPBench: Benchmarking the Knowledge of Large Language Models in Intellectual Property
di: Wang, Qiyao, et al.
Pubblicazione: (2025)
di: Wang, Qiyao, et al.
Pubblicazione: (2025)
IP-MOT: Instance Prompt Learning for Cross-Domain Multi-Object Tracking
di: Luo, Run, et al.
Pubblicazione: (2024)
di: Luo, Run, et al.
Pubblicazione: (2024)
OpenOmni: Advancing Open-Source Omnimodal Large Language Models with Progressive Multimodal Alignment and Real-Time Self-Aware Emotional Speech Synthesis
di: Luo, Run, et al.
Pubblicazione: (2025)
di: Luo, Run, et al.
Pubblicazione: (2025)
Implicit Actor Critic Coupling via a Supervised Learning Framework for RLVR
di: Li, Jiaming, et al.
Pubblicazione: (2025)
di: Li, Jiaming, et al.
Pubblicazione: (2025)
Learning Ordinal Probabilistic Reward from Preferences
di: Chen, Longze, et al.
Pubblicazione: (2026)
di: Chen, Longze, et al.
Pubblicazione: (2026)
One-Shot Learning as Instruction Data Prospector for Large Language Models
di: Li, Yunshui, et al.
Pubblicazione: (2023)
di: Li, Yunshui, et al.
Pubblicazione: (2023)
Leave No Document Behind: Benchmarking Long-Context LLMs with Extended Multi-Doc QA
di: Wang, Minzheng, et al.
Pubblicazione: (2024)
di: Wang, Minzheng, et al.
Pubblicazione: (2024)
CLaSp: In-Context Layer Skip for Self-Speculative Decoding
di: Chen, Longze, et al.
Pubblicazione: (2025)
di: Chen, Longze, et al.
Pubblicazione: (2025)
RuCL: Stratified Rubric-Based Curriculum Learning for Multimodal Large Language Model Reasoning
di: Chen, Yukun, et al.
Pubblicazione: (2026)
di: Chen, Yukun, et al.
Pubblicazione: (2026)
AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control
di: Li, Ruosen, et al.
Pubblicazione: (2025)
di: Li, Ruosen, et al.
Pubblicazione: (2025)
NExT-OMNI: Towards Any-to-Any Omnimodal Foundation Models with Discrete Flow Matching
di: Luo, Run, et al.
Pubblicazione: (2025)
di: Luo, Run, et al.
Pubblicazione: (2025)
Improving Variable-Length Generation in Diffusion Language Models via Length Regularization
di: Cheng, Zicong, et al.
Pubblicazione: (2026)
di: Cheng, Zicong, et al.
Pubblicazione: (2026)
Large Language Models are Good Attackers: Efficient and Stealthy Textual Backdoor Attacks
di: Li, Ziqiang, et al.
Pubblicazione: (2024)
di: Li, Ziqiang, et al.
Pubblicazione: (2024)
LIFEBench: Evaluating Length Instruction Following in Large Language Models
di: Zhang, Wei, et al.
Pubblicazione: (2025)
di: Zhang, Wei, et al.
Pubblicazione: (2025)
CLEX: Continuous Length Extrapolation for Large Language Models
di: Chen, Guanzheng, et al.
Pubblicazione: (2023)
di: Chen, Guanzheng, et al.
Pubblicazione: (2023)
Large Language Models for Generative Recommendation: A Survey and Visionary Discussions
di: Li, Lei, et al.
Pubblicazione: (2023)
di: Li, Lei, et al.
Pubblicazione: (2023)
Precise Length Control in Large Language Models
di: Butcher, Bradley, et al.
Pubblicazione: (2024)
di: Butcher, Bradley, et al.
Pubblicazione: (2024)
SelfCP: Compressing Over-Limit Prompt via the Frozen Large Language Model Itself
di: Gao, Jun, et al.
Pubblicazione: (2024)
di: Gao, Jun, et al.
Pubblicazione: (2024)
PersonaMath: Boosting Mathematical Reasoning via Persona-Driven Data Augmentation
di: Luo, Jing, et al.
Pubblicazione: (2024)
di: Luo, Jing, et al.
Pubblicazione: (2024)
Expanding before Inferring: Enhancing Factuality in Large Language Models through Premature Layers Interpolation
di: Chen, Dingwei, et al.
Pubblicazione: (2025)
di: Chen, Dingwei, et al.
Pubblicazione: (2025)
Exploring the Translation Mechanism of Large Language Models
di: Zhang, Hongbin, et al.
Pubblicazione: (2025)
di: Zhang, Hongbin, et al.
Pubblicazione: (2025)
Length Representations in Large Language Models
di: Moon, Sangjun, et al.
Pubblicazione: (2025)
di: Moon, Sangjun, et al.
Pubblicazione: (2025)
Hansel: Output Length Controlling Framework for Large Language Models
di: Song, Seoha, et al.
Pubblicazione: (2024)
di: Song, Seoha, et al.
Pubblicazione: (2024)
A Watermark for Order-Agnostic Language Models
di: Chen, Ruibo, et al.
Pubblicazione: (2024)
di: Chen, Ruibo, et al.
Pubblicazione: (2024)
GIRAFFE: Design Choices for Extending the Context Length of Visual Language Models
di: Li, Mukai, et al.
Pubblicazione: (2024)
di: Li, Mukai, et al.
Pubblicazione: (2024)
Towards Lightweight, Adaptive and Attribute-Aware Multi-Aspect Controllable Text Generation with Large Language Models
di: Zhu, Chenyu, et al.
Pubblicazione: (2025)
di: Zhu, Chenyu, et al.
Pubblicazione: (2025)
A Large Language Model Based Method for Complex Logical Reasoning over Knowledge Graphs
di: Zhang, Ziyan, et al.
Pubblicazione: (2025)
di: Zhang, Ziyan, et al.
Pubblicazione: (2025)
TF-Attack: Transferable and Fast Adversarial Attacks on Large Language Models
di: Li, Zelin, et al.
Pubblicazione: (2024)
di: Li, Zelin, et al.
Pubblicazione: (2024)
Generator-Assistant Stepwise Rollback Framework for Large Language Model Agent
di: Li, Xingzuo, et al.
Pubblicazione: (2025)
di: Li, Xingzuo, et al.
Pubblicazione: (2025)
GTA: Supervised-Guided Reinforcement Learning for Text Classification with Large Language Models
di: Zeng, Min, et al.
Pubblicazione: (2025)
di: Zeng, Min, et al.
Pubblicazione: (2025)
Personalized Large Language Model Assistant with Evolving Conditional Memory
di: Yuan, Ruifeng, et al.
Pubblicazione: (2023)
di: Yuan, Ruifeng, et al.
Pubblicazione: (2023)
Text2World: Benchmarking Large Language Models for Symbolic World Model Generation
di: Hu, Mengkang, et al.
Pubblicazione: (2025)
di: Hu, Mengkang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Long Context is Not Long at All: A Prospector of Long-Dependency Data for Large Language Models
di: Chen, Longze, et al.
Pubblicazione: (2024) -
Marathon: A Race Through the Realm of Long Context with Large Language Models
di: Zhang, Lei, et al.
Pubblicazione: (2023) -
DEEM: Diffusion Models Serve as the Eyes of Large Language Models for Image Perception
di: Luo, Run, et al.
Pubblicazione: (2024) -
STORYTELLER: An Enhanced Plot-Planning Framework for Coherent and Cohesive Story Generation
di: Li, Jiaming, et al.
Pubblicazione: (2025) -
Hierarchical Context Pruning: Optimizing Real-World Code Completion with Repository-Level Pretrained Code LLMs
di: Zhang, Lei, et al.
Pubblicazione: (2024)