LLM can Achieve Self-Regulation via Hyperparameter Aware Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Siyin, Li, Shimin, Sun, Tianxiang, Fu, Jinlan, Cheng, Qinyuan, Ye, Jiasheng, Ye, Junjie, Qiu, Xipeng, Huang, Xuanjing |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Safe Inputs but Unsafe Output: Benchmarking Cross-modality Safety Alignment of Large Vision-Language Model
par: Wang, Siyin, et autres
Publié: (2024)
par: Wang, Siyin, et autres
Publié: (2024)
Agent Alignment in Evolving Social Norms
par: Li, Shimin, et autres
Publié: (2024)
par: Li, Shimin, et autres
Publié: (2024)
World Modeling Makes a Better Planner: Dual Preference Optimization for Embodied Task Planning
par: Wang, Siyin, et autres
Publié: (2025)
par: Wang, Siyin, et autres
Publié: (2025)
Dynamic and Generalizable Process Reward Modeling
par: Yin, Zhangyue, et autres
Publié: (2025)
par: Yin, Zhangyue, et autres
Publié: (2025)
In-Memory Learning: A Declarative Learning Framework for Large Language Models
par: Wang, Bo, et autres
Publié: (2024)
par: Wang, Bo, et autres
Publié: (2024)
Data Mixing Laws: Optimizing Data Mixtures by Predicting Language Modeling Performance
par: Ye, Jiasheng, et autres
Publié: (2024)
par: Ye, Jiasheng, et autres
Publié: (2024)
Scaling Laws for Fact Memorization of Large Language Models
par: Lu, Xingyu, et autres
Publié: (2024)
par: Lu, Xingyu, et autres
Publié: (2024)
Unified Active Retrieval for Retrieval Augmented Generation
par: Cheng, Qinyuan, et autres
Publié: (2024)
par: Cheng, Qinyuan, et autres
Publié: (2024)
DetectiveQA: Evaluating Long-Context Reasoning on Detective Novels
par: Xu, Zhe, et autres
Publié: (2024)
par: Xu, Zhe, et autres
Publié: (2024)
AutoLogi: Automated Generation of Logic Puzzles for Evaluating Reasoning Abilities of Large Language Models
par: Zhu, Qin, et autres
Publié: (2025)
par: Zhu, Qin, et autres
Publié: (2025)
VisuoThink: Empowering LVLM Reasoning with Multimodal Tree Search
par: Wang, Yikun, et autres
Publié: (2025)
par: Wang, Yikun, et autres
Publié: (2025)
Can AI Assistants Know What They Don't Know?
par: Cheng, Qinyuan, et autres
Publié: (2024)
par: Cheng, Qinyuan, et autres
Publié: (2024)
LLatrieval: LLM-Verified Retrieval for Verifiable Generation
par: Li, Xiaonan, et autres
Publié: (2023)
par: Li, Xiaonan, et autres
Publié: (2023)
Case2Code: Scalable Synthetic Data for Code Generation
par: Shao, Yunfan, et autres
Publié: (2024)
par: Shao, Yunfan, et autres
Publié: (2024)
Domain Generalization via Causal Adjustment for Cross-Domain Sentiment Analysis
par: Wang, Siyin, et autres
Publié: (2024)
par: Wang, Siyin, et autres
Publié: (2024)
ConvSearch-R1: Enhancing Query Reformulation for Conversational Search with Reasoning via Reinforcement Learning
par: Zhu, Changtai, et autres
Publié: (2025)
par: Zhu, Changtai, et autres
Publié: (2025)
Error Classification of Large Language Models on Math Word Problems: A Dynamically Adaptive Framework
par: Sun, Yuhong, et autres
Publié: (2025)
par: Sun, Yuhong, et autres
Publié: (2025)
MCM-DPO: Multifaceted Cross-Modal Direct Preference Optimization for Alt-text Generation
par: Fu, Jinlan, et autres
Publié: (2025)
par: Fu, Jinlan, et autres
Publié: (2025)
Hint-before-Solving Prompting: Guiding LLMs to Effectively Utilize Encoded Knowledge
par: Fu, Jinlan, et autres
Publié: (2024)
par: Fu, Jinlan, et autres
Publié: (2024)
Emergent Structured Representations Support Flexible In-Context Inference in Large Language Models
par: Xu, Ningyu, et autres
Publié: (2026)
par: Xu, Ningyu, et autres
Publié: (2026)
World Action Models: The Next Frontier in Embodied AI
par: Wang, Siyin, et autres
Publié: (2026)
par: Wang, Siyin, et autres
Publié: (2026)
DenoSent: A Denoising Objective for Self-Supervised Sentence Representation Learning
par: Wang, Xinghao, et autres
Publié: (2024)
par: Wang, Xinghao, et autres
Publié: (2024)
Beyond Attention Magnitude: Leveraging Inter-layer Rank Consistency for Efficient Vision-Language-Action Models
par: Liu, Peiju, et autres
Publié: (2026)
par: Liu, Peiju, et autres
Publié: (2026)
Unleashing Embodied Task Planning Ability in LLMs via Reinforcement Learning
par: Fei, Zhaoye, et autres
Publié: (2025)
par: Fei, Zhaoye, et autres
Publié: (2025)
LLM-DA: Data Augmentation via Large Language Models for Few-Shot Named Entity Recognition
par: Ye, Junjie, et autres
Publié: (2024)
par: Ye, Junjie, et autres
Publié: (2024)
InstructTTSEval: Benchmarking Complex Natural-Language Instruction Following in Text-to-Speech Systems
par: Huang, Kexin, et autres
Publié: (2025)
par: Huang, Kexin, et autres
Publié: (2025)
Revisiting the Test-Time Scaling of o1-like Models: Do they Truly Possess Test-Time Scaling Capabilities?
par: Zeng, Zhiyuan, et autres
Publié: (2025)
par: Zeng, Zhiyuan, et autres
Publié: (2025)
FutureOmni: Evaluating Future Forecasting from Omni-Modal Context for Multimodal LLMs
par: Chen, Qian, et autres
Publié: (2026)
par: Chen, Qian, et autres
Publié: (2026)
Aggregation of Reasoning: A Hierarchical Framework for Enhancing Answer Selection in Large Language Models
par: Yin, Zhangyue, et autres
Publié: (2024)
par: Yin, Zhangyue, et autres
Publié: (2024)
HERMES: KV Cache as Hierarchical Memory for Efficient Streaming Video Understanding
par: Zhang, Haowei, et autres
Publié: (2026)
par: Zhang, Haowei, et autres
Publié: (2026)
AstroReason-Bench: Evaluating Unified Agentic Planning across Heterogeneous Space Planning Problems
par: Wang, Weiyi, et autres
Publié: (2026)
par: Wang, Weiyi, et autres
Publié: (2026)
CCTU: A Benchmark for Tool Use under Complex Constraints
par: Ye, Junjie, et autres
Publié: (2026)
par: Ye, Junjie, et autres
Publié: (2026)
Multi-hop Reasoning via Early Knowledge Alignment
par: Wang, Yuxin, et autres
Publié: (2025)
par: Wang, Yuxin, et autres
Publié: (2025)
Unveiling In-Context Learning: A Coordinate System to Understand Its Working Mechanism
par: Zhao, Anhao, et autres
Publié: (2024)
par: Zhao, Anhao, et autres
Publié: (2024)
Model Utility Law: Evaluating LLMs beyond Performance through Mechanism Interpretable Metric
par: Cao, Yixin, et autres
Publié: (2025)
par: Cao, Yixin, et autres
Publié: (2025)
WESR: Scaling and Evaluating Word-level Event-Speech Recognition
par: Yang, Chenchen, et autres
Publié: (2026)
par: Yang, Chenchen, et autres
Publié: (2026)
Function Induction and Task Generalization: An Interpretability Study with Off-by-One Addition
par: Ye, Qinyuan, et autres
Publié: (2025)
par: Ye, Qinyuan, et autres
Publié: (2025)
AnyGPT: Unified Multimodal LLM with Discrete Sequence Modeling
par: Zhan, Jun, et autres
Publié: (2024)
par: Zhan, Jun, et autres
Publié: (2024)
SpeechGPT-Gen: Scaling Chain-of-Information Speech Generation
par: Zhang, Dong, et autres
Publié: (2024)
par: Zhang, Dong, et autres
Publié: (2024)
MOSS-VoiceGenerator: Create Realistic Voices with Natural Language Descriptions
par: Huang, Kexin, et autres
Publié: (2026)
par: Huang, Kexin, et autres
Publié: (2026)
Documents similaires
-
Safe Inputs but Unsafe Output: Benchmarking Cross-modality Safety Alignment of Large Vision-Language Model
par: Wang, Siyin, et autres
Publié: (2024) -
Agent Alignment in Evolving Social Norms
par: Li, Shimin, et autres
Publié: (2024) -
World Modeling Makes a Better Planner: Dual Preference Optimization for Embodied Task Planning
par: Wang, Siyin, et autres
Publié: (2025) -
Dynamic and Generalizable Process Reward Modeling
par: Yin, Zhangyue, et autres
Publié: (2025) -
In-Memory Learning: A Declarative Learning Framework for Large Language Models
par: Wang, Bo, et autres
Publié: (2024)