Salvato in:
| Autori principali: | Qiu, Zihan, Huang, Zeyu, Fu, Jie |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2310.10908 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Unlocking Continual Learning Abilities in Language Models
di: Du, Wenyu, et al.
Pubblicazione: (2024)
di: Du, Wenyu, et al.
Pubblicazione: (2024)
GW-MoE: Resolving Uncertainty in MoE Router with Global Workspace Theory
di: Wu, Haoze, et al.
Pubblicazione: (2024)
di: Wu, Haoze, et al.
Pubblicazione: (2024)
Unlock the Potential of Large Language Models for Predictive Tabular Tasks in Data Science with Table-Specific Pretraining
di: Yang, Yazheng, et al.
Pubblicazione: (2024)
di: Yang, Yazheng, et al.
Pubblicazione: (2024)
Emergent Causal-Geometric Dynamics Across Depth in Large Language Models
di: Haim, Shahar, et al.
Pubblicazione: (2026)
di: Haim, Shahar, et al.
Pubblicazione: (2026)
HyperMoE: Towards Better Mixture of Experts via Transferring Among Experts
di: Zhao, Hao, et al.
Pubblicazione: (2024)
di: Zhao, Hao, et al.
Pubblicazione: (2024)
Emergent Abilities in Large Language Models: A Survey
di: Berti, Leonardo, et al.
Pubblicazione: (2025)
di: Berti, Leonardo, et al.
Pubblicazione: (2025)
Understanding Emergent Abilities of Language Models from the Loss Perspective
di: Du, Zhengxiao, et al.
Pubblicazione: (2024)
di: Du, Zhengxiao, et al.
Pubblicazione: (2024)
Unlock the Correlation between Supervised Fine-Tuning and Reinforcement Learning in Training Code Large Language Models
di: Chen, Jie, et al.
Pubblicazione: (2024)
di: Chen, Jie, et al.
Pubblicazione: (2024)
ROPO: Robust Preference Optimization for Large Language Models
di: Liang, Xize, et al.
Pubblicazione: (2024)
di: Liang, Xize, et al.
Pubblicazione: (2024)
A Closer Look into Mixture-of-Experts in Large Language Models
di: Lo, Ka Man, et al.
Pubblicazione: (2024)
di: Lo, Ka Man, et al.
Pubblicazione: (2024)
Modular Machine Learning: An Indispensable Path towards New-Generation Large Language Models
di: Wang, Xin, et al.
Pubblicazione: (2025)
di: Wang, Xin, et al.
Pubblicazione: (2025)
Uncovering Emergent Physics Representations Learned In-Context by Large Language Models
di: Song, Yeongwoo, et al.
Pubblicazione: (2025)
di: Song, Yeongwoo, et al.
Pubblicazione: (2025)
Machine Bullshit: Characterizing the Emergent Disregard for Truth in Large Language Models
di: Liang, Kaiqu, et al.
Pubblicazione: (2025)
di: Liang, Kaiqu, et al.
Pubblicazione: (2025)
LMEraser: Large Model Unlearning through Adaptive Prompt Tuning
di: Xu, Jie, et al.
Pubblicazione: (2024)
di: Xu, Jie, et al.
Pubblicazione: (2024)
In-Training Defenses against Emergent Misalignment in Language Models
di: Kaczér, David, et al.
Pubblicazione: (2025)
di: Kaczér, David, et al.
Pubblicazione: (2025)
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
di: Li, Ziniu, et al.
Pubblicazione: (2024)
di: Li, Ziniu, et al.
Pubblicazione: (2024)
SPaCe: Unlocking Sample-Efficient Large Language Models Training With Self-Pace Curriculum Learning
di: Do, Dai, et al.
Pubblicazione: (2025)
di: Do, Dai, et al.
Pubblicazione: (2025)
Blending Supervised and Reinforcement Fine-Tuning with Prefix Sampling
di: Huang, Zeyu, et al.
Pubblicazione: (2025)
di: Huang, Zeyu, et al.
Pubblicazione: (2025)
Automated Federated Pipeline for Parameter-Efficient Fine-Tuning of Large Language Models
di: Fang, Zihan, et al.
Pubblicazione: (2024)
di: Fang, Zihan, et al.
Pubblicazione: (2024)
Knowledge Fusion of Large Language Models Via Modular SkillPacks
di: Du, Guodong, et al.
Pubblicazione: (2025)
di: Du, Guodong, et al.
Pubblicazione: (2025)
Dynamic Influence Tracker: Measuring Time-Varying Sample Influence During Training
di: Xu, Jie, et al.
Pubblicazione: (2025)
di: Xu, Jie, et al.
Pubblicazione: (2025)
SwiftPrune: Hessian-Free Weight Pruning for Large Language Models
di: Kang, Yuhan, et al.
Pubblicazione: (2025)
di: Kang, Yuhan, et al.
Pubblicazione: (2025)
EpiLLM: Unlocking the Potential of Large Language Models in Epidemic Forecasting
di: Gong, Chenghua, et al.
Pubblicazione: (2025)
di: Gong, Chenghua, et al.
Pubblicazione: (2025)
Segment Policy Optimization: Effective Segment-Level Credit Assignment in RL for Large Language Models
di: Guo, Yiran, et al.
Pubblicazione: (2025)
di: Guo, Yiran, et al.
Pubblicazione: (2025)
Unlocking Memorization in Large Language Models with Dynamic Soft Prompting
di: Wang, Zhepeng, et al.
Pubblicazione: (2024)
di: Wang, Zhepeng, et al.
Pubblicazione: (2024)
Event-CausNet: Unlocking Causal Knowledge from Text with Large Language Models for Reliable Spatio-Temporal Forecasting
di: Niu, Luyao, et al.
Pubblicazione: (2025)
di: Niu, Luyao, et al.
Pubblicazione: (2025)
Emergent Semantic Role Understanding in Language Models
di: Griffiths, Carla, et al.
Pubblicazione: (2026)
di: Griffiths, Carla, et al.
Pubblicazione: (2026)
SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation
di: Ren, Yanwei, et al.
Pubblicazione: (2025)
di: Ren, Yanwei, et al.
Pubblicazione: (2025)
Unlocking Generalization for Robotics via Modularity and Scale
di: Dalal, Murtaza
Pubblicazione: (2025)
di: Dalal, Murtaza
Pubblicazione: (2025)
Model Organisms for Emergent Misalignment
di: Turner, Edward, et al.
Pubblicazione: (2025)
di: Turner, Edward, et al.
Pubblicazione: (2025)
Over-Searching in Search-Augmented Large Language Models
di: Xie, Roy, et al.
Pubblicazione: (2026)
di: Xie, Roy, et al.
Pubblicazione: (2026)
Breaking Silos: Adaptive Model Fusion Unlocks Better Time Series Forecasting
di: Liu, Zhining, et al.
Pubblicazione: (2025)
di: Liu, Zhining, et al.
Pubblicazione: (2025)
Composition of Experts: A Modular Compound AI System Leveraging Large Language Models
di: Jain, Swayambhoo, et al.
Pubblicazione: (2024)
di: Jain, Swayambhoo, et al.
Pubblicazione: (2024)
Reward Guidance for Reinforcement Learning Tasks Based on Large Language Models: The LMGT Framework
di: Deng, Yongxin, et al.
Pubblicazione: (2024)
di: Deng, Yongxin, et al.
Pubblicazione: (2024)
Optimizing Prompts for Large Language Models: A Causal Approach
di: Chen, Wei, et al.
Pubblicazione: (2026)
di: Chen, Wei, et al.
Pubblicazione: (2026)
Efficient Low Rank Attention for Long-Context Inference in Large Language Models
di: Li, Tenghui, et al.
Pubblicazione: (2025)
di: Li, Tenghui, et al.
Pubblicazione: (2025)
Prompting Fairness: Integrating Causality to Debias Large Language Models
di: Li, Jingling, et al.
Pubblicazione: (2024)
di: Li, Jingling, et al.
Pubblicazione: (2024)
Distributed Interpretability and Control for Large Language Models
di: Desai, Dev Arpan, et al.
Pubblicazione: (2026)
di: Desai, Dev Arpan, et al.
Pubblicazione: (2026)
Beyond Frequency: The Role of Redundancy in Large Language Model Memorization
di: Zhang, Jie, et al.
Pubblicazione: (2025)
di: Zhang, Jie, et al.
Pubblicazione: (2025)
SheetAgent: Towards A Generalist Agent for Spreadsheet Reasoning and Manipulation via Large Language Models
di: Chen, Yibin, et al.
Pubblicazione: (2024)
di: Chen, Yibin, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Unlocking Continual Learning Abilities in Language Models
di: Du, Wenyu, et al.
Pubblicazione: (2024) -
GW-MoE: Resolving Uncertainty in MoE Router with Global Workspace Theory
di: Wu, Haoze, et al.
Pubblicazione: (2024) -
Unlock the Potential of Large Language Models for Predictive Tabular Tasks in Data Science with Table-Specific Pretraining
di: Yang, Yazheng, et al.
Pubblicazione: (2024) -
Emergent Causal-Geometric Dynamics Across Depth in Large Language Models
di: Haim, Shahar, et al.
Pubblicazione: (2026) -
HyperMoE: Towards Better Mixture of Experts via Transferring Among Experts
di: Zhao, Hao, et al.
Pubblicazione: (2024)