Shuttle Between the Instructions and the Parameters of Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Sun, Wangtao, Xu, Haotian, Liao, Huanxuan, Yu, Xuanqing, Jiang, Zhongtao, He, Shizhu, Zhao, Jun, Liu, Kang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ExpNote: Black-box Large Language Models are Better Task Solvers with Experience Notebook
por: Sun, Wangtao, et al.
Publicado: (2023)
por: Sun, Wangtao, et al.
Publicado: (2023)
ItD: Large Language Models Can Teach Themselves Induction through Deduction
por: Sun, Wangtao, et al.
Publicado: (2024)
por: Sun, Wangtao, et al.
Publicado: (2024)
Beyond Instruction Following: Evaluating Inferential Rule Following of Large Language Models
por: Sun, Wangtao, et al.
Publicado: (2024)
por: Sun, Wangtao, et al.
Publicado: (2024)
DATA: Decomposed Attention-based Task Adaptation for Rehearsal-Free Continual Learning
por: Liao, Huanxuan, et al.
Publicado: (2025)
por: Liao, Huanxuan, et al.
Publicado: (2025)
Beyond Hard and Soft: Hybrid Context Compression for Balancing Local and Global Information Retention
por: Liao, Huanxuan, et al.
Publicado: (2025)
por: Liao, Huanxuan, et al.
Publicado: (2025)
Awakening Augmented Generation: Learning to Awaken Internal Knowledge of Large Language Models for Question Answering
por: Liao, Huanxuan, et al.
Publicado: (2024)
por: Liao, Huanxuan, et al.
Publicado: (2024)
Neural-Symbolic Collaborative Distillation: Advancing Small Language Models for Complex Reasoning Tasks
por: Liao, Huanxuan, et al.
Publicado: (2024)
por: Liao, Huanxuan, et al.
Publicado: (2024)
From Instance Training to Instruction Learning: Task Adapters Generation from Instructions
por: Liao, Huanxuan, et al.
Publicado: (2024)
por: Liao, Huanxuan, et al.
Publicado: (2024)
Dynamic Parametric Retrieval Augmented Generation for Test-time Knowledge Enhancement
por: Tan, Yuqiao, et al.
Publicado: (2025)
por: Tan, Yuqiao, et al.
Publicado: (2025)
$\textit{SKIntern}$: Internalizing Symbolic Knowledge for Distilling Better CoT Capabilities into Small Language Models
por: Liao, Huanxuan, et al.
Publicado: (2024)
por: Liao, Huanxuan, et al.
Publicado: (2024)
ResAdapt: Adaptive Resolution for Efficient Multimodal Reasoning
por: Liao, Huanxuan, et al.
Publicado: (2026)
por: Liao, Huanxuan, et al.
Publicado: (2026)
ONSEP: A Novel Online Neural-Symbolic Framework for Event Prediction Based on Large Language Model
por: Yu, Xuanqing, et al.
Publicado: (2024)
por: Yu, Xuanqing, et al.
Publicado: (2024)
Probabilistic Uncertain Reward Model
por: Sun, Wangtao, et al.
Publicado: (2025)
por: Sun, Wangtao, et al.
Publicado: (2025)
SparK: Query-Aware Unstructured Sparsity with Recoverable KV Cache Channel Pruning
por: Liao, Huanxuan, et al.
Publicado: (2025)
por: Liao, Huanxuan, et al.
Publicado: (2025)
LLaSA: Large Language and Structured Data Assistant
por: Xu, Yao, et al.
Publicado: (2024)
por: Xu, Yao, et al.
Publicado: (2024)
Neural Incompatibility: The Unbridgeable Gap of Cross-Scale Parametric Knowledge Transfer in Large Language Models
por: Tan, Yuqiao, et al.
Publicado: (2025)
por: Tan, Yuqiao, et al.
Publicado: (2025)
MoELoRA: Contrastive Learning Guided Mixture of Experts on Parameter-Efficient Fine-Tuning for Large Language Models
por: Luo, Tongxu, et al.
Publicado: (2024)
por: Luo, Tongxu, et al.
Publicado: (2024)
From Chain to Tree: Refining Chain-like Rules into Tree-like Rules on Knowledge Graphs
por: Sun, Wangtao, et al.
Publicado: (2024)
por: Sun, Wangtao, et al.
Publicado: (2024)
CITI: Enhancing Tool Utilizing Ability in Large Language Models without Sacrificing General Performance
por: Hao, Yupu, et al.
Publicado: (2024)
por: Hao, Yupu, et al.
Publicado: (2024)
SC-Taxo: Hierarchical Taxonomy Generation under Semantic Consistency Constraints using Large Language Models
por: Cai, Shiqiang, et al.
Publicado: (2026)
por: Cai, Shiqiang, et al.
Publicado: (2026)
S3Eval: A Synthetic, Scalable, Systematic Evaluation Suite for Large Language Models
por: Lei, Fangyu, et al.
Publicado: (2023)
por: Lei, Fangyu, et al.
Publicado: (2023)
ControlLM: Crafting Diverse Personalities for Language Models
por: Weng, Yixuan, et al.
Publicado: (2024)
por: Weng, Yixuan, et al.
Publicado: (2024)
Instruction Mining: Instruction Data Selection for Tuning Large Language Models
por: Cao, Yihan, et al.
Publicado: (2023)
por: Cao, Yihan, et al.
Publicado: (2023)
Amplify Adjacent Token Differences: Enhancing Long Chain-of-Thought Reasoning with Shift-FFN
por: Xu, Yao, et al.
Publicado: (2025)
por: Xu, Yao, et al.
Publicado: (2025)
The Zero-Step Thinking: An Empirical Study of Mode Selection as Harder Early Exit in Reasoning Models
por: Tan, Yuqiao, et al.
Publicado: (2025)
por: Tan, Yuqiao, et al.
Publicado: (2025)
Find Parent then Label Children: A Two-stage Taxonomy Completion Method with Pre-trained Language Model
por: Xia, Fei, et al.
Publicado: (2024)
por: Xia, Fei, et al.
Publicado: (2024)
WideSeek: Advancing Wide Research via Multi-Agent Scaling
por: Huang, Ziyang, et al.
Publicado: (2026)
por: Huang, Ziyang, et al.
Publicado: (2026)
Improve Rule Retrieval and Reasoning with Self-Induction and Relevance ReEstimate
por: Huang, Ziyang, et al.
Publicado: (2025)
por: Huang, Ziyang, et al.
Publicado: (2025)
Multilingual Knowledge Graph Completion from Pretrained Language Models with Knowledge Constraints
por: Song, Ran, et al.
Publicado: (2024)
por: Song, Ran, et al.
Publicado: (2024)
From $P(y|x)$ to $P(y)$: Investigating Reinforcement Learning in Pre-train Space
por: Tan, Yuqiao, et al.
Publicado: (2026)
por: Tan, Yuqiao, et al.
Publicado: (2026)
Task-Stratified Knowledge Scaling Laws for Post-Training Quantized Large Language Models
por: Zhou, Chenxi, et al.
Publicado: (2025)
por: Zhou, Chenxi, et al.
Publicado: (2025)
Evaluating Large Language Models at Evaluating Instruction Following
por: Zeng, Zhiyuan, et al.
Publicado: (2023)
por: Zeng, Zhiyuan, et al.
Publicado: (2023)
Mastering Symbolic Operations: Augmenting Language Models with Compiled Neural Networks
por: Weng, Yixuan, et al.
Publicado: (2023)
por: Weng, Yixuan, et al.
Publicado: (2023)
Efficient Data Learning for Open Information Extraction with Pre-trained Language Models
por: Fan, Zhiyuan, et al.
Publicado: (2023)
por: Fan, Zhiyuan, et al.
Publicado: (2023)
Benchmarking Generation and Evaluation Capabilities of Large Language Models for Instruction Controllable Summarization
por: Liu, Yixin, et al.
Publicado: (2023)
por: Liu, Yixin, et al.
Publicado: (2023)
Evaluating Personalized Tool-Augmented LLMs from the Perspectives of Personalization and Proactivity
por: Hao, Yupu, et al.
Publicado: (2025)
por: Hao, Yupu, et al.
Publicado: (2025)
Federated Data-Efficient Instruction Tuning for Large Language Models
por: Qin, Zhen, et al.
Publicado: (2024)
por: Qin, Zhen, et al.
Publicado: (2024)
DA-Code: Agent Data Science Code Generation Benchmark for Large Language Models
por: Huang, Yiming, et al.
Publicado: (2024)
por: Huang, Yiming, et al.
Publicado: (2024)
Parameter Efficient Instruction Tuning: An Empirical Study
por: He, Pengfei
Publicado: (2024)
por: He, Pengfei
Publicado: (2024)
Instructional Fingerprinting of Large Language Models
por: Xu, Jiashu, et al.
Publicado: (2024)
por: Xu, Jiashu, et al.
Publicado: (2024)
Ejemplares similares
-
ExpNote: Black-box Large Language Models are Better Task Solvers with Experience Notebook
por: Sun, Wangtao, et al.
Publicado: (2023) -
ItD: Large Language Models Can Teach Themselves Induction through Deduction
por: Sun, Wangtao, et al.
Publicado: (2024) -
Beyond Instruction Following: Evaluating Inferential Rule Following of Large Language Models
por: Sun, Wangtao, et al.
Publicado: (2024) -
DATA: Decomposed Attention-based Task Adaptation for Rehearsal-Free Continual Learning
por: Liao, Huanxuan, et al.
Publicado: (2025) -
Beyond Hard and Soft: Hybrid Context Compression for Balancing Local and Global Information Retention
por: Liao, Huanxuan, et al.
Publicado: (2025)