Guardado en:
| Autores principales: | Lin, Ziqian, Bharti, Shubham Kumar, Lee, Kangwook |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2502.19787 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Dual Operating Modes of In-Context Learning
por: Lin, Ziqian, et al.
Publicado: (2024)
por: Lin, Ziqian, et al.
Publicado: (2024)
Task Vectors in In-Context Learning: Emergence, Formation, and Benefit
por: Yang, Liu, et al.
Publicado: (2025)
por: Yang, Liu, et al.
Publicado: (2025)
Fine-Tuning Without Forgetting In-Context Learning: A Theoretical Analysis of Linear Attention Models
por: Lee, Chungpa, et al.
Publicado: (2026)
por: Lee, Chungpa, et al.
Publicado: (2026)
Can MLLMs Perform Text-to-Image In-Context Learning?
por: Zeng, Yuchen, et al.
Publicado: (2024)
por: Zeng, Yuchen, et al.
Publicado: (2024)
Transformers in the Dark: Navigating Unknown Search Spaces via Bandit Feedback
por: Kim, Jungtaek, et al.
Publicado: (2026)
por: Kim, Jungtaek, et al.
Publicado: (2026)
Optimizing DDPM Sampling with Shortcut Fine-Tuning
por: Fan, Ying, et al.
Publicado: (2023)
por: Fan, Ying, et al.
Publicado: (2023)
Can Mamba Learn How to Learn? A Comparative Study on In-Context Learning Tasks
por: Park, Jongho, et al.
Publicado: (2024)
por: Park, Jongho, et al.
Publicado: (2024)
The Expressive Power of Low-Rank Adaptation
por: Zeng, Yuchen, et al.
Publicado: (2023)
por: Zeng, Yuchen, et al.
Publicado: (2023)
Everything Everywhere All at Once: LLMs can In-Context Learn Multiple Tasks in Superposition
por: Xiong, Zheyang, et al.
Publicado: (2024)
por: Xiong, Zheyang, et al.
Publicado: (2024)
Looped Transformers are Better at Learning Learning Algorithms
por: Yang, Liu, et al.
Publicado: (2023)
por: Yang, Liu, et al.
Publicado: (2023)
Variation Spaces for Multi-Output Neural Networks: Insights on Multi-Task Learning and Network Compression
por: Shenouda, Joseph, et al.
Publicado: (2023)
por: Shenouda, Joseph, et al.
Publicado: (2023)
Rare-to-Frequent: Unlocking Compositional Generation Power of Diffusion Models on Rare Concepts with LLM Guidance
por: Park, Dongmin, et al.
Publicado: (2024)
por: Park, Dongmin, et al.
Publicado: (2024)
Looped Transformers for Length Generalization
por: Fan, Ying, et al.
Publicado: (2024)
por: Fan, Ying, et al.
Publicado: (2024)
Memorization Capacity for Additive Fine-Tuning with Small ReLU Networks
por: Sohn, Jy-yong, et al.
Publicado: (2024)
por: Sohn, Jy-yong, et al.
Publicado: (2024)
A Novel Data-Dependent Learning Paradigm for Large Hypothesis Classes
por: Pour, Alireza F., et al.
Publicado: (2025)
por: Pour, Alireza F., et al.
Publicado: (2025)
DS-AL: A Dual-Stream Analytic Learning for Exemplar-Free Class-Incremental Learning
por: Zhuang, Huiping, et al.
Publicado: (2024)
por: Zhuang, Huiping, et al.
Publicado: (2024)
ReJump: A Tree-Jump Representation for Analyzing and Improving LLM Reasoning
por: Zeng, Yuchen, et al.
Publicado: (2025)
por: Zeng, Yuchen, et al.
Publicado: (2025)
Leave-One-Out Prediction for General Hypothesis Classes
por: Qian, Jian, et al.
Publicado: (2026)
por: Qian, Jian, et al.
Publicado: (2026)
Self-Improving Transformers Overcome Easy-to-Hard and Length Generalization Challenges
por: Lee, Nayoung, et al.
Publicado: (2025)
por: Lee, Nayoung, et al.
Publicado: (2025)
Predictive Pipelined Decoding: A Compute-Latency Trade-off for Exact LLM Decoding
por: Yang, Seongjun, et al.
Publicado: (2023)
por: Yang, Seongjun, et al.
Publicado: (2023)
Smoothness Adaptive Hypothesis Transfer Learning
por: Lin, Haotian, et al.
Publicado: (2024)
por: Lin, Haotian, et al.
Publicado: (2024)
On Hypothesis Transfer Learning of Functional Linear Models
por: Lin, Haotian, et al.
Publicado: (2022)
por: Lin, Haotian, et al.
Publicado: (2022)
Infected Smallville: How Disease Threat Shapes Sociality in LLM Agents
por: Choi, Soyeon, et al.
Publicado: (2025)
por: Choi, Soyeon, et al.
Publicado: (2025)
From Artificial Needles to Real Haystacks: Improving Retrieval Capabilities in LLMs by Finetuning on Synthetic Data
por: Xiong, Zheyang, et al.
Publicado: (2024)
por: Xiong, Zheyang, et al.
Publicado: (2024)
What Do Language Models Learn in Context? The Structured Task Hypothesis
por: Li, Jiaoda, et al.
Publicado: (2024)
por: Li, Jiaoda, et al.
Publicado: (2024)
ENTP: Encoder-only Next Token Prediction
por: Ewer, Ethan, et al.
Publicado: (2024)
por: Ewer, Ethan, et al.
Publicado: (2024)
How to Correctly Report LLM-as-a-Judge Evaluations
por: Lee, Chungpa, et al.
Publicado: (2025)
por: Lee, Chungpa, et al.
Publicado: (2025)
Parameter-Efficient Fine-Tuning of State Space Models
por: Galim, Kevin, et al.
Publicado: (2024)
por: Galim, Kevin, et al.
Publicado: (2024)
Multi-Bin Batching for Increasing LLM Inference Throughput
por: Guldogan, Ozgur, et al.
Publicado: (2024)
por: Guldogan, Ozgur, et al.
Publicado: (2024)
Automated Type Annotation in Python Using Large Language Models
por: Bharti, Varun, et al.
Publicado: (2025)
por: Bharti, Varun, et al.
Publicado: (2025)
Hypothesis Class Determines Explanation: Why Accurate Models Disagree on Feature Attribution
por: B, Thackshanaramana
Publicado: (2026)
por: B, Thackshanaramana
Publicado: (2026)
Bayesian Active Learning in the Presence of Nuisance Parameters
por: Sloman, Sabina J., et al.
Publicado: (2023)
por: Sloman, Sabina J., et al.
Publicado: (2023)
Muon with Spectral Guidance: Efficient Optimization for Scientific Machine Learning
por: Lu, Binghang, et al.
Publicado: (2026)
por: Lu, Binghang, et al.
Publicado: (2026)
HTM-EAR: Importance-Preserving Tiered Memory with Hybrid Routing under Saturation
por: Singh, Shubham Kumar
Publicado: (2026)
por: Singh, Shubham Kumar
Publicado: (2026)
Rethinking Attention Output Projection: Structured Hadamard Transforms for Efficient Transformers
por: Aggarwal, Shubham, et al.
Publicado: (2026)
por: Aggarwal, Shubham, et al.
Publicado: (2026)
MixKVQ: Query-Aware Mixed-Precision KV Cache Quantization for Long-Context Reasoning
por: Zhang, Tao, et al.
Publicado: (2025)
por: Zhang, Tao, et al.
Publicado: (2025)
Quantization vs Pruning: Insights from the Strong Lottery Ticket Hypothesis
por: Kumar, Aakash, et al.
Publicado: (2025)
por: Kumar, Aakash, et al.
Publicado: (2025)
Hypothesis Spaces for Deep Learning
por: Wang, Rui, et al.
Publicado: (2024)
por: Wang, Rui, et al.
Publicado: (2024)
Multi-Task Corrupted Prediction for Learning Robust Audio-Visual Speech Representation
por: Kim, Sungnyun, et al.
Publicado: (2025)
por: Kim, Sungnyun, et al.
Publicado: (2025)
LookaheadKV: Fast and Accurate KV Cache Eviction by Glimpsing into the Future without Generation
por: Ahn, Jinwoo, et al.
Publicado: (2026)
por: Ahn, Jinwoo, et al.
Publicado: (2026)
Ejemplares similares
-
Dual Operating Modes of In-Context Learning
por: Lin, Ziqian, et al.
Publicado: (2024) -
Task Vectors in In-Context Learning: Emergence, Formation, and Benefit
por: Yang, Liu, et al.
Publicado: (2025) -
Fine-Tuning Without Forgetting In-Context Learning: A Theoretical Analysis of Linear Attention Models
por: Lee, Chungpa, et al.
Publicado: (2026) -
Can MLLMs Perform Text-to-Image In-Context Learning?
por: Zeng, Yuchen, et al.
Publicado: (2024) -
Transformers in the Dark: Navigating Unknown Search Spaces via Bandit Feedback
por: Kim, Jungtaek, et al.
Publicado: (2026)