Revisiting In-context Learning Inference Circuit in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cho, Hakaze, Kato, Mariko, Sakai, Yoshihiro, Inoue, Naoya |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Affinity and Diversity: A Unified Metric for Demonstration Selection via Internal Representations
par: Kato, Mariko, et autres
Publié: (2025)
par: Kato, Mariko, et autres
Publié: (2025)
Token-based Decision Criteria Are Suboptimal in In-context Learning
par: Cho, Hakaze, et autres
Publié: (2024)
par: Cho, Hakaze, et autres
Publié: (2024)
Understanding Token Probability Encoding in Output Embeddings
par: Cho, Hakaze, et autres
Publié: (2024)
par: Cho, Hakaze, et autres
Publié: (2024)
Mechanistic Fine-tuning for In-context Learning
par: Cho, Hakaze, et autres
Publié: (2025)
par: Cho, Hakaze, et autres
Publié: (2025)
Mechanism of Task-oriented Information Removal in In-context Learning
par: Cho, Hakaze, et autres
Publié: (2025)
par: Cho, Hakaze, et autres
Publié: (2025)
StaICC: Standardized Evaluation for Classification Task in In-context Learning
par: Cho, Hakaze, et autres
Publié: (2025)
par: Cho, Hakaze, et autres
Publié: (2025)
Binary Autoencoder for Mechanistic Interpretability of Large Language Models
par: Cho, Hakaze, et autres
Publié: (2025)
par: Cho, Hakaze, et autres
Publié: (2025)
NoisyICL: A Little Noise in Model Parameters Calibrates In-context Learning
par: Zhao, Yufeng, et autres
Publié: (2024)
par: Zhao, Yufeng, et autres
Publié: (2024)
The Transfer Neurons Hypothesis: An Underlying Mechanism for Language Latent Space Transitions in Multilingual LLMs
par: Tezuka, Hinata, et autres
Publié: (2025)
par: Tezuka, Hinata, et autres
Publié: (2025)
Probing the Decision Boundaries of In-context Learning in Large Language Models
par: Zhao, Siyan, et autres
Publié: (2024)
par: Zhao, Siyan, et autres
Publié: (2024)
Unveiling Imitation Learning: Exploring the Impact of Data Falsity to Large Language Model
par: Cho, Hyunsoo
Publié: (2024)
par: Cho, Hyunsoo
Publié: (2024)
Reasoning Circuits in Language Models: A Mechanistic Interpretation of Syllogistic Inference
par: Kim, Geonhee, et autres
Publié: (2024)
par: Kim, Geonhee, et autres
Publié: (2024)
LLM in a flash: Efficient Large Language Model Inference with Limited Memory
par: Alizadeh, Keivan, et autres
Publié: (2023)
par: Alizadeh, Keivan, et autres
Publié: (2023)
Multilinguality of Large Language Models From a Structural Perspective
par: Sakajo, Haruki, et autres
Publié: (2026)
par: Sakajo, Haruki, et autres
Publié: (2026)
Revisiting Uncertainty Estimation and Calibration of Large Language Models
par: Tao, Linwei, et autres
Publié: (2025)
par: Tao, Linwei, et autres
Publié: (2025)
In-context Autoencoder for Context Compression in a Large Language Model
par: Ge, Tao, et autres
Publié: (2023)
par: Ge, Tao, et autres
Publié: (2023)
Revisiting Entropy in Reinforcement Learning for Large Reasoning Models
par: Jin, Renren, et autres
Publié: (2025)
par: Jin, Renren, et autres
Publié: (2025)
Revisiting In-Context Learning with Long Context Language Models
par: Baek, Jinheon, et autres
Publié: (2024)
par: Baek, Jinheon, et autres
Publié: (2024)
PHOTON: Hierarchical Autoregressive Modeling for Lightspeed and Memory-Efficient Language Generation
par: Ichikawa, Yuma, et autres
Publié: (2025)
par: Ichikawa, Yuma, et autres
Publié: (2025)
Revisiting the Scaling Properties of Downstream Metrics in Large Language Model Training
par: Krajewski, Jakub, et autres
Publié: (2025)
par: Krajewski, Jakub, et autres
Publié: (2025)
Why Larger Language Models Do In-context Learning Differently?
par: Shi, Zhenmei, et autres
Publié: (2024)
par: Shi, Zhenmei, et autres
Publié: (2024)
Toward the Evaluation of Large Language Models Considering Score Variance across Instruction Templates
par: Sakai, Yusuke, et autres
Publié: (2024)
par: Sakai, Yusuke, et autres
Publié: (2024)
Towards Interpretable Sequence Continuation: Analyzing Shared Circuits in Large Language Models
par: Lan, Michael, et autres
Publié: (2023)
par: Lan, Michael, et autres
Publié: (2023)
Eliciting In-context Retrieval and Reasoning for Long-context Large Language Models
par: Qiu, Yifu, et autres
Publié: (2025)
par: Qiu, Yifu, et autres
Publié: (2025)
Second-Order Information Matters: Revisiting Machine Unlearning for Large Language Models
par: Gu, Kang, et autres
Publié: (2024)
par: Gu, Kang, et autres
Publié: (2024)
From Local to Global: Revisiting Structured Pruning Paradigms for Large Language Models
par: Wang, Ziyan, et autres
Publié: (2025)
par: Wang, Ziyan, et autres
Publié: (2025)
Revisiting Replay and Gradient Alignment for Continual Pre-Training of Large Language Models
par: Abbes, Istabrak, et autres
Publié: (2025)
par: Abbes, Istabrak, et autres
Publié: (2025)
Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis
par: Yang, Haolin, et autres
Publié: (2025)
par: Yang, Haolin, et autres
Publié: (2025)
An Efficient Inference Framework for Early-exit Large Language Models
par: Miao, Ruijie, et autres
Publié: (2024)
par: Miao, Ruijie, et autres
Publié: (2024)
Revisiting Prompt Sensitivity in Large Language Models for Text Classification: The Role of Prompt Underspecification
par: Pecher, Branislav, et autres
Publié: (2026)
par: Pecher, Branislav, et autres
Publié: (2026)
Causality Elicitation from Large Language Models
par: Kameyama, Takashi, et autres
Publié: (2026)
par: Kameyama, Takashi, et autres
Publié: (2026)
CORM: Cache Optimization with Recent Message for Large Language Model Inference
par: Dai, Jincheng, et autres
Publié: (2024)
par: Dai, Jincheng, et autres
Publié: (2024)
Revisiting Graph-Tokenizing Large Language Models: A Systematic Evaluation of Graph Token Understanding
par: Zhang, Zhongjian, et autres
Publié: (2026)
par: Zhang, Zhongjian, et autres
Publié: (2026)
ResumeAtlas: Revisiting Resume Classification with Large-Scale Datasets and Large Language Models
par: Heakl, Ahmed, et autres
Publié: (2024)
par: Heakl, Ahmed, et autres
Publié: (2024)
Large Language Models for Travel Behavior Prediction
par: Mo, Baichuan, et autres
Publié: (2023)
par: Mo, Baichuan, et autres
Publié: (2023)
Revisiting the Shape Convention of Transformer Language Models
par: Liao, Feng-Ting, et autres
Publié: (2026)
par: Liao, Feng-Ting, et autres
Publié: (2026)
mCSQA: Multilingual Commonsense Reasoning Dataset with Unified Creation Strategy by Language Models and Humans
par: Sakai, Yusuke, et autres
Publié: (2024)
par: Sakai, Yusuke, et autres
Publié: (2024)
Inference-Aware Fine-Tuning for Best-of-N Sampling in Large Language Models
par: Chow, Yinlam, et autres
Publié: (2024)
par: Chow, Yinlam, et autres
Publié: (2024)
LLMExplainer: Large Language Model based Bayesian Inference for Graph Explanation Generation
par: Zhang, Jiaxing, et autres
Publié: (2024)
par: Zhang, Jiaxing, et autres
Publié: (2024)
DP-Fusion: Token-Level Differentially Private Inference for Large Language Models
par: Thareja, Rushil, et autres
Publié: (2025)
par: Thareja, Rushil, et autres
Publié: (2025)
Documents similaires
-
Affinity and Diversity: A Unified Metric for Demonstration Selection via Internal Representations
par: Kato, Mariko, et autres
Publié: (2025) -
Token-based Decision Criteria Are Suboptimal in In-context Learning
par: Cho, Hakaze, et autres
Publié: (2024) -
Understanding Token Probability Encoding in Output Embeddings
par: Cho, Hakaze, et autres
Publié: (2024) -
Mechanistic Fine-tuning for In-context Learning
par: Cho, Hakaze, et autres
Publié: (2025) -
Mechanism of Task-oriented Information Removal in In-context Learning
par: Cho, Hakaze, et autres
Publié: (2025)