Enregistré dans:
| Auteur principal: | Kotte, Varun |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2601.06151 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
UCCI: Calibrated Uncertainty for Cost-Optimal LLM Cascade Routing
par: Kotte, Varun
Publié: (2026)
par: Kotte, Varun
Publié: (2026)
PASC: Pipeline-Aware Conformal Prediction with Joint Coverage Guarantees for Multi-Stage NLP and LLM Pipelines
par: Kotte, Varun
Publié: (2026)
par: Kotte, Varun
Publié: (2026)
Not All Queries Need Rewriting: When Prompt-Only LLM Refinement Helps and Hurts Dense Retrieval
par: Kotte, Varun
Publié: (2026)
par: Kotte, Varun
Publié: (2026)
Towards Reliable Latent Knowledge Estimation in LLMs: Zero-Prompt Many-Shot Based Factual Knowledge Extraction
par: Wu, Qinyuan, et autres
Publié: (2024)
par: Wu, Qinyuan, et autres
Publié: (2024)
Prompting Large Language Models for Clinical Temporal Relation Extraction
par: He, Jianping, et autres
Publié: (2024)
par: He, Jianping, et autres
Publié: (2024)
xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction
par: Chang, Chi-Chih, et autres
Publié: (2025)
par: Chang, Chi-Chih, et autres
Publié: (2025)
PolyPrompt: Automating Knowledge Extraction from Multilingual Language Models with Dynamic Prompt Generation
par: Roll, Nathan
Publié: (2025)
par: Roll, Nathan
Publié: (2025)
PARSE: LLM Driven Schema Optimization for Reliable Entity Extraction
par: Shrimal, Anubhav, et autres
Publié: (2025)
par: Shrimal, Anubhav, et autres
Publié: (2025)
Retrieval Augmented Generation for Domain-specific Question Answering
par: Sharma, Sanat, et autres
Publié: (2024)
par: Sharma, Sanat, et autres
Publié: (2024)
Towards Lightweight Reliability: Using Soft Prompts for Hallucination Mitigation in Large Language Models
par: Siddiqui, S M Tahmid, et autres
Publié: (2026)
par: Siddiqui, S M Tahmid, et autres
Publié: (2026)
Provable Knowledge Acquisition and Extraction in One-Layer Transformers
par: Xu, Ruichen, et autres
Publié: (2025)
par: Xu, Ruichen, et autres
Publié: (2025)
Adaptive Prompting for Continual Relation Extraction: A Within-Task Variance Perspective
par: Le, Minh, et autres
Publié: (2024)
par: Le, Minh, et autres
Publié: (2024)
Better Prompt Compression Without Multi-Layer Perceptrons
par: Honig, Edouardo, et autres
Publié: (2025)
par: Honig, Edouardo, et autres
Publié: (2025)
Basis Sharing: Cross-Layer Parameter Sharing for Large Language Model Compression
par: Wang, Jingcun, et autres
Publié: (2024)
par: Wang, Jingcun, et autres
Publié: (2024)
Reward-based Input Construction for Cross-document Relation Extraction
par: Na, Byeonghu, et autres
Publié: (2024)
par: Na, Byeonghu, et autres
Publié: (2024)
Leveraging Large Language Models for Structure Learning in Prompted Weak Supervision
par: Su, Jinyan, et autres
Publié: (2024)
par: Su, Jinyan, et autres
Publié: (2024)
Adaptive Prompt Structure Factorization: A Framework for Self-Discovering and Optimizing Compositional Prompt Programs
par: Liu, Haoyue, et autres
Publié: (2026)
par: Liu, Haoyue, et autres
Publié: (2026)
Which Client is Reliable?: A Reliable and Personalized Prompt-based Federated Learning for Medical Image Question Answering
par: Zhu, He, et autres
Publié: (2024)
par: Zhu, He, et autres
Publié: (2024)
An Aspect Extraction Framework using Different Embedding Types, Learning Models, and Dependency Structure
par: Erkan, Ali, et autres
Publié: (2025)
par: Erkan, Ali, et autres
Publié: (2025)
Structured Prompts Improve Evaluation of Language Models
par: Aali, Asad, et autres
Publié: (2025)
par: Aali, Asad, et autres
Publié: (2025)
Advancing Multi-Step Mathematical Reasoning in Large Language Models through Multi-Layered Self-Reflection with Auto-Prompting
par: Loureiro, André de Souza, et autres
Publié: (2025)
par: Loureiro, André de Souza, et autres
Publié: (2025)
CLT-Forge: A Scalable Library for Cross-Layer Transcoders and Attribution Graphs
par: Draye, Florent, et autres
Publié: (2026)
par: Draye, Florent, et autres
Publié: (2026)
Pause Tokens Strictly Increase the Expressivity of Constant-Depth Transformers
par: London, Charles, et autres
Publié: (2025)
par: London, Charles, et autres
Publié: (2025)
Cross-Layer Discrete Concept Discovery for Interpreting Language Models
par: Garg, Ankur, et autres
Publié: (2025)
par: Garg, Ankur, et autres
Publié: (2025)
CLAA: Cross-Layer Attention Aggregation for Accelerating LLM Prefill
par: McDanel, Bradley, et autres
Publié: (2026)
par: McDanel, Bradley, et autres
Publié: (2026)
Dynamic Prompt Fusion for Multi-Task and Cross-Domain Adaptation in LLMs
par: Hu, Xin, et autres
Publié: (2025)
par: Hu, Xin, et autres
Publié: (2025)
Real-Time Trustworthiness Scoring for LLM Structured Outputs and Data Extraction
par: Goh, Hui Wen, et autres
Publié: (2026)
par: Goh, Hui Wen, et autres
Publié: (2026)
Reducing Transformer Key-Value Cache Size with Cross-Layer Attention
par: Brandon, William, et autres
Publié: (2024)
par: Brandon, William, et autres
Publié: (2024)
On the Geometric Structure of Layer Updates in Deep Language Models
par: Yoo, Jun-Sik
Publié: (2026)
par: Yoo, Jun-Sik
Publié: (2026)
How Reliable is Language Model Micro-Benchmarking?
par: Yauney, Gregory, et autres
Publié: (2025)
par: Yauney, Gregory, et autres
Publié: (2025)
IndexCache: Accelerating Sparse Attention via Cross-Layer Index Reuse
par: Bai, Yushi, et autres
Publié: (2026)
par: Bai, Yushi, et autres
Publié: (2026)
CP-Prompt: Composition-Based Cross-modal Prompting for Domain-Incremental Continual Learning
par: Feng, Yu, et autres
Publié: (2024)
par: Feng, Yu, et autres
Publié: (2024)
SABER: Uncovering Vulnerabilities in Safety Alignment via Cross-Layer Residual Connection
par: Joshi, Maithili, et autres
Publié: (2025)
par: Joshi, Maithili, et autres
Publié: (2025)
Layer Swapping for Zero-Shot Cross-Lingual Transfer in Large Language Models
par: Bandarkar, Lucas, et autres
Publié: (2024)
par: Bandarkar, Lucas, et autres
Publié: (2024)
BenchAgents: Multi-Agent Systems for Structured Benchmark Creation
par: Butt, Natasha, et autres
Publié: (2024)
par: Butt, Natasha, et autres
Publié: (2024)
Attention Speaks Volumes: Localizing and Mitigating Bias in Language Models
par: Adiga, Rishabh, et autres
Publié: (2024)
par: Adiga, Rishabh, et autres
Publié: (2024)
Designing Informative Metrics for Few-Shot Example Selection
par: Adiga, Rishabh, et autres
Publié: (2024)
par: Adiga, Rishabh, et autres
Publié: (2024)
Improving Structural Diversity of Blackbox LLMs via Chain-of-Specification Prompting
par: Young, Halley, et autres
Publié: (2024)
par: Young, Halley, et autres
Publié: (2024)
A Single-Layer Model Can Do Language Modeling
par: Wang, Zanmin
Publié: (2026)
par: Wang, Zanmin
Publié: (2026)
Do Large Language Model Benchmarks Test Reliability?
par: Vendrow, Joshua, et autres
Publié: (2025)
par: Vendrow, Joshua, et autres
Publié: (2025)
Documents similaires
-
UCCI: Calibrated Uncertainty for Cost-Optimal LLM Cascade Routing
par: Kotte, Varun
Publié: (2026) -
PASC: Pipeline-Aware Conformal Prediction with Joint Coverage Guarantees for Multi-Stage NLP and LLM Pipelines
par: Kotte, Varun
Publié: (2026) -
Not All Queries Need Rewriting: When Prompt-Only LLM Refinement Helps and Hurts Dense Retrieval
par: Kotte, Varun
Publié: (2026) -
Towards Reliable Latent Knowledge Estimation in LLMs: Zero-Prompt Many-Shot Based Factual Knowledge Extraction
par: Wu, Qinyuan, et autres
Publié: (2024) -
Prompting Large Language Models for Clinical Temporal Relation Extraction
par: He, Jianping, et autres
Publié: (2024)