In-Context Algebra
Fuente:
arXiv
Salvato in:
| Autori principali: | Todd, Eric, Brinkmann, Jannik, Gandikota, Rohit, Bau, David |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Token Erasure as a Footprint of Implicit Vocabulary Items in LLMs
di: Feucht, Sheridan, et al.
Pubblicazione: (2024)
di: Feucht, Sheridan, et al.
Pubblicazione: (2024)
Steering Language Models in Multi-Token Generation: A Case Study on Tense and Aspect
di: Klerings, Alina, et al.
Pubblicazione: (2025)
di: Klerings, Alina, et al.
Pubblicazione: (2025)
The Dual-Route Model of Induction
di: Feucht, Sheridan, et al.
Pubblicazione: (2025)
di: Feucht, Sheridan, et al.
Pubblicazione: (2025)
Overcoming Long-Context Limitations of State-Space Models via Context-Dependent Sparse Attention
di: Zhan, Zhihao, et al.
Pubblicazione: (2025)
di: Zhan, Zhihao, et al.
Pubblicazione: (2025)
Position-aware Automatic Circuit Discovery
di: Haklay, Tal, et al.
Pubblicazione: (2025)
di: Haklay, Tal, et al.
Pubblicazione: (2025)
Resonant Context Anchoring: Decoupling Attention Routing and Signal Gain at Inference Time
di: Zhao, Mingkuan, et al.
Pubblicazione: (2026)
di: Zhao, Mingkuan, et al.
Pubblicazione: (2026)
Structure-Guided Entity Resolution: Fine-Tuning LLMs for Robust Name Matching in Complex Linguistic Contexts
di: Chourasia, Shivam, et al.
Pubblicazione: (2026)
di: Chourasia, Shivam, et al.
Pubblicazione: (2026)
Context-Aware Clustering using Large Language Models
di: Tipirneni, Sindhu, et al.
Pubblicazione: (2024)
di: Tipirneni, Sindhu, et al.
Pubblicazione: (2024)
Efficient Solutions For An Intriguing Failure of LLMs: Long Context Window Does Not Mean LLMs Can Analyze Long Sequences Flawlessly
di: Hosseini, Peyman, et al.
Pubblicazione: (2024)
di: Hosseini, Peyman, et al.
Pubblicazione: (2024)
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2023)
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2023)
TIME: Temporally Intelligent Meta-reasoning Engine for Context-Triggered Explicit Reasoning
di: Das, Susmit
Pubblicazione: (2026)
di: Das, Susmit
Pubblicazione: (2026)
Bayesian Attention Mechanism: A Probabilistic Framework for Positional Encoding and Context Length Extrapolation
di: Bianchessi, Arthur S., et al.
Pubblicazione: (2025)
di: Bianchessi, Arthur S., et al.
Pubblicazione: (2025)
MedFuzz: Exploring the Robustness of Large Language Models in Medical Question Answering
di: Ness, Robert Osazuwa, et al.
Pubblicazione: (2024)
di: Ness, Robert Osazuwa, et al.
Pubblicazione: (2024)
Enhancing Traffic Accident Classifications: Application of NLP Methods for City Safety
di: Özeren, Enes, et al.
Pubblicazione: (2025)
di: Özeren, Enes, et al.
Pubblicazione: (2025)
Large Language Model (LLM) Bias Index -- LLMBI
di: Oketunji, Abiodun Finbarrs, et al.
Pubblicazione: (2023)
di: Oketunji, Abiodun Finbarrs, et al.
Pubblicazione: (2023)
Engineering A Large Language Model From Scratch
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2024)
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2024)
Beyond Hallucinations: A Composite Score for Measuring Reliability in Open-Source Large Language Models
di: Salla, Rohit Kumar, et al.
Pubblicazione: (2025)
di: Salla, Rohit Kumar, et al.
Pubblicazione: (2025)
CG-TTRL: Context-Guided Test-Time Reinforcement Learning for On-Device Large Language Models
di: Hosseini, Peyman, et al.
Pubblicazione: (2025)
di: Hosseini, Peyman, et al.
Pubblicazione: (2025)
Advancing Transformer Architecture in Long-Context Large Language Models: A Comprehensive Survey
di: Huang, Yunpeng, et al.
Pubblicazione: (2023)
di: Huang, Yunpeng, et al.
Pubblicazione: (2023)
MMSciBench: Benchmarking Language Models on Chinese Multimodal Scientific Problems
di: Ye, Xinwu, et al.
Pubblicazione: (2025)
di: Ye, Xinwu, et al.
Pubblicazione: (2025)
Influence-driven Curriculum Learning for Pre-training on Limited Data
di: Schoenegger, Loris, et al.
Pubblicazione: (2025)
di: Schoenegger, Loris, et al.
Pubblicazione: (2025)
Amulet: ReAlignment During Test Time for Personalized Preference Adaptation of LLMs
di: Zhang, Zhaowei, et al.
Pubblicazione: (2025)
di: Zhang, Zhaowei, et al.
Pubblicazione: (2025)
Interpreto: An Explainability Library for Transformers
di: Poché, Antonin, et al.
Pubblicazione: (2025)
di: Poché, Antonin, et al.
Pubblicazione: (2025)
GenAI Content Detection Task 3: Cross-Domain Machine-Generated Text Detection Challenge
di: Dugan, Liam, et al.
Pubblicazione: (2025)
di: Dugan, Liam, et al.
Pubblicazione: (2025)
WSM: Decay-Free Learning Rate Schedule via Checkpoint Merging for LLM Pre-training
di: Tian, Changxin, et al.
Pubblicazione: (2025)
di: Tian, Changxin, et al.
Pubblicazione: (2025)
Reconstructing Syllable Sequences in Abugida Scripts with Incomplete Inputs
di: Thu, Ye Kyaw, et al.
Pubblicazione: (2025)
di: Thu, Ye Kyaw, et al.
Pubblicazione: (2025)
Ambiguity in LLMs is a concept missing problem
di: Hu, Zhibo, et al.
Pubblicazione: (2025)
di: Hu, Zhibo, et al.
Pubblicazione: (2025)
Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment
di: Zhang, Yizhuo, et al.
Pubblicazione: (2025)
di: Zhang, Yizhuo, et al.
Pubblicazione: (2025)
Constraint-Driven Small Language Models Based on Agent and OpenAlex Knowledge Graph: Mining Conceptual Pathways and Discovering Innovation Points in Academic Papers
di: Xia, Ziye, et al.
Pubblicazione: (2025)
di: Xia, Ziye, et al.
Pubblicazione: (2025)
Digital Guardians: Can GPT-4, Perspective API, and Moderation API reliably detect hate speech in reader comments of German online newspapers?
di: Weber, Manuel, et al.
Pubblicazione: (2025)
di: Weber, Manuel, et al.
Pubblicazione: (2025)
QiMeng-Attention: SOTA Attention Operator is generated by SOTA Attention Algorithm
di: Zhou, Qirui, et al.
Pubblicazione: (2025)
di: Zhou, Qirui, et al.
Pubblicazione: (2025)
Reinforcement Learning for Latent-Space Thinking in LLMs
di: Özeren, Enes, et al.
Pubblicazione: (2025)
di: Özeren, Enes, et al.
Pubblicazione: (2025)
HYPEROFA: Expanding LLM Vocabulary to New Languages via Hypernetwork-Based Embedding Initialization
di: Özeren, Enes, et al.
Pubblicazione: (2025)
di: Özeren, Enes, et al.
Pubblicazione: (2025)
ZERA: Zero-init Instruction Evolving Refinement Agent -- From Zero Instructions to Structured Prompts via Principle-based Optimization
di: Yi, Seungyoun, et al.
Pubblicazione: (2025)
di: Yi, Seungyoun, et al.
Pubblicazione: (2025)
QUAD: Quantization and Parameter-Efficient Tuning of LLM with Activation Decomposition
di: Hu, Yuxuan, et al.
Pubblicazione: (2025)
di: Hu, Yuxuan, et al.
Pubblicazione: (2025)
From Facts to Folklore: Evaluating Large Language Models on Bengali Cultural Knowledge
di: Chowdhury, Nafis, et al.
Pubblicazione: (2025)
di: Chowdhury, Nafis, et al.
Pubblicazione: (2025)
Towards Latent Diffusion Suitable For Text
di: Midavaine, Nesta, et al.
Pubblicazione: (2026)
di: Midavaine, Nesta, et al.
Pubblicazione: (2026)
SpectralLoRA: Is Low-Frequency Structure Sufficient for LoRA Adaptation? A Spectral Analysis of Weight Updates
di: Singh, Rajveer
Pubblicazione: (2026)
di: Singh, Rajveer
Pubblicazione: (2026)
BLP-2023 Task 2: Sentiment Analysis
di: Hasan, Md. Arid, et al.
Pubblicazione: (2023)
di: Hasan, Md. Arid, et al.
Pubblicazione: (2023)
FIM-LoRA: Task-Informative Rank Allocation for LoRA via Calibration-Time Gradient-Variance Estimation
di: Sathyavageeswaran, Ramakrishnan
Pubblicazione: (2026)
di: Sathyavageeswaran, Ramakrishnan
Pubblicazione: (2026)
Documenti analoghi
-
Token Erasure as a Footprint of Implicit Vocabulary Items in LLMs
di: Feucht, Sheridan, et al.
Pubblicazione: (2024) -
Steering Language Models in Multi-Token Generation: A Case Study on Tense and Aspect
di: Klerings, Alina, et al.
Pubblicazione: (2025) -
The Dual-Route Model of Induction
di: Feucht, Sheridan, et al.
Pubblicazione: (2025) -
Overcoming Long-Context Limitations of State-Space Models via Context-Dependent Sparse Attention
di: Zhan, Zhihao, et al.
Pubblicazione: (2025) -
Position-aware Automatic Circuit Discovery
di: Haklay, Tal, et al.
Pubblicazione: (2025)