Enregistré dans:
| Auteurs principaux: | Timoneda, Joan C., Vera, Sebastián Vallejo |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2503.04874 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Machines Do See Color: A Guideline to Classify Different Forms of Racist Discourse in Large Corpora
par: Gordillo, Diana Davila, et autres
Publié: (2024)
par: Gordillo, Diana Davila, et autres
Publié: (2024)
Bias in LLMs as Annotators: The Effect of Party Cues on Labelling Decision by Large Language Models
par: Vera, Sebastian Vallejo, et autres
Publié: (2024)
par: Vera, Sebastian Vallejo, et autres
Publié: (2024)
One Model is All You Need: ByT5-Sanskrit, a Unified Model for Sanskrit NLP Tasks
par: Nehrdich, Sebastian, et autres
Publié: (2024)
par: Nehrdich, Sebastian, et autres
Publié: (2024)
Attention Is All You Need But You Don't Need All Of It For Inference of Large Language Models
par: Tyukin, Georgy, et autres
Publié: (2024)
par: Tyukin, Georgy, et autres
Publié: (2024)
The Synthetic Imputation Approach: Generating Optimal Synthetic Texts For Underrepresented Categories In Supervised Classification Tasks
par: Timoneda, Joan C.
Publié: (2025)
par: Timoneda, Joan C.
Publié: (2025)
Synthetic Data RL: Task Definition Is All You Need
par: Guo, Yiduo, et autres
Publié: (2025)
par: Guo, Yiduo, et autres
Publié: (2025)
How Does Code Pretraining Affect Language Model Task Performance?
par: Petty, Jackson, et autres
Publié: (2024)
par: Petty, Jackson, et autres
Publié: (2024)
Attention Is Not All You Need: The Importance of Feedforward Networks in Transformer Models
par: Gerber, Isaac
Publié: (2025)
par: Gerber, Isaac
Publié: (2025)
More Agents Is All You Need
par: Li, Junyou, et autres
Publié: (2024)
par: Li, Junyou, et autres
Publié: (2024)
Block Rotation is All You Need for MXFP4 Quantization
par: Shao, Yuantian, et autres
Publié: (2025)
par: Shao, Yuantian, et autres
Publié: (2025)
Tensor Product Attention Is All You Need
par: Zhang, Yifan, et autres
Publié: (2025)
par: Zhang, Yifan, et autres
Publié: (2025)
Attention Smoothing Is All You Need For Unlearning
par: Zade, Saleh Zare, et autres
Publié: (2026)
par: Zade, Saleh Zare, et autres
Publié: (2026)
Not All Thoughts Need HBM: Semantics-Aware Memory Hierarchy for LLM Reasoning
par: Yuan, Aojie, et autres
Publié: (2026)
par: Yuan, Aojie, et autres
Publié: (2026)
Confidence Is All You Need: Few-Shot RL Fine-Tuning of Language Models
par: Li, Pengyi, et autres
Publié: (2025)
par: Li, Pengyi, et autres
Publié: (2025)
Annotation Sensitivity: Training Data Collection Methods Affect Model Performance
par: Kern, Christoph, et autres
Publié: (2023)
par: Kern, Christoph, et autres
Publié: (2023)
Evaluation is All You Need: Strategic Overclaiming of LLM Reasoning Capabilities Through Evaluation Design
par: Sun, Lin, et autres
Publié: (2025)
par: Sun, Lin, et autres
Publié: (2025)
Guidance is All You Need: Temperature-Guided Reasoning in Large Language Models
par: Gomaa, Eyad, et autres
Publié: (2024)
par: Gomaa, Eyad, et autres
Publié: (2024)
Evidence Is All You Need: Ordering Imaging Studies via Language Model Alignment with the ACR Appropriateness Criteria
par: Yao, Michael S., et autres
Publié: (2024)
par: Yao, Michael S., et autres
Publié: (2024)
Attention Is All You Need for KV Cache in Diffusion LLMs
par: Nguyen-Tri, Quan, et autres
Publié: (2025)
par: Nguyen-Tri, Quan, et autres
Publié: (2025)
Evaluating Memory Structure in LLM Agents
par: Shutova, Alina, et autres
Publié: (2026)
par: Shutova, Alina, et autres
Publié: (2026)
All You Need is One: Capsule Prompt Tuning with a Single Vector
par: Liu, Yiyang, et autres
Publié: (2025)
par: Liu, Yiyang, et autres
Publié: (2025)
Intrinsic Fingerprint of LLMs: Continue Training is NOT All You Need to Steal A Model!
par: Yoon, Do-hyeon, et autres
Publié: (2025)
par: Yoon, Do-hyeon, et autres
Publié: (2025)
Winner-Take-All Column Row Sampling for Memory Efficient Adaptation of Language Model
par: Liu, Zirui, et autres
Publié: (2023)
par: Liu, Zirui, et autres
Publié: (2023)
Reformulation is All You Need: Addressing Malicious Text Features in DNNs
par: Jiang, Yi, et autres
Publié: (2025)
par: Jiang, Yi, et autres
Publié: (2025)
Can Memory-Augmented Language Models Generalize on Reasoning-in-a-Haystack Tasks?
par: Das, Payel, et autres
Publié: (2025)
par: Das, Payel, et autres
Publié: (2025)
SecEncoder: Logs are All You Need in Security
par: Bulut, Muhammed Fatih, et autres
Publié: (2024)
par: Bulut, Muhammed Fatih, et autres
Publié: (2024)
Are More LLM Calls All You Need? Towards Scaling Laws of Compound Inference Systems
par: Chen, Lingjiao, et autres
Publié: (2024)
par: Chen, Lingjiao, et autres
Publié: (2024)
How Does Quantization Affect Multilingual LLMs?
par: Marchisio, Kelly, et autres
Publié: (2024)
par: Marchisio, Kelly, et autres
Publié: (2024)
Assessing Episodic Memory in LLMs with Sequence Order Recall Tasks
par: Pink, Mathis, et autres
Publié: (2024)
par: Pink, Mathis, et autres
Publié: (2024)
Dynamic Cheatsheet: Test-Time Learning with Adaptive Memory
par: Suzgun, Mirac, et autres
Publié: (2025)
par: Suzgun, Mirac, et autres
Publié: (2025)
Are Retrials All You Need? Enhancing Large Language Model Reasoning Without Verbalized Feedback
par: Potamitis, Nearchos, et autres
Publié: (2025)
par: Potamitis, Nearchos, et autres
Publié: (2025)
Memory and Bandwidth are All You Need for Fully Sharded Data Parallel
par: Wang, Jiangtao, et autres
Publié: (2025)
par: Wang, Jiangtao, et autres
Publié: (2025)
Language Model Memory and Memory Models for Language
par: Badger, Benjamin L.
Publié: (2026)
par: Badger, Benjamin L.
Publié: (2026)
Augmenting Human Evaluation with LLM Judges: How Many Human Reviews Do You Need?
par: Kim, Jane Paik
Publié: (2026)
par: Kim, Jane Paik
Publié: (2026)
An Extra RMSNorm is All You Need for Fine Tuning to 1.58 Bits
par: Steinmetz, Cody, et autres
Publié: (2025)
par: Steinmetz, Cody, et autres
Publié: (2025)
Think Before You Act: Decision Transformers with Working Memory
par: Kang, Jikun, et autres
Publié: (2023)
par: Kang, Jikun, et autres
Publié: (2023)
Identifying the sources of ideological bias in GPT models through linguistic variation in output
par: Walker, Christina, et autres
Publié: (2024)
par: Walker, Christina, et autres
Publié: (2024)
Goal-Directed Search Outperforms Goal-Agnostic Memory Compression in Long-Context Memory Tasks
par: Zheng, Yicong, et autres
Publié: (2025)
par: Zheng, Yicong, et autres
Publié: (2025)
Attention Score is not All You Need for Token Importance Indicator in KV Cache Reduction: Value Also Matters
par: Guo, Zhiyu, et autres
Publié: (2024)
par: Guo, Zhiyu, et autres
Publié: (2024)
CAMformer: Associative Memory is All You Need
par: Molom-Ochir, Tergel, et autres
Publié: (2025)
par: Molom-Ochir, Tergel, et autres
Publié: (2025)
Documents similaires
-
Machines Do See Color: A Guideline to Classify Different Forms of Racist Discourse in Large Corpora
par: Gordillo, Diana Davila, et autres
Publié: (2024) -
Bias in LLMs as Annotators: The Effect of Party Cues on Labelling Decision by Large Language Models
par: Vera, Sebastian Vallejo, et autres
Publié: (2024) -
One Model is All You Need: ByT5-Sanskrit, a Unified Model for Sanskrit NLP Tasks
par: Nehrdich, Sebastian, et autres
Publié: (2024) -
Attention Is All You Need But You Don't Need All Of It For Inference of Large Language Models
par: Tyukin, Georgy, et autres
Publié: (2024) -
The Synthetic Imputation Approach: Generating Optimal Synthetic Texts For Underrepresented Categories In Supervised Classification Tasks
par: Timoneda, Joan C.
Publié: (2025)