Enregistré dans:
| Auteurs principaux: | Kardos, Márton, Kostkan, Jan, Vermillet, Arnault-Quentin, Nielbo, Kristoffer, Enevoldsen, Kenneth, Rocca, Roberta |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2406.09556 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Topeax -- An Improved Clustering Topic Model with Density Peak Detection and Lexical-Semantic Term Importance
par: Kardos, Márton
Publié: (2026)
par: Kardos, Márton
Publié: (2026)
Encoder vs Decoder: Comparative Analysis of Encoder and Decoder Language Models on Multilingual NLU Tasks
par: Nielsen, Dan Saattrup, et autres
Publié: (2024)
par: Nielsen, Dan Saattrup, et autres
Publié: (2024)
Resonant Context Anchoring: Decoupling Attention Routing and Signal Gain at Inference Time
par: Zhao, Mingkuan, et autres
Publié: (2026)
par: Zhao, Mingkuan, et autres
Publié: (2026)
Geometric Deviation as an Unsupervised Pre-Generation Reliability Signal: Probing LLM Representations for Answerability
par: Du, Yucheng
Publié: (2026)
par: Du, Yucheng
Publié: (2026)
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
par: Oketunji, Abiodun Finbarrs
Publié: (2023)
par: Oketunji, Abiodun Finbarrs
Publié: (2023)
topicwizard -- a Modern, Model-agnostic Framework for Topic Model Visualization and Interpretation
par: Kardos, Márton, et autres
Publié: (2025)
par: Kardos, Márton, et autres
Publié: (2025)
Improving the Capabilities of Large Language Model Based Marketing Analytics Copilots With Semantic Search And Fine-Tuning
par: Gao, Yilin, et autres
Publié: (2024)
par: Gao, Yilin, et autres
Publié: (2024)
Future Token Prediction -- Causal Language Modelling with Per-Token Semantic State Vector for Multi-Token Prediction
par: Walker, Nicholas
Publié: (2024)
par: Walker, Nicholas
Publié: (2024)
Path-Lock Expert: Separating Reasoning Mode in Hybrid Thinking via Architecture-Level Separation
par: Wang, Shouren, et autres
Publié: (2026)
par: Wang, Shouren, et autres
Publié: (2026)
Large Language Model (LLM) Bias Index -- LLMBI
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023)
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023)
Engineering A Large Language Model From Scratch
par: Oketunji, Abiodun Finbarrs
Publié: (2024)
par: Oketunji, Abiodun Finbarrs
Publié: (2024)
GenAI Content Detection Task 3: Cross-Domain Machine-Generated Text Detection Challenge
par: Dugan, Liam, et autres
Publié: (2025)
par: Dugan, Liam, et autres
Publié: (2025)
Weakly Supervised Distillation of Hallucination Signals into Transformer Representations
par: Salehmohamed, Shoaib Sadiq, et autres
Publié: (2026)
par: Salehmohamed, Shoaib Sadiq, et autres
Publié: (2026)
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
par: Fadli, Samih
Publié: (2025)
par: Fadli, Samih
Publié: (2025)
Harnessing Negative Signals: Reinforcement Distillation from Teacher Data for LLM Reasoning
par: Xu, Shuyao, et autres
Publié: (2025)
par: Xu, Shuyao, et autres
Publié: (2025)
Semantic Convergence: Investigating Shared Representations Across Scaled LLMs
par: Son, Daniel, et autres
Publié: (2025)
par: Son, Daniel, et autres
Publié: (2025)
In-Context Fixation: When Demonstrated Labels Override Semantics in Few-Shot Classification
par: Liu, Ming
Publié: (2026)
par: Liu, Ming
Publié: (2026)
Language as a Wave Phenomenon: Semantic Phase Locking and Interference in Neural Networks
par: Yıldırım, Alper, et autres
Publié: (2025)
par: Yıldırım, Alper, et autres
Publié: (2025)
MMSciBench: Benchmarking Language Models on Chinese Multimodal Scientific Problems
par: Ye, Xinwu, et autres
Publié: (2025)
par: Ye, Xinwu, et autres
Publié: (2025)
Influence-driven Curriculum Learning for Pre-training on Limited Data
par: Schoenegger, Loris, et autres
Publié: (2025)
par: Schoenegger, Loris, et autres
Publié: (2025)
Towards Latent Diffusion Suitable For Text
par: Midavaine, Nesta, et autres
Publié: (2026)
par: Midavaine, Nesta, et autres
Publié: (2026)
SpectralLoRA: Is Low-Frequency Structure Sufficient for LoRA Adaptation? A Spectral Analysis of Weight Updates
par: Singh, Rajveer
Publié: (2026)
par: Singh, Rajveer
Publié: (2026)
BLP-2023 Task 2: Sentiment Analysis
par: Hasan, Md. Arid, et autres
Publié: (2023)
par: Hasan, Md. Arid, et autres
Publié: (2023)
FIM-LoRA: Task-Informative Rank Allocation for LoRA via Calibration-Time Gradient-Variance Estimation
par: Sathyavageeswaran, Ramakrishnan
Publié: (2026)
par: Sathyavageeswaran, Ramakrishnan
Publié: (2026)
Have Faith in Faithfulness: Going Beyond Circuit Overlap When Finding Model Mechanisms
par: Hanna, Michael, et autres
Publié: (2024)
par: Hanna, Michael, et autres
Publié: (2024)
Integrating Expert Labels into LLM-based Emission Goal Detection: Example Selection vs Automatic Prompt Design
par: Wrzalik, Marco, et autres
Publié: (2024)
par: Wrzalik, Marco, et autres
Publié: (2024)
Amulet: ReAlignment During Test Time for Personalized Preference Adaptation of LLMs
par: Zhang, Zhaowei, et autres
Publié: (2025)
par: Zhang, Zhaowei, et autres
Publié: (2025)
Where Should LoRA Go? Component-Type Placement in Hybrid Language Models
par: Borobia, Hector, et autres
Publié: (2026)
par: Borobia, Hector, et autres
Publié: (2026)
Interpreto: An Explainability Library for Transformers
par: Poché, Antonin, et autres
Publié: (2025)
par: Poché, Antonin, et autres
Publié: (2025)
RightNow-Arabic-0.5B-Turbo: An Open Sub-1B Arabic Language Model via Vocabulary Injection and Edge-First Deployment
par: Jaber, Jaber, et autres
Publié: (2026)
par: Jaber, Jaber, et autres
Publié: (2026)
Structured-Sparse Attention for Entity Tracking with Subquadratic Sequence Complexity
par: Zhao, Hangyue, et autres
Publié: (2026)
par: Zhao, Hangyue, et autres
Publié: (2026)
Efficacy of ByT5 in Multilingual Translation of Biblical Texts for Underrepresented Languages
par: Aars, Corinne, et autres
Publié: (2024)
par: Aars, Corinne, et autres
Publié: (2024)
WSM: Decay-Free Learning Rate Schedule via Checkpoint Merging for LLM Pre-training
par: Tian, Changxin, et autres
Publié: (2025)
par: Tian, Changxin, et autres
Publié: (2025)
PowLU: An Activation Function for Stable Pre-Training of LLMs
par: Jiang, Peijie, et autres
Publié: (2026)
par: Jiang, Peijie, et autres
Publié: (2026)
Reconstructing Syllable Sequences in Abugida Scripts with Incomplete Inputs
par: Thu, Ye Kyaw, et autres
Publié: (2025)
par: Thu, Ye Kyaw, et autres
Publié: (2025)
Human-interpretable clustering of short-text using large language models
par: Miller, Justin K., et autres
Publié: (2024)
par: Miller, Justin K., et autres
Publié: (2024)
Scaling Laws for Forgetting When Fine-Tuning Large Language Models
par: Kalajdzievski, Damjan
Publié: (2024)
par: Kalajdzievski, Damjan
Publié: (2024)
Structure-Guided Entity Resolution: Fine-Tuning LLMs for Robust Name Matching in Complex Linguistic Contexts
par: Chourasia, Shivam, et autres
Publié: (2026)
par: Chourasia, Shivam, et autres
Publié: (2026)
Lon-ea at SemEval-2023 Task 11: A Comparison of Activation Functions for Soft and Hard Label Prediction
par: Hosseini, Peyman, et autres
Publié: (2023)
par: Hosseini, Peyman, et autres
Publié: (2023)
A Framework for Fine-Tuning LLMs using Heterogeneous Feedback
par: Aponte, Ryan, et autres
Publié: (2024)
par: Aponte, Ryan, et autres
Publié: (2024)
Documents similaires
-
Topeax -- An Improved Clustering Topic Model with Density Peak Detection and Lexical-Semantic Term Importance
par: Kardos, Márton
Publié: (2026) -
Encoder vs Decoder: Comparative Analysis of Encoder and Decoder Language Models on Multilingual NLU Tasks
par: Nielsen, Dan Saattrup, et autres
Publié: (2024) -
Resonant Context Anchoring: Decoupling Attention Routing and Signal Gain at Inference Time
par: Zhao, Mingkuan, et autres
Publié: (2026) -
Geometric Deviation as an Unsupervised Pre-Generation Reliability Signal: Probing LLM Representations for Answerability
par: Du, Yucheng
Publié: (2026) -
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
par: Oketunji, Abiodun Finbarrs
Publié: (2023)