An Analysis of Active Learning Algorithms using Real-World Crowd-sourced Text Annotations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Totakura, Varun, Singh, Ankita, Dong, Yushun, Chakraborty, Shayok |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Exploring LLM-based Verilog Code Generation with Data-Efficient Fine-Tuning and Testbench Automation
par: Chen, Mu-Chi, et autres
Publié: (2026)
par: Chen, Mu-Chi, et autres
Publié: (2026)
Efficient Telecom Specific LLM: TSLAM-Mini with QLoRA and Digital Twin Data
par: Ethiraj, Vignesh, et autres
Publié: (2025)
par: Ethiraj, Vignesh, et autres
Publié: (2025)
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
par: Fadli, Samih
Publié: (2025)
par: Fadli, Samih
Publié: (2025)
On the Influence of Discourse Relations in Persuasive Texts
par: Turk, Nawar, et autres
Publié: (2025)
par: Turk, Nawar, et autres
Publié: (2025)
Layer-Aware Embedding Fusion for LLMs in Text Classifications
par: Gwak, Jiho, et autres
Publié: (2025)
par: Gwak, Jiho, et autres
Publié: (2025)
Survey Transfer Learning: Recycling Data with Silicon Responses
par: Amini, Ali
Publié: (2025)
par: Amini, Ali
Publié: (2025)
Emergent Lexical Semantics in Neural Language Models: Testing Martin's Law on LLM-Generated Text
par: Kugler, Kai
Publié: (2025)
par: Kugler, Kai
Publié: (2025)
TRiMS: Real-Time Tracking of Minimal Sufficient Length for Efficient Reasoning via RL
par: Bian, Tingcheng, et autres
Publié: (2026)
par: Bian, Tingcheng, et autres
Publié: (2026)
Automated CAD Modeling Sequence Generation from Text Descriptions via Transformer-Based Large Language Models
par: Liao, Jianxing, et autres
Publié: (2025)
par: Liao, Jianxing, et autres
Publié: (2025)
Latent Cache Flow: Model-to-Model Communication Without Text
par: Rossi, Maximillian, et autres
Publié: (2026)
par: Rossi, Maximillian, et autres
Publié: (2026)
SiliconMind-V1: Multi-Agent Distillation and Debug-Reasoning Workflows for Verilog Code Generation
par: Chen, Mu-Chi, et autres
Publié: (2026)
par: Chen, Mu-Chi, et autres
Publié: (2026)
LLM-Rubric: A Multidimensional, Calibrated Approach to Automated Evaluation of Natural Language Texts
par: Hashemi, Helia, et autres
Publié: (2024)
par: Hashemi, Helia, et autres
Publié: (2024)
Variance Is Not Importance: Structural Analysis of Transformer Compressibility Across Model Scales
par: Salfati, Samuel
Publié: (2026)
par: Salfati, Samuel
Publié: (2026)
TensorLens: End-to-End Transformer Analysis via High-Order Attention Tensors
par: Atad, Ido Andrew, et autres
Publié: (2026)
par: Atad, Ido Andrew, et autres
Publié: (2026)
Transformer Scalability Crisis: The First Comprehensive Empirical Analysis of Performance Walls in Modern Language Models
par: Moghadasi, Mahdi Naser, et autres
Publié: (2026)
par: Moghadasi, Mahdi Naser, et autres
Publié: (2026)
Induce, Align, Predict: Zero-Shot Stance Detection via Cognitive Inductive Reasoning
par: Zhang, Bowen, et autres
Publié: (2025)
par: Zhang, Bowen, et autres
Publié: (2025)
propella-1: Multi-Property Document Annotation for LLM Data Curation at Scale
par: Idahl, Maximilian, et autres
Publié: (2026)
par: Idahl, Maximilian, et autres
Publié: (2026)
Computational Economics in Large Language Models: Exploring Model Behavior and Incentive Design under Resource Constraints
par: Reddy, Sandeep, et autres
Publié: (2025)
par: Reddy, Sandeep, et autres
Publié: (2025)
QuAnTS: Question Answering on Time Series
par: Divo, Felix, et autres
Publié: (2025)
par: Divo, Felix, et autres
Publié: (2025)
Automated Bug Triaging using Instruction-Tuned Large Language Models
par: Kiashemshaki, Kiana, et autres
Publié: (2025)
par: Kiashemshaki, Kiana, et autres
Publié: (2025)
Merge-Bench: Resolve Merge Conflicts with Large Language Models
par: Schesch, Benedikt, et autres
Publié: (2026)
par: Schesch, Benedikt, et autres
Publié: (2026)
Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers
par: Abramov, Roman, et autres
Publié: (2025)
par: Abramov, Roman, et autres
Publié: (2025)
ACE: Exploring Activation Cosine Similarity and Variance for Accurate and Calibration-Efficient LLM Pruning
par: Mi, Zhendong, et autres
Publié: (2025)
par: Mi, Zhendong, et autres
Publié: (2025)
KSHSeek: Data-Driven Approaches to Mitigating and Detecting Knowledge-Shortcut Hallucinations in Generative Models
par: Liu, Zhongxin, et autres
Publié: (2025)
par: Liu, Zhongxin, et autres
Publié: (2025)
Latent Instruction Representation Alignment: defending against jailbreaks, backdoors and undesired knowledge in LLMs
par: Easley, Eric, et autres
Publié: (2026)
par: Easley, Eric, et autres
Publié: (2026)
Calibrated Confidence Estimation for Tabular Question Answering
par: Voss, Lukas
Publié: (2026)
par: Voss, Lukas
Publié: (2026)
Scalable GPU-Accelerated Euler Characteristic Curves: Optimization and Differentiable Learning for PyTorch
par: Saxena, Udit
Publié: (2025)
par: Saxena, Udit
Publié: (2025)
JURY-RL: Votes Propose, Proofs Dispose for Label-Free RLVR
par: Chen, Xinjie, et autres
Publié: (2026)
par: Chen, Xinjie, et autres
Publié: (2026)
Descriptive Collision in Sparse Autoencoder Auto-Interpretability: When One Explanation Describes Many Features
par: McCann, Jordan F.
Publié: (2026)
par: McCann, Jordan F.
Publié: (2026)
Super Apriel: One Checkpoint, Many Speeds
par: Labs, SLAM, et autres
Publié: (2026)
par: Labs, SLAM, et autres
Publié: (2026)
OSCToM: RL-Guided Adversarial Generation for High-Order Theory of Mind
par: Srishty, Sharmin Sultana, et autres
Publié: (2026)
par: Srishty, Sharmin Sultana, et autres
Publié: (2026)
Synergy over Discrepancy: A Partition-Based Approach to Multi-Domain LLM Fine-Tuning
par: Ye, Hua, et autres
Publié: (2025)
par: Ye, Hua, et autres
Publié: (2025)
Towards Alignment-Centric Paradigm: A Survey of Instruction Tuning in Large Language Models
par: Han, Xudong, et autres
Publié: (2025)
par: Han, Xudong, et autres
Publié: (2025)
Character-Level Transformer for Tajik-Persian Transliteration with a Parallel Lexical Corpus
par: Arabov, Mullosharaf K.
Publié: (2026)
par: Arabov, Mullosharaf K.
Publié: (2026)
Mitigating Cross-Lingual Cultural Inconsistencies in LLMs via Consensus-Driven Preference Optimisation
par: Resck, Lucas, et autres
Publié: (2026)
par: Resck, Lucas, et autres
Publié: (2026)
BitCal-TTS: Bit-Calibrated Test-Time Scaling for Quantized Reasoning Models
par: Patarlapalli, Sai Babu, et autres
Publié: (2026)
par: Patarlapalli, Sai Babu, et autres
Publié: (2026)
KerZOO: Kernel Function Informed Zeroth-Order Optimization for Accurate and Accelerated LLM Fine-Tuning
par: Mi, Zhendong, et autres
Publié: (2025)
par: Mi, Zhendong, et autres
Publié: (2025)
Learned Relay Representations for Forward-Thinking Discrete Diffusion Models
par: Rozonoyer, Benjamin, et autres
Publié: (2026)
par: Rozonoyer, Benjamin, et autres
Publié: (2026)
Bridging the Gap: An Intermediate Language for Enhanced and Cost-Effective Grapheme-to-Phoneme Conversion with Homographs with Multiple Pronunciations Disambiguation
par: Bertina, Abbas, et autres
Publié: (2025)
par: Bertina, Abbas, et autres
Publié: (2025)
Revisiting LRP: Positional Attribution as the Missing Ingredient for Transformer Explainability
par: Bakish, Yarden, et autres
Publié: (2025)
par: Bakish, Yarden, et autres
Publié: (2025)
Documents similaires
-
Exploring LLM-based Verilog Code Generation with Data-Efficient Fine-Tuning and Testbench Automation
par: Chen, Mu-Chi, et autres
Publié: (2026) -
Efficient Telecom Specific LLM: TSLAM-Mini with QLoRA and Digital Twin Data
par: Ethiraj, Vignesh, et autres
Publié: (2025) -
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
par: Fadli, Samih
Publié: (2025) -
On the Influence of Discourse Relations in Persuasive Texts
par: Turk, Nawar, et autres
Publié: (2025) -
Layer-Aware Embedding Fusion for LLMs in Text Classifications
par: Gwak, Jiho, et autres
Publié: (2025)