Ambiguity in LLMs is a concept missing problem
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hu, Zhibo, Wang, Chen, Shu, Yanfeng, Paik, Hye-Young, Zhu, Liming |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Metaphors are a Source of Cross-Domain Misalignment of Large Reasoning Models
par: Hu, Zhibo, et autres
Publié: (2026)
par: Hu, Zhibo, et autres
Publié: (2026)
Prompt Perturbation in Retrieval-Augmented Generation based Large Language Models
par: Hu, Zhibo, et autres
Publié: (2024)
par: Hu, Zhibo, et autres
Publié: (2024)
When Models Can't Follow: Testing Instruction Adherence Across 256 LLMs
par: Young, Richard J., et autres
Publié: (2025)
par: Young, Richard J., et autres
Publié: (2025)
Amulet: ReAlignment During Test Time for Personalized Preference Adaptation of LLMs
par: Zhang, Zhaowei, et autres
Publié: (2025)
par: Zhang, Zhaowei, et autres
Publié: (2025)
PowLU: An Activation Function for Stable Pre-Training of LLMs
par: Jiang, Peijie, et autres
Publié: (2026)
par: Jiang, Peijie, et autres
Publié: (2026)
A Framework for Fine-Tuning LLMs using Heterogeneous Feedback
par: Aponte, Ryan, et autres
Publié: (2024)
par: Aponte, Ryan, et autres
Publié: (2024)
Token Erasure as a Footprint of Implicit Vocabulary Items in LLMs
par: Feucht, Sheridan, et autres
Publié: (2024)
par: Feucht, Sheridan, et autres
Publié: (2024)
Hardware Co-Design Scaling Laws via Roofline Modelling for On-Device LLMs
par: Sun, Luoyang, et autres
Publié: (2026)
par: Sun, Luoyang, et autres
Publié: (2026)
Reinforcement Learning for Latent-Space Thinking in LLMs
par: Özeren, Enes, et autres
Publié: (2025)
par: Özeren, Enes, et autres
Publié: (2025)
Efficient Solutions For An Intriguing Failure of LLMs: Long Context Window Does Not Mean LLMs Can Analyze Long Sequences Flawlessly
par: Hosseini, Peyman, et autres
Publié: (2024)
par: Hosseini, Peyman, et autres
Publié: (2024)
The Open Source Advantage in Large Language Models (LLMs)
par: Manchanda, Jiya, et autres
Publié: (2024)
par: Manchanda, Jiya, et autres
Publié: (2024)
QUAD: Quantization and Parameter-Efficient Tuning of LLM with Activation Decomposition
par: Hu, Yuxuan, et autres
Publié: (2025)
par: Hu, Yuxuan, et autres
Publié: (2025)
Structure-Guided Entity Resolution: Fine-Tuning LLMs for Robust Name Matching in Complex Linguistic Contexts
par: Chourasia, Shivam, et autres
Publié: (2026)
par: Chourasia, Shivam, et autres
Publié: (2026)
NRR-Phi: Text-to-State Mapping for Ambiguity Preservation in LLM Inference
par: Saito, Kei
Publié: (2026)
par: Saito, Kei
Publié: (2026)
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
par: Oketunji, Abiodun Finbarrs
Publié: (2023)
par: Oketunji, Abiodun Finbarrs
Publié: (2023)
PersonalLLM: Tailoring LLMs to Individual Preferences
par: Zollo, Thomas P., et autres
Publié: (2024)
par: Zollo, Thomas P., et autres
Publié: (2024)
NRR-Core: Non-Resolution Reasoning as a Computational Framework for Contextual Identity and Ambiguity Preservation
par: Saito, Kei
Publié: (2025)
par: Saito, Kei
Publié: (2025)
Resonant Context Anchoring: Decoupling Attention Routing and Signal Gain at Inference Time
par: Zhao, Mingkuan, et autres
Publié: (2026)
par: Zhao, Mingkuan, et autres
Publié: (2026)
Overcoming Long-Context Limitations of State-Space Models via Context-Dependent Sparse Attention
par: Zhan, Zhihao, et autres
Publié: (2025)
par: Zhan, Zhihao, et autres
Publié: (2025)
GenAI Content Detection Task 3: Cross-Domain Machine-Generated Text Detection Challenge
par: Dugan, Liam, et autres
Publié: (2025)
par: Dugan, Liam, et autres
Publié: (2025)
MALoRA: Mixture of Asymmetric Low-Rank Adaptation for Enhanced Multi-Task Learning
par: Wang, Xujia, et autres
Publié: (2024)
par: Wang, Xujia, et autres
Publié: (2024)
Rethinking Addressing in Language Models via Contexualized Equivariant Positional Encoding
par: Zhu, Jiajun, et autres
Publié: (2025)
par: Zhu, Jiajun, et autres
Publié: (2025)
QiMeng-Attention: SOTA Attention Operator is generated by SOTA Attention Algorithm
par: Zhou, Qirui, et autres
Publié: (2025)
par: Zhou, Qirui, et autres
Publié: (2025)
WSM: Decay-Free Learning Rate Schedule via Checkpoint Merging for LLM Pre-training
par: Tian, Changxin, et autres
Publié: (2025)
par: Tian, Changxin, et autres
Publié: (2025)
TCNN: Triple Convolutional Neural Network Models for Retrieval-based Question Answering System in E-commerce
par: Song, Shuangyong, et autres
Publié: (2020)
par: Song, Shuangyong, et autres
Publié: (2020)
Large Language Model (LLM) Bias Index -- LLMBI
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023)
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023)
Engineering A Large Language Model From Scratch
par: Oketunji, Abiodun Finbarrs
Publié: (2024)
par: Oketunji, Abiodun Finbarrs
Publié: (2024)
MMSciBench: Benchmarking Language Models on Chinese Multimodal Scientific Problems
par: Ye, Xinwu, et autres
Publié: (2025)
par: Ye, Xinwu, et autres
Publié: (2025)
Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment
par: Zhang, Yizhuo, et autres
Publié: (2025)
par: Zhang, Yizhuo, et autres
Publié: (2025)
Sparsing Law: Towards Large Language Models with Greater Activation Sparsity
par: Luo, Yuqi, et autres
Publié: (2024)
par: Luo, Yuqi, et autres
Publié: (2024)
Sigmoid Head for Quality Estimation under Language Ambiguity
par: Dinh, Tu Anh, et autres
Publié: (2026)
par: Dinh, Tu Anh, et autres
Publié: (2026)
Efficacy of ByT5 in Multilingual Translation of Biblical Texts for Underrepresented Languages
par: Aars, Corinne, et autres
Publié: (2024)
par: Aars, Corinne, et autres
Publié: (2024)
Better and Worse with Scale: How Contextual Entrainment Diverges with Model Size
par: Kukreja, Dikshant, et autres
Publié: (2026)
par: Kukreja, Dikshant, et autres
Publié: (2026)
Semantic Convergence: Investigating Shared Representations Across Scaled LLMs
par: Son, Daniel, et autres
Publié: (2025)
par: Son, Daniel, et autres
Publié: (2025)
Are LLM Uncertainty and Correctness Encoded by the Same Features? A Functional Dissociation via Sparse Autoencoders
par: Patel, Het, et autres
Publié: (2026)
par: Patel, Het, et autres
Publié: (2026)
Influence-driven Curriculum Learning for Pre-training on Limited Data
par: Schoenegger, Loris, et autres
Publié: (2025)
par: Schoenegger, Loris, et autres
Publié: (2025)
Towards Latent Diffusion Suitable For Text
par: Midavaine, Nesta, et autres
Publié: (2026)
par: Midavaine, Nesta, et autres
Publié: (2026)
SpectralLoRA: Is Low-Frequency Structure Sufficient for LoRA Adaptation? A Spectral Analysis of Weight Updates
par: Singh, Rajveer
Publié: (2026)
par: Singh, Rajveer
Publié: (2026)
BLP-2023 Task 2: Sentiment Analysis
par: Hasan, Md. Arid, et autres
Publié: (2023)
par: Hasan, Md. Arid, et autres
Publié: (2023)
FIM-LoRA: Task-Informative Rank Allocation for LoRA via Calibration-Time Gradient-Variance Estimation
par: Sathyavageeswaran, Ramakrishnan
Publié: (2026)
par: Sathyavageeswaran, Ramakrishnan
Publié: (2026)
Documents similaires
-
Metaphors are a Source of Cross-Domain Misalignment of Large Reasoning Models
par: Hu, Zhibo, et autres
Publié: (2026) -
Prompt Perturbation in Retrieval-Augmented Generation based Large Language Models
par: Hu, Zhibo, et autres
Publié: (2024) -
When Models Can't Follow: Testing Instruction Adherence Across 256 LLMs
par: Young, Richard J., et autres
Publié: (2025) -
Amulet: ReAlignment During Test Time for Personalized Preference Adaptation of LLMs
par: Zhang, Zhaowei, et autres
Publié: (2025) -
PowLU: An Activation Function for Stable Pre-Training of LLMs
par: Jiang, Peijie, et autres
Publié: (2026)