A Comparative Study of Learning Paradigms in Large Language Models via Intrinsic Dimension
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Janapati, Saahith, Ji, Yangfeng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Real-Time Multimodal Cognitive Assistant for Emergency Medical Services
par: Weerasinghe, Keshara, et autres
Publié: (2024)
par: Weerasinghe, Keshara, et autres
Publié: (2024)
In-Context Learning (and Unlearning) of Length Biases
par: Schoch, Stephanie, et autres
Publié: (2025)
par: Schoch, Stephanie, et autres
Publié: (2025)
Characterizing Truthfulness in Large Language Model Generations with Local Intrinsic Dimension
par: Yin, Fan, et autres
Publié: (2024)
par: Yin, Fan, et autres
Publié: (2024)
Monte Carlo Sampling for Analyzing In-Context Examples
par: Schoch, Stephanie, et autres
Publié: (2025)
par: Schoch, Stephanie, et autres
Publié: (2025)
Memorization in Language Models through the Lens of Intrinsic Dimension
par: Arnold, Stefan
Publié: (2025)
par: Arnold, Stefan
Publié: (2025)
Addressing Both Statistical and Causal Gender Fairness in NLP Models
par: Chen, Hannah, et autres
Publié: (2024)
par: Chen, Hannah, et autres
Publié: (2024)
Do Prevalent Bias Metrics Capture Allocational Harms from LLMs?
par: Cyberey, Hannah, et autres
Publié: (2024)
par: Cyberey, Hannah, et autres
Publié: (2024)
Unsupervised Concept Vector Extraction for Bias Control in LLMs
par: Cyberey, Hannah, et autres
Publié: (2025)
par: Cyberey, Hannah, et autres
Publié: (2025)
White-Box Sensitivity Auditing with Steering Vectors
par: Cyberey, Hannah, et autres
Publié: (2026)
par: Cyberey, Hannah, et autres
Publié: (2026)
Learning Intrinsic Dimension via Information Bottleneck for Explainable Aspect-based Sentiment Analysis
par: Cheng, Zhenxiao, et autres
Publié: (2024)
par: Cheng, Zhenxiao, et autres
Publié: (2024)
The Path of Self-Evolving Large Language Models: Achieving Data-Efficient Learning via Intrinsic Feedback
par: Zhang, Hangfan, et autres
Publié: (2025)
par: Zhang, Hangfan, et autres
Publié: (2025)
Less is More: Local Intrinsic Dimensions of Contextual Language Models
par: Ruppik, Benjamin Matthias, et autres
Publié: (2025)
par: Ruppik, Benjamin Matthias, et autres
Publié: (2025)
A Learning Rate Path Switching Training Paradigm for Version Updates of Large Language Models
par: Wang, Zhihao, et autres
Publié: (2024)
par: Wang, Zhihao, et autres
Publié: (2024)
Thinking with Nothinking Calibration: A New In-Context Learning Paradigm in Reasoning Large Language Models
par: Wu, Haotian, et autres
Publié: (2025)
par: Wu, Haotian, et autres
Publié: (2025)
High-Dimension Human Value Representation in Large Language Models
par: Cahyawijaya, Samuel, et autres
Publié: (2024)
par: Cahyawijaya, Samuel, et autres
Publié: (2024)
A Novel Paradigm Boosting Translation Capabilities of Large Language Models
par: Guo, Jiaxin, et autres
Publié: (2024)
par: Guo, Jiaxin, et autres
Publié: (2024)
A Preference-driven Paradigm for Enhanced Translation with Large Language Models
par: Zhu, Dawei, et autres
Publié: (2024)
par: Zhu, Dawei, et autres
Publié: (2024)
Irony Detection in Urdu Text: A Comparative Study Using Machine Learning Models and Large Language Models
par: Ahmad, Fiaz, et autres
Publié: (2025)
par: Ahmad, Fiaz, et autres
Publié: (2025)
Comparative Study of Multilingual Idioms and Similes in Large Language Models
par: Khoshtab, Paria, et autres
Publié: (2024)
par: Khoshtab, Paria, et autres
Publié: (2024)
Beyond Benchmarking: A New Paradigm for Evaluation and Assessment of Large Language Models
par: Liu, Jin, et autres
Publié: (2024)
par: Liu, Jin, et autres
Publié: (2024)
A Paradigm Shift: The Future of Machine Translation Lies with Large Language Models
par: Lyu, Chenyang, et autres
Publié: (2023)
par: Lyu, Chenyang, et autres
Publié: (2023)
Understanding Intrinsic Socioeconomic Biases in Large Language Models
par: Arzaghi, Mina, et autres
Publié: (2024)
par: Arzaghi, Mina, et autres
Publié: (2024)
Do Large Language Models Possess a Theory of Mind? A Comparative Evaluation Using the Strange Stories Paradigm
par: Babarczy, Anna, et autres
Publié: (2026)
par: Babarczy, Anna, et autres
Publié: (2026)
InsCL: A Data-efficient Continual Learning Paradigm for Fine-tuning Large Language Models with Instructions
par: Wang, Yifan, et autres
Publié: (2024)
par: Wang, Yifan, et autres
Publié: (2024)
A Comparative Study on Large Language Models for Log Parsing
par: Astekin, Merve, et autres
Publié: (2024)
par: Astekin, Merve, et autres
Publié: (2024)
Can Large Language Models Faithfully Express Their Intrinsic Uncertainty in Words?
par: Yona, Gal, et autres
Publié: (2024)
par: Yona, Gal, et autres
Publié: (2024)
The Shadow Self: Intrinsic Value Misalignment in Large Language Model Agents
par: Chen, Chen, et autres
Publié: (2026)
par: Chen, Chen, et autres
Publié: (2026)
Conceptual Metaphor Theory as a Prompting Paradigm for Large Language Models
par: Kramer, Oliver
Publié: (2025)
par: Kramer, Oliver
Publié: (2025)
Measuring Intrinsic Dimension of Token Embeddings
par: Kataiwa, Takuya, et autres
Publié: (2025)
par: Kataiwa, Takuya, et autres
Publié: (2025)
CDEval: A Benchmark for Measuring the Cultural Dimensions of Large Language Models
par: Wang, Yuhang, et autres
Publié: (2023)
par: Wang, Yuhang, et autres
Publié: (2023)
Lateral Phishing With Large Language Models: A Large Organization Comparative Study
par: Bethany, Mazal, et autres
Publié: (2024)
par: Bethany, Mazal, et autres
Publié: (2024)
Graph Reasoning Paradigm: Structured and Symbolic Reasoning with Topology-Aware Reinforcement Learning for Large Language Models
par: Liu, Runxuan, et autres
Publié: (2026)
par: Liu, Runxuan, et autres
Publié: (2026)
Syntactic Blind Spots: How Misalignment Leads to LLMs Mathematical Errors
par: Williamson, Dane, et autres
Publié: (2025)
par: Williamson, Dane, et autres
Publié: (2025)
Reference Trustable Decoding: A Training-Free Augmentation Paradigm for Large Language Models
par: Shi, Luohe, et autres
Publié: (2024)
par: Shi, Luohe, et autres
Publié: (2024)
A Paradigm Shift in Machine Translation: Boosting Translation Performance of Large Language Models
par: Xu, Haoran, et autres
Publié: (2023)
par: Xu, Haoran, et autres
Publié: (2023)
Data Augmentation using Large Language Models: Data Perspectives, Learning Paradigms and Challenges
par: Ding, Bosheng, et autres
Publié: (2024)
par: Ding, Bosheng, et autres
Publié: (2024)
Fine-Tuning Large Language Models for Scientific Text Classification: A Comparative Study
par: Rostam, Zhyar Rzgar K, et autres
Publié: (2024)
par: Rostam, Zhyar Rzgar K, et autres
Publié: (2024)
Evaluating Large Language Models for Diacritic Restoration in Romanian Texts: A Comparative Study
par: Nadas, Mihai, et autres
Publié: (2025)
par: Nadas, Mihai, et autres
Publié: (2025)
Intrinsic Model Weaknesses: How Priming Attacks Unveil Vulnerabilities in Large Language Models
par: Huang, Yuyi, et autres
Publié: (2025)
par: Huang, Yuyi, et autres
Publié: (2025)
Chain-of-Reasoning: Towards Unified Mathematical Reasoning in Large Language Models via a Multi-Paradigm Perspective
par: Yu, Yiyao, et autres
Publié: (2025)
par: Yu, Yiyao, et autres
Publié: (2025)
Documents similaires
-
Real-Time Multimodal Cognitive Assistant for Emergency Medical Services
par: Weerasinghe, Keshara, et autres
Publié: (2024) -
In-Context Learning (and Unlearning) of Length Biases
par: Schoch, Stephanie, et autres
Publié: (2025) -
Characterizing Truthfulness in Large Language Model Generations with Local Intrinsic Dimension
par: Yin, Fan, et autres
Publié: (2024) -
Monte Carlo Sampling for Analyzing In-Context Examples
par: Schoch, Stephanie, et autres
Publié: (2025) -
Memorization in Language Models through the Lens of Intrinsic Dimension
par: Arnold, Stefan
Publié: (2025)