From General Reasoning to Domain Expertise: Uncovering the Limits of Generalization in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Alsagheer, Dana, Lu, Yang, Kamal, Abdulrahman, Kamal, Omar, Kamal, Mohammad, Mansour, Nada, Wu, Cosmo Yang, Karanjai, Rambiba, Li, Sen, Shi, Weidong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability
par: Alsagheer, Dana, et autres
Publié: (2025)
par: Alsagheer, Dana, et autres
Publié: (2025)
Comparing Rationality Between Large Language Models and Humans: Insights and Open Questions
par: Alsagheer, Dana, et autres
Publié: (2024)
par: Alsagheer, Dana, et autres
Publié: (2024)
LAGAN: Deep Semi-Supervised Linguistic-Anthropology Classification with Conditional Generative Adversarial Neural Network
par: Kamal, Rossi
Publié: (2023)
par: Kamal, Rossi
Publié: (2023)
ETHNO-DAANN: Ethnographic Engagement Classification by Deep Adversarial Transfer Learning
par: Kamal, Rossi
Publié: (2023)
par: Kamal, Rossi
Publié: (2023)
HPCAgentTester: A Multi-Agent LLM Approach for Enhanced HPC Unit Test Generation
par: Karanjai, Rabimba, et autres
Publié: (2025)
par: Karanjai, Rabimba, et autres
Publié: (2025)
Cryptocurrency Portfolio Management with Reinforcement Learning: Soft Actor--Critic and Deep Deterministic Policy Gradient Algorithms
par: Paykan, Kamal
Publié: (2025)
par: Paykan, Kamal
Publié: (2025)
The JARVIS Infrastructure is All You Need for Materials Design
par: Choudhary, Kamal
Publié: (2025)
par: Choudhary, Kamal
Publié: (2025)
LookALike: Human Mimicry based collaborative decision making
par: Karanjai, Rabimba, et autres
Publié: (2024)
par: Karanjai, Rabimba, et autres
Publié: (2024)
COFT: Counterfactual-Conformal Decoding for Fair Chain-of-Thought Reasoning in Large Language Models
par: Fayyazi, Arya, et autres
Publié: (2026)
par: Fayyazi, Arya, et autres
Publié: (2026)
Rethinking Publication: A Certification Framework for AI-Enabled Research
par: Lu, Yang, et autres
Publié: (2026)
par: Lu, Yang, et autres
Publié: (2026)
Community-acquired neonatal SARS-CoV-2 infection: case report
par: Kamila Mohammad Kamal Mansour
Publié: (2024)
par: Kamila Mohammad Kamal Mansour
Publié: (2024)
Detecting Conspiracy Theory Against COVID-19 Vaccines
par: Amin, Md Hasibul, et autres
Publié: (2022)
par: Amin, Md Hasibul, et autres
Publié: (2022)
Weaving the Cosmos: WASM-Powered Interchain Communication for AI Enabled Smart Contracts
par: Karanjai, Rabimba, et autres
Publié: (2025)
par: Karanjai, Rabimba, et autres
Publié: (2025)
BenchQC: A Benchmarking Toolkit for Quantum Computation
par: Nia Pollard, et autres
Publié: (2025)
par: Nia Pollard, et autres
Publié: (2025)
Understanding Pruning Regimes in Vision-Language Models Through Domain-Aware Layer Selection
par: Khaki, Saeed, et autres
Publié: (2026)
par: Khaki, Saeed, et autres
Publié: (2026)
Advancing Welding Defect Detection in Maritime Operations via Adapt-WeldNet and Defect Detection Interpretability Analysis
par: S, Kamal Basha, et autres
Publié: (2025)
par: S, Kamal Basha, et autres
Publié: (2025)
Towards Scalable SOAP Note Generation: A Weakly Supervised Multimodal Framework
par: Kamal, Sadia, et autres
Publié: (2025)
par: Kamal, Sadia, et autres
Publié: (2025)
Skin-SOAP: A Weakly Supervised Framework for Generating Structured SOAP Notes
par: Kamal, Sadia, et autres
Publié: (2025)
par: Kamal, Sadia, et autres
Publié: (2025)
Supervised Contrastive Machine Unlearning of Background Bias in Sonar Image Classification with Fine-Grained Explainable AI
par: S, Kamal Basha, et autres
Publié: (2025)
par: S, Kamal Basha, et autres
Publié: (2025)
Cross-Task Benchmarking of CNN Architectures
par: Sherawat, Kamal, et autres
Publié: (2026)
par: Sherawat, Kamal, et autres
Publié: (2026)
CHIPS-FF: Evaluating Universal Machine Learning Force Fields for Material Properties
par: Wines, Daniel, et autres
Publié: (2024)
par: Wines, Daniel, et autres
Publié: (2024)
Physics-informed simulation framework for realistic sonar image generation and statistical validation
par: S, Kamal Basha, et autres
Publié: (2026)
par: S, Kamal Basha, et autres
Publié: (2026)
MH‐ARO: Meta‐heuristic based adaptive routing for large scale opportunistic networks
par: Soni Chaurasia, et autres
Publié: (2024)
par: Soni Chaurasia, et autres
Publié: (2024)
LogBabylon: A Unified Framework for Cross-Log File Integration and Analysis
par: Karanjai, Rabimba, et autres
Publié: (2024)
par: Karanjai, Rabimba, et autres
Publié: (2024)
Machine Learning for Consistency Violation Faults Analysis
par: Giri, Kamal, et autres
Publié: (2025)
par: Giri, Kamal, et autres
Publié: (2025)
Improving Power Plant CO2 Emission Estimation with Deep Learning and Satellite/Simulated Data
par: Deb, Dibyabha, et autres
Publié: (2025)
par: Deb, Dibyabha, et autres
Publié: (2025)
Balancing Privacy and Action Performance: A Penalty-Driven Approach to Image Anonymization
par: Aslam, Nazia, et autres
Publié: (2025)
par: Aslam, Nazia, et autres
Publié: (2025)
A Survey on Symbolic Knowledge Distillation of Large Language Models
par: Acharya, Kamal, et autres
Publié: (2024)
par: Acharya, Kamal, et autres
Publié: (2024)
AdaptiSent: Context-Aware Adaptive Attention for Multimodal Aspect-Based Sentiment Analysis
par: Rafiuddin, S M, et autres
Publié: (2025)
par: Rafiuddin, S M, et autres
Publié: (2025)
MedGrad E-CLIP: Enhancing Trust and Transparency in AI-Driven Skin Lesion Diagnosis
par: Kamal, Sadia, et autres
Publié: (2025)
par: Kamal, Sadia, et autres
Publié: (2025)
Semantic Uncertainty Quantification of Hallucinations in LLMs: A Quantum Tensor Network Based Method
par: Vipulanandan, Pragatheeswaran, et autres
Publié: (2026)
par: Vipulanandan, Pragatheeswaran, et autres
Publié: (2026)
Text-VQA Aug: Pipelined Harnessing of Large Multimodal Models for Automated Synthesis
par: Joshi, Soham, et autres
Publié: (2025)
par: Joshi, Soham, et autres
Publié: (2025)
Collaboration is all you need: LLM Assisted Safe Code Translation
par: Karanjai, Rabimba, et autres
Publié: (2025)
par: Karanjai, Rabimba, et autres
Publié: (2025)
Single-rotating Five-dimensional Near-horizon Extremal Geometry in General Relativity
par: Hajian, Kamal
Publié: (2023)
par: Hajian, Kamal
Publié: (2023)
SOVABench: A Vehicle Surveillance Action Retrieval Benchmark for Multimodal Large Language Models
par: Rabasseda, Oriol, et autres
Publié: (2026)
par: Rabasseda, Oriol, et autres
Publié: (2026)
AtomGPT: Atomistic Generative Pre-trained Transformer for Forward and Inverse Materials Design
par: Choudhary, Kamal
Publié: (2024)
par: Choudhary, Kamal
Publié: (2024)
Free Will, the Butterfly Effect, and the Limits of Human Agency: A Sociological, Psychoanalytic, and Cognitive Perspective
par: Aferiad, Kamal
Publié: (2026)
par: Aferiad, Kamal
Publié: (2026)
VisTIRA: Closing the Image-Text Modality Gap in Visual Math Reasoning via Structured Tool Integration
par: Khaki, Saeed, et autres
Publié: (2026)
par: Khaki, Saeed, et autres
Publié: (2026)
A Detailed Factor Analysis for the Political Compass Test: Navigating Ideologies of Large Language Models
par: Kamal, Sadia, et autres
Publié: (2025)
par: Kamal, Sadia, et autres
Publié: (2025)
Disease Identification From Unstructured User Input
par: Faisal, Fahim, et autres
Publié: (2019)
par: Faisal, Fahim, et autres
Publié: (2019)
Documents similaires
-
Governance Challenges in Reinforcement Learning from Human Feedback: Evaluator Rationality and Reinforcement Stability
par: Alsagheer, Dana, et autres
Publié: (2025) -
Comparing Rationality Between Large Language Models and Humans: Insights and Open Questions
par: Alsagheer, Dana, et autres
Publié: (2024) -
LAGAN: Deep Semi-Supervised Linguistic-Anthropology Classification with Conditional Generative Adversarial Neural Network
par: Kamal, Rossi
Publié: (2023) -
ETHNO-DAANN: Ethnographic Engagement Classification by Deep Adversarial Transfer Learning
par: Kamal, Rossi
Publié: (2023) -
HPCAgentTester: A Multi-Agent LLM Approach for Enhanced HPC Unit Test Generation
par: Karanjai, Rabimba, et autres
Publié: (2025)