Scaling Item-to-Standard Alignment with Large Language Models: Accuracy, Limits, and Solutions
Fuente:
arXiv
Guardado en:
| Autores principales: | Karimi-Malekabadi, Farzan, Razavi, Pooya, Powers, Sonya |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Estimating Item Difficulty Using Large Language Models and Tree-Based Machine Learning Algorithms
por: Razavi, Pooya, et al.
Publicado: (2025)
por: Razavi, Pooya, et al.
Publicado: (2025)
Tracing Moral Foundations in Large Language Models
por: Yu, Chenxiao, et al.
Publicado: (2026)
por: Yu, Chenxiao, et al.
Publicado: (2026)
Realistic threat perception drives intergroup conflict: A causal, dynamic analysis using generative-agent simulations
por: Abdurahman, Suhaib, et al.
Publicado: (2025)
por: Abdurahman, Suhaib, et al.
Publicado: (2025)
Theory Trace Card: Theory-Driven Socio-Cognitive Evaluation of LLMs
por: Karimi-Malekabadi, Farzan, et al.
Publicado: (2026)
por: Karimi-Malekabadi, Farzan, et al.
Publicado: (2026)
Fundamental Limitations of Alignment in Large Language Models
por: Wolf, Yotam, et al.
Publicado: (2023)
por: Wolf, Yotam, et al.
Publicado: (2023)
Exploring Large Language Models for Climate Forecasting
por: Wang, Yang, et al.
Publicado: (2024)
por: Wang, Yang, et al.
Publicado: (2024)
On the Limitations of Steering in Language Model Alignment
por: Niranjan, Chebrolu, et al.
Publicado: (2025)
por: Niranjan, Chebrolu, et al.
Publicado: (2025)
Balancing Accuracy and Novelty with Sub-Item Popularity
por: Mallamaci, Chiara, et al.
Publicado: (2025)
por: Mallamaci, Chiara, et al.
Publicado: (2025)
miniF2F-Lean Revisited: Reviewing Limitations and Charting a Path Forward
por: Ospanov, Azim, et al.
Publicado: (2025)
por: Ospanov, Azim, et al.
Publicado: (2025)
Integrating Graphs, Large Language Models, and Agents: Reasoning and Retrieval
por: Jelodar, Hamed, et al.
Publicado: (2026)
por: Jelodar, Hamed, et al.
Publicado: (2026)
ABC Align: Large Language Model Alignment for Safety & Accuracy
por: Seneque, Gareth, et al.
Publicado: (2024)
por: Seneque, Gareth, et al.
Publicado: (2024)
LLM-I2I: Boost Your Small Item2Item Recommendation Model with Large Language Model
por: Feng, Yinfu, et al.
Publicado: (2025)
por: Feng, Yinfu, et al.
Publicado: (2025)
Estimating Item Difficulty with Large Language Models as Experts
por: Kolesnikova, Diana, et al.
Publicado: (2026)
por: Kolesnikova, Diana, et al.
Publicado: (2026)
Large Language Models (LLMs) for Source Code Analysis: applications, models and datasets
por: Jelodar, Hamed, et al.
Publicado: (2025)
por: Jelodar, Hamed, et al.
Publicado: (2025)
Probing the Limits of Stylistic Alignment in Vision-Language Models
por: Farajidizaji, Asma, et al.
Publicado: (2025)
por: Farajidizaji, Asma, et al.
Publicado: (2025)
On Diversified Preferences of Large Language Model Alignment
por: Zeng, Dun, et al.
Publicado: (2023)
por: Zeng, Dun, et al.
Publicado: (2023)
Federated Continual Learning: Concepts, Challenges, and Solutions
por: Hamedi, Parisa, et al.
Publicado: (2025)
por: Hamedi, Parisa, et al.
Publicado: (2025)
On the Limits of Innate Planning in Large Language Models
por: Schepanowski, Charles, et al.
Publicado: (2025)
por: Schepanowski, Charles, et al.
Publicado: (2025)
On the Limitations of Large Language Models for Conceptual Database Modeling
por: Siqueira, Arthur F., et al.
Publicado: (2026)
por: Siqueira, Arthur F., et al.
Publicado: (2026)
Quantum-Efficient Reinforcement Learning Solutions for Last-Mile On-Demand Delivery
por: Moosavi, Farzan, et al.
Publicado: (2025)
por: Moosavi, Farzan, et al.
Publicado: (2025)
Reconstructing Item Characteristic Curves using Fine-Tuned Large Language Models
por: Ormerod, Christopher
Publicado: (2026)
por: Ormerod, Christopher
Publicado: (2026)
Leveraging Large Language Models For Optimized Item Categorization using UNSPSC Taxonomy
por: Singh, Anmolika, et al.
Publicado: (2024)
por: Singh, Anmolika, et al.
Publicado: (2024)
Getting In Contract with Large Language Models -- An Agency Theory Perspective On Large Language Model Alignment
por: Kaltenpoth, Sascha, et al.
Publicado: (2025)
por: Kaltenpoth, Sascha, et al.
Publicado: (2025)
Benchmarking Prompt Sensitivity in Large Language Models
por: Razavi, Amirhossein, et al.
Publicado: (2025)
por: Razavi, Amirhossein, et al.
Publicado: (2025)
HLLM: Enhancing Sequential Recommendations via Hierarchical Large Language Models for Item and User Modeling
por: Chen, Junyi, et al.
Publicado: (2024)
por: Chen, Junyi, et al.
Publicado: (2024)
Automated Item Neutralization for Non-Cognitive Scales: A Large Language Model Approach to Reducing Social-Desirability Bias
por: Wu, Sirui, et al.
Publicado: (2025)
por: Wu, Sirui, et al.
Publicado: (2025)
The ORCA Benchmark: Evaluating Real-World Calculation Accuracy in Large Language Models
por: Herambourg, Claudia, et al.
Publicado: (2025)
por: Herambourg, Claudia, et al.
Publicado: (2025)
The Law of Multi-Model Collaboration: Scaling Limits of Model Ensembling for Large Language Models
por: Lu, Dakuan, et al.
Publicado: (2025)
por: Lu, Dakuan, et al.
Publicado: (2025)
PermLLM: Learnable Channel Permutation for N:M Sparse Large Language Models
por: Zou, Lancheng, et al.
Publicado: (2025)
por: Zou, Lancheng, et al.
Publicado: (2025)
Large Language Model's Multi-Capability Alignment in Biomedical Domain
por: Wu, Wentao, et al.
Publicado: (2025)
por: Wu, Wentao, et al.
Publicado: (2025)
Towards Complex Ontology Alignment using Large Language Models
por: Amini, Reihaneh, et al.
Publicado: (2024)
por: Amini, Reihaneh, et al.
Publicado: (2024)
Using Large Language Models to Understand Telecom Standards
por: Karapantelakis, Athanasios, et al.
Publicado: (2024)
por: Karapantelakis, Athanasios, et al.
Publicado: (2024)
Doubly Robust Alignment for Large Language Models
por: Xu, Erhan, et al.
Publicado: (2025)
por: Xu, Erhan, et al.
Publicado: (2025)
Benchmarking Distributional Alignment of Large Language Models
por: Meister, Nicole, et al.
Publicado: (2024)
por: Meister, Nicole, et al.
Publicado: (2024)
Beyond Accuracy: A Geometric Stability Analysis of Large Language Models in Chess Evaluation
por: Song, Xidan, et al.
Publicado: (2025)
por: Song, Xidan, et al.
Publicado: (2025)
Multi-Scale Manifold Alignment for Interpreting Large Language Models: A Unified Information-Geometric Framework
por: Zhang, Yukun, et al.
Publicado: (2025)
por: Zhang, Yukun, et al.
Publicado: (2025)
Large Language Model (LLM) for Software Security: Code Analysis, Malware Analysis, Reverse Engineering
por: Jelodar, Hamed, et al.
Publicado: (2025)
por: Jelodar, Hamed, et al.
Publicado: (2025)
Model Merging Scaling Laws in Large Language Models
por: Wang, Yuanyi, et al.
Publicado: (2025)
por: Wang, Yuanyi, et al.
Publicado: (2025)
Behavior-Aware Item Modeling via Dynamic Procedural Solution Representations for Knowledge Tracing
por: Seo, Jun, et al.
Publicado: (2026)
por: Seo, Jun, et al.
Publicado: (2026)
An Uncertainty-Driven Adaptive Self-Alignment Framework for Large Language Models
por: Sun, Haoran, et al.
Publicado: (2025)
por: Sun, Haoran, et al.
Publicado: (2025)
Ejemplares similares
-
Estimating Item Difficulty Using Large Language Models and Tree-Based Machine Learning Algorithms
por: Razavi, Pooya, et al.
Publicado: (2025) -
Tracing Moral Foundations in Large Language Models
por: Yu, Chenxiao, et al.
Publicado: (2026) -
Realistic threat perception drives intergroup conflict: A causal, dynamic analysis using generative-agent simulations
por: Abdurahman, Suhaib, et al.
Publicado: (2025) -
Theory Trace Card: Theory-Driven Socio-Cognitive Evaluation of LLMs
por: Karimi-Malekabadi, Farzan, et al.
Publicado: (2026) -
Fundamental Limitations of Alignment in Large Language Models
por: Wolf, Yotam, et al.
Publicado: (2023)