Guardado en:
| Autores principales: | Jin, Jiarui, Wu, Yuwei, Li, Haoxuan, He, Xiaoting, Zhang, Weinan, Yang, Yiming, Yu, Yong, Wang, Jun, Yang, Mengyue |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2506.06033 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CoLD: Counterfactually-Guided Length Debiasing for Process Reward Models in Mathematical Reasoning
por: Zheng, Congmin, et al.
Publicado: (2025)
por: Zheng, Congmin, et al.
Publicado: (2025)
A Survey of Process Reward Models: From Outcome Signals to Process Supervisions for Large Language Models
por: Zheng, Congmin, et al.
Publicado: (2025)
por: Zheng, Congmin, et al.
Publicado: (2025)
ItD: Large Language Models Can Teach Themselves Induction through Deduction
por: Sun, Wangtao, et al.
Publicado: (2024)
por: Sun, Wangtao, et al.
Publicado: (2024)
InfoRank: Unbiased Learning-to-Rank via Conditional Mutual Information Minimization
por: Jin, Jiarui, et al.
Publicado: (2024)
por: Jin, Jiarui, et al.
Publicado: (2024)
Large Language Models Are Not Robust Multiple Choice Selectors
por: Zheng, Chujie, et al.
Publicado: (2023)
por: Zheng, Chujie, et al.
Publicado: (2023)
Causal Sufficiency and Necessity Improves Chain-of-Thought Reasoning
por: Yu, Xiangning, et al.
Publicado: (2025)
por: Yu, Xiangning, et al.
Publicado: (2025)
ConceptViz: A Visual Analytics Approach for Exploring Concepts in Large Language Models
por: Li, Haoxuan, et al.
Publicado: (2025)
por: Li, Haoxuan, et al.
Publicado: (2025)
Trigger$^3$: Refining Query Correction via Adaptive Model Selector
por: Zhang, Kepu, et al.
Publicado: (2024)
por: Zhang, Kepu, et al.
Publicado: (2024)
Probing the "Psyche'' of Large Reasoning Models: Understanding Through a Human Lens
por: Chen, Yuxiang, et al.
Publicado: (2025)
por: Chen, Yuxiang, et al.
Publicado: (2025)
Language Models can Evaluate Themselves via Probability Discrepancy
por: Xia, Tingyu, et al.
Publicado: (2024)
por: Xia, Tingyu, et al.
Publicado: (2024)
A Human-Centric Pipeline for Aligning Large Language Models with Chinese Medical Ethics
por: Jin, Haoan, et al.
Publicado: (2026)
por: Jin, Haoan, et al.
Publicado: (2026)
TrajSelector: Harnessing Latent Representations for Efficient and Effective Best-of-N in Large Reasoning Model
por: Yu, Bin, et al.
Publicado: (2025)
por: Yu, Bin, et al.
Publicado: (2025)
Fine-Grained Interpretation of Political Opinions in Large Language Models
por: Hu, Jingyu, et al.
Publicado: (2025)
por: Hu, Jingyu, et al.
Publicado: (2025)
MedEthicEval: Evaluating Large Language Models Based on Chinese Medical Ethics
por: Jin, Haoan, et al.
Publicado: (2025)
por: Jin, Haoan, et al.
Publicado: (2025)
A Dynamic Knowledge Update-Driven Model with Large Language Models for Fake News Detection
por: Jin, Di, et al.
Publicado: (2025)
por: Jin, Di, et al.
Publicado: (2025)
Quick on the Uptake: Eliciting Implicit Intents from Human Demonstrations for Personalized Mobile-Use Agents
por: Wu, Zheng, et al.
Publicado: (2025)
por: Wu, Zheng, et al.
Publicado: (2025)
Strengthened Symbol Binding Makes Large Language Models Reliable Multiple-Choice Selectors
por: Xue, Mengge, et al.
Publicado: (2024)
por: Xue, Mengge, et al.
Publicado: (2024)
Rephrase and Respond: Let Large Language Models Ask Better Questions for Themselves
por: Deng, Yihe, et al.
Publicado: (2023)
por: Deng, Yihe, et al.
Publicado: (2023)
Causal Fine-Tuning under Latent Confounded Shift
por: Yu, Jialin, et al.
Publicado: (2024)
por: Yu, Jialin, et al.
Publicado: (2024)
SVFit: Parameter-Efficient Fine-Tuning of Large Pre-Trained Models Using Singular Values
por: Sun, Chengwei, et al.
Publicado: (2024)
por: Sun, Chengwei, et al.
Publicado: (2024)
Revealing Behavioral Plasticity in Large Language Models: A Token-Conditional Perspective
por: Mao, Liyuan, et al.
Publicado: (2026)
por: Mao, Liyuan, et al.
Publicado: (2026)
Estimating the Effects of Sample Training Orders for Large Language Models without Retraining
por: Yang, Hao, et al.
Publicado: (2025)
por: Yang, Hao, et al.
Publicado: (2025)
Meta-Reasoning: Semantics-Symbol Deconstruction for Large Language Models
por: Wang, Yiming, et al.
Publicado: (2023)
por: Wang, Yiming, et al.
Publicado: (2023)
Adapting Large Language Models for Education: Foundational Capabilities, Potentials, and Challenges
por: Li, Qingyao, et al.
Publicado: (2023)
por: Li, Qingyao, et al.
Publicado: (2023)
PsyEval: A Suite of Mental Health Related Tasks for Evaluating Large Language Models
por: Jin, Haoan, et al.
Publicado: (2023)
por: Jin, Haoan, et al.
Publicado: (2023)
Large Language Models Make Sample-Efficient Recommender Systems
por: Lin, Jianghao, et al.
Publicado: (2024)
por: Lin, Jianghao, et al.
Publicado: (2024)
Helping Large Language Models Protect Themselves: An Enhanced Filtering and Summarization System
por: Muhaimin, Sheikh Samit, et al.
Publicado: (2025)
por: Muhaimin, Sheikh Samit, et al.
Publicado: (2025)
Towards Label-Only Membership Inference Attack against Pre-trained Large Language Models
por: He, Yu, et al.
Publicado: (2025)
por: He, Yu, et al.
Publicado: (2025)
SongSage: A Large Musical Language Model with Lyric Generative Pre-training
por: Guo, Jiani, et al.
Publicado: (2026)
por: Guo, Jiani, et al.
Publicado: (2026)
Mitigating Hidden Confounding by Progressive Confounder Imputation via Large Language Models
por: Yang, Hao, et al.
Publicado: (2025)
por: Yang, Hao, et al.
Publicado: (2025)
Cross-layer Attention Sharing for Pre-trained Large Language Models
por: Mu, Yongyu, et al.
Publicado: (2024)
por: Mu, Yongyu, et al.
Publicado: (2024)
Self-Demos: Eliciting Out-of-Demonstration Generalizability in Large Language Models
por: He, Wei, et al.
Publicado: (2024)
por: He, Wei, et al.
Publicado: (2024)
Delusions of Large Language Models
por: Xu, Hongshen, et al.
Publicado: (2025)
por: Xu, Hongshen, et al.
Publicado: (2025)
Fine-tuning Pre-trained Language Models for Few-shot Intent Detection: Supervised Pre-training and Isotropization
por: Zhang, Haode, et al.
Publicado: (2022)
por: Zhang, Haode, et al.
Publicado: (2022)
LLM4CD: Leveraging Large Language Models for Open-World Knowledge Augmented Cognitive Diagnosis
por: Zhang, Weiming, et al.
Publicado: (2025)
por: Zhang, Weiming, et al.
Publicado: (2025)
ReMiT: RL-Guided Mid-Training for Iterative LLM Evolution
por: Huang, Junjie, et al.
Publicado: (2026)
por: Huang, Junjie, et al.
Publicado: (2026)
Adding Alignment Control to Language Models
por: Zhu, Wenhong, et al.
Publicado: (2025)
por: Zhu, Wenhong, et al.
Publicado: (2025)
Can Large Language Models Still Explain Themselves? Investigating the Impact of Quantization on Self-Explanations
por: Wang, Qianli, et al.
Publicado: (2026)
por: Wang, Qianli, et al.
Publicado: (2026)
3D-PreMise: Can Large Language Models Generate 3D Shapes with Sharp Features and Parametric Control?
por: Yuan, Zeqing, et al.
Publicado: (2024)
por: Yuan, Zeqing, et al.
Publicado: (2024)
Leveraging Group Relative Policy Optimization to Advance Large Language Models in Traditional Chinese Medicine
por: Xie, Jiacheng, et al.
Publicado: (2025)
por: Xie, Jiacheng, et al.
Publicado: (2025)
Ejemplares similares
-
CoLD: Counterfactually-Guided Length Debiasing for Process Reward Models in Mathematical Reasoning
por: Zheng, Congmin, et al.
Publicado: (2025) -
A Survey of Process Reward Models: From Outcome Signals to Process Supervisions for Large Language Models
por: Zheng, Congmin, et al.
Publicado: (2025) -
ItD: Large Language Models Can Teach Themselves Induction through Deduction
por: Sun, Wangtao, et al.
Publicado: (2024) -
InfoRank: Unbiased Learning-to-Rank via Conditional Mutual Information Minimization
por: Jin, Jiarui, et al.
Publicado: (2024) -
Large Language Models Are Not Robust Multiple Choice Selectors
por: Zheng, Chujie, et al.
Publicado: (2023)