The Strongest Teacher Is Not Always the Best Teacher: Student-Centric Answer Selection
Fuente:
arXiv
Guardado en:
| Autores principales: | Hu, Zhengyu, Xiao, Zheyuan, Song, Linxin, Jiang, Fengqing, Li, Yutai, Chen, Zhengyu, Xiong, Zhihan, Liu, Yue, Lin, Junhao, Su, Yao, Hu, Lijie, Ding, Kaize, Teng, Xiao, Poovendran, Radha |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Explaining Length Bias in LLM-Based Preference Evaluations
por: Hu, Zhengyu, et al.
Publicado: (2024)
por: Hu, Zhengyu, et al.
Publicado: (2024)
Stronger Models are NOT Stronger Teachers for Instruction Tuning
por: Xu, Zhangchen, et al.
Publicado: (2024)
por: Xu, Zhangchen, et al.
Publicado: (2024)
Towards Acyclic Preference Evaluation of Language Models via Multiple Evaluators
por: Hu, Zhengyu, et al.
Publicado: (2024)
por: Hu, Zhengyu, et al.
Publicado: (2024)
Population-Aligned Persona Generation for LLM-based Social Simulation
por: Hu, Zhengyu, et al.
Publicado: (2025)
por: Hu, Zhengyu, et al.
Publicado: (2025)
Let's Ask GNN: Empowering Large Language Model for Graph In-Context Learning
por: Hu, Zhengyu, et al.
Publicado: (2024)
por: Hu, Zhengyu, et al.
Publicado: (2024)
BadChain: Backdoor Chain-of-Thought Prompting for Large Language Models
por: Xiang, Zhen, et al.
Publicado: (2024)
por: Xiang, Zhen, et al.
Publicado: (2024)
$P$-trivial MMP, Zariski decompositions and minimal models for generalised pairs
por: Hu, Zhengyu
Publicado: (2025)
por: Hu, Zhengyu
Publicado: (2025)
Brave: Byzantine-Resilient and Privacy-Preserving Peer-to-Peer Federated Learning
por: Xu, Zhangchen, et al.
Publicado: (2024)
por: Xu, Zhangchen, et al.
Publicado: (2024)
CoAct: Co-Active LLM Preference Learning with Human-AI Synergy
por: Xu, Ruiyao, et al.
Publicado: (2026)
por: Xu, Ruiyao, et al.
Publicado: (2026)
ChatBug: A Common Vulnerability of Aligned LLMs Induced by Chat Templates
por: Jiang, Fengqing, et al.
Publicado: (2024)
por: Jiang, Fengqing, et al.
Publicado: (2024)
BadScientist: Can a Research Agent Write Convincing but Unsound Papers that Fool LLM Reviewers?
por: Jiang, Fengqing, et al.
Publicado: (2025)
por: Jiang, Fengqing, et al.
Publicado: (2025)
ACE: A Model Poisoning Attack on Contribution Evaluation Methods in Federated Learning
por: Xu, Zhangchen, et al.
Publicado: (2024)
por: Xu, Zhangchen, et al.
Publicado: (2024)
Variational principle of higher dimension weighted pressure for amenable group actions
por: Yin, Zhengyu, et al.
Publicado: (2023)
por: Yin, Zhengyu, et al.
Publicado: (2023)
Minimal amenable subshift with full mean dimension
por: Yin, Zhengyu, et al.
Publicado: (2024)
por: Yin, Zhengyu, et al.
Publicado: (2024)
Unveiling the Learning Mind of Language Models: A Cognitive Framework and Empirical Study
por: Hu, Zhengyu, et al.
Publicado: (2025)
por: Hu, Zhengyu, et al.
Publicado: (2025)
Existence of the minimal model program for log canonical generalized pairs
por: Hu, Zhengyu, et al.
Publicado: (2026)
por: Hu, Zhengyu, et al.
Publicado: (2026)
Simple and Asymmetric Graph Contrastive Learning without Augmentations
por: Xiao, Teng, et al.
Publicado: (2023)
por: Xiao, Teng, et al.
Publicado: (2023)
The Teacher Aide...An Answer to the Teacher Shortage.
por: Axford, Roger W.
Publicado: (1968)
por: Axford, Roger W.
Publicado: (1968)
SafeDecoding: Defending against Jailbreak Attacks via Safety-Aware Decoding
por: Xu, Zhangchen, et al.
Publicado: (2024)
por: Xu, Zhangchen, et al.
Publicado: (2024)
CleanGen: Mitigating Backdoor Attacks for Generation Tasks in Large Language Models
por: Li, Yuetai, et al.
Publicado: (2024)
por: Li, Yuetai, et al.
Publicado: (2024)
ArtPrompt: ASCII Art-based Jailbreak Attacks against Aligned LLMs
por: Jiang, Fengqing, et al.
Publicado: (2024)
por: Jiang, Fengqing, et al.
Publicado: (2024)
Selection of Teachers and Student Teachers. Bibliographies in Education. No. 64.
por: Beslin, Ralph
Publicado: (1978)
por: Beslin, Ralph
Publicado: (1978)
Strongest quantum nonlocality in $N$-partite systems
por: Hu, Mengying, et al.
Publicado: (2024)
por: Hu, Mengying, et al.
Publicado: (2024)
The Relationship Between Teachers' Professional Knowledge and Skills, Teachers' Empowerment, and Students' Learning
por: Jui‐Teng Li, et al.
Publicado: (2025)
por: Jui‐Teng Li, et al.
Publicado: (2025)
Prioritizing the Best: Incentivizing Reliable Multimodal Reasoning by Rewarding Beyond Answer Correctness
por: Jia, Mengzhao, et al.
Publicado: (2026)
por: Jia, Mengzhao, et al.
Publicado: (2026)
Dual-Forward Path Teacher Knowledge Distillation: Bridging the Capacity Gap Between Teacher and Student
por: Li, Tong, et al.
Publicado: (2025)
por: Li, Tong, et al.
Publicado: (2025)
TinyV: Reducing False Negatives in Verification Improves RL for LLM Reasoning
por: Xu, Zhangchen, et al.
Publicado: (2025)
por: Xu, Zhangchen, et al.
Publicado: (2025)
Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing
por: Xu, Zhangchen, et al.
Publicado: (2024)
por: Xu, Zhangchen, et al.
Publicado: (2024)
On-Policy Distillation with Best-of-N Teacher Rollout Selection
por: Zhang, Ke, et al.
Publicado: (2026)
por: Zhang, Ke, et al.
Publicado: (2026)
Editable Concept Bottleneck Models
por: Hu, Lijie, et al.
Publicado: (2024)
por: Hu, Lijie, et al.
Publicado: (2024)
Scaled packing pressures on subsets for amenable group actions
por: Xiao, Zubiao, et al.
Publicado: (2024)
por: Xiao, Zubiao, et al.
Publicado: (2024)
Steering Multimodal Large Language Models Decoding for Context-Aware Safety
por: Liu, Zheyuan, et al.
Publicado: (2025)
por: Liu, Zheyuan, et al.
Publicado: (2025)
The Development of L2 Selves Among Chinese Early Adolescent Learners of English in Student‐ and Teacher‐Centred Contexts: A Person‐in‐Context Relational View
por: Xiao Hu, et al.
Publicado: (2026)
por: Xiao Hu, et al.
Publicado: (2026)
The Domestic AI Advantage: How the National Identity of Generative AI Shapes Consumer Adoption of AI ‐Generated Content
por: Zhengyu Shen, et al.
Publicado: (2026)
por: Zhengyu Shen, et al.
Publicado: (2026)
Synthesis and Structural Insights into 1,4‐Bis(phenylsulfonyl)‐1 H ‐pyrazol‐5‐amine Derivatives via a One‐Pot Domino Reaction
por: Lingyun Li, et al.
Publicado: (2025)
por: Lingyun Li, et al.
Publicado: (2025)
Strongest nonlocal sets with minimum cardinality in tripartite systems
por: Zhen, Xiao-Fan, et al.
Publicado: (2024)
por: Zhen, Xiao-Fan, et al.
Publicado: (2024)
Vertex-minimal hyperbolic origami 2-torus
por: Zou, Zhengyu
Publicado: (2025)
por: Zou, Zhengyu
Publicado: (2025)
Shadowing property for set-valued map and its inverse limit
por: Yin, Zhengyu
Publicado: (2024)
por: Yin, Zhengyu
Publicado: (2024)
Open/closed correspondence for the projective line
por: Zong, Zhengyu
Publicado: (2025)
por: Zong, Zhengyu
Publicado: (2025)
Variational principles of relative weighted topological pressures
por: Yin, Zhengyu
Publicado: (2024)
por: Yin, Zhengyu
Publicado: (2024)
Ejemplares similares
-
Explaining Length Bias in LLM-Based Preference Evaluations
por: Hu, Zhengyu, et al.
Publicado: (2024) -
Stronger Models are NOT Stronger Teachers for Instruction Tuning
por: Xu, Zhangchen, et al.
Publicado: (2024) -
Towards Acyclic Preference Evaluation of Language Models via Multiple Evaluators
por: Hu, Zhengyu, et al.
Publicado: (2024) -
Population-Aligned Persona Generation for LLM-based Social Simulation
por: Hu, Zhengyu, et al.
Publicado: (2025) -
Let's Ask GNN: Empowering Large Language Model for Graph In-Context Learning
por: Hu, Zhengyu, et al.
Publicado: (2024)