Cross-model Transferability among Large Language Models on the Platonic Representations of Concepts
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Youcheng, Huang, Chen, Feng, Duanyu, Lei, Wenqiang, Lv, Jiancheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Legend: Leveraging Representation Engineering to Annotate Safety Margin for Preference Datasets
por: Feng, Duanyu, et al.
Publicado: (2024)
por: Feng, Duanyu, et al.
Publicado: (2024)
Beyond Solving Math Quiz: Evaluating the Ability of Large Reasoning Models to Ask for Information
por: Huang, Youcheng, et al.
Publicado: (2025)
por: Huang, Youcheng, et al.
Publicado: (2025)
DREditor: An Time-efficient Approach for Building a Domain-specific Dense Retrieval Model
por: Huang, Chen, et al.
Publicado: (2024)
por: Huang, Chen, et al.
Publicado: (2024)
Towards Analyzing and Understanding the Limitations of DPO: A Theoretical Perspective
por: Feng, Duanyu, et al.
Publicado: (2024)
por: Feng, Duanyu, et al.
Publicado: (2024)
Concept -- An Evaluation Protocol on Conversational Recommender Systems with System-centric and User-centric Factors
por: Huang, Chen, et al.
Publicado: (2024)
por: Huang, Chen, et al.
Publicado: (2024)
Dishonesty in Helpful and Harmless Alignment
por: Huang, Youcheng, et al.
Publicado: (2024)
por: Huang, Youcheng, et al.
Publicado: (2024)
How to Enable Effective Cooperation Between Humans and NLP Models: A Survey of Principles, Formalizations, and Beyond
por: Huang, Chen, et al.
Publicado: (2025)
por: Huang, Chen, et al.
Publicado: (2025)
Towards Understanding the Influence of Reward Margin on Preference Model Performance
por: Qin, Bowen, et al.
Publicado: (2024)
por: Qin, Bowen, et al.
Publicado: (2024)
See the Unseen: Better Context-Consistent Knowledge-Editing by Noises
por: Huang, Youcheng, et al.
Publicado: (2024)
por: Huang, Youcheng, et al.
Publicado: (2024)
AMaPO: Adaptive Margin-attached Preference Optimization for Language Model Alignment
por: Deng, Ruibo, et al.
Publicado: (2025)
por: Deng, Ruibo, et al.
Publicado: (2025)
E2Edev: Benchmarking Large Language Models in End-to-End Software Development Task
por: Liu, Jingyao, et al.
Publicado: (2025)
por: Liu, Jingyao, et al.
Publicado: (2025)
METER: Evaluating Multi-Level Contextual Causal Reasoning in Large Language Models
por: Li, Pengfeng, et al.
Publicado: (2026)
por: Li, Pengfeng, et al.
Publicado: (2026)
Probing Multimodal Large Language Models for Global and Local Semantic Representations
por: Tao, Mingxu, et al.
Publicado: (2024)
por: Tao, Mingxu, et al.
Publicado: (2024)
Can Large Language Models Understand Internet Buzzwords Through User-Generated Content
por: Huang, Chen, et al.
Publicado: (2025)
por: Huang, Chen, et al.
Publicado: (2025)
Empowering Many, Biasing a Few: Generalist Credit Scoring through Large Language Models
por: Feng, Duanyu, et al.
Publicado: (2023)
por: Feng, Duanyu, et al.
Publicado: (2023)
ConceptViz: A Visual Analytics Approach for Exploring Concepts in Large Language Models
por: Li, Haoxuan, et al.
Publicado: (2025)
por: Li, Haoxuan, et al.
Publicado: (2025)
Revisiting Jailbreaking for Large Language Models: A Representation Engineering Perspective
por: Li, Tianlong, et al.
Publicado: (2024)
por: Li, Tianlong, et al.
Publicado: (2024)
FAS: Fast ANN-SNN Conversion for Spiking Large Language Models
por: Chen, Long, et al.
Publicado: (2025)
por: Chen, Long, et al.
Publicado: (2025)
Improving Large Language Models with Concept-Aware Fine-Tuning
por: Chen, Michael K., et al.
Publicado: (2025)
por: Chen, Michael K., et al.
Publicado: (2025)
PromptBridge: Cross-Model Prompt Transfer for Large Language Models
por: Wang, Yaxuan, et al.
Publicado: (2025)
por: Wang, Yaxuan, et al.
Publicado: (2025)
Layer Swapping for Zero-Shot Cross-Lingual Transfer in Large Language Models
por: Bandarkar, Lucas, et al.
Publicado: (2024)
por: Bandarkar, Lucas, et al.
Publicado: (2024)
Self-supervised Quantized Representation for Seamlessly Integrating Knowledge Graphs with Large Language Models
por: Lin, Qika, et al.
Publicado: (2025)
por: Lin, Qika, et al.
Publicado: (2025)
From Knowledge to Treatment: Large Language Model Assisted Biomedical Concept Representation for Drug Repurposing
por: Xiang, Chengrui, et al.
Publicado: (2025)
por: Xiang, Chengrui, et al.
Publicado: (2025)
Emergent Structured Representations Support Flexible In-Context Inference in Large Language Models
por: Xu, Ningyu, et al.
Publicado: (2026)
por: Xu, Ningyu, et al.
Publicado: (2026)
Code-Switching In-Context Learning for Cross-Lingual Transfer of Large Language Models
por: Yoo, Haneul, et al.
Publicado: (2025)
por: Yoo, Haneul, et al.
Publicado: (2025)
The Geometry of Refusal in Large Language Models: Concept Cones and Representational Independence
por: Wollschläger, Tom, et al.
Publicado: (2025)
por: Wollschläger, Tom, et al.
Publicado: (2025)
Fine-grained Stateful Knowledge Exploration: Effective and Efficient Graph Retrieval with Large Language Models
por: Tao, Dehao, et al.
Publicado: (2024)
por: Tao, Dehao, et al.
Publicado: (2024)
Effective and Efficient Adversarial Detection for Vision-Language Models via A Single Vector
por: Huang, Youcheng, et al.
Publicado: (2024)
por: Huang, Youcheng, et al.
Publicado: (2024)
Emotion Concepts and their Function in a Large Language Model
por: Sofroniew, Nicholas, et al.
Publicado: (2026)
por: Sofroniew, Nicholas, et al.
Publicado: (2026)
Large Language Model for Patent Concept Generation
por: Ren, Runtao, et al.
Publicado: (2024)
por: Ren, Runtao, et al.
Publicado: (2024)
On the Tip of the Tongue: Analyzing Conceptual Representation in Large Language Models with Reverse-Dictionary Probe
por: Xu, Ningyu, et al.
Publicado: (2024)
por: Xu, Ningyu, et al.
Publicado: (2024)
Coarse-to-Fine Highlighting: Reducing Knowledge Hallucination in Large Language Models
por: Lv, Qitan, et al.
Publicado: (2024)
por: Lv, Qitan, et al.
Publicado: (2024)
Beyond Persuasion: Towards Conversational Recommender System with Credible Explanations
por: Qin, Peixin, et al.
Publicado: (2024)
por: Qin, Peixin, et al.
Publicado: (2024)
Towards Proactive Information Probing: Customer Service Chatbots Harvesting Value from Conversation
por: Huang, Chen, et al.
Publicado: (2026)
por: Huang, Chen, et al.
Publicado: (2026)
Neural Incompatibility: The Unbridgeable Gap of Cross-Scale Parametric Knowledge Transfer in Large Language Models
por: Tan, Yuqiao, et al.
Publicado: (2025)
por: Tan, Yuqiao, et al.
Publicado: (2025)
Language-Specific Representation of Emotion-Concept Knowledge Causally Supports Emotion Inference
por: Li, Ming, et al.
Publicado: (2023)
por: Li, Ming, et al.
Publicado: (2023)
Contrastive Cross-Course Knowledge Tracing via Concept Graph Guided Knowledge Transfer
por: Han, Wenkang, et al.
Publicado: (2025)
por: Han, Wenkang, et al.
Publicado: (2025)
Identifying Linear Relational Concepts in Large Language Models
por: Chanin, David, et al.
Publicado: (2023)
por: Chanin, David, et al.
Publicado: (2023)
Lost in the Source Language: How Large Language Models Evaluate the Quality of Machine Translation
por: Huang, Xu, et al.
Publicado: (2024)
por: Huang, Xu, et al.
Publicado: (2024)
Automated Triaging and Transfer Learning of Incident Learning Safety Reports Using Large Language Representational Models
por: Beidler, Peter, et al.
Publicado: (2025)
por: Beidler, Peter, et al.
Publicado: (2025)
Ejemplares similares
-
Legend: Leveraging Representation Engineering to Annotate Safety Margin for Preference Datasets
por: Feng, Duanyu, et al.
Publicado: (2024) -
Beyond Solving Math Quiz: Evaluating the Ability of Large Reasoning Models to Ask for Information
por: Huang, Youcheng, et al.
Publicado: (2025) -
DREditor: An Time-efficient Approach for Building a Domain-specific Dense Retrieval Model
por: Huang, Chen, et al.
Publicado: (2024) -
Towards Analyzing and Understanding the Limitations of DPO: A Theoretical Perspective
por: Feng, Duanyu, et al.
Publicado: (2024) -
Concept -- An Evaluation Protocol on Conversational Recommender Systems with System-centric and User-centric Factors
por: Huang, Chen, et al.
Publicado: (2024)