Identifying Multiple Personalities in Large Language Models with External Evaluation
Fuente:
arXiv
Guardado en:
| Autores principales: | Song, Xiaoyang, Adachi, Yuta, Feng, Jessie, Lin, Mouwei, Yu, Linhao, Li, Frank, Gupta, Akshat, Anumanchipalli, Gopala, Kaur, Simerjot |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Self-Assessment Tests are Unreliable Measures of LLM Personality
por: Gupta, Akshat, et al.
Publicado: (2023)
por: Gupta, Akshat, et al.
Publicado: (2023)
Rebuilding ROME : Resolving Model Collapse during Sequential Model Editing
por: Gupta, Akshat, et al.
Publicado: (2024)
por: Gupta, Akshat, et al.
Publicado: (2024)
A Unified Framework for Model Editing
por: Gupta, Akshat, et al.
Publicado: (2024)
por: Gupta, Akshat, et al.
Publicado: (2024)
Is Bigger Edit Batch Size Always Better? -- An Empirical Study on Model Editing with Llama-3
por: Yoon, Junsang, et al.
Publicado: (2024)
por: Yoon, Junsang, et al.
Publicado: (2024)
Geometric Interpretation of Layer Normalization and a Comparative Analysis with RMSNorm
por: Gupta, Akshat, et al.
Publicado: (2024)
por: Gupta, Akshat, et al.
Publicado: (2024)
Model Editing at Scale leads to Gradual and Catastrophic Forgetting
por: Gupta, Akshat, et al.
Publicado: (2024)
por: Gupta, Akshat, et al.
Publicado: (2024)
How Do LLMs Use Their Depth?
por: Gupta, Akshat, et al.
Publicado: (2025)
por: Gupta, Akshat, et al.
Publicado: (2025)
Efficient Knowledge Editing via Minimal Precomputation
por: Gupta, Akshat, et al.
Publicado: (2025)
por: Gupta, Akshat, et al.
Publicado: (2025)
The Oracle Has Spoken: A Multi-Aspect Evaluation of Dialogue in Pythia
por: Chen, Zixun, et al.
Publicado: (2025)
por: Chen, Zixun, et al.
Publicado: (2025)
PokerBench: Training Large Language Models to become Professional Poker Players
por: Zhuang, Richard, et al.
Publicado: (2025)
por: Zhuang, Richard, et al.
Publicado: (2025)
Towards Hierarchical Spoken Language Dysfluency Modeling
por: Lian, Jiachen, et al.
Publicado: (2024)
por: Lian, Jiachen, et al.
Publicado: (2024)
FineZip : Pushing the Limits of Large Language Models for Practical Lossless Text Compression
por: Mittu, Fazal, et al.
Publicado: (2024)
por: Mittu, Fazal, et al.
Publicado: (2024)
Evolutionary Strategies lead to Catastrophic Forgetting in LLMs
por: Abdi, Immanuel, et al.
Publicado: (2026)
por: Abdi, Immanuel, et al.
Publicado: (2026)
Lifelong Knowledge Editing requires Better Regularization
por: Gupta, Akshat, et al.
Publicado: (2025)
por: Gupta, Akshat, et al.
Publicado: (2025)
Norm Growth and Stability Challenges in Localized Sequential Knowledge Editing
por: Gupta, Akshat, et al.
Publicado: (2025)
por: Gupta, Akshat, et al.
Publicado: (2025)
Conservative Bias in Large Language Models: Measuring Relation Predictions
por: Aguda, Toyin, et al.
Publicado: (2025)
por: Aguda, Toyin, et al.
Publicado: (2025)
Sylber: Syllabic Embedding Representation of Speech from Raw Audio
por: Cho, Cheol Jun, et al.
Publicado: (2024)
por: Cho, Cheol Jun, et al.
Publicado: (2024)
Scaling Spoken Language Models with Syllabic Speech Tokenization
por: Lee, Nicholas, et al.
Publicado: (2025)
por: Lee, Nicholas, et al.
Publicado: (2025)
Large Language Models as Financial Data Annotators: A Study on Effectiveness and Efficiency
por: Aguda, Toyin, et al.
Publicado: (2024)
por: Aguda, Toyin, et al.
Publicado: (2024)
LFED: A Literary Fiction Evaluation Dataset for Large Language Models
por: Yu, Linhao, et al.
Publicado: (2024)
por: Yu, Linhao, et al.
Publicado: (2024)
Unsupervised TTS Acoustic Modeling for TTS with Conditional Disentangled Sequential VAE
por: Lian, Jiachen, et al.
Publicado: (2022)
por: Lian, Jiachen, et al.
Publicado: (2022)
Grounding LLM Reasoning with Knowledge Graphs
por: Amayuelas, Alfonso, et al.
Publicado: (2025)
por: Amayuelas, Alfonso, et al.
Publicado: (2025)
Multimodal Segmentation for Vocal Tract Modeling
por: Jain, Rishi, et al.
Publicado: (2024)
por: Jain, Rishi, et al.
Publicado: (2024)
FinNLI: Novel Dataset for Multi-Genre Financial Natural Language Inference Benchmarking
por: Magomere, Jabez, et al.
Publicado: (2025)
por: Magomere, Jabez, et al.
Publicado: (2025)
FinQAPT: Empowering Financial Decisions with End-to-End LLM-driven Question Answering Pipeline
por: Singh, Kuldeep, et al.
Publicado: (2024)
por: Singh, Kuldeep, et al.
Publicado: (2024)
Self-Supervised Models of Speech Infer Universal Articulatory Kinematics
por: Cho, Cheol Jun, et al.
Publicado: (2023)
por: Cho, Cheol Jun, et al.
Publicado: (2023)
Sylber 2.0: A Universal Syllable Embedding
por: Cho, Cheol Jun, et al.
Publicado: (2026)
por: Cho, Cheol Jun, et al.
Publicado: (2026)
Full-Duplex-Bench: A Benchmark to Evaluate Full-duplex Spoken Dialogue Models on Turn-taking Capabilities
por: Lin, Guan-Ting, et al.
Publicado: (2025)
por: Lin, Guan-Ting, et al.
Publicado: (2025)
Self-Pluralising Culture Alignment for Large Language Models
por: Xu, Shaoyang, et al.
Publicado: (2024)
por: Xu, Shaoyang, et al.
Publicado: (2024)
How Reliable are Confidence Estimators for Large Reasoning Models? A Systematic Benchmark on High-Stakes Domains
por: Khanmohammadi, Reza, et al.
Publicado: (2026)
por: Khanmohammadi, Reza, et al.
Publicado: (2026)
Coding Speech through Vocal Tract Kinematics
por: Cho, Cheol Jun, et al.
Publicado: (2024)
por: Cho, Cheol Jun, et al.
Publicado: (2024)
SD-HuBERT: Sentence-Level Self-Distillation Induces Syllabic Organization in HuBERT
por: Cho, Cheol Jun, et al.
Publicado: (2023)
por: Cho, Cheol Jun, et al.
Publicado: (2023)
DePrompt: Desensitization and Evaluation of Personal Identifiable Information in Large Language Model Prompts
por: Sun, Xiongtao, et al.
Publicado: (2024)
por: Sun, Xiongtao, et al.
Publicado: (2024)
A Variational Approach for Mitigating Entity Bias in Relation Extraction
por: Mensah, Samuel, et al.
Publicado: (2025)
por: Mensah, Samuel, et al.
Publicado: (2025)
Plan-and-Act: Improving Planning of Agents for Long-Horizon Tasks
por: Erdogan, Lutfi Eren, et al.
Publicado: (2025)
por: Erdogan, Lutfi Eren, et al.
Publicado: (2025)
Skills-in-Context Prompting: Unlocking Compositionality in Large Language Models
por: Chen, Jiaao, et al.
Publicado: (2023)
por: Chen, Jiaao, et al.
Publicado: (2023)
CMoralEval: A Moral Evaluation Benchmark for Chinese Large Language Models
por: Yu, Linhao, et al.
Publicado: (2024)
por: Yu, Linhao, et al.
Publicado: (2024)
Evaluating the External and Parametric Knowledge Fusion of Large Language Models
por: Zhang, Hao, et al.
Publicado: (2024)
por: Zhang, Hao, et al.
Publicado: (2024)
Thrust: Adaptively Propels Large Language Models with External Knowledge
por: Zhao, Xinran, et al.
Publicado: (2023)
por: Zhao, Xinran, et al.
Publicado: (2023)
Echoes of Agreement: Argument Driven Opinion Shifts in Large Language Models
por: Kaur, Avneet
Publicado: (2025)
por: Kaur, Avneet
Publicado: (2025)
Ejemplares similares
-
Self-Assessment Tests are Unreliable Measures of LLM Personality
por: Gupta, Akshat, et al.
Publicado: (2023) -
Rebuilding ROME : Resolving Model Collapse during Sequential Model Editing
por: Gupta, Akshat, et al.
Publicado: (2024) -
A Unified Framework for Model Editing
por: Gupta, Akshat, et al.
Publicado: (2024) -
Is Bigger Edit Batch Size Always Better? -- An Empirical Study on Model Editing with Llama-3
por: Yoon, Junsang, et al.
Publicado: (2024) -
Geometric Interpretation of Layer Normalization and a Comparative Analysis with RMSNorm
por: Gupta, Akshat, et al.
Publicado: (2024)