Guardado en:
| Autores principales: | Xu, Weilun, Rusnak, Alexander, Kaplan, Frederic |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2603.23659 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
HAECcity: Open-Vocabulary Scene Understanding of City-Scale Point Clouds with Superpoint Graph Clustering
por: Rusnak, Alexander, et al.
Publicado: (2025)
por: Rusnak, Alexander, et al.
Publicado: (2025)
Probing Multimodal Large Language Models for Global and Local Semantic Representations
por: Tao, Mingxu, et al.
Publicado: (2024)
por: Tao, Mingxu, et al.
Publicado: (2024)
Emergent Hierarchical Structure in Large Language Models: An Information-Theoretic Framework for Multi-Scale Representation
por: Zhang, Yukin, et al.
Publicado: (2025)
por: Zhang, Yukin, et al.
Publicado: (2025)
On the Tip of the Tongue: Analyzing Conceptual Representation in Large Language Models with Reverse-Dictionary Probe
por: Xu, Ningyu, et al.
Publicado: (2024)
por: Xu, Ningyu, et al.
Publicado: (2024)
Emergent Structured Representations Support Flexible In-Context Inference in Large Language Models
por: Xu, Ningyu, et al.
Publicado: (2026)
por: Xu, Ningyu, et al.
Publicado: (2026)
Revealing the Intrinsic Ethical Vulnerability of Aligned Large Language Models
por: Lian, Jiawei, et al.
Publicado: (2025)
por: Lian, Jiawei, et al.
Publicado: (2025)
The Moral Consistency Pipeline: Continuous Ethical Evaluation for Large Language Models
por: Jamshidi, Saeid, et al.
Publicado: (2025)
por: Jamshidi, Saeid, et al.
Publicado: (2025)
Moral Persuasion in Large Language Models: Evaluating Susceptibility and Ethical Alignment
por: Huang, Allison, et al.
Publicado: (2024)
por: Huang, Allison, et al.
Publicado: (2024)
When Large Language Models Meet Law: Dual-Lens Taxonomy, Technical Advances, and Ethical Governance
por: Shao, Peizhang, et al.
Publicado: (2025)
por: Shao, Peizhang, et al.
Publicado: (2025)
H-Probes: Extracting Hierarchical Structures From Latent Representations of Language Models
por: Dawes, Cutter, et al.
Publicado: (2026)
por: Dawes, Cutter, et al.
Publicado: (2026)
SproutBench: A Benchmark for Safe and Ethical Large Language Models for Youth
por: Xing, Wenpeng, et al.
Publicado: (2025)
por: Xing, Wenpeng, et al.
Publicado: (2025)
Diverse Human Value Alignment for Large Language Models via Ethical Reasoning
por: Wang, Jiahao, et al.
Publicado: (2025)
por: Wang, Jiahao, et al.
Publicado: (2025)
The Only Way is Ethics: A Guide to Ethical Research with Large Language Models
por: Ungless, Eddie L., et al.
Publicado: (2024)
por: Ungless, Eddie L., et al.
Publicado: (2024)
"Pull or Not to Pull?'': Investigating Moral Biases in Leading Large Language Models Across Ethical Dilemmas
por: Ding, Junchen, et al.
Publicado: (2025)
por: Ding, Junchen, et al.
Publicado: (2025)
Probing Neural Topology of Large Language Models
por: Zheng, Yu, et al.
Publicado: (2025)
por: Zheng, Yu, et al.
Publicado: (2025)
Probing Causality Manipulation of Large Language Models
por: Zhang, Chenyang, et al.
Publicado: (2024)
por: Zhang, Chenyang, et al.
Publicado: (2024)
Leveraging Graph Structures and Large Language Models for End-to-End Synthetic Task-Oriented Dialogues
por: Medjad, Maya, et al.
Publicado: (2025)
por: Medjad, Maya, et al.
Publicado: (2025)
Extracting and Steering Emotion Representations in Small Language Models: A Methodological Comparison
por: Jeong, Jihoon
Publicado: (2026)
por: Jeong, Jihoon
Publicado: (2026)
RadialRouter: Structured Representation for Efficient and Robust Large Language Models Routing
por: Jin, Ruihan, et al.
Publicado: (2025)
por: Jin, Ruihan, et al.
Publicado: (2025)
How Independent are Large Language Models? A Statistical Framework for Auditing Behavioral Entanglement and Reweighting Verifier Ensembles
por: Kuai, Chenchen, et al.
Publicado: (2026)
por: Kuai, Chenchen, et al.
Publicado: (2026)
Fortifying Ethical Boundaries in AI: Advanced Strategies for Enhancing Security in Large Language Models
por: He, Yunhong, et al.
Publicado: (2024)
por: He, Yunhong, et al.
Publicado: (2024)
Can Large Language Models Generate Effective Datasets for Emotion Recognition in Conversations?
por: Kaplan, Burak Can, et al.
Publicado: (2025)
por: Kaplan, Burak Can, et al.
Publicado: (2025)
Assisted Debate Builder with Large Language Models
por: Faugier, Elliot, et al.
Publicado: (2024)
por: Faugier, Elliot, et al.
Publicado: (2024)
Probing the Robustness of Theory of Mind in Large Language Models
por: Nickel, Christian, et al.
Publicado: (2024)
por: Nickel, Christian, et al.
Publicado: (2024)
Probing the Difficulty Perception Mechanism of Large Language Models
por: Lee, Sunbowen, et al.
Publicado: (2025)
por: Lee, Sunbowen, et al.
Publicado: (2025)
Towards Explainable Temporal Reasoning in Large Language Models: A Structure-Aware Generative Framework
por: Jiang, Zihao, et al.
Publicado: (2025)
por: Jiang, Zihao, et al.
Publicado: (2025)
Evaluation Methodology for Large Language Models for Multilingual Document Question and Answer
por: Kahana, Adar, et al.
Publicado: (2024)
por: Kahana, Adar, et al.
Publicado: (2024)
Methodology of Adapting Large English Language Models for Specific Cultural Contexts
por: Zhang, Wenjing, et al.
Publicado: (2024)
por: Zhang, Wenjing, et al.
Publicado: (2024)
PRISM: A Methodology for Auditing Biases in Large Language Models
por: Azzopardi, Leif, et al.
Publicado: (2024)
por: Azzopardi, Leif, et al.
Publicado: (2024)
Dynamic Evaluation of Large Language Models by Meta Probing Agents
por: Zhu, Kaijie, et al.
Publicado: (2024)
por: Zhu, Kaijie, et al.
Publicado: (2024)
Experiments or Outcomes? Probing Scientific Feasibility in Large Language Models
por: Mohammadi, Seyedali, et al.
Publicado: (2026)
por: Mohammadi, Seyedali, et al.
Publicado: (2026)
Stuck in the Matrix: Probing Spatial Reasoning in Large Language Models
por: Bai, Maggie, et al.
Publicado: (2025)
por: Bai, Maggie, et al.
Publicado: (2025)
Neural Probe-Based Hallucination Detection for Large Language Models
por: Liang, Shize, et al.
Publicado: (2025)
por: Liang, Shize, et al.
Publicado: (2025)
Counterfactual Probing for Hallucination Detection and Mitigation in Large Language Models
por: Feng, Yijun
Publicado: (2025)
por: Feng, Yijun
Publicado: (2025)
Legal Evalutions and Challenges of Large Language Models
por: Wang, Jiaqi, et al.
Publicado: (2024)
por: Wang, Jiaqi, et al.
Publicado: (2024)
Challenges and Responses in the Practice of Large Language Models
por: Zhu, Hongyin
Publicado: (2024)
por: Zhu, Hongyin
Publicado: (2024)
Integrating Emotional and Linguistic Models for Ethical Compliance in Large Language Models
por: Chang, Edward Y.
Publicado: (2024)
por: Chang, Edward Y.
Publicado: (2024)
Exploring Large Language Models on Cross-Cultural Values in Connection with Training Methodology
por: Kim, Minsang, et al.
Publicado: (2024)
por: Kim, Minsang, et al.
Publicado: (2024)
Denevil: Towards Deciphering and Navigating the Ethical Values of Large Language Models via Instruction Learning
por: Duan, Shitong, et al.
Publicado: (2023)
por: Duan, Shitong, et al.
Publicado: (2023)
How Large Language Models are Transforming Machine-Paraphrased Plagiarism
por: Wahle, Jan Philip, et al.
Publicado: (2022)
por: Wahle, Jan Philip, et al.
Publicado: (2022)
Ejemplares similares
-
HAECcity: Open-Vocabulary Scene Understanding of City-Scale Point Clouds with Superpoint Graph Clustering
por: Rusnak, Alexander, et al.
Publicado: (2025) -
Probing Multimodal Large Language Models for Global and Local Semantic Representations
por: Tao, Mingxu, et al.
Publicado: (2024) -
Emergent Hierarchical Structure in Large Language Models: An Information-Theoretic Framework for Multi-Scale Representation
por: Zhang, Yukin, et al.
Publicado: (2025) -
On the Tip of the Tongue: Analyzing Conceptual Representation in Large Language Models with Reverse-Dictionary Probe
por: Xu, Ningyu, et al.
Publicado: (2024) -
Emergent Structured Representations Support Flexible In-Context Inference in Large Language Models
por: Xu, Ningyu, et al.
Publicado: (2026)