Leveraging Multilingual Training for Authorship Representation: Enhancing Generalization across Languages and Domains
Fuente:
arXiv
Saved in:
| Main Authors: | Kim, Junghwan, Zhang, Haotian, Jurgens, David |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Are Rules Meant to be Broken? Understanding Multilingual Moral Reasoning as a Computational Pipeline with UniMoral
by: Kumar, Shivani, et al.
Published: (2025)
by: Kumar, Shivani, et al.
Published: (2025)
Authorship Obfuscation in Multilingual Machine-Generated Text Detection
by: Macko, Dominik, et al.
Published: (2024)
by: Macko, Dominik, et al.
Published: (2024)
Think Multilingual, Not Harder: A Data-Efficient Framework for Teaching Reasoning Models to Code-Switch
by: Lin, Eleanor M., et al.
Published: (2026)
by: Lin, Eleanor M., et al.
Published: (2026)
Authorship Attribution in Multilingual Machine-Generated Texts
by: La Cava, Lucio, et al.
Published: (2025)
by: La Cava, Lucio, et al.
Published: (2025)
PART: Pre-trained Authorship Representation Transformer
by: Huertas-Tato, Javier, et al.
Published: (2022)
by: Huertas-Tato, Javier, et al.
Published: (2022)
Leveraging Language Models and RAG for Efficient Knowledge Discovery in Clinical Environments
by: Ko, Seokhwan, et al.
Published: (2025)
by: Ko, Seokhwan, et al.
Published: (2025)
The Language of Trauma: Modeling Traumatic Event Descriptions Across Domains with Explainable AI
by: Schirmer, Miriam, et al.
Published: (2024)
by: Schirmer, Miriam, et al.
Published: (2024)
A Multilingual Similarity Dataset for News Article Frame
by: Chen, Xi, et al.
Published: (2024)
by: Chen, Xi, et al.
Published: (2024)
Tokenization is Sensitive to Language Variation
by: Wegmann, Anna, et al.
Published: (2025)
by: Wegmann, Anna, et al.
Published: (2025)
Latent Distance Guided Alignment Training for Large Language Models
by: Luo, Haotian
Published: (2024)
by: Luo, Haotian
Published: (2024)
AlignX: Advancing Multilingual Large Language Models with Multilingual Representation Alignment
by: Bu, Mengyu, et al.
Published: (2025)
by: Bu, Mengyu, et al.
Published: (2025)
Cross-Lingual Prompt Steerability: Towards Accurate and Robust LLM Behavior across Languages
by: Zhang, Lechen, et al.
Published: (2025)
by: Zhang, Lechen, et al.
Published: (2025)
Beyond Consensus: Perspectivist Modeling and Evaluation of Annotator Disagreement in NLP
by: Xu, Yinuo, et al.
Published: (2026)
by: Xu, Yinuo, et al.
Published: (2026)
Modeling Empathetic Alignment in Conversation
by: Yang, Jiamin, et al.
Published: (2024)
by: Yang, Jiamin, et al.
Published: (2024)
LangSAMP: Language-Script Aware Multilingual Pretraining
by: Liu, Yihong, et al.
Published: (2024)
by: Liu, Yihong, et al.
Published: (2024)
The Call for Socially Aware Language Technologies
by: Yang, Diyi, et al.
Published: (2024)
by: Yang, Diyi, et al.
Published: (2024)
Can Large Language Models Identify Authorship?
by: Huang, Baixiang, et al.
Published: (2024)
by: Huang, Baixiang, et al.
Published: (2024)
ALMs: Authorial Language Models for Authorship Attribution
by: Huang, Weihang, et al.
Published: (2024)
by: Huang, Weihang, et al.
Published: (2024)
Beyond Shared Vocabulary: Increasing Representational Word Similarities across Languages for Multilingual Machine Translation
by: Wu, Di, et al.
Published: (2023)
by: Wu, Di, et al.
Published: (2023)
IRCoder: Intermediate Representations Make Language Models Robust Multilingual Code Generators
by: Paul, Indraneil, et al.
Published: (2024)
by: Paul, Indraneil, et al.
Published: (2024)
PART: Progressive Alignment Representation Training for Multilingual Speech-To-Text with LLMs
by: Zhang, Pei, et al.
Published: (2025)
by: Zhang, Pei, et al.
Published: (2025)
The Muddy Waters of Modeling Empathy in Language: The Practical Impacts of Theoretical Constructs
by: Lahnala, Allison, et al.
Published: (2025)
by: Lahnala, Allison, et al.
Published: (2025)
A Critical Reflection and Forward Perspective on Empathy and Natural Language Processing
by: Lahnala, Allison, et al.
Published: (2022)
by: Lahnala, Allison, et al.
Published: (2022)
Leveraging LLMs for Synthesizing Training Data Across Many Languages in Multilingual Dense Retrieval
by: Thakur, Nandan, et al.
Published: (2023)
by: Thakur, Nandan, et al.
Published: (2023)
Teaching LLMs to Abstain across Languages via Multilingual Feedback
by: Feng, Shangbin, et al.
Published: (2024)
by: Feng, Shangbin, et al.
Published: (2024)
Real or Robotic? Assessing Whether LLMs Accurately Simulate Qualities of Human Responses in Dialogue
by: Ivey, Jonathan, et al.
Published: (2024)
by: Ivey, Jonathan, et al.
Published: (2024)
Pruning Multilingual Large Language Models for Multilingual Inference
by: Kim, Hwichan, et al.
Published: (2024)
by: Kim, Hwichan, et al.
Published: (2024)
LexGen: Domain-aware Multilingual Lexicon Generation
by: Maheshwari, Ayush, et al.
Published: (2024)
by: Maheshwari, Ayush, et al.
Published: (2024)
Explainable Disentangled Representation Learning for Generalizable Authorship Attribution in the Era of Generative AI
by: Man, Hieu, et al.
Published: (2026)
by: Man, Hieu, et al.
Published: (2026)
Building an Efficient Multilingual Non-Profit IR System for the Islamic Domain Leveraging Multiprocessing Design in Rust
by: Pavlova, Vera, et al.
Published: (2024)
by: Pavlova, Vera, et al.
Published: (2024)
Hybrid Training Approaches for LLMs: Leveraging Real and Synthetic Data to Enhance Model Performance in Domain-Specific Applications
by: Zhezherau, Alexey, et al.
Published: (2024)
by: Zhezherau, Alexey, et al.
Published: (2024)
Enhancing Multilingual RAG Systems with Debiased Language Preference-Guided Query Fusion
by: Park, Jeonghyun, et al.
Published: (2026)
by: Park, Jeonghyun, et al.
Published: (2026)
Multilingual and Domain-Agnostic Tip-of-the-Tongue Query Generation for Simulated Evaluation
by: He, Xuhong, et al.
Published: (2026)
by: He, Xuhong, et al.
Published: (2026)
Information Loss in LLMs' Multilingual Translation: The Role of Training Data, Language Proximity, and Language Family
by: Lin, Yumeng, et al.
Published: (2025)
by: Lin, Yumeng, et al.
Published: (2025)
TransliCo: A Contrastive Learning Framework to Address the Script Barrier in Multilingual Pretrained Language Models
by: Liu, Yihong, et al.
Published: (2024)
by: Liu, Yihong, et al.
Published: (2024)
Authorship Impersonation via LLM Prompting does not Evade Authorship Verification Methods
by: Zeng, Baoyi, et al.
Published: (2026)
by: Zeng, Baoyi, et al.
Published: (2026)
Taxi1500: A Multilingual Dataset for Text Classification in 1500 Languages
by: Ma, Chunlan, et al.
Published: (2023)
by: Ma, Chunlan, et al.
Published: (2023)
TransMI: A Framework to Create Strong Baselines from Multilingual Pretrained Language Models for Transliterated Data
by: Liu, Yihong, et al.
Published: (2024)
by: Liu, Yihong, et al.
Published: (2024)
Improving Multilingual Language Models by Aligning Representations through Steering
by: Mahmoud, Omar, et al.
Published: (2025)
by: Mahmoud, Omar, et al.
Published: (2025)
ZeroNLG: Aligning and Autoencoding Domains for Zero-Shot Multimodal and Multilingual Natural Language Generation
by: Yang, Bang, et al.
Published: (2023)
by: Yang, Bang, et al.
Published: (2023)
Similar Items
-
Are Rules Meant to be Broken? Understanding Multilingual Moral Reasoning as a Computational Pipeline with UniMoral
by: Kumar, Shivani, et al.
Published: (2025) -
Authorship Obfuscation in Multilingual Machine-Generated Text Detection
by: Macko, Dominik, et al.
Published: (2024) -
Think Multilingual, Not Harder: A Data-Efficient Framework for Teaching Reasoning Models to Code-Switch
by: Lin, Eleanor M., et al.
Published: (2026) -
Authorship Attribution in Multilingual Machine-Generated Texts
by: La Cava, Lucio, et al.
Published: (2025) -
PART: Pre-trained Authorship Representation Transformer
by: Huertas-Tato, Javier, et al.
Published: (2022)