Uncovering inequalities in new knowledge learning by large language models across different languages
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Chenglong, Tang, Haoyu, Yang, Xiyuan, Xie, Yueqi, Suh, Jina, Sitaram, Sunayana, Huang, Junming, Xie, Yu, Gong, Zhaoya, Xie, Xing, Wu, Fangzhao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Measuring Human Contribution in AI-Assisted Content Generation
por: Xie, Yueqi, et al.
Publicado: (2024)
por: Xie, Yueqi, et al.
Publicado: (2024)
CartoAgent: a multimodal large language model-powered multi-agent cartographic framework for map style transfer and evaluation
por: Wang, Chenglong, et al.
Publicado: (2025)
por: Wang, Chenglong, et al.
Publicado: (2025)
CultureLLM: Incorporating Cultural Differences into Large Language Models
por: Li, Cheng, et al.
Publicado: (2024)
por: Li, Cheng, et al.
Publicado: (2024)
Benchmarking and Defending Against Indirect Prompt Injection Attacks on Large Language Models
por: Yi, Jingwei, et al.
Publicado: (2023)
por: Yi, Jingwei, et al.
Publicado: (2023)
M5 -- A Diverse Benchmark to Assess the Performance of Large Multimodal Models Across Multilingual and Multicultural Vision-Language Tasks
por: Schneider, Florian, et al.
Publicado: (2024)
por: Schneider, Florian, et al.
Publicado: (2024)
Defending against Indirect Prompt Injection by Instruction Detection
por: Wen, Tongyu, et al.
Publicado: (2025)
por: Wen, Tongyu, et al.
Publicado: (2025)
Variance reduction in output from generative AI
por: Xie, Yu, et al.
Publicado: (2025)
por: Xie, Yu, et al.
Publicado: (2025)
MS-HuBERT: Mitigating Pre-training and Inference Mismatch in Masked Language Modelling methods for learning Speech Representations
por: Yadav, Hemant, et al.
Publicado: (2024)
por: Yadav, Hemant, et al.
Publicado: (2024)
A Unified Framework and Dataset for Assessing Societal Bias in Vision-Language Models
por: Sathe, Ashutosh, et al.
Publicado: (2024)
por: Sathe, Ashutosh, et al.
Publicado: (2024)
Factual consistency evaluation of summarization in the Era of large language models
por: Luo, Zheheng, et al.
Publicado: (2024)
por: Luo, Zheheng, et al.
Publicado: (2024)
Exploring Pretraining via Active Forgetting for Improving Cross Lingual Transfer for Decoder Language Models
por: Aggarwal, Divyanshu, et al.
Publicado: (2024)
por: Aggarwal, Divyanshu, et al.
Publicado: (2024)
Contamination Report for Multilingual Benchmarks
por: Ahuja, Sanchit, et al.
Publicado: (2024)
por: Ahuja, Sanchit, et al.
Publicado: (2024)
Improving Self Consistency in LLMs through Probabilistic Tokenization
por: Sathe, Ashutosh, et al.
Publicado: (2024)
por: Sathe, Ashutosh, et al.
Publicado: (2024)
Multilingual large language models leak human stereotypes across language boundaries
por: Cao, Yang Trista, et al.
Publicado: (2023)
por: Cao, Yang Trista, et al.
Publicado: (2023)
DOSA: A Dataset of Social Artifacts from Different Indian Geographical Subcultures
por: Seth, Agrima, et al.
Publicado: (2024)
por: Seth, Agrima, et al.
Publicado: (2024)
Speech Representation Learning Revisited: The Necessity of Separate Learnable Parameters and Robust Data Augmentation
por: Yadav, Hemant, et al.
Publicado: (2024)
por: Yadav, Hemant, et al.
Publicado: (2024)
JOOCI: a Framework for Learning Comprehensive Speech Representations
por: Yadav, Hemant, et al.
Publicado: (2024)
por: Yadav, Hemant, et al.
Publicado: (2024)
Alzheimer's disease detection based on large language model prompt engineering
por: Zheng, Tian, et al.
Publicado: (2025)
por: Zheng, Tian, et al.
Publicado: (2025)
DEPART: DEcomposing PARiTy across Multilingual LLMs
por: Uppadhyay, Manan, et al.
Publicado: (2026)
por: Uppadhyay, Manan, et al.
Publicado: (2026)
Dynamic data sampler for cross-language transfer learning in large language models
por: Li, Yudong, et al.
Publicado: (2024)
por: Li, Yudong, et al.
Publicado: (2024)
Fluent but Foreign: Even Regional LLMs Lack Cultural Alignment
por: Agarwal, Dhruv, et al.
Publicado: (2025)
por: Agarwal, Dhruv, et al.
Publicado: (2025)
A quantitative analysis of knowledge-learning preferences in large language models in molecular science
por: Liu, Pengfei, et al.
Publicado: (2024)
por: Liu, Pengfei, et al.
Publicado: (2024)
HEALTH-PARIKSHA: Assessing RAG Models for Health Chatbots in Real-World Multilingual Settings
por: Gumma, Varun, et al.
Publicado: (2024)
por: Gumma, Varun, et al.
Publicado: (2024)
MAPLE: Multilingual Evaluation of Parameter Efficient Finetuning of Large Language Models
por: Aggarwal, Divyanshu, et al.
Publicado: (2024)
por: Aggarwal, Divyanshu, et al.
Publicado: (2024)
Biomedical knowledge graph-optimized prompt generation for large language models
por: Soman, Karthik, et al.
Publicado: (2023)
por: Soman, Karthik, et al.
Publicado: (2023)
Humans overrely on overconfident language models, across languages
por: Rathi, Neil, et al.
Publicado: (2025)
por: Rathi, Neil, et al.
Publicado: (2025)
MAFIA: Multi-Adapter Fused Inclusive LanguAge Models
por: Jain, Prachi, et al.
Publicado: (2024)
por: Jain, Prachi, et al.
Publicado: (2024)
Evaluation scheme for children-centered language interaction competence of AI-driven robots
por: Xie, Siqi, et al.
Publicado: (2024)
por: Xie, Siqi, et al.
Publicado: (2024)
Epistemic diversity across language models mitigates knowledge collapse
por: Hodel, Damian, et al.
Publicado: (2025)
por: Hodel, Damian, et al.
Publicado: (2025)
The language of time: a language model perspective on time-series foundation models
por: Xie, Yi, et al.
Publicado: (2025)
por: Xie, Yi, et al.
Publicado: (2025)
Dissociating language and thought in large language models
por: Mahowald, Kyle, et al.
Publicado: (2023)
por: Mahowald, Kyle, et al.
Publicado: (2023)
GradSafe: Detecting Jailbreak Prompts for LLMs via Safety-Critical Gradient Analysis
por: Xie, Yueqi, et al.
Publicado: (2024)
por: Xie, Yueqi, et al.
Publicado: (2024)
A large-scale evaluation of commonsense knowledge in humans and large language models
por: Nguyen, Tuan Dung, et al.
Publicado: (2025)
por: Nguyen, Tuan Dung, et al.
Publicado: (2025)
Unified attacks to large language model watermarks: spoofing and scrubbing in unauthorized knowledge distillation
por: Yi, Xin, et al.
Publicado: (2025)
por: Yi, Xin, et al.
Publicado: (2025)
Towards continually learning new languages
por: Pham, Ngoc-Quan, et al.
Publicado: (2022)
por: Pham, Ngoc-Quan, et al.
Publicado: (2022)
Retrieval augmentation of large language models for lay language generation
por: Guo, Yue, et al.
Publicado: (2022)
por: Guo, Yue, et al.
Publicado: (2022)
Do large language models resemble humans in language use?
por: Cai, Zhenguang G., et al.
Publicado: (2023)
por: Cai, Zhenguang G., et al.
Publicado: (2023)
SmartCLIP: Modular Vision-language Alignment with Identification Guarantees
por: Xie, Shaoan, et al.
Publicado: (2025)
por: Xie, Shaoan, et al.
Publicado: (2025)
METAL: Towards Multilingual Meta-Evaluation
por: Hada, Rishav, et al.
Publicado: (2024)
por: Hada, Rishav, et al.
Publicado: (2024)
Exploring Continual Fine-Tuning for Enhancing Language Ability in Large Language Model
por: Aggarwal, Divyanshu, et al.
Publicado: (2024)
por: Aggarwal, Divyanshu, et al.
Publicado: (2024)
Ejemplares similares
-
Measuring Human Contribution in AI-Assisted Content Generation
por: Xie, Yueqi, et al.
Publicado: (2024) -
CartoAgent: a multimodal large language model-powered multi-agent cartographic framework for map style transfer and evaluation
por: Wang, Chenglong, et al.
Publicado: (2025) -
CultureLLM: Incorporating Cultural Differences into Large Language Models
por: Li, Cheng, et al.
Publicado: (2024) -
Benchmarking and Defending Against Indirect Prompt Injection Attacks on Large Language Models
por: Yi, Jingwei, et al.
Publicado: (2023) -
M5 -- A Diverse Benchmark to Assess the Performance of Large Multimodal Models Across Multilingual and Multicultural Vision-Language Tasks
por: Schneider, Florian, et al.
Publicado: (2024)