Massively Multi-Cultural Knowledge Acquisition & LM Benchmarking
Fuente:
arXiv
Salvato in:
| Autori principali: | Fung, Yi, Zhao, Ruining, Doo, Jae, Sun, Chenkai, Ji, Heng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
NormSAGE: Multi-Lingual Multi-Cultural Norm Discovery from Conversations On-the-Fly
di: Fung, Yi R., et al.
Pubblicazione: (2022)
di: Fung, Yi R., et al.
Pubblicazione: (2022)
Word Embeddings Are Steers for Language Models
di: Han, Chi, et al.
Pubblicazione: (2023)
di: Han, Chi, et al.
Pubblicazione: (2023)
Information Association for Language Model Updating by Mitigating LM-Logical Discrepancy
di: Yu, Pengfei, et al.
Pubblicazione: (2023)
di: Yu, Pengfei, et al.
Pubblicazione: (2023)
LEMMA: Towards LVLM-Enhanced Multimodal Misinformation Detection with External Knowledge Augmentation
di: Xuan, Keyang, et al.
Pubblicazione: (2024)
di: Xuan, Keyang, et al.
Pubblicazione: (2024)
Beyond Reactive Safety: Risk-Aware LLM Alignment via Long-Horizon Simulation
di: Sun, Chenkai, et al.
Pubblicazione: (2025)
di: Sun, Chenkai, et al.
Pubblicazione: (2025)
Persona-DB: Efficient Large Language Model Personalization for Response Prediction with Collaborative Data Refinement
di: Sun, Chenkai, et al.
Pubblicazione: (2024)
di: Sun, Chenkai, et al.
Pubblicazione: (2024)
Knowledge Overshadowing Causes Amalgamated Hallucination in Large Language Models
di: Zhang, Yuji, et al.
Pubblicazione: (2024)
di: Zhang, Yuji, et al.
Pubblicazione: (2024)
Self-Correction is More than Refinement: A Learning Framework for Visual and Language Reasoning Tasks
di: He, Jiayi, et al.
Pubblicazione: (2024)
di: He, Jiayi, et al.
Pubblicazione: (2024)
ADEPT: A DEbiasing PrompT Framework
di: Yang, Ke, et al.
Pubblicazione: (2022)
di: Yang, Ke, et al.
Pubblicazione: (2022)
Alice: Proactive Learning with Teacher's Demonstrations for Weak-to-Strong Generalization
di: Wu, Shujin, et al.
Pubblicazione: (2025)
di: Wu, Shujin, et al.
Pubblicazione: (2025)
DATE-LM: Benchmarking Data Attribution Evaluation for Large Language Models
di: Jiao, Cathy, et al.
Pubblicazione: (2025)
di: Jiao, Cathy, et al.
Pubblicazione: (2025)
Massive Sound Embedding Benchmark (MSEB)
di: Heigold, Georg, et al.
Pubblicazione: (2026)
di: Heigold, Georg, et al.
Pubblicazione: (2026)
GlossLM: A Massively Multilingual Corpus and Pretrained Model for Interlinear Glossed Text
di: Ginn, Michael, et al.
Pubblicazione: (2024)
di: Ginn, Michael, et al.
Pubblicazione: (2024)
JMMMU: A Japanese Massive Multi-discipline Multimodal Understanding Benchmark for Culture-aware Evaluation
di: Onohara, Shota, et al.
Pubblicazione: (2024)
di: Onohara, Shota, et al.
Pubblicazione: (2024)
Schema-Guided Culture-Aware Complex Event Simulation with Multi-Agent Role-Play
di: Li, Sha, et al.
Pubblicazione: (2024)
di: Li, Sha, et al.
Pubblicazione: (2024)
Veri-R1: Toward Precise and Faithful Claim Verification via Online Reinforcement Learning
di: He, Qi, et al.
Pubblicazione: (2025)
di: He, Qi, et al.
Pubblicazione: (2025)
CREATOR: Tool Creation for Disentangling Abstract and Concrete Reasoning of Large Language Models
di: Qian, Cheng, et al.
Pubblicazione: (2023)
di: Qian, Cheng, et al.
Pubblicazione: (2023)
OpenLearnLM Benchmark: A Unified Framework for Evaluating Knowledge, Skill, and Attitude in Educational Large Language Models
di: Lee, Unggi, et al.
Pubblicazione: (2026)
di: Lee, Unggi, et al.
Pubblicazione: (2026)
CALM: Unleashing the Cross-Lingual Self-Aligning Ability of Language Model Question Answering
di: Wang, Yumeng, et al.
Pubblicazione: (2025)
di: Wang, Yumeng, et al.
Pubblicazione: (2025)
The Law of Knowledge Overshadowing: Towards Understanding, Predicting, and Preventing LLM Hallucination
di: Zhang, Yuji, et al.
Pubblicazione: (2025)
di: Zhang, Yuji, et al.
Pubblicazione: (2025)
ReasoningLM: Enabling Structural Subgraph Reasoning in Pre-trained Language Models for Question Answering over Knowledge Graph
di: Jiang, Jinhao, et al.
Pubblicazione: (2023)
di: Jiang, Jinhao, et al.
Pubblicazione: (2023)
3LM: Bridging Arabic, STEM, and Code through Benchmarking
di: Boussaha, Basma El Amel, et al.
Pubblicazione: (2025)
di: Boussaha, Basma El Amel, et al.
Pubblicazione: (2025)
Discovering Knowledge Deficiencies of Language Models on Massive Knowledge Base
di: Song, Linxin, et al.
Pubblicazione: (2025)
di: Song, Linxin, et al.
Pubblicazione: (2025)
FinMTEB: Finance Massive Text Embedding Benchmark
di: Tang, Yixuan, et al.
Pubblicazione: (2025)
di: Tang, Yixuan, et al.
Pubblicazione: (2025)
MACAROON: Training Vision-Language Models To Be Your Engaged Partners
di: Wu, Shujin, et al.
Pubblicazione: (2024)
di: Wu, Shujin, et al.
Pubblicazione: (2024)
User-Aware Active Knowledge Acquisition for Emotional Support Dialogue
di: Xu, Mufan, et al.
Pubblicazione: (2026)
di: Xu, Mufan, et al.
Pubblicazione: (2026)
GIMMICK -- Globally Inclusive Multimodal Multitask Cultural Knowledge Benchmarking
di: Schneider, Florian, et al.
Pubblicazione: (2025)
di: Schneider, Florian, et al.
Pubblicazione: (2025)
ChainLM: Empowering Large Language Models with Improved Chain-of-Thought Prompting
di: Cheng, Xiaoxue, et al.
Pubblicazione: (2024)
di: Cheng, Xiaoxue, et al.
Pubblicazione: (2024)
PrivLM-Bench: A Multi-level Privacy Evaluation Benchmark for Language Models
di: Li, Haoran, et al.
Pubblicazione: (2023)
di: Li, Haoran, et al.
Pubblicazione: (2023)
LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models
di: Han, Chi, et al.
Pubblicazione: (2023)
di: Han, Chi, et al.
Pubblicazione: (2023)
MMMG: A Massive, Multidisciplinary, Multi-Tier Generation Benchmark for Text-to-Image Reasoning
di: Luo, Yuxuan, et al.
Pubblicazione: (2025)
di: Luo, Yuxuan, et al.
Pubblicazione: (2025)
BLEnD: A Benchmark for LLMs on Everyday Knowledge in Diverse Cultures and Languages
di: Myung, Junho, et al.
Pubblicazione: (2024)
di: Myung, Junho, et al.
Pubblicazione: (2024)
The Echoes of Multilinguality: Tracing Cultural Value Shifts during LM Fine-tuning
di: Choenni, Rochelle, et al.
Pubblicazione: (2024)
di: Choenni, Rochelle, et al.
Pubblicazione: (2024)
KG-BiLM: Knowledge Graph Embedding via Bidirectional Language Models
di: Chen, Zirui, et al.
Pubblicazione: (2025)
di: Chen, Zirui, et al.
Pubblicazione: (2025)
Tracing Multilingual Factual Knowledge Acquisition in Pretraining
di: Liu, Yihong, et al.
Pubblicazione: (2025)
di: Liu, Yihong, et al.
Pubblicazione: (2025)
StructLM: Towards Building Generalist Models for Structured Knowledge Grounding
di: Zhuang, Alex, et al.
Pubblicazione: (2024)
di: Zhuang, Alex, et al.
Pubblicazione: (2024)
MAC-Tuning: LLM Multi-Compositional Problem Reasoning with Enhanced Knowledge Boundary Awareness
di: Huang, Junsheng, et al.
Pubblicazione: (2025)
di: Huang, Junsheng, et al.
Pubblicazione: (2025)
On Stable Long-Form Generation: Benchmarking and Mitigating Length Volatility
di: He, Zhitao, et al.
Pubblicazione: (2026)
di: He, Zhitao, et al.
Pubblicazione: (2026)
CultureCLIP: Empowering CLIP with Cultural Awareness through Synthetic Images and Contextualized Captions
di: Huang, Yuchen, et al.
Pubblicazione: (2025)
di: Huang, Yuchen, et al.
Pubblicazione: (2025)
Atomic Reasoning for Scientific Table Claim Verification
di: Zhang, Yuji, et al.
Pubblicazione: (2025)
di: Zhang, Yuji, et al.
Pubblicazione: (2025)
Documenti analoghi
-
NormSAGE: Multi-Lingual Multi-Cultural Norm Discovery from Conversations On-the-Fly
di: Fung, Yi R., et al.
Pubblicazione: (2022) -
Word Embeddings Are Steers for Language Models
di: Han, Chi, et al.
Pubblicazione: (2023) -
Information Association for Language Model Updating by Mitigating LM-Logical Discrepancy
di: Yu, Pengfei, et al.
Pubblicazione: (2023) -
LEMMA: Towards LVLM-Enhanced Multimodal Misinformation Detection with External Knowledge Augmentation
di: Xuan, Keyang, et al.
Pubblicazione: (2024) -
Beyond Reactive Safety: Risk-Aware LLM Alignment via Long-Horizon Simulation
di: Sun, Chenkai, et al.
Pubblicazione: (2025)