LiveCultureBench: a Multi-Agent, Multi-Cultural Benchmark for Large Language Models in Dynamic Social Simulations
Fuente:
arXiv
Guardado en:
| Autores principales: | Pham, Viet-Thanh, Qu, Lizhen, Vu, Thuy-Trang, Haffari, Gholamreza, Phung, Dinh |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Mixture-of-Skills: Learning to Optimize Data Usage for Fine-Tuning Large Language Models
por: Wu, Minghao, et al.
Publicado: (2024)
por: Wu, Minghao, et al.
Publicado: (2024)
Evidence-based Distributional Alignment for Large Language Models
por: Pham, Viet-Thanh, et al.
Publicado: (2026)
por: Pham, Viet-Thanh, et al.
Publicado: (2026)
Adapting Large Language Models for Document-Level Machine Translation
por: Wu, Minghao, et al.
Publicado: (2024)
por: Wu, Minghao, et al.
Publicado: (2024)
The Best of Both Worlds: Bridging Quality and Diversity in Data Selection with Bipartite Graph
por: Wu, Minghao, et al.
Publicado: (2024)
por: Wu, Minghao, et al.
Publicado: (2024)
Assistive Large Language Model Agents for Socially-Aware Negotiation Dialogues
por: Hua, Yuncheng, et al.
Publicado: (2024)
por: Hua, Yuncheng, et al.
Publicado: (2024)
SCAR: Data Selection via Style Consistency-Aware Response Ranking for Efficient Instruction-Tuning of Large Language Models
por: Li, Zhuang, et al.
Publicado: (2024)
por: Li, Zhuang, et al.
Publicado: (2024)
Active Continual Learning: On Balancing Knowledge Retention and Learnability
por: Vu, Thuy-Trang, et al.
Publicado: (2023)
por: Vu, Thuy-Trang, et al.
Publicado: (2023)
Conversational SimulMT: Efficient Simultaneous Translation with Large Language Models
por: Wang, Minghan, et al.
Publicado: (2024)
por: Wang, Minghan, et al.
Publicado: (2024)
Unbiased Sliced Wasserstein Kernels for High-Quality Audio Captioning
por: Luong, Manh, et al.
Publicado: (2025)
por: Luong, Manh, et al.
Publicado: (2025)
Direct Evaluation of Chain-of-Thought in Multi-hop Reasoning with Knowledge Graphs
por: Nguyen, Minh-Vuong, et al.
Publicado: (2024)
por: Nguyen, Minh-Vuong, et al.
Publicado: (2024)
Proverbs Run in Pairs: Evaluating Proverb Translation Capability of Large Language Model
por: Wang, Minghan, et al.
Publicado: (2025)
por: Wang, Minghan, et al.
Publicado: (2025)
Towards Probing Speech-Specific Risks in Large Multimodal Models: A Taxonomy, Benchmark, and Insights
por: Yang, Hao, et al.
Publicado: (2024)
por: Yang, Hao, et al.
Publicado: (2024)
Discourse Graph Guided Document Translation with Large Language Models
por: Pham, Viet-Thanh, et al.
Publicado: (2025)
por: Pham, Viet-Thanh, et al.
Publicado: (2025)
Simultaneous Machine Translation with Large Language Models
por: Wang, Minghan, et al.
Publicado: (2023)
por: Wang, Minghan, et al.
Publicado: (2023)
Jigsaw Puzzles: Splitting Harmful Questions to Jailbreak Large Language Models
por: Yang, Hao, et al.
Publicado: (2024)
por: Yang, Hao, et al.
Publicado: (2024)
Reshaping Representation Space to Balance the Safety and Over-rejection in Large Audio Language Models
por: Yang, Hao, et al.
Publicado: (2025)
por: Yang, Hao, et al.
Publicado: (2025)
Discrete Minds in a Continuous World: Do Language Models Know Time Passes?
por: Wang, Minghan, et al.
Publicado: (2025)
por: Wang, Minghan, et al.
Publicado: (2025)
AIPO: Learning to Reason from Active Interaction
por: Liu, Junnan, et al.
Publicado: (2026)
por: Liu, Junnan, et al.
Publicado: (2026)
Beyond Imitation: Recovering Dense Rewards from Demonstrations
por: Li, Jiangnan, et al.
Publicado: (2025)
por: Li, Jiangnan, et al.
Publicado: (2025)
SituatedThinker: Grounding LLM Reasoning with Real-World through Situated Thinking
por: Liu, Junnan, et al.
Publicado: (2025)
por: Liu, Junnan, et al.
Publicado: (2025)
Towards Inference-time Scaling for Continuous Space Reasoning
por: Wang, Minghan, et al.
Publicado: (2025)
por: Wang, Minghan, et al.
Publicado: (2025)
Continual Learning for Large Language Models: A Survey
por: Wu, Tongtong, et al.
Publicado: (2024)
por: Wu, Tongtong, et al.
Publicado: (2024)
Audio Is the Achilles' Heel: Red Teaming Audio Large Multimodal Models
por: Yang, Hao, et al.
Publicado: (2024)
por: Yang, Hao, et al.
Publicado: (2024)
Extending LLMs to New Languages: A Case Study of Llama and Persian Adaptation
por: Sani, Samin Mahdizadeh, et al.
Publicado: (2024)
por: Sani, Samin Mahdizadeh, et al.
Publicado: (2024)
Exploring the Potential of Multimodal LLM with Knowledge-Intensive Multimodal ASR
por: Wang, Minghan, et al.
Publicado: (2024)
por: Wang, Minghan, et al.
Publicado: (2024)
GTS: Inference-Time Scaling of Latent Reasoning with a Learnable Gaussian Thought Sampler
por: Wang, Minghan, et al.
Publicado: (2026)
por: Wang, Minghan, et al.
Publicado: (2026)
On the Reliability of Large Language Models for Causal Discovery
por: Feng, Tao, et al.
Publicado: (2024)
por: Feng, Tao, et al.
Publicado: (2024)
Resurfacing Paralinguistic Awareness in Large Audio Language Models
por: Yang, Hao, et al.
Publicado: (2026)
por: Yang, Hao, et al.
Publicado: (2026)
The Social Cost of Intelligence: Emergence, Propagation, and Amplification of Stereotypical Bias in Multi-Agent Systems
por: Nguyen, Thi-Nhung, et al.
Publicado: (2025)
por: Nguyen, Thi-Nhung, et al.
Publicado: (2025)
Zero-Shot Privacy-Aware Text Rewriting via Iterative Tree Search
por: Huang, Shuo, et al.
Publicado: (2025)
por: Huang, Shuo, et al.
Publicado: (2025)
IRIS: An Iterative and Integrated Framework for Verifiable Causal Discovery in the Absence of Tabular Data
por: Feng, Tao, et al.
Publicado: (2025)
por: Feng, Tao, et al.
Publicado: (2025)
CausalScore: An Automatic Reference-Free Metric for Assessing Response Relevance in Open-Domain Dialogue Systems
por: Feng, Tao, et al.
Publicado: (2024)
por: Feng, Tao, et al.
Publicado: (2024)
RIDE: Enhancing Large Language Model Alignment through Restyled In-Context Learning Demonstration Exemplars
por: Hua, Yuncheng, et al.
Publicado: (2025)
por: Hua, Yuncheng, et al.
Publicado: (2025)
CONGRAD:Conflicting Gradient Filtering for Multilingual Preference Alignment
por: Li, Jiangnan, et al.
Publicado: (2025)
por: Li, Jiangnan, et al.
Publicado: (2025)
SpeechDialogueFactory: Generating High-Quality Speech Dialogue Data to Accelerate Your Speech-LLM Development
por: Wang, Minghan, et al.
Publicado: (2025)
por: Wang, Minghan, et al.
Publicado: (2025)
MAPLE: Multi-Agent Adaptive Planning with Long-Term Memory for Table Reasoning
por: Bai, Ye, et al.
Publicado: (2025)
por: Bai, Ye, et al.
Publicado: (2025)
GFM-RAG: Graph Foundation Model for Retrieval Augmented Generation
por: Luo, Linhao, et al.
Publicado: (2025)
por: Luo, Linhao, et al.
Publicado: (2025)
Mini-BEHAVIOR-Gran: Revealing U-Shaped Effects of Instruction Granularity on Language-Guided Embodied Agents
por: Huang, Sukai, et al.
Publicado: (2026)
por: Huang, Sukai, et al.
Publicado: (2026)
Importance-Aware Data Augmentation for Document-Level Neural Machine Translation
por: Wu, Minghao, et al.
Publicado: (2024)
por: Wu, Minghao, et al.
Publicado: (2024)
G-reasoner: Foundation Models for Unified Reasoning over Graph-structured Knowledge
por: Luo, Linhao, et al.
Publicado: (2025)
por: Luo, Linhao, et al.
Publicado: (2025)
Ejemplares similares
-
Mixture-of-Skills: Learning to Optimize Data Usage for Fine-Tuning Large Language Models
por: Wu, Minghao, et al.
Publicado: (2024) -
Evidence-based Distributional Alignment for Large Language Models
por: Pham, Viet-Thanh, et al.
Publicado: (2026) -
Adapting Large Language Models for Document-Level Machine Translation
por: Wu, Minghao, et al.
Publicado: (2024) -
The Best of Both Worlds: Bridging Quality and Diversity in Data Selection with Bipartite Graph
por: Wu, Minghao, et al.
Publicado: (2024) -
Assistive Large Language Model Agents for Socially-Aware Negotiation Dialogues
por: Hua, Yuncheng, et al.
Publicado: (2024)