TransportationGames: Benchmarking Transportation Knowledge of (Multimodal) Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Xue, Shi, Xiangyu, Lou, Xinyue, Qi, Rui, Chen, Yufeng, Xu, Jinan, Han, Wenjuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Think in Safety: Unveiling and Mitigating Safety Alignment Collapse in Multimodal Large Reasoning Model
di: Lou, Xinyue, et al.
Pubblicazione: (2025)
di: Lou, Xinyue, et al.
Pubblicazione: (2025)
Dual-Space Knowledge Distillation for Large Language Models
di: Zhang, Songming, et al.
Pubblicazione: (2024)
di: Zhang, Songming, et al.
Pubblicazione: (2024)
KDFlow: A User-Friendly and Efficient Knowledge Distillation Framework for Large Language Models
di: Zhang, Songming, et al.
Pubblicazione: (2026)
di: Zhang, Songming, et al.
Pubblicazione: (2026)
SoT: Structured-of-Thought Prompting Guides Multilingual Reasoning in Large Language Models
di: Qi, Rui, et al.
Pubblicazione: (2025)
di: Qi, Rui, et al.
Pubblicazione: (2025)
Towards Faster k-Nearest-Neighbor Machine Translation
di: Shi, Xiangyu, et al.
Pubblicazione: (2023)
di: Shi, Xiangyu, et al.
Pubblicazione: (2023)
A Dual-Space Framework for General Knowledge Distillation of Large Language Models
di: Zhang, Xue, et al.
Pubblicazione: (2025)
di: Zhang, Xue, et al.
Pubblicazione: (2025)
Towards Understanding and Improving Knowledge Distillation for Neural Machine Translation
di: Zhang, Songming, et al.
Pubblicazione: (2023)
di: Zhang, Songming, et al.
Pubblicazione: (2023)
CM-Align: Consistency-based Multilingual Alignment for Large Language Models
di: Zhang, Xue, et al.
Pubblicazione: (2025)
di: Zhang, Xue, et al.
Pubblicazione: (2025)
Multilingual Knowledge Editing with Language-Agnostic Factual Neurons
di: Zhang, Xue, et al.
Pubblicazione: (2024)
di: Zhang, Xue, et al.
Pubblicazione: (2024)
When Helpers Become Hazards: A Benchmark for Analyzing Multimodal LLM-Powered Safety in Daily Life
di: Lou, Xinyue, et al.
Pubblicazione: (2026)
di: Lou, Xinyue, et al.
Pubblicazione: (2026)
AlignDistil: Token-Level Language Model Alignment as Adaptive Policy Distillation
di: Zhang, Songming, et al.
Pubblicazione: (2025)
di: Zhang, Songming, et al.
Pubblicazione: (2025)
Enhancing Cross-Tokenizer Knowledge Distillation with Contextual Dynamical Mapping
di: Chen, Yijie, et al.
Pubblicazione: (2025)
di: Chen, Yijie, et al.
Pubblicazione: (2025)
Language-Coupled Reinforcement Learning for Multilingual Retrieval-Augmented Generation
di: Qi, Rui, et al.
Pubblicazione: (2026)
di: Qi, Rui, et al.
Pubblicazione: (2026)
Warmup-Distill: Bridge the Distribution Mismatch between Teacher and Student before Knowledge Distillation
di: Sun, Zengkui, et al.
Pubblicazione: (2025)
di: Sun, Zengkui, et al.
Pubblicazione: (2025)
LLMsPark: A Benchmark for Evaluating Large Language Models in Strategic Gaming Contexts
di: Chen, Junhao, et al.
Pubblicazione: (2025)
di: Chen, Junhao, et al.
Pubblicazione: (2025)
WTU-EVAL: A Whether-or-Not Tool Usage Evaluation Benchmark for Large Language Models
di: Ning, Kangyun, et al.
Pubblicazione: (2024)
di: Ning, Kangyun, et al.
Pubblicazione: (2024)
Multi-Aspect Knowledge Distillation for Language Model with Low-rank Factorization
di: Liu, Zihe, et al.
Pubblicazione: (2026)
di: Liu, Zihe, et al.
Pubblicazione: (2026)
MUCAR: Benchmarking Multilingual Cross-Modal Ambiguity Resolution for Multimodal Large Language Models
di: Wang, Xiaolong, et al.
Pubblicazione: (2025)
di: Wang, Xiaolong, et al.
Pubblicazione: (2025)
Less, but Better: Efficient Multilingual Expansion for LLMs via Layer-wise Mixture-of-Experts
di: Zhang, Xue, et al.
Pubblicazione: (2025)
di: Zhang, Xue, et al.
Pubblicazione: (2025)
ECKGBench: Benchmarking Large Language Models in E-commerce Leveraging Knowledge Graph
di: Liu, Langming, et al.
Pubblicazione: (2025)
di: Liu, Langming, et al.
Pubblicazione: (2025)
TransGPT: Multi-modal Generative Pre-trained Transformer for Transportation
di: Wang, Peng, et al.
Pubblicazione: (2024)
di: Wang, Peng, et al.
Pubblicazione: (2024)
Model Whisper: Steering Vectors Unlock Large Language Models' Potential in Test-time
di: Kang, Xinyue, et al.
Pubblicazione: (2025)
di: Kang, Xinyue, et al.
Pubblicazione: (2025)
SAP-Bench: Benchmarking Multimodal Large Language Models in Surgical Action Planning
di: Xu, Mengya, et al.
Pubblicazione: (2025)
di: Xu, Mengya, et al.
Pubblicazione: (2025)
Financial Knowledge Large Language Model
di: Yang, Cehao, et al.
Pubblicazione: (2024)
di: Yang, Cehao, et al.
Pubblicazione: (2024)
Benchmarking Gaslighting Negation Attacks Against Multimodal Large Language Models
di: Zhu, Bin, et al.
Pubblicazione: (2025)
di: Zhu, Bin, et al.
Pubblicazione: (2025)
Outdated Issue Aware Decoding for Reasoning Questions on Edited Knowledge
di: Sun, Zengkui, et al.
Pubblicazione: (2024)
di: Sun, Zengkui, et al.
Pubblicazione: (2024)
StressEval: Failure-Driven Dynamic Benchmarking for Knowledge-Intensive Reasoning in Large Language Models
di: Chen, Yongrui, et al.
Pubblicazione: (2026)
di: Chen, Yongrui, et al.
Pubblicazione: (2026)
Exploiting Pseudo Image Captions for Multimodal Summarization
di: Jiang, Chaoya, et al.
Pubblicazione: (2023)
di: Jiang, Chaoya, et al.
Pubblicazione: (2023)
Multi-perspective Improvement of Knowledge Graph Completion with Large Language Models
di: Xu, Derong, et al.
Pubblicazione: (2024)
di: Xu, Derong, et al.
Pubblicazione: (2024)
Transport and Merge: Cross-Architecture Merging for Large Language Models
di: Cui, Chenhang, et al.
Pubblicazione: (2026)
di: Cui, Chenhang, et al.
Pubblicazione: (2026)
LCS: A Language Converter Strategy for Zero-Shot Neural Machine Translation
di: Sun, Zengkui, et al.
Pubblicazione: (2024)
di: Sun, Zengkui, et al.
Pubblicazione: (2024)
Think Natively: Unlocking Multilingual Reasoning with Consistency-Enhanced Reinforcement Learning
di: Zhang, Xue, et al.
Pubblicazione: (2025)
di: Zhang, Xue, et al.
Pubblicazione: (2025)
KoLA: Carefully Benchmarking World Knowledge of Large Language Models
di: Yu, Jifan, et al.
Pubblicazione: (2023)
di: Yu, Jifan, et al.
Pubblicazione: (2023)
MMIDR: Teaching Large Language Model to Interpret Multimodal Misinformation via Knowledge Distillation
di: Wang, Longzheng, et al.
Pubblicazione: (2024)
di: Wang, Longzheng, et al.
Pubblicazione: (2024)
Benchmarking Knowledge Boundary for Large Language Models: A Different Perspective on Model Evaluation
di: Yin, Xunjian, et al.
Pubblicazione: (2024)
di: Yin, Xunjian, et al.
Pubblicazione: (2024)
ChatIE: Zero-Shot Information Extraction via Chatting with ChatGPT
di: Wei, Xiang, et al.
Pubblicazione: (2023)
di: Wei, Xiang, et al.
Pubblicazione: (2023)
Enhancing Multimodal Large Language Models for Ancient Chinese Character Evolution Analysis via Glyph-Driven Fine-Tuning
di: Song, Rui, et al.
Pubblicazione: (2026)
di: Song, Rui, et al.
Pubblicazione: (2026)
Trustworthy Alignment of Retrieval-Augmented Large Language Models via Reinforcement Learning
di: Zhang, Zongmeng, et al.
Pubblicazione: (2024)
di: Zhang, Zongmeng, et al.
Pubblicazione: (2024)
Beyond Binary Gender: Evaluating Gender-Inclusive Machine Translation with Ambiguous Attitude Words
di: Chen, Yijie, et al.
Pubblicazione: (2024)
di: Chen, Yijie, et al.
Pubblicazione: (2024)
Comments as Natural Logic Pivots: Improve Code Generation via Comment Perspective
di: Chen, Yijie, et al.
Pubblicazione: (2024)
di: Chen, Yijie, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Think in Safety: Unveiling and Mitigating Safety Alignment Collapse in Multimodal Large Reasoning Model
di: Lou, Xinyue, et al.
Pubblicazione: (2025) -
Dual-Space Knowledge Distillation for Large Language Models
di: Zhang, Songming, et al.
Pubblicazione: (2024) -
KDFlow: A User-Friendly and Efficient Knowledge Distillation Framework for Large Language Models
di: Zhang, Songming, et al.
Pubblicazione: (2026) -
SoT: Structured-of-Thought Prompting Guides Multilingual Reasoning in Large Language Models
di: Qi, Rui, et al.
Pubblicazione: (2025) -
Towards Faster k-Nearest-Neighbor Machine Translation
di: Shi, Xiangyu, et al.
Pubblicazione: (2023)