Salvato in:
| Autori principali: | Zeng, Jiayi, Feng, Yizhe, He, Mengliang, Lei, Wenhui, Zhang, Wei, Liu, Zeming, Shi, Xiaoming, Zhou, Aimin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2506.00064 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Flow2Code: Evaluating Large Language Models for Flowchart-based Code Generation Capability
di: He, Mengliang, et al.
Pubblicazione: (2025)
di: He, Mengliang, et al.
Pubblicazione: (2025)
Mathematical Language Models: A Survey
di: Liu, Wentao, et al.
Pubblicazione: (2023)
di: Liu, Wentao, et al.
Pubblicazione: (2023)
DOP: Diagnostic-Oriented Prompting for Large Language Models in Mathematical Correction
di: Chen, Hao, et al.
Pubblicazione: (2024)
di: Chen, Hao, et al.
Pubblicazione: (2024)
Stealthy Jailbreak Attacks on Large Language Models via Benign Data Mirroring
di: Mu, Honglin, et al.
Pubblicazione: (2024)
di: Mu, Honglin, et al.
Pubblicazione: (2024)
GODBench: A Benchmark for Multimodal Large Language Models in Video Comment Art
di: Lei, Yiming, et al.
Pubblicazione: (2025)
di: Lei, Yiming, et al.
Pubblicazione: (2025)
SpMis: An Investigation of Synthetic Spoken Misinformation Detection
di: Liu, Peizhuo, et al.
Pubblicazione: (2024)
di: Liu, Peizhuo, et al.
Pubblicazione: (2024)
BP-GPT: Auditory Neural Decoding Using fMRI-prompted LLM
di: Chen, Xiaoyu, et al.
Pubblicazione: (2025)
di: Chen, Xiaoyu, et al.
Pubblicazione: (2025)
Open-vocabulary Auditory Neural Decoding Using fMRI-prompted LLM
di: Chen, Xiaoyu, et al.
Pubblicazione: (2024)
di: Chen, Xiaoyu, et al.
Pubblicazione: (2024)
RepoDebug: Repository-Level Multi-Task and Multi-Language Debugging Evaluation of Large Language Models
di: Liu, Jingjing, et al.
Pubblicazione: (2025)
di: Liu, Jingjing, et al.
Pubblicazione: (2025)
Echo: A Large Language Model with Temporal Episodic Memory
di: Liu, WenTao, et al.
Pubblicazione: (2025)
di: Liu, WenTao, et al.
Pubblicazione: (2025)
Leveraging Computerized Adaptive Testing for Cost-effective Evaluation of Large Language Models in Medical Benchmarking
di: Zheng, Tianpeng, et al.
Pubblicazione: (2026)
di: Zheng, Tianpeng, et al.
Pubblicazione: (2026)
FinDABench: Benchmarking Financial Data Analysis Ability of Large Language Models
di: Liu, Shu, et al.
Pubblicazione: (2024)
di: Liu, Shu, et al.
Pubblicazione: (2024)
Digger: Detecting Copyright Content Mis-usage in Large Language Model Training
di: Li, Haodong, et al.
Pubblicazione: (2024)
di: Li, Haodong, et al.
Pubblicazione: (2024)
Self-ensemble: Mitigating Confidence Mis-calibration for Large Language Models
di: Xu, Zicheng, et al.
Pubblicazione: (2025)
di: Xu, Zicheng, et al.
Pubblicazione: (2025)
KVPruner: Structural Pruning for Faster and Memory-Efficient Large Language Models
di: Lv, Bo, et al.
Pubblicazione: (2024)
di: Lv, Bo, et al.
Pubblicazione: (2024)
SMRC: Aligning Large Language Models with Student Reasoning for Mathematical Error Correction
di: Zeng, Biaojie, et al.
Pubblicazione: (2025)
di: Zeng, Biaojie, et al.
Pubblicazione: (2025)
MedFact: Benchmarking the Fact-Checking Capabilities of Large Language Models on Chinese Medical Texts
di: He, Jiayi, et al.
Pubblicazione: (2025)
di: He, Jiayi, et al.
Pubblicazione: (2025)
Multiple-Debias: A Full-process Debiasing Method for Multilingual Pre-trained Language Models
di: Liang, Haoyu, et al.
Pubblicazione: (2026)
di: Liang, Haoyu, et al.
Pubblicazione: (2026)
How Well Do LLMs Handle Cantonese? Benchmarking Cantonese Capabilities of Large Language Models
di: Jiang, Jiyue, et al.
Pubblicazione: (2024)
di: Jiang, Jiyue, et al.
Pubblicazione: (2024)
The Few-shot Dilemma: Over-prompting Large Language Models
di: Tang, Yongjian, et al.
Pubblicazione: (2025)
di: Tang, Yongjian, et al.
Pubblicazione: (2025)
LocalGPT: Benchmarking and Advancing Large Language Models for Local Life Services in Meituan
di: Lan, Xiaochong, et al.
Pubblicazione: (2025)
di: Lan, Xiaochong, et al.
Pubblicazione: (2025)
DeepSeek's WEIRD Behavior: The cultural alignment of Large Language Models and the effects of prompt language and cultural prompting
di: Luther, James, et al.
Pubblicazione: (2025)
di: Luther, James, et al.
Pubblicazione: (2025)
A Survey on Proactive Defense Strategies Against Misinformation in Large Language Models
di: Liu, Shuliang, et al.
Pubblicazione: (2025)
di: Liu, Shuliang, et al.
Pubblicazione: (2025)
DocMEdit: Towards Document-Level Model Editing
di: Zeng, Li, et al.
Pubblicazione: (2025)
di: Zeng, Li, et al.
Pubblicazione: (2025)
OmniEduBench: A Comprehensive Chinese Benchmark for Evaluating Large Language Models in Education
di: Zhang, Min, et al.
Pubblicazione: (2025)
di: Zhang, Min, et al.
Pubblicazione: (2025)
KwaiChat: A Large-Scale Video-Driven Multilingual Mixed-Type Dialogue Corpus
di: Shi, Xiaoming, et al.
Pubblicazione: (2025)
di: Shi, Xiaoming, et al.
Pubblicazione: (2025)
LIFBench: Evaluating the Instruction Following Performance and Stability of Large Language Models in Long-Context Scenarios
di: Wu, Xiaodong, et al.
Pubblicazione: (2024)
di: Wu, Xiaodong, et al.
Pubblicazione: (2024)
Adversarial Representation Engineering: A General Model Editing Framework for Large Language Models
di: Zhang, Yihao, et al.
Pubblicazione: (2024)
di: Zhang, Yihao, et al.
Pubblicazione: (2024)
Automata-Based Steering of Large Language Models for Diverse Structured Generation
di: Luan, Xiaokun, et al.
Pubblicazione: (2025)
di: Luan, Xiaokun, et al.
Pubblicazione: (2025)
Genetic Auto-prompt Learning for Pre-trained Code Intelligence Language Models
di: Feng, Chengzhe, et al.
Pubblicazione: (2024)
di: Feng, Chengzhe, et al.
Pubblicazione: (2024)
WundtGPT: Shaping Large Language Models To Be An Empathetic, Proactive Psychologist
di: Ren, Chenyu, et al.
Pubblicazione: (2024)
di: Ren, Chenyu, et al.
Pubblicazione: (2024)
CrossTrafficLLM: A Human-Centric Framework for Interpretable Traffic Intelligence via Large Language Model
di: Du, Zeming, et al.
Pubblicazione: (2025)
di: Du, Zeming, et al.
Pubblicazione: (2025)
MLP Fusion: Towards Efficient Fine-tuning of Dense and Mixture-of-Experts Language Models
di: Ai, Mengting, et al.
Pubblicazione: (2023)
di: Ai, Mengting, et al.
Pubblicazione: (2023)
Examining the Robustness of Large Language Models across Language Complexity
di: Zhang, Jiayi
Pubblicazione: (2025)
di: Zhang, Jiayi
Pubblicazione: (2025)
STEER-BENCH: A Benchmark for Evaluating the Steerability of Large Language Models
di: Chen, Kai, et al.
Pubblicazione: (2025)
di: Chen, Kai, et al.
Pubblicazione: (2025)
ProBench: Benchmarking Large Language Models in Competitive Programming
di: Yang, Lei, et al.
Pubblicazione: (2025)
di: Yang, Lei, et al.
Pubblicazione: (2025)
What's in a prompt? Language models encode literary style in prompt embeddings
di: Sarfati, Raphaël, et al.
Pubblicazione: (2025)
di: Sarfati, Raphaël, et al.
Pubblicazione: (2025)
LLM-KT: Aligning Large Language Models with Knowledge Tracing using a Plug-and-Play Instruction
di: Wang, Ziwei, et al.
Pubblicazione: (2025)
di: Wang, Ziwei, et al.
Pubblicazione: (2025)
Soft-prompt Tuning for Large Language Models to Evaluate Bias
di: Tian, Jacob-Junqi, et al.
Pubblicazione: (2023)
di: Tian, Jacob-Junqi, et al.
Pubblicazione: (2023)
Enhancing Tool Learning in Large Language Models with Hierarchical Error Checklists
di: Cui, Yue, et al.
Pubblicazione: (2025)
di: Cui, Yue, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Flow2Code: Evaluating Large Language Models for Flowchart-based Code Generation Capability
di: He, Mengliang, et al.
Pubblicazione: (2025) -
Mathematical Language Models: A Survey
di: Liu, Wentao, et al.
Pubblicazione: (2023) -
DOP: Diagnostic-Oriented Prompting for Large Language Models in Mathematical Correction
di: Chen, Hao, et al.
Pubblicazione: (2024) -
Stealthy Jailbreak Attacks on Large Language Models via Benign Data Mirroring
di: Mu, Honglin, et al.
Pubblicazione: (2024) -
GODBench: A Benchmark for Multimodal Large Language Models in Video Comment Art
di: Lei, Yiming, et al.
Pubblicazione: (2025)