Salvato in:
| Autori principali: | Luo, Zheng, Kutralingam, T Pranav, Okoani, Ogochukwu N, Xu, Wanpeng, Wei, Hua, Hu, Xiyang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2601.05366 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AdaRefiner: Refining Decisions of Language Models with Adaptive Feedback
di: Zhang, Wanpeng, et al.
Pubblicazione: (2023)
di: Zhang, Wanpeng, et al.
Pubblicazione: (2023)
Dynamics of Adversarial Attacks on Large Language Model-Based Search Engines
di: Hu, Xiyang
Pubblicazione: (2025)
di: Hu, Xiyang
Pubblicazione: (2025)
SUTRA: Scalable Multilingual Language Model Architecture
di: Bendale, Abhijit, et al.
Pubblicazione: (2024)
di: Bendale, Abhijit, et al.
Pubblicazione: (2024)
Value-Action Alignment in Large Language Models under Privacy-Prosocial Conflict
di: Chen, Guanyu, et al.
Pubblicazione: (2026)
di: Chen, Guanyu, et al.
Pubblicazione: (2026)
Towards More Accurate US Presidential Election via Multi-step Reasoning with Large Language Models
di: Yu, Chenxiao, et al.
Pubblicazione: (2024)
di: Yu, Chenxiao, et al.
Pubblicazione: (2024)
Lost in the Source Language: How Large Language Models Evaluate the Quality of Machine Translation
di: Huang, Xu, et al.
Pubblicazione: (2024)
di: Huang, Xu, et al.
Pubblicazione: (2024)
Simulating Complex Multi-Turn Tool Calling Interactions in Stateless Execution Environments
di: Crouse, Maxwell, et al.
Pubblicazione: (2026)
di: Crouse, Maxwell, et al.
Pubblicazione: (2026)
Instructional Agents: Reducing Teaching Faculty Workload through Multi-Agent Instructional Design
di: Yao, Huaiyuan, et al.
Pubblicazione: (2025)
di: Yao, Huaiyuan, et al.
Pubblicazione: (2025)
A Survey on Multilingual Large Language Models: Corpora, Alignment, and Bias
di: Xu, Yuemei, et al.
Pubblicazione: (2024)
di: Xu, Yuemei, et al.
Pubblicazione: (2024)
Multilingual Collaborative Defense for Large Language Models
di: Li, Hongliang, et al.
Pubblicazione: (2025)
di: Li, Hongliang, et al.
Pubblicazione: (2025)
Executing Natural Language-Described Algorithms with Large Language Models: An Investigation
di: Zheng, Xin, et al.
Pubblicazione: (2024)
di: Zheng, Xin, et al.
Pubblicazione: (2024)
Fairness or Fluency? An Investigation into Language Bias of Pairwise LLM-as-a-Judge
di: Zhou, Xiaolin, et al.
Pubblicazione: (2026)
di: Zhou, Xiaolin, et al.
Pubblicazione: (2026)
DiffuGuard: How Intrinsic Safety is Lost and Found in Diffusion Large Language Models
di: Li, Zherui, et al.
Pubblicazione: (2025)
di: Li, Zherui, et al.
Pubblicazione: (2025)
AD-LLM: Benchmarking Large Language Models for Anomaly Detection
di: Yang, Tiankai, et al.
Pubblicazione: (2024)
di: Yang, Tiankai, et al.
Pubblicazione: (2024)
From Rubrics to Reliable Scores: Evidence-Grounded Text Evaluation with LLM Judges
di: Hong, Yihan, et al.
Pubblicazione: (2026)
di: Hong, Yihan, et al.
Pubblicazione: (2026)
"Lost-in-the-Later": Framework for Quantifying Contextual Grounding in Large Language Models
di: Tao, Yufei, et al.
Pubblicazione: (2025)
di: Tao, Yufei, et al.
Pubblicazione: (2025)
AgentMath: Empowering Mathematical Reasoning for Large Language Models via Tool-Augmented Agent
di: Luo, Haipeng, et al.
Pubblicazione: (2025)
di: Luo, Haipeng, et al.
Pubblicazione: (2025)
Tool Learning with Large Language Models: A Survey
di: Qu, Changle, et al.
Pubblicazione: (2024)
di: Qu, Changle, et al.
Pubblicazione: (2024)
Learning to Trust the Crowd: A Multi-Model Consensus Reasoning Engine for Large Language Models
di: Kallem, Pranav
Pubblicazione: (2026)
di: Kallem, Pranav
Pubblicazione: (2026)
LoopTool: Closing the Data-Training Loop for Robust LLM Tool Calls
di: Zhang, Kangning, et al.
Pubblicazione: (2025)
di: Zhang, Kangning, et al.
Pubblicazione: (2025)
Supernova Event Dataset: Interpreting Large Language Models' Personality through Critical Event Analysis
di: Agarwal, Pranav, et al.
Pubblicazione: (2025)
di: Agarwal, Pranav, et al.
Pubblicazione: (2025)
Identifying and Extracting Rare Disease Phenotypes with Large Language Models
di: Shyr, Cathy, et al.
Pubblicazione: (2023)
di: Shyr, Cathy, et al.
Pubblicazione: (2023)
Tool Calling is Linearly Readable and Steerable in Language Models
di: Wu, Zekun, et al.
Pubblicazione: (2026)
di: Wu, Zekun, et al.
Pubblicazione: (2026)
ToolNet: Connecting Large Language Models with Massive Tools via Tool Graph
di: Liu, Xukun, et al.
Pubblicazione: (2024)
di: Liu, Xukun, et al.
Pubblicazione: (2024)
MeNTi: Bridging Medical Calculator and LLM Agent with Nested Tool Calling
di: Zhu, Yakun, et al.
Pubblicazione: (2024)
di: Zhu, Yakun, et al.
Pubblicazione: (2024)
Focusing on Language: Revealing and Exploiting Language Attention Heads in Multilingual Large Language Models
di: Liu, Xin, et al.
Pubblicazione: (2025)
di: Liu, Xin, et al.
Pubblicazione: (2025)
BiasLab: A Multilingual, Dual-Framing Framework for Robust Measurement of Output-Level Bias in Large Language Models
di: Guey, William, et al.
Pubblicazione: (2026)
di: Guey, William, et al.
Pubblicazione: (2026)
Long-Horizon Plan Execution in Large Tool Spaces through Entropy-Guided Branching
di: Wei, Rongzhe, et al.
Pubblicazione: (2026)
di: Wei, Rongzhe, et al.
Pubblicazione: (2026)
Flaming-hot Initiation with Regular Execution Sampling for Large Language Models
di: Chen, Weizhe, et al.
Pubblicazione: (2024)
di: Chen, Weizhe, et al.
Pubblicazione: (2024)
Multimodal Generative Engine Optimization: Rank Manipulation for Vision-Language Model Rankers
di: Du, Yixuan, et al.
Pubblicazione: (2026)
di: Du, Yixuan, et al.
Pubblicazione: (2026)
MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages
di: Han, Wenhan, et al.
Pubblicazione: (2025)
di: Han, Wenhan, et al.
Pubblicazione: (2025)
MoZIP: A Multilingual Benchmark to Evaluate Large Language Models in Intellectual Property
di: Ni, Shiwen, et al.
Pubblicazione: (2024)
di: Ni, Shiwen, et al.
Pubblicazione: (2024)
Lost in the Pipeline: How Well Do Large Language Models Handle Data Preparation?
di: Spreafico, Matteo, et al.
Pubblicazione: (2025)
di: Spreafico, Matteo, et al.
Pubblicazione: (2025)
Lost in the Logic: An Evaluation of Large Language Models' Reasoning Capabilities on LSAT Logic Games
di: Malik, Saumya
Pubblicazione: (2024)
di: Malik, Saumya
Pubblicazione: (2024)
All Languages Matter: On the Multilingual Safety of Large Language Models
di: Wang, Wenxuan, et al.
Pubblicazione: (2023)
di: Wang, Wenxuan, et al.
Pubblicazione: (2023)
Latent Preference Modeling for Cross-Session Personalized Tool Calling
di: Yoon, Yejin, et al.
Pubblicazione: (2026)
di: Yoon, Yejin, et al.
Pubblicazione: (2026)
Exploring Polyglot Harmony: On Multilingual Data Allocation for Large Language Models Pretraining
di: Guo, Ping, et al.
Pubblicazione: (2025)
di: Guo, Ping, et al.
Pubblicazione: (2025)
Multilingual Performance Biases of Large Language Models in Education
di: Gupta, Vansh, et al.
Pubblicazione: (2025)
di: Gupta, Vansh, et al.
Pubblicazione: (2025)
How do Large Language Models Handle Multilingualism?
di: Zhao, Yiran, et al.
Pubblicazione: (2024)
di: Zhao, Yiran, et al.
Pubblicazione: (2024)
Mitigating Multilingual Hallucination in Large Vision-Language Models
di: Qu, Xiaoye, et al.
Pubblicazione: (2024)
di: Qu, Xiaoye, et al.
Pubblicazione: (2024)
Documenti analoghi
-
AdaRefiner: Refining Decisions of Language Models with Adaptive Feedback
di: Zhang, Wanpeng, et al.
Pubblicazione: (2023) -
Dynamics of Adversarial Attacks on Large Language Model-Based Search Engines
di: Hu, Xiyang
Pubblicazione: (2025) -
SUTRA: Scalable Multilingual Language Model Architecture
di: Bendale, Abhijit, et al.
Pubblicazione: (2024) -
Value-Action Alignment in Large Language Models under Privacy-Prosocial Conflict
di: Chen, Guanyu, et al.
Pubblicazione: (2026) -
Towards More Accurate US Presidential Election via Multi-step Reasoning with Large Language Models
di: Yu, Chenxiao, et al.
Pubblicazione: (2024)