Enregistré dans:
| Auteurs principaux: | Wang, Jialiang, Liu, Yuchen, Xu, Hang, Hu, Kaichun, Di, Shimin, Ni, Wangze, Yue, Linan, Zhang, Min-Ling, Ren, Kui, Chen, Lei |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2604.23593 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TravelEval: A Comprehensive Benchmarking Framework for Evaluating LLM-Powered Travel Planning Agents
par: Chen, Weiyi, et autres
Publié: (2026)
par: Chen, Weiyi, et autres
Publié: (2026)
Guided by Trajectories: Repairing and Rewarding Tool-Use Trajectories for Tool-Integrated Reasoning
par: Gong, Siyu, et autres
Publié: (2026)
par: Gong, Siyu, et autres
Publié: (2026)
RxnNano:Training Compact LLMs for Chemical Reaction and Retrosynthesis Prediction via Hierarchical Curriculum Learning
par: Li, Ran, et autres
Publié: (2026)
par: Li, Ran, et autres
Publié: (2026)
Code2MCP: Transforming Code Repositories into MCP Services
par: Ouyang, Chaoqian, et autres
Publié: (2025)
par: Ouyang, Chaoqian, et autres
Publié: (2025)
ContextCache: Context-Aware Semantic Cache for Multi-Turn Queries in Large Language Models
par: Yan, Jianxin, et autres
Publié: (2025)
par: Yan, Jianxin, et autres
Publié: (2025)
ERASER: Machine Unlearning in MLaaS via an Inference Serving-Aware Approach
par: Hu, Yuke, et autres
Publié: (2023)
par: Hu, Yuke, et autres
Publié: (2023)
Can we trust the evaluation on ChatGPT?
par: Aiyappa, Rachith, et autres
Publié: (2023)
par: Aiyappa, Rachith, et autres
Publié: (2023)
Editorial: Why should we care about preparing referee reports?
par: Matheus Albergaria
Publié: (2021)
par: Matheus Albergaria
Publié: (2021)
RAC: Relation-Aware Cache Replacement for Large Language Models
par: Wu, Yuchong, et autres
Publié: (2026)
par: Wu, Yuchong, et autres
Publié: (2026)
Learning to Compose for Cross-domain Agentic Workflow Generation
par: Wang, Jialiang, et autres
Publié: (2026)
par: Wang, Jialiang, et autres
Publié: (2026)
FactReview: Evidence-Grounded Peer Review with Execution-Based Claim Verification
par: Yue, Ling, et autres
Publié: (2026)
par: Yue, Ling, et autres
Publié: (2026)
SJP referees
Publié: (2025)
Publié: (2025)
Can we disrupt the momentum of the AI colonization of science education?
par: Lucy Avraamidou
Publié: (2024)
par: Lucy Avraamidou
Publié: (2024)
SRBench: A Comprehensive Benchmark for Sequential Recommendation with Large Language Models
par: Li, Jianhong, et autres
Publié: (2026)
par: Li, Jianhong, et autres
Publié: (2026)
Class-aware and Augmentation-free Contrastive Learning from Label Proportion
par: Wang, Jialiang, et autres
Publié: (2024)
par: Wang, Jialiang, et autres
Publié: (2024)
Bridging Efficiency and Transparency: Explainable CoT Compression in Multimodal Large Reasoning Models
par: Wang, Yizhi, et autres
Publié: (2026)
par: Wang, Yizhi, et autres
Publié: (2026)
Training Multimodal Large Reasoning Models Needs Better Thoughts: A Three-Stage Framework for Long Chain-of-Thought Synthesis and Selection
par: Wang, Yizhi, et autres
Publié: (2025)
par: Wang, Yizhi, et autres
Publié: (2025)
Can we trust LLM Self-Explanations for Entity Resolution?
par: Teofili, Tommaso, et autres
Publié: (2026)
par: Teofili, Tommaso, et autres
Publié: (2026)
QCFuse: Query-Centric Cache Fusion for Efficient RAG Inference
par: Yan, Jianxin, et autres
Publié: (2026)
par: Yan, Jianxin, et autres
Publié: (2026)
HarmMetric Eval: Benchmarking Metrics and Judges for LLM Harmfulness Assessment
par: Yang, Langqi, et autres
Publié: (2025)
par: Yang, Langqi, et autres
Publié: (2025)
When I say … trust in AI
par: Levent Çetinkaya
Publié: (2025)
par: Levent Çetinkaya
Publié: (2025)
Can we trust AI for acne advice: A double‐blind performance comparison with NICE guidelines
par: Xufei Luo, et autres
Publié: (2025)
par: Xufei Luo, et autres
Publié: (2025)
DualBreach: Efficient Dual-Jailbreaking via Target-Driven Initialization and Multi-Target Optimization
par: Huang, Xinzhe, et autres
Publié: (2025)
par: Huang, Xinzhe, et autres
Publié: (2025)
Don't Overthink It: A Survey of Efficient R1-style Large Reasoning Models
par: Yue, Linan, et autres
Publié: (2025)
par: Yue, Linan, et autres
Publié: (2025)
Guest editors and referees 2023
Publié: (2024)
Publié: (2024)
TCT referee recognition 2023
Publié: (2024)
Publié: (2024)
Why do referees end their careers and which factors determine the duration of a referee’s career?
par: Christian Rullang
Publié: (2017)
par: Christian Rullang
Publié: (2017)
ExplainitAI: When do we trust artificial intelligence? The influence of content and explainability in a cross-cultural comparison
par: Kang, Sora, et autres
Publié: (2025)
par: Kang, Sora, et autres
Publié: (2025)
Can we automatize scientific discovery in the cognitive sciences?
par: Jagadish, Akshay K., et autres
Publié: (2026)
par: Jagadish, Akshay K., et autres
Publié: (2026)
Misfortunes of a mathematicians' trio using Computer Algebra Systems: Can we trust?
par: Durán, Antonio J., et autres
Publié: (2013)
par: Durán, Antonio J., et autres
Publié: (2013)
Scientific writing and referee professional training
par: George Argota Pérez
Publié: (2023)
par: George Argota Pérez
Publié: (2023)
When End-to-End is Overkill: Rethinking Cascaded Speech-to-Text Translation
par: Min, Anna, et autres
Publié: (2025)
par: Min, Anna, et autres
Publié: (2025)
SpatialJB: How Text Distribution Art Becomes the "Jailbreak Key" for LLM Guardrails
par: Mou, Zhiyi, et autres
Publié: (2026)
par: Mou, Zhiyi, et autres
Publié: (2026)
Proficient Graph Neural Network Design by Accumulating Knowledge on Large Language Models
par: Wang, Jialiang, et autres
Publié: (2024)
par: Wang, Jialiang, et autres
Publié: (2024)
Beyond Model Base Retrieval: Weaving Knowledge to Master Fine-grained Neural Network Design
par: Wang, Jialiang, et autres
Publié: (2025)
par: Wang, Jialiang, et autres
Publié: (2025)
Can we coevolve with AI?
par: Joshua E Lerner, et autres
Publié: (2024)
par: Joshua E Lerner, et autres
Publié: (2024)
When can we trust untrusted monitoring? A safety case sketch across collusion strategies
par: Gardner-Challis, Nelson, et autres
Publié: (2026)
par: Gardner-Challis, Nelson, et autres
Publié: (2026)
When should we trust the annotation? Selective prediction for molecular structure retrieval from mass spectra
par: Jürgens, Mira, et autres
Publié: (2026)
par: Jürgens, Mira, et autres
Publié: (2026)
International. Send off referee, says Israel
Publié: (1998)
Publié: (1998)
Visible Light‐Induced Polymerization to Access Polyamides
par: Haiyan Hu, et autres
Publié: (2024)
par: Haiyan Hu, et autres
Publié: (2024)
Documents similaires
-
TravelEval: A Comprehensive Benchmarking Framework for Evaluating LLM-Powered Travel Planning Agents
par: Chen, Weiyi, et autres
Publié: (2026) -
Guided by Trajectories: Repairing and Rewarding Tool-Use Trajectories for Tool-Integrated Reasoning
par: Gong, Siyu, et autres
Publié: (2026) -
RxnNano:Training Compact LLMs for Chemical Reaction and Retrosynthesis Prediction via Hierarchical Curriculum Learning
par: Li, Ran, et autres
Publié: (2026) -
Code2MCP: Transforming Code Repositories into MCP Services
par: Ouyang, Chaoqian, et autres
Publié: (2025) -
ContextCache: Context-Aware Semantic Cache for Multi-Turn Queries in Large Language Models
par: Yan, Jianxin, et autres
Publié: (2025)