TRACER: Verifiable Generative Provenance for Multimodal Tool-Using Agents
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yu, Bihui, Jia, Caijun, Chi, Jing, Liu, Xiaohan, Wang, Yining, Bai, He, Liu, Yuchen, Wei, Jingxuan, Zhu, Junnan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GenProve: Learning to Generate Text with Fine-Grained Provenance
par: Wei, Jingxuan, et autres
Publié: (2026)
par: Wei, Jingxuan, et autres
Publié: (2026)
ChartReasoner: Code-Driven Modality Bridging for Long-Chain Reasoning in Chart Question Answering
par: Jia, Caijun, et autres
Publié: (2025)
par: Jia, Caijun, et autres
Publié: (2025)
Guided Verifier: Collaborative Multimodal Reasoning via Dynamic Process Supervision
par: Sun, Lingzhuang, et autres
Publié: (2026)
par: Sun, Lingzhuang, et autres
Publié: (2026)
LLaVA-NeuMT: Selective Layer-Neuron Modulation for Efficient Multilingual Multimodal Translation
par: Wei, Jingxuan, et autres
Publié: (2025)
par: Wei, Jingxuan, et autres
Publié: (2025)
ChartMind: A Comprehensive Benchmark for Complex Real-world Multimodal Chart Question Answering
par: Wei, Jingxuan, et autres
Publié: (2025)
par: Wei, Jingxuan, et autres
Publié: (2025)
Canvas-of-Thought: Grounding Reasoning via Mutable Structured States
par: Sun, Lingzhuang, et autres
Publié: (2026)
par: Sun, Lingzhuang, et autres
Publié: (2026)
MM-Verify: Enhancing Multimodal Reasoning with Chain-of-Thought Verification
par: Sun, Linzhuang, et autres
Publié: (2025)
par: Sun, Linzhuang, et autres
Publié: (2025)
How RL Unlocks the Aha Moment in Geometric Interleaved Reasoning
par: Zhang, Xiangxiang, et autres
Publié: (2026)
par: Zhang, Xiangxiang, et autres
Publié: (2026)
TROVE: A Challenge for Fine-Grained Text Provenance via Source Sentence Tracing and Relationship Classification
par: Zhu, Junnan, et autres
Publié: (2025)
par: Zhu, Junnan, et autres
Publié: (2025)
Thinking with Drafting: Optical Decompression via Logical Reconstruction
par: Wei, Jingxuan, et autres
Publié: (2026)
par: Wei, Jingxuan, et autres
Publié: (2026)
BEATS: Optimizing LLM Mathematical Capabilities with BackVerify and Adaptive Disambiguate based Efficient Tree Search
par: Sun, Linzhuang, et autres
Publié: (2024)
par: Sun, Linzhuang, et autres
Publié: (2024)
GGBench: A Geometric Generative Reasoning Benchmark for Unified Multimodal Models
par: Wei, Jingxuan, et autres
Publié: (2025)
par: Wei, Jingxuan, et autres
Publié: (2025)
BayesRAG: Probabilistic Mutual Evidence Corroboration for Multimodal Retrieval-Augmented Generation
par: Li, Xuan, et autres
Publié: (2026)
par: Li, Xuan, et autres
Publié: (2026)
Geoint-R1: Formalizing Multimodal Geometric Reasoning with Dynamic Auxiliary Constructions
par: Wei, Jingxuan, et autres
Publié: (2025)
par: Wei, Jingxuan, et autres
Publié: (2025)
LaTER: Efficient Test-Time Reasoning via Latent Exploration and Explicit Verification
par: Li, Xuan, et autres
Publié: (2026)
par: Li, Xuan, et autres
Publié: (2026)
A Survey on Image-text Multimodal Models
par: Guo, Ruifeng, et autres
Publié: (2023)
par: Guo, Ruifeng, et autres
Publié: (2023)
Sentence-Level or Token-Level? A Comprehensive Study on Knowledge Distillation
par: Wei, Jingxuan, et autres
Publié: (2024)
par: Wei, Jingxuan, et autres
Publié: (2024)
SciToolAgent: A Knowledge Graph-Driven Scientific Agent for Multi-Tool Integration
par: Ding, Keyan, et autres
Publié: (2025)
par: Ding, Keyan, et autres
Publié: (2025)
Efficient-Empathy: Towards Efficient and Effective Selection of Empathy Data
par: Sun, Linzhuang, et autres
Publié: (2024)
par: Sun, Linzhuang, et autres
Publié: (2024)
Synth-Empathy: Towards High-Quality Synthetic Empathy Data
par: Liang, Hao, et autres
Publié: (2024)
par: Liang, Hao, et autres
Publié: (2024)
GTA: A Benchmark for General Tool Agents
par: Wang, Jize, et autres
Publié: (2024)
par: Wang, Jize, et autres
Publié: (2024)
Towards Verifiable Multimodal Deep Research: A Multi-Agent Harness for Interleaved Report Generation
par: Zhang, Chenghao, et autres
Publié: (2026)
par: Zhang, Chenghao, et autres
Publié: (2026)
VERINA: Benchmarking Verifiable Code Generation
par: Ye, Zhe, et autres
Publié: (2025)
par: Ye, Zhe, et autres
Publié: (2025)
CompassVerifier: A Unified and Robust Verifier for LLMs Evaluation and Outcome Reward
par: Liu, Shudong, et autres
Publié: (2025)
par: Liu, Shudong, et autres
Publié: (2025)
Dissecting Tool-Integrated Reasoning: An Empirical Study and Analysis
par: Zhao, Yufeng, et autres
Publié: (2025)
par: Zhao, Yufeng, et autres
Publié: (2025)
GTA-2: Benchmarking General Tool Agents from Atomic Tool-Use to Open-Ended Workflows
par: Wang, Jize, et autres
Publié: (2026)
par: Wang, Jize, et autres
Publié: (2026)
ToolGate: Contract-Grounded and Verified Tool Execution for LLMs
par: Liu, Yanming, et autres
Publié: (2026)
par: Liu, Yanming, et autres
Publié: (2026)
PAGER: Bridging the Semantic-Execution Gap in Point-Precise Geometric GUI Control
par: Wei, Jingxuan, et autres
Publié: (2026)
par: Wei, Jingxuan, et autres
Publié: (2026)
ResearchPulse: Building Method-Experiment Chains through Multi-Document Scientific Inference
par: Chen, Qi, et autres
Publié: (2025)
par: Chen, Qi, et autres
Publié: (2025)
AgentV-RL: Scaling Reward Modeling with Agentic Verifier
par: Zhang, Jiazheng, et autres
Publié: (2026)
par: Zhang, Jiazheng, et autres
Publié: (2026)
Firefly: Illuminating Large-Scale Verified Tool-Call Data Generation from Real APIs
par: Lu, Yuxuan, et autres
Publié: (2026)
par: Lu, Yuxuan, et autres
Publié: (2026)
PaperFit: Vision-in-the-Loop Typesetting Optimization for Scientific Documents
par: Yu, Bihui, et autres
Publié: (2026)
par: Yu, Bihui, et autres
Publié: (2026)
TRACER: Persistent Regularization for Robust Multimodal Finetuning
par: Asadollahzadeh, Hesam, et autres
Publié: (2026)
par: Asadollahzadeh, Hesam, et autres
Publié: (2026)
Context-Adaptive Synthesis and Compression for Enhanced Retrieval-Augmented Generation in Complex Domains
par: Zhou, Peiran, et autres
Publié: (2025)
par: Zhou, Peiran, et autres
Publié: (2025)
From Self-Evolving Synthetic Data to Verifiable-Reward RL: Post-Training Multi-turn Interactive Tool-Using Agents
par: Gao, Jiaxuan, et autres
Publié: (2026)
par: Gao, Jiaxuan, et autres
Publié: (2026)
Fine-grained and Explainable Factuality Evaluation for Multimodal Summarization
par: Zhang, Yue, et autres
Publié: (2024)
par: Zhang, Yue, et autres
Publié: (2024)
Assertion-Conditioned Compliance: A Provenance-Aware Vulnerability in Multi-Turn Tool-Calling Agents
par: Waqas, Daud, et autres
Publié: (2025)
par: Waqas, Daud, et autres
Publié: (2025)
Trajectory2Task: Training Robust Tool-Calling Agents with Synthesized Yet Verifiable Data for Complex User Intents
par: Wang, Ziyi, et autres
Publié: (2026)
par: Wang, Ziyi, et autres
Publié: (2026)
Toward Efficient Agents: Memory, Tool learning, and Planning
par: Yang, Xiaofang, et autres
Publié: (2026)
par: Yang, Xiaofang, et autres
Publié: (2026)
Verified Critical Step Optimization for LLM Agents
par: Li, Mukai, et autres
Publié: (2026)
par: Li, Mukai, et autres
Publié: (2026)
Documents similaires
-
GenProve: Learning to Generate Text with Fine-Grained Provenance
par: Wei, Jingxuan, et autres
Publié: (2026) -
ChartReasoner: Code-Driven Modality Bridging for Long-Chain Reasoning in Chart Question Answering
par: Jia, Caijun, et autres
Publié: (2025) -
Guided Verifier: Collaborative Multimodal Reasoning via Dynamic Process Supervision
par: Sun, Lingzhuang, et autres
Publié: (2026) -
LLaVA-NeuMT: Selective Layer-Neuron Modulation for Efficient Multilingual Multimodal Translation
par: Wei, Jingxuan, et autres
Publié: (2025) -
ChartMind: A Comprehensive Benchmark for Complex Real-world Multimodal Chart Question Answering
par: Wei, Jingxuan, et autres
Publié: (2025)