AgroTools: A Benchmark for Tool-Augmented Multimodal Agents in Agriculture
Fuente:
arXiv
Guardado en:
| Autores principales: | Ye, Zi, Wen, Yibin, Fan, Xiaoya, Zhang, Xinyu, Wu, Jing, Zeng, Kun, Mai, Zurong, Zhang, Jiarui, Shi, Bohan, Zheng, Juepeng, Huang, Jianxi, Lu, Yutong, Fu, Haohuan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Can Large Multimodal Models Understand Agricultural Scenes? Benchmarking with AgroMind
por: Li, Qingmei, et al.
Publicado: (2025)
por: Li, Qingmei, et al.
Publicado: (2025)
AgroCoT: A Chain-of-Thought Benchmark for Evaluating Reasoning in Vision-Language Models for Agriculture
por: Wen, Yibin, et al.
Publicado: (2025)
por: Wen, Yibin, et al.
Publicado: (2025)
AgroNVILA: Perception-Reasoning Decoupling for Multi-view Agricultural Multimodal Large Language Models
por: Zhang, Jiarui, et al.
Publicado: (2026)
por: Zhang, Jiarui, et al.
Publicado: (2026)
AgroVG: A Large-Scale Multi-Source Benchmark for Agricultural Visual Grounding
por: Li, Haocheng, et al.
Publicado: (2026)
por: Li, Haocheng, et al.
Publicado: (2026)
HM-Bench: A Comprehensive Benchmark for Multimodal Large Language Models in Hyperspectral Remote Sensing
por: Zhang, Xinyu, et al.
Publicado: (2026)
por: Zhang, Xinyu, et al.
Publicado: (2026)
GTPBD: A Fine-Grained Global Terraced Parcel and Boundary Dataset
por: Zhang, Zhiwei, et al.
Publicado: (2025)
por: Zhang, Zhiwei, et al.
Publicado: (2025)
A Comprehensive Review of Agricultural Parcel and Boundary Delineation from Remote Sensing Images: Recent Progress and Future Perspectives
por: Zheng, Juepeng, et al.
Publicado: (2025)
por: Zheng, Juepeng, et al.
Publicado: (2025)
GTPBD-MM: A Global Terraced Parcel and Boundary Dataset with Multi-Modality
por: Zhang, Zhiwei, et al.
Publicado: (2026)
por: Zhang, Zhiwei, et al.
Publicado: (2026)
Evidential Graph Contrastive Alignment for Source-Free Blending-Target Domain Adaptation
por: Zheng, Juepeng, et al.
Publicado: (2024)
por: Zheng, Juepeng, et al.
Publicado: (2024)
Low Saturation Confidence Distribution-based Test-Time Adaptation for Cross-Domain Remote Sensing Image Classification
por: Liang, Yu, et al.
Publicado: (2024)
por: Liang, Yu, et al.
Publicado: (2024)
GALA: A GlobAl-LocAl Approach for Multi-Source Active Domain Adaptation
por: Zheng, Juepeng, et al.
Publicado: (2025)
por: Zheng, Juepeng, et al.
Publicado: (2025)
Parameter-Efficient Modality-Balanced Symmetric Fusion for Multimodal Remote Sensing Semantic Segmentation
por: Li, Haocheng, et al.
Publicado: (2026)
por: Li, Haocheng, et al.
Publicado: (2026)
SAGE: Style-Adaptive Generalization for Privacy-Constrained Semantic Segmentation Across Domains
por: Li, Qingmei, et al.
Publicado: (2025)
por: Li, Qingmei, et al.
Publicado: (2025)
AIM: Asymmetric Information Masking for Visual Question Answering Continual Learning
por: Zhang, Peifeng, et al.
Publicado: (2026)
por: Zhang, Peifeng, et al.
Publicado: (2026)
A Multimodal Foundation Agent for Financial Trading: Tool-Augmented, Diversified, and Generalist
por: Zhang, Wentao, et al.
Publicado: (2024)
por: Zhang, Wentao, et al.
Publicado: (2024)
AGCD: Agent-Guided Cross-Modal Decoding for Weather Forecasting
por: Wu, Jing, et al.
Publicado: (2026)
por: Wu, Jing, et al.
Publicado: (2026)
Tool-Genesis: A Task-Driven Tool Creation Benchmark for Self-Evolving Language Agent
por: Xia, Bowei, et al.
Publicado: (2026)
por: Xia, Bowei, et al.
Publicado: (2026)
DeepLight: Reconstructing High-Resolution Observations of Nighttime Light With Multi-Modal Remote Sensing Data
por: Zhang, Lixian, et al.
Publicado: (2024)
por: Zhang, Lixian, et al.
Publicado: (2024)
ML-Tool-Bench: Tool-Augmented Planning for ML Tasks
por: Chittepu, Yaswanth, et al.
Publicado: (2025)
por: Chittepu, Yaswanth, et al.
Publicado: (2025)
Tool-MCoT: Tool Augmented Multimodal Chain-of-Thought for Content Safety Moderation
por: Zhang, Shutong, et al.
Publicado: (2026)
por: Zhang, Shutong, et al.
Publicado: (2026)
ToolBeHonest: A Multi-level Hallucination Diagnostic Benchmark for Tool-Augmented Large Language Models
por: Zhang, Yuxiang, et al.
Publicado: (2024)
por: Zhang, Yuxiang, et al.
Publicado: (2024)
TAMA: Tool-Augmented Multimodal Agent for Procedural Activity Understanding
por: Hasegawa, Kimihiro, et al.
Publicado: (2025)
por: Hasegawa, Kimihiro, et al.
Publicado: (2025)
An Executable Benchmarking Suite for Tool-Using Agents
por: Zhong, Zhiqing, et al.
Publicado: (2026)
por: Zhong, Zhiqing, et al.
Publicado: (2026)
AgroBench: Vision-Language Model Benchmark in Agriculture
por: Shinoda, Risa, et al.
Publicado: (2025)
por: Shinoda, Risa, et al.
Publicado: (2025)
CCTU: A Benchmark for Tool Use under Complex Constraints
por: Ye, Junjie, et al.
Publicado: (2026)
por: Ye, Junjie, et al.
Publicado: (2026)
GeoAgentBench: A Dynamic Execution Benchmark for Tool-Augmented Agents in Spatial Analysis
por: Yu, Bo, et al.
Publicado: (2026)
por: Yu, Bo, et al.
Publicado: (2026)
From Noisy Historical Maps to Time-Series Oil Palm Mapping Without Annotation in Malaysia and Indonesia (2020-2024)
por: Kuapanich, Nuttaset, et al.
Publicado: (2026)
por: Kuapanich, Nuttaset, et al.
Publicado: (2026)
AgriBench: A Hierarchical Agriculture Benchmark for Multimodal Large Language Models
por: Zhou, Yutong, et al.
Publicado: (2024)
por: Zhou, Yutong, et al.
Publicado: (2024)
GTA: A Benchmark for General Tool Agents
por: Wang, Jize, et al.
Publicado: (2024)
por: Wang, Jize, et al.
Publicado: (2024)
Seal-Tools: Self-Instruct Tool Learning Dataset for Agent Tuning and Detailed Benchmark
por: Wu, Mengsong, et al.
Publicado: (2024)
por: Wu, Mengsong, et al.
Publicado: (2024)
SynthTools: A Framework for Scaling Synthetic Tools for Agent Development
por: Castellani, Tommaso, et al.
Publicado: (2025)
por: Castellani, Tommaso, et al.
Publicado: (2025)
EgoBench: An Interactive Egocentric Multimodal Benchmark for Tool-Using Agents
por: Liu, Yunqi, et al.
Publicado: (2026)
por: Liu, Yunqi, et al.
Publicado: (2026)
ReflecTool: Towards Reflection-Aware Tool-Augmented Clinical Agents
por: Liao, Yusheng, et al.
Publicado: (2024)
por: Liao, Yusheng, et al.
Publicado: (2024)
ReTool-Video: Recursive Tool-Using Video Agents with Meta-Augmented Tool Grounding
por: Liu, Xiao, et al.
Publicado: (2026)
por: Liu, Xiao, et al.
Publicado: (2026)
Benchmarking Failures in Tool-Augmented Language Models
por: Treviño, Eduardo, et al.
Publicado: (2025)
por: Treviño, Eduardo, et al.
Publicado: (2025)
OSWorld-MCP: Benchmarking MCP Tool Invocation In Computer-Use Agents
por: Jia, Hongrui, et al.
Publicado: (2025)
por: Jia, Hongrui, et al.
Publicado: (2025)
ToolSandbox: A Stateful, Conversational, Interactive Evaluation Benchmark for LLM Tool Use Capabilities
por: Lu, Jiarui, et al.
Publicado: (2024)
por: Lu, Jiarui, et al.
Publicado: (2024)
ToolMem: Enhancing Multimodal Agents with Learnable Tool Capability Memory
por: Xiao, Yunzhong, et al.
Publicado: (2025)
por: Xiao, Yunzhong, et al.
Publicado: (2025)
AgroFlux: A Spatial-Temporal Benchmark for Carbon and Nitrogen Flux Prediction in Agricultural Ecosystems
por: Cheng, Qi, et al.
Publicado: (2026)
por: Cheng, Qi, et al.
Publicado: (2026)
Thinking With Videos: Multimodal Tool-Augmented Reinforcement Learning for Long Video Reasoning
por: Zhang, Haoji, et al.
Publicado: (2025)
por: Zhang, Haoji, et al.
Publicado: (2025)
Ejemplares similares
-
Can Large Multimodal Models Understand Agricultural Scenes? Benchmarking with AgroMind
por: Li, Qingmei, et al.
Publicado: (2025) -
AgroCoT: A Chain-of-Thought Benchmark for Evaluating Reasoning in Vision-Language Models for Agriculture
por: Wen, Yibin, et al.
Publicado: (2025) -
AgroNVILA: Perception-Reasoning Decoupling for Multi-view Agricultural Multimodal Large Language Models
por: Zhang, Jiarui, et al.
Publicado: (2026) -
AgroVG: A Large-Scale Multi-Source Benchmark for Agricultural Visual Grounding
por: Li, Haocheng, et al.
Publicado: (2026) -
HM-Bench: A Comprehensive Benchmark for Multimodal Large Language Models in Hyperspectral Remote Sensing
por: Zhang, Xinyu, et al.
Publicado: (2026)