DAComp: Benchmarking Data Agents across the Full Data Intelligence Lifecycle
Fuente:
arXiv
Salvato in:
| Autori principali: | Lei, Fangyu, Meng, Jinxiang, Huang, Yiming, Zhao, Junjie, Zhang, Yitong, Luo, Jianwen, Zou, Xin, Yang, Ruiyi, Shi, Wenbo, Gao, Yan, He, Shizhu, Wang, Zuo, Liu, Qian, Wang, Yang, Wang, Ke, Zhao, Jun, Liu, Kang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DA-Code: Agent Data Science Code Generation Benchmark for Large Language Models
di: Huang, Yiming, et al.
Pubblicazione: (2024)
di: Huang, Yiming, et al.
Pubblicazione: (2024)
GATE: Graph-based Adaptive Tool Evolution Across Diverse Tasks
di: Luo, Jianwen, et al.
Pubblicazione: (2025)
di: Luo, Jianwen, et al.
Pubblicazione: (2025)
DV-World: Benchmarking Data Visualization Agents in Real-World Scenarios
di: Meng, Jinxiang, et al.
Pubblicazione: (2026)
di: Meng, Jinxiang, et al.
Pubblicazione: (2026)
S3Eval: A Synthetic, Scalable, Systematic Evaluation Suite for Large Language Models
di: Lei, Fangyu, et al.
Pubblicazione: (2023)
di: Lei, Fangyu, et al.
Pubblicazione: (2023)
Reasoning-Table: Exploring Reinforcement Learning for Table Reasoning
di: Lei, Fangyu, et al.
Pubblicazione: (2025)
di: Lei, Fangyu, et al.
Pubblicazione: (2025)
S$^3$HQA: A Three-Stage Approach for Multi-hop Text-Table Hybrid Question Answering
di: Lei, Fangyu, et al.
Pubblicazione: (2023)
di: Lei, Fangyu, et al.
Pubblicazione: (2023)
DataTales: A Benchmark for Real-World Intelligent Data Narration
di: Yang, Yajing, et al.
Pubblicazione: (2024)
di: Yang, Yajing, et al.
Pubblicazione: (2024)
MoELoRA: Contrastive Learning Guided Mixture of Experts on Parameter-Efficient Fine-Tuning for Large Language Models
di: Luo, Tongxu, et al.
Pubblicazione: (2024)
di: Luo, Tongxu, et al.
Pubblicazione: (2024)
LLaSA: Large Language and Structured Data Assistant
di: Xu, Yao, et al.
Pubblicazione: (2024)
di: Xu, Yao, et al.
Pubblicazione: (2024)
OR-Space: A Full-Lifecycle Workspace Benchmark for Industrial Optimization Agents
di: Zhou, Chenyu, et al.
Pubblicazione: (2026)
di: Zhou, Chenyu, et al.
Pubblicazione: (2026)
Utilizing Autoregressive Networks for Full Lifecycle Data Generation of Rolling Bearings for RUL Prediction
di: Wang, Junliang, et al.
Pubblicazione: (2024)
di: Wang, Junliang, et al.
Pubblicazione: (2024)
Amplify Adjacent Token Differences: Enhancing Long Chain-of-Thought Reasoning with Shift-FFN
di: Xu, Yao, et al.
Pubblicazione: (2025)
di: Xu, Yao, et al.
Pubblicazione: (2025)
Projected Holstein-Primakoff boson representation of quantum spins for spin wave theory
di: Liu, Ke, et al.
Pubblicazione: (2025)
di: Liu, Ke, et al.
Pubblicazione: (2025)
The Zero-Step Thinking: An Empirical Study of Mode Selection as Harder Early Exit in Reasoning Models
di: Tan, Yuqiao, et al.
Pubblicazione: (2025)
di: Tan, Yuqiao, et al.
Pubblicazione: (2025)
From Chain to Tree: Refining Chain-like Rules into Tree-like Rules on Knowledge Graphs
di: Sun, Wangtao, et al.
Pubblicazione: (2024)
di: Sun, Wangtao, et al.
Pubblicazione: (2024)
Neural Incompatibility: The Unbridgeable Gap of Cross-Scale Parametric Knowledge Transfer in Large Language Models
di: Tan, Yuqiao, et al.
Pubblicazione: (2025)
di: Tan, Yuqiao, et al.
Pubblicazione: (2025)
RoboMIND: Benchmark on Multi-embodiment Intelligence Normative Data for Robot Manipulation
di: Wu, Kun, et al.
Pubblicazione: (2024)
di: Wu, Kun, et al.
Pubblicazione: (2024)
3-D Reconfigurable Intelligent Surface: From Reflection to Transmission and From Single Hemisphere to Full 3-D Coverage
di: Wang, Ruiqi, et al.
Pubblicazione: (2026)
di: Wang, Ruiqi, et al.
Pubblicazione: (2026)
Lifecycle-Aware code generation: Leveraging Software Engineering Phases in LLMs
di: Xing, Xing, et al.
Pubblicazione: (2025)
di: Xing, Xing, et al.
Pubblicazione: (2025)
Automating Function-Level TARA for Automotive Full-Lifecycle Security
di: Yang, Yuqiao, et al.
Pubblicazione: (2025)
di: Yang, Yuqiao, et al.
Pubblicazione: (2025)
Full‐Lifecycle Monitoring of Electrode States in Lithium‐Ion Batteries
di: Shuoyuan Mao, et al.
Pubblicazione: (2025)
di: Shuoyuan Mao, et al.
Pubblicazione: (2025)
Query2Triple: Unified Query Encoding for Answering Diverse Complex Queries over Knowledge Graphs
di: Xu, Yao, et al.
Pubblicazione: (2023)
di: Xu, Yao, et al.
Pubblicazione: (2023)
ControlLM: Crafting Diverse Personalities for Language Models
di: Weng, Yixuan, et al.
Pubblicazione: (2024)
di: Weng, Yixuan, et al.
Pubblicazione: (2024)
Air‐Processed Efficient Perovskite Solar Cells With Full Lifecycle Management
di: Chuanming Tian, et al.
Pubblicazione: (2024)
di: Chuanming Tian, et al.
Pubblicazione: (2024)
Existence, uniqueness, and approximability of solutions to the classical Melan equation in suspension bridges
di: Wang, Jinxiang
Pubblicazione: (2025)
di: Wang, Jinxiang
Pubblicazione: (2025)
Demystifying the Lifecycle of Failures in Platform-Orchestrated Agentic Workflows
di: Ma, Xuyan, et al.
Pubblicazione: (2025)
di: Ma, Xuyan, et al.
Pubblicazione: (2025)
Offloading and Quality Control for AI Generated Content Services in 6G Mobile Edge Computing Networks
di: Wang, Yitong, et al.
Pubblicazione: (2023)
di: Wang, Yitong, et al.
Pubblicazione: (2023)
On the Estimation Approach of Net Carbon Sequestration Under Non‐Continuous Flooding in Rice Fields
di: Jinyang Wang, et al.
Pubblicazione: (2025)
di: Jinyang Wang, et al.
Pubblicazione: (2025)
Efficient Data Learning for Open Information Extraction with Pre-trained Language Models
di: Fan, Zhiyuan, et al.
Pubblicazione: (2023)
di: Fan, Zhiyuan, et al.
Pubblicazione: (2023)
ExpNote: Black-box Large Language Models are Better Task Solvers with Experience Notebook
di: Sun, Wangtao, et al.
Pubblicazione: (2023)
di: Sun, Wangtao, et al.
Pubblicazione: (2023)
Find Parent then Label Children: A Two-stage Taxonomy Completion Method with Pre-trained Language Model
di: Xia, Fei, et al.
Pubblicazione: (2024)
di: Xia, Fei, et al.
Pubblicazione: (2024)
DATA: Decomposed Attention-based Task Adaptation for Rehearsal-Free Continual Learning
di: Liao, Huanxuan, et al.
Pubblicazione: (2025)
di: Liao, Huanxuan, et al.
Pubblicazione: (2025)
Dynamic Parametric Retrieval Augmented Generation for Test-time Knowledge Enhancement
di: Tan, Yuqiao, et al.
Pubblicazione: (2025)
di: Tan, Yuqiao, et al.
Pubblicazione: (2025)
SC-Taxo: Hierarchical Taxonomy Generation under Semantic Consistency Constraints using Large Language Models
di: Cai, Shiqiang, et al.
Pubblicazione: (2026)
di: Cai, Shiqiang, et al.
Pubblicazione: (2026)
WideSearch: Benchmarking Agentic Broad Info-Seeking
di: Wong, Ryan, et al.
Pubblicazione: (2025)
di: Wong, Ryan, et al.
Pubblicazione: (2025)
Reinforcement Learning Meets Large Language Models: A Survey of Advancements and Applications Across the LLM Lifecycle
di: Liu, Keliang, et al.
Pubblicazione: (2025)
di: Liu, Keliang, et al.
Pubblicazione: (2025)
Private Transformer Inference in MLaaS: A Survey
di: Li, Yang, et al.
Pubblicazione: (2025)
di: Li, Yang, et al.
Pubblicazione: (2025)
A Survey on Private Transformer Inference
di: Li, Yang, et al.
Pubblicazione: (2024)
di: Li, Yang, et al.
Pubblicazione: (2024)
SAFLA: Semantic-aware Full Lifecycle Assurance Designed for Intent-Driven Networks
di: Kou, Shiwen, et al.
Pubblicazione: (2024)
di: Kou, Shiwen, et al.
Pubblicazione: (2024)
From $P(y|x)$ to $P(y)$: Investigating Reinforcement Learning in Pre-train Space
di: Tan, Yuqiao, et al.
Pubblicazione: (2026)
di: Tan, Yuqiao, et al.
Pubblicazione: (2026)
Documenti analoghi
-
DA-Code: Agent Data Science Code Generation Benchmark for Large Language Models
di: Huang, Yiming, et al.
Pubblicazione: (2024) -
GATE: Graph-based Adaptive Tool Evolution Across Diverse Tasks
di: Luo, Jianwen, et al.
Pubblicazione: (2025) -
DV-World: Benchmarking Data Visualization Agents in Real-World Scenarios
di: Meng, Jinxiang, et al.
Pubblicazione: (2026) -
S3Eval: A Synthetic, Scalable, Systematic Evaluation Suite for Large Language Models
di: Lei, Fangyu, et al.
Pubblicazione: (2023) -
Reasoning-Table: Exploring Reinforcement Learning for Table Reasoning
di: Lei, Fangyu, et al.
Pubblicazione: (2025)