Deep Literature Survey Automation with an Iterative Workflow
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Hongbo, Cui, Han, Wang, Yidong, Tian, Yijian, Guo, Qi, Wang, Cunxiang, Wu, Jian, Song, Chiyu, Zhang, Yue |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
TrustJudge: Inconsistencies of LLM-as-a-Judge and How to Alleviate Them
por: Wang, Yidong, et al.
Publicado: (2025)
por: Wang, Yidong, et al.
Publicado: (2025)
How Likely Do LLMs with CoT Mimic Human Reasoning?
por: Bao, Guangsheng, et al.
Publicado: (2024)
por: Bao, Guangsheng, et al.
Publicado: (2024)
Knowledge Conflicts for LLMs: A Survey
por: Xu, Rongwu, et al.
Publicado: (2024)
por: Xu, Rongwu, et al.
Publicado: (2024)
AutoSurvey: Large Language Models Can Automatically Write Surveys
por: Wang, Yidong, et al.
Publicado: (2024)
por: Wang, Yidong, et al.
Publicado: (2024)
A Survey on Evaluation of Large Language Models
por: Chang, Yupeng, et al.
Publicado: (2023)
por: Chang, Yupeng, et al.
Publicado: (2023)
Direct Value Optimization: Improving Chain-of-Thought Reasoning in LLMs with Refined Values
por: Zhang, Hongbo, et al.
Publicado: (2025)
por: Zhang, Hongbo, et al.
Publicado: (2025)
Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future
por: Wang, Yidong, et al.
Publicado: (2025)
por: Wang, Yidong, et al.
Publicado: (2025)
StateFlow: Enhancing LLM Task-Solving through State-Driven Workflows
por: Wu, Yiran, et al.
Publicado: (2024)
por: Wu, Yiran, et al.
Publicado: (2024)
PandaLM: An Automatic Evaluation Benchmark for LLM Instruction Tuning Optimization
por: Wang, Yidong, et al.
Publicado: (2023)
por: Wang, Yidong, et al.
Publicado: (2023)
Unlocking Recursive Thinking of LLMs: Alignment via Refinement
por: Zhang, Haoke, et al.
Publicado: (2025)
por: Zhang, Haoke, et al.
Publicado: (2025)
DeepSurvey-Bench: Evaluating Academic Value of Automatically Generated Scientific Survey
por: Zhang, Guo-Biao, et al.
Publicado: (2026)
por: Zhang, Guo-Biao, et al.
Publicado: (2026)
Nash CoT: Multi-Path Inference with Preference Equilibrium
por: Zhang, Ziqi, et al.
Publicado: (2024)
por: Zhang, Ziqi, et al.
Publicado: (2024)
Reasoning on Multiple Needles In A Haystack
por: Wang, Yidong
Publicado: (2025)
por: Wang, Yidong
Publicado: (2025)
CycleResearcher: Improving Automated Research via Automated Review
por: Weng, Yixuan, et al.
Publicado: (2024)
por: Weng, Yixuan, et al.
Publicado: (2024)
Deep Research: A Systematic Survey
por: Shi, Zhengliang, et al.
Publicado: (2025)
por: Shi, Zhengliang, et al.
Publicado: (2025)
SEW: Self-Evolving Agentic Workflows for Automated Code Generation
por: Liu, Siwei, et al.
Publicado: (2025)
por: Liu, Siwei, et al.
Publicado: (2025)
TrustDataFilter:Leveraging Trusted Knowledge Base Data for More Effective Filtering of Unknown Information
por: Zhang, Jinghong, et al.
Publicado: (2025)
por: Zhang, Jinghong, et al.
Publicado: (2025)
$R^3$: "This is My SQL, Are You With Me?" A Consensus-Based Multi-Agent System for Text-to-SQL Tasks
por: Xia, Hanchen, et al.
Publicado: (2024)
por: Xia, Hanchen, et al.
Publicado: (2024)
AFlow: Automating Agentic Workflow Generation
por: Zhang, Jiayi, et al.
Publicado: (2024)
por: Zhang, Jiayi, et al.
Publicado: (2024)
Detecting RLVR Training Data via Structural Convergence of Reasoning
por: Zhang, Hongbo, et al.
Publicado: (2026)
por: Zhang, Hongbo, et al.
Publicado: (2026)
TraceSIR: A Multi-Agent Framework for Structured Analysis and Reporting of Agentic Execution Traces
por: Yang, Shu-Xun, et al.
Publicado: (2026)
por: Yang, Shu-Xun, et al.
Publicado: (2026)
Aligning AI Research with the Needs of Clinical Coding Workflows: Eight Recommendations Based on US Data Analysis and Critical Review
por: Gan, Yidong, et al.
Publicado: (2024)
por: Gan, Yidong, et al.
Publicado: (2024)
Demystifying Instruction Mixing for Fine-tuning Large Language Models
por: Wang, Renxi, et al.
Publicado: (2023)
por: Wang, Renxi, et al.
Publicado: (2023)
LongSafety: Evaluating Long-Context Safety of Large Language Models
por: Lu, Yida, et al.
Publicado: (2025)
por: Lu, Yida, et al.
Publicado: (2025)
AutoFlow: Automated Workflow Generation for Large Language Model Agents
por: Li, Zelong, et al.
Publicado: (2024)
por: Li, Zelong, et al.
Publicado: (2024)
CHI-Bench: Can AI Agents Automate End-to-End, Long-Horizon, Policy-Rich Healthcare Workflows?
por: Chen, Haolin, et al.
Publicado: (2026)
por: Chen, Haolin, et al.
Publicado: (2026)
Spider2-V: How Far Are Multimodal Agents From Automating Data Science and Engineering Workflows?
por: Cao, Ruisheng, et al.
Publicado: (2024)
por: Cao, Ruisheng, et al.
Publicado: (2024)
Self-DC: When to Reason and When to Act? Self Divide-and-Conquer for Compositional Unknown Questions
por: Wang, Hongru, et al.
Publicado: (2024)
por: Wang, Hongru, et al.
Publicado: (2024)
Seed-Prover: Deep and Broad Reasoning for Automated Theorem Proving
por: Chen, Luoxin, et al.
Publicado: (2025)
por: Chen, Luoxin, et al.
Publicado: (2025)
AutoSurvey2: Empowering Researchers with Next Level Automated Literature Surveys
por: Wu, Siyi, et al.
Publicado: (2025)
por: Wu, Siyi, et al.
Publicado: (2025)
UDA: Unsupervised Debiasing Alignment for Pair-wise LLM-as-a-Judge
por: Zhang, Yang, et al.
Publicado: (2025)
por: Zhang, Yang, et al.
Publicado: (2025)
Survey on Knowledge Distillation for Large Language Models: Methods, Evaluation, and Application
por: Yang, Chuanpeng, et al.
Publicado: (2024)
por: Yang, Chuanpeng, et al.
Publicado: (2024)
FreeEval: A Modular Framework for Trustworthy and Efficient Evaluation of Large Language Models
por: Yu, Zhuohao, et al.
Publicado: (2024)
por: Yu, Zhuohao, et al.
Publicado: (2024)
From Static Templates to Dynamic Runtime Graphs: A Survey of Workflow Optimization for LLM Agents
por: Yue, Ling, et al.
Publicado: (2026)
por: Yue, Ling, et al.
Publicado: (2026)
SAC-Opt: Semantic Anchors for Iterative Correction in Optimization Modeling
por: Zhang, Yansen, et al.
Publicado: (2025)
por: Zhang, Yansen, et al.
Publicado: (2025)
Distilling Text Style Transfer With Self-Explanation From LLMs
por: Zhang, Chiyu, et al.
Publicado: (2024)
por: Zhang, Chiyu, et al.
Publicado: (2024)
Natural Language Interfaces for Tabular Data Querying and Visualization: A Survey
por: Zhang, Weixu, et al.
Publicado: (2023)
por: Zhang, Weixu, et al.
Publicado: (2023)
Iterative Formalization and Planning in Partially Observable Environments
por: Gong, Liancheng, et al.
Publicado: (2025)
por: Gong, Liancheng, et al.
Publicado: (2025)
RefineCoder: Iterative Improving of Large Language Models via Adaptive Critique Refinement for Code Generation
por: Zhou, Changzhi, et al.
Publicado: (2025)
por: Zhou, Changzhi, et al.
Publicado: (2025)
SHIELD: Evaluation and Defense Strategies for Copyright Compliance in LLM Text Generation
por: Liu, Xiaoze, et al.
Publicado: (2024)
por: Liu, Xiaoze, et al.
Publicado: (2024)
Ejemplares similares
-
TrustJudge: Inconsistencies of LLM-as-a-Judge and How to Alleviate Them
por: Wang, Yidong, et al.
Publicado: (2025) -
How Likely Do LLMs with CoT Mimic Human Reasoning?
por: Bao, Guangsheng, et al.
Publicado: (2024) -
Knowledge Conflicts for LLMs: A Survey
por: Xu, Rongwu, et al.
Publicado: (2024) -
AutoSurvey: Large Language Models Can Automatically Write Surveys
por: Wang, Yidong, et al.
Publicado: (2024) -
A Survey on Evaluation of Large Language Models
por: Chang, Yupeng, et al.
Publicado: (2023)