AI Research Agents Narrow Scientific Exploration
Fuente:
arXiv
Salvato in:
| Autori principali: | Tang, Yixuan, Yang, Yi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Crowded in B-Space: Calibrating Shared Directions for LoRA Merging
di: Tang, Yixuan, et al.
Pubblicazione: (2026)
di: Tang, Yixuan, et al.
Pubblicazione: (2026)
KV-Embedding: Training-free Text Embedding via Internal KV Re-routing in Decoder-only LLMs
di: Tang, Yixuan, et al.
Pubblicazione: (2026)
di: Tang, Yixuan, et al.
Pubblicazione: (2026)
Mind the Shift: Decoding Monetary Policy Stance from FOMC Statements with Large Language Models
di: Tang, Yixuan, et al.
Pubblicazione: (2026)
di: Tang, Yixuan, et al.
Pubblicazione: (2026)
MultiHop-RAG: Benchmarking Retrieval-Augmented Generation for Multi-Hop Queries
di: Tang, Yixuan, et al.
Pubblicazione: (2024)
di: Tang, Yixuan, et al.
Pubblicazione: (2024)
SR-GRPO: Stable Rank as an Intrinsic Geometric Reward for Large Language Model Alignment
di: Tang, Yixuan, et al.
Pubblicazione: (2025)
di: Tang, Yixuan, et al.
Pubblicazione: (2025)
GAPrune: Gradient-Alignment Pruning for Domain-Aware Embeddings
di: Tang, Yixuan, et al.
Pubblicazione: (2025)
di: Tang, Yixuan, et al.
Pubblicazione: (2025)
Pooling And Attention: What Are Effective Designs For LLM-Based Embedding Models?
di: Tang, Yixuan, et al.
Pubblicazione: (2024)
di: Tang, Yixuan, et al.
Pubblicazione: (2024)
Do We Need Domain-Specific Embedding Models? An Empirical Investigation
di: Tang, Yixuan, et al.
Pubblicazione: (2024)
di: Tang, Yixuan, et al.
Pubblicazione: (2024)
FinMTEB: Finance Massive Text Embedding Benchmark
di: Tang, Yixuan, et al.
Pubblicazione: (2025)
di: Tang, Yixuan, et al.
Pubblicazione: (2025)
Know the Unknown: An Uncertainty-Sensitive Method for LLM Instruction Tuning
di: Li, Jiaqi, et al.
Pubblicazione: (2024)
di: Li, Jiaqi, et al.
Pubblicazione: (2024)
PersonaFuse: A Personality Activation-Driven Framework for Enhancing Human-LLM Interactions
di: Tang, Yixuan, et al.
Pubblicazione: (2025)
di: Tang, Yixuan, et al.
Pubblicazione: (2025)
AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite
di: Bragg, Jonathan, et al.
Pubblicazione: (2025)
di: Bragg, Jonathan, et al.
Pubblicazione: (2025)
FML-bench: Benchmarking Machine Learning Agents for Scientific Research
di: Zou, Qiran, et al.
Pubblicazione: (2025)
di: Zou, Qiran, et al.
Pubblicazione: (2025)
EvoScientist: Towards Multi-Agent Evolving AI Scientists for End-to-End Scientific Discovery
di: Lyu, Yougang, et al.
Pubblicazione: (2026)
di: Lyu, Yougang, et al.
Pubblicazione: (2026)
AI4Research: A Survey of Artificial Intelligence for Scientific Research
di: Chen, Qiguang, et al.
Pubblicazione: (2025)
di: Chen, Qiguang, et al.
Pubblicazione: (2025)
SciResearcher: Scaling Deep Research Agents for Frontier Scientific Reasoning
di: Zheng, Tianshi, et al.
Pubblicazione: (2026)
di: Zheng, Tianshi, et al.
Pubblicazione: (2026)
Revealing the Numeracy Gap: An Empirical Investigation of Text Embedding Models
di: Deng, Ningyuan, et al.
Pubblicazione: (2025)
di: Deng, Ningyuan, et al.
Pubblicazione: (2025)
Debating the Unspoken: Role-Anchored Multi-Agent Reasoning for Half-Truth Detection
di: Tang, Yixuan, et al.
Pubblicazione: (2026)
di: Tang, Yixuan, et al.
Pubblicazione: (2026)
Multi-Modal Data Exploration via Language Agents
di: Nooralahzadeh, Farhad, et al.
Pubblicazione: (2024)
di: Nooralahzadeh, Farhad, et al.
Pubblicazione: (2024)
SciNet: Evaluating AI Agents in Relation-Aware Scientific Literature Retrieval
di: Shao, Chenyang, et al.
Pubblicazione: (2025)
di: Shao, Chenyang, et al.
Pubblicazione: (2025)
FLARE: Task-agnostic embedding model evaluation through a normalization process
di: Jiang, Jingzhou, et al.
Pubblicazione: (2026)
di: Jiang, Jingzhou, et al.
Pubblicazione: (2026)
Can LLMs Identify Critical Limitations within Scientific Research? A Systematic Evaluation on AI Research Papers
di: Xu, Zhijian, et al.
Pubblicazione: (2025)
di: Xu, Zhijian, et al.
Pubblicazione: (2025)
SQuAI: Scientific Question-Answering with Multi-Agent Retrieval-Augmented Generation
di: Besrour, Ines, et al.
Pubblicazione: (2025)
di: Besrour, Ines, et al.
Pubblicazione: (2025)
FlowPIE: Test-Time Scientific Idea Evolution with Flow-Guided Literature Exploration
di: Wang, Qiyao, et al.
Pubblicazione: (2026)
di: Wang, Qiyao, et al.
Pubblicazione: (2026)
When AI Co-Scientists Fail: SPOT-a Benchmark for Automated Verification of Scientific Research
di: Son, Guijin, et al.
Pubblicazione: (2025)
di: Son, Guijin, et al.
Pubblicazione: (2025)
Evaluating and Aligning Human Economic Risk Preferences in LLMs
di: Liu, Jiaxin, et al.
Pubblicazione: (2025)
di: Liu, Jiaxin, et al.
Pubblicazione: (2025)
SciAgentGym: Benchmarking Multi-Step Scientific Tool-use in LLM Agents
di: Shen, Yujiong, et al.
Pubblicazione: (2026)
di: Shen, Yujiong, et al.
Pubblicazione: (2026)
The Straight and Narrow: Do LLMs Possess an Internal Moral Path?
di: Hu, Luoming, et al.
Pubblicazione: (2026)
di: Hu, Luoming, et al.
Pubblicazione: (2026)
BAGEL: Bootstrapping Agents by Guiding Exploration with Language
di: Murty, Shikhar, et al.
Pubblicazione: (2024)
di: Murty, Shikhar, et al.
Pubblicazione: (2024)
MARG: Multi-Agent Review Generation for Scientific Papers
di: D'Arcy, Mike, et al.
Pubblicazione: (2024)
di: D'Arcy, Mike, et al.
Pubblicazione: (2024)
From Labor to Collaboration: A Methodological Experiment Using AI Agents to Augment Research Perspectives in Taiwan's Humanities and Social Sciences
di: Huang, Yi-Chih
Pubblicazione: (2026)
di: Huang, Yi-Chih
Pubblicazione: (2026)
Jr. AI Scientist and Its Risk Report: Autonomous Scientific Exploration from a Baseline Paper
di: Miyai, Atsuyuki, et al.
Pubblicazione: (2025)
di: Miyai, Atsuyuki, et al.
Pubblicazione: (2025)
Agent Explorative Policy Optimization for Multimodal Agentic Reasoning
di: Kang, Minki, et al.
Pubblicazione: (2026)
di: Kang, Minki, et al.
Pubblicazione: (2026)
Go-Browse: Training Web Agents with Structured Exploration
di: Gandhi, Apurva, et al.
Pubblicazione: (2025)
di: Gandhi, Apurva, et al.
Pubblicazione: (2025)
Language Guided Exploration for RL Agents in Text Environments
di: Golchha, Hitesh, et al.
Pubblicazione: (2024)
di: Golchha, Hitesh, et al.
Pubblicazione: (2024)
Code2Math: Can Your Code Agent Effectively Evolve Math Problems Through Exploration?
di: Guo, Dadi, et al.
Pubblicazione: (2026)
di: Guo, Dadi, et al.
Pubblicazione: (2026)
FlexSQL: Flexible Exploration and Execution Make Better Text-to-SQL Agents
di: Pham, Quang Hieu, et al.
Pubblicazione: (2026)
di: Pham, Quang Hieu, et al.
Pubblicazione: (2026)
SciToolAgent: A Knowledge Graph-Driven Scientific Agent for Multi-Tool Integration
di: Ding, Keyan, et al.
Pubblicazione: (2025)
di: Ding, Keyan, et al.
Pubblicazione: (2025)
EarthSE: A Benchmark for Evaluating Earth Scientific Exploration Capability of LLMs
di: Xu, Wanghan, et al.
Pubblicazione: (2025)
di: Xu, Wanghan, et al.
Pubblicazione: (2025)
ResearchAgent: Iterative Research Idea Generation over Scientific Literature with Large Language Models
di: Baek, Jinheon, et al.
Pubblicazione: (2024)
di: Baek, Jinheon, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Crowded in B-Space: Calibrating Shared Directions for LoRA Merging
di: Tang, Yixuan, et al.
Pubblicazione: (2026) -
KV-Embedding: Training-free Text Embedding via Internal KV Re-routing in Decoder-only LLMs
di: Tang, Yixuan, et al.
Pubblicazione: (2026) -
Mind the Shift: Decoding Monetary Policy Stance from FOMC Statements with Large Language Models
di: Tang, Yixuan, et al.
Pubblicazione: (2026) -
MultiHop-RAG: Benchmarking Retrieval-Augmented Generation for Multi-Hop Queries
di: Tang, Yixuan, et al.
Pubblicazione: (2024) -
SR-GRPO: Stable Rank as an Intrinsic Geometric Reward for Large Language Model Alignment
di: Tang, Yixuan, et al.
Pubblicazione: (2025)