Real Deep Research for AI, Robotics and Beyond
Fuente:
arXiv
Guardado en:
| Autores principales: | Zou, Xueyan, Ye, Jianglong, Zhang, Hao, Xiang, Xiaoyu, Ding, Mingyu, Yang, Zhaojing, Lee, Yong Jae, Tu, Zhuowen, Liu, Sifei, Wang, Xiaolong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
M3: 3D-Spatial MultiModal Memory
por: Zou, Xueyan, et al.
Publicado: (2025)
por: Zou, Xueyan, et al.
Publicado: (2025)
NaVILA: Legged Robot Vision-Language-Action Model for Navigation
por: Cheng, An-Chieh, et al.
Publicado: (2024)
por: Cheng, An-Chieh, et al.
Publicado: (2024)
HOIDiffusion: Generating Realistic 3D Hand-Object Interaction Data
por: Zhang, Mengqi, et al.
Publicado: (2024)
por: Zhang, Mengqi, et al.
Publicado: (2024)
Interfacing Foundation Models' Embeddings
por: Zou, Xueyan, et al.
Publicado: (2023)
por: Zou, Xueyan, et al.
Publicado: (2023)
Characterizing Learning Curves During Language Model Pre-Training: Learning, Forgetting, and Stability
por: Chang, Tyler A., et al.
Publicado: (2023)
por: Chang, Tyler A., et al.
Publicado: (2023)
Goldfish: Monolingual Language Models for 350 Languages
por: Chang, Tyler A., et al.
Publicado: (2024)
por: Chang, Tyler A., et al.
Publicado: (2024)
Interaction as Intelligence: Deep Research With Human-AI Partnership
por: Ye, Lyumanshan, et al.
Publicado: (2025)
por: Ye, Lyumanshan, et al.
Publicado: (2025)
Beyond Turn Limits: Training Deep Search Agents with Dynamic Context Window
por: Tang, Qiaoyu, et al.
Publicado: (2025)
por: Tang, Qiaoyu, et al.
Publicado: (2025)
$\textbf{PLUM}$: Improving Code LMs with Execution-Guided On-Policy Preference Learning Driven By Synthetic Test Cases
por: Zhang, Dylan, et al.
Publicado: (2024)
por: Zhang, Dylan, et al.
Publicado: (2024)
PhyGrasp: Generalizing Robotic Grasping with Physics-informed Large Multimodal Models
por: Guo, Dingkun, et al.
Publicado: (2024)
por: Guo, Dingkun, et al.
Publicado: (2024)
FeatureNeRF: Learning Generalizable NeRFs by Distilling Foundation Models
por: Ye, Jianglong, et al.
Publicado: (2023)
por: Ye, Jianglong, et al.
Publicado: (2023)
DeepResearcher: Scaling Deep Research via Reinforcement Learning in Real-world Environments
por: Zheng, Yuxiang, et al.
Publicado: (2025)
por: Zheng, Yuxiang, et al.
Publicado: (2025)
How Multimodal LLMs Solve Image Tasks: A Lens on Visual Grounding, Task Reasoning, and Answer Decoding
por: Yu, Zhuoran, et al.
Publicado: (2025)
por: Yu, Zhuoran, et al.
Publicado: (2025)
Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition
por: Feng, Junwei, et al.
Publicado: (2025)
por: Feng, Junwei, et al.
Publicado: (2025)
Exploring the Limitations of Large Language Models in Compositional Relation Reasoning
por: Zhao, Jinman, et al.
Publicado: (2024)
por: Zhao, Jinman, et al.
Publicado: (2024)
Beyond Simulations: What 20,000 Real Conversations Reveal About Mental Health AI Safety
por: Stamatis, Caitlin A., et al.
Publicado: (2026)
por: Stamatis, Caitlin A., et al.
Publicado: (2026)
Beyond Single-shot Writing: Deep Research Agents are Unreliable at Multi-turn Report Revision
por: Chen, Bingsen, et al.
Publicado: (2026)
por: Chen, Bingsen, et al.
Publicado: (2026)
Beyond English: Unveiling Multilingual Bias in LLM Copyright Compliance
por: Chen, Yupeng, et al.
Publicado: (2025)
por: Chen, Yupeng, et al.
Publicado: (2025)
AI Urban Scientist: Multi-Agent Collaborative Automation for Urban Research
por: Xia, Tong, et al.
Publicado: (2025)
por: Xia, Tong, et al.
Publicado: (2025)
Efficient Scaling of Diffusion Transformers for Text-to-Image Generation
por: Li, Hao, et al.
Publicado: (2024)
por: Li, Hao, et al.
Publicado: (2024)
Language Models Don't Know What You Want: Evaluating Personalization in Deep Research Needs Real Users
por: Balepur, Nishant, et al.
Publicado: (2026)
por: Balepur, Nishant, et al.
Publicado: (2026)
DeepResearchEval: An Automated Framework for Deep Research Task Construction and Agentic Evaluation
por: Wang, Yibo, et al.
Publicado: (2026)
por: Wang, Yibo, et al.
Publicado: (2026)
CogDual: Enhancing Dual Cognition of LLMs via Reinforcement Learning with Implicit Rule-Based Rewards
por: Liu, Cheng, et al.
Publicado: (2025)
por: Liu, Cheng, et al.
Publicado: (2025)
QeRL: Beyond Efficiency -- Quantization-enhanced Reinforcement Learning for LLMs
por: Huang, Wei, et al.
Publicado: (2025)
por: Huang, Wei, et al.
Publicado: (2025)
A Method for the Architecture of a Medical Vertical Large Language Model Based on Deepseek R1
por: Zhang, Mingda, et al.
Publicado: (2025)
por: Zhang, Mingda, et al.
Publicado: (2025)
RGBD Objects in the Wild: Scaling Real-World 3D Object Learning from RGB-D Videos
por: Xia, Hongchi, et al.
Publicado: (2024)
por: Xia, Hongchi, et al.
Publicado: (2024)
DEER: A Benchmark for Evaluating Deep Research Agents on Expert Report Generation
por: Han, Janghoon, et al.
Publicado: (2025)
por: Han, Janghoon, et al.
Publicado: (2025)
FinDeepResearch: Evaluating Deep Research Agents in Rigorous Financial Analysis
por: Zhu, Fengbin, et al.
Publicado: (2025)
por: Zhu, Fengbin, et al.
Publicado: (2025)
REMAC: Self-Reflective and Self-Evolving Multi-Agent Collaboration for Long-Horizon Robot Manipulation
por: Yuan, Puzhen, et al.
Publicado: (2025)
por: Yuan, Puzhen, et al.
Publicado: (2025)
Dex1B: Learning with 1B Demonstrations for Dexterous Manipulation
por: Ye, Jianglong, et al.
Publicado: (2025)
por: Ye, Jianglong, et al.
Publicado: (2025)
Deep Research as Rubric for Reinforcement Learning
por: Mei, Wangyi, et al.
Publicado: (2026)
por: Mei, Wangyi, et al.
Publicado: (2026)
Musketeer: Joint Training for Multi-task Vision Language Model with Task Explanation Prompts
por: Zhang, Zhaoyang, et al.
Publicado: (2023)
por: Zhang, Zhaoyang, et al.
Publicado: (2023)
Beyond Isolated Dots: Benchmarking Structured Table Construction as Deep Knowledge Extraction
por: Zhong, Tianyun, et al.
Publicado: (2025)
por: Zhong, Tianyun, et al.
Publicado: (2025)
An Interactive Paradigm for Deep Research
por: Ai, Lin, et al.
Publicado: (2026)
por: Ai, Lin, et al.
Publicado: (2026)
A Systematic Study of Compositional Syntactic Transformer Language Models
por: Zhao, Yida, et al.
Publicado: (2025)
por: Zhao, Yida, et al.
Publicado: (2025)
Deep Researcher with Test-Time Diffusion
por: Han, Rujun, et al.
Publicado: (2025)
por: Han, Rujun, et al.
Publicado: (2025)
Survey of Design Paradigms for Social Robots
por: Frieske, Rita, et al.
Publicado: (2024)
por: Frieske, Rita, et al.
Publicado: (2024)
OccuBench: Evaluating AI Agents on Real-World Professional Tasks via Language Environment Simulation
por: Hu, Xiaomeng, et al.
Publicado: (2026)
por: Hu, Xiaomeng, et al.
Publicado: (2026)
Beyond Passive Critical Thinking: Fostering Proactive Questioning to Enhance Human-AI Collaboration
por: Wang, Ante, et al.
Publicado: (2025)
por: Wang, Ante, et al.
Publicado: (2025)
DocKD: Knowledge Distillation from LLMs for Open-World Document Understanding Models
por: Kim, Sungnyun, et al.
Publicado: (2024)
por: Kim, Sungnyun, et al.
Publicado: (2024)
Ejemplares similares
-
M3: 3D-Spatial MultiModal Memory
por: Zou, Xueyan, et al.
Publicado: (2025) -
NaVILA: Legged Robot Vision-Language-Action Model for Navigation
por: Cheng, An-Chieh, et al.
Publicado: (2024) -
HOIDiffusion: Generating Realistic 3D Hand-Object Interaction Data
por: Zhang, Mengqi, et al.
Publicado: (2024) -
Interfacing Foundation Models' Embeddings
por: Zou, Xueyan, et al.
Publicado: (2023) -
Characterizing Learning Curves During Language Model Pre-Training: Learning, Forgetting, and Stability
por: Chang, Tyler A., et al.
Publicado: (2023)