Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Jinzheng, Ju, Sibo, Su, Yanzhou, Li, Hongguang, Shen, Yiqing |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
An Agent Framework for Real-Time Financial Information Searching with Large Language Models
by: Li, Jinzheng, et al.
Published: (2024)
by: Li, Jinzheng, et al.
Published: (2024)
Reinforcement Fine-Tuning for Reasoning towards Multi-Step Multi-Source Search in Large Language Models
by: Shi, Wentao, et al.
Published: (2025)
by: Shi, Wentao, et al.
Published: (2025)
FinSphere, a Real-Time Stock Analysis Agent Powered by Instruction-Tuned LLMs and Domain Tools
by: Han, Shijie, et al.
Published: (2025)
by: Han, Shijie, et al.
Published: (2025)
Formalizing Multimedia Recommendation through Multimodal Deep Learning
by: Malitesta, Daniele, et al.
Published: (2023)
by: Malitesta, Daniele, et al.
Published: (2023)
ReasonEmbed: Enhanced Text Embeddings for Reasoning-Intensive Document Retrieval
by: Chen, Jianlyu, et al.
Published: (2025)
by: Chen, Jianlyu, et al.
Published: (2025)
TongSearch-QR: Reinforced Query Reasoning for Retrieval
by: Qin, Xubo, et al.
Published: (2025)
by: Qin, Xubo, et al.
Published: (2025)
R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning
by: Song, Huatong, et al.
Published: (2025)
by: Song, Huatong, et al.
Published: (2025)
RAG-R1: Incentivizing the Search and Reasoning Capabilities of LLMs through Multi-query Parallelism
by: Tan, Zhiwen, et al.
Published: (2025)
by: Tan, Zhiwen, et al.
Published: (2025)
Agentic Conversational Search with Contextualized Reasoning via Reinforcement Learning
by: Mo, Fengran, et al.
Published: (2026)
by: Mo, Fengran, et al.
Published: (2026)
Retro*: Optimizing LLMs for Reasoning-Intensive Document Retrieval
by: Lan, Junwei, et al.
Published: (2025)
by: Lan, Junwei, et al.
Published: (2025)
Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning
by: Jin, Bowen, et al.
Published: (2025)
by: Jin, Bowen, et al.
Published: (2025)
ConvSearch-R1: Enhancing Query Reformulation for Conversational Search with Reasoning via Reinforcement Learning
by: Zhu, Changtai, et al.
Published: (2025)
by: Zhu, Changtai, et al.
Published: (2025)
ERank: Fusing Supervised Fine-Tuning and Reinforcement Learning for Effective and Efficient Text Reranking
by: Cai, Yuzheng, et al.
Published: (2025)
by: Cai, Yuzheng, et al.
Published: (2025)
Adaptive Retrieval for Reasoning-Intensive Retrieval
by: Kim, Jongho, et al.
Published: (2026)
by: Kim, Jongho, et al.
Published: (2026)
LLM-guided Hierarchical Search for End-to-end Reasoning Intensive Retrieval
by: Gupta, Nilesh, et al.
Published: (2025)
by: Gupta, Nilesh, et al.
Published: (2025)
TabSQLify: Enhancing Reasoning Capabilities of LLMs Through Table Decomposition
by: Nahid, Md Mahadi Hasan, et al.
Published: (2024)
by: Nahid, Md Mahadi Hasan, et al.
Published: (2024)
Unifying Search and Recommendation in LLMs via Gradient Multi-Subspace Tuning
by: Zhao, Jujia, et al.
Published: (2026)
by: Zhao, Jujia, et al.
Published: (2026)
Counterfactual Learning-Driven Representation Disentanglement for Search-Enhanced Recommendation
by: Cui, Jiajun, et al.
Published: (2024)
by: Cui, Jiajun, et al.
Published: (2024)
Reproducing Adaptive Reranking for Reasoning-Intensive IR
by: Rathee, Mandeep, et al.
Published: (2026)
by: Rathee, Mandeep, et al.
Published: (2026)
Rethinking Reasoning-Intensive Retrieval: Evaluating and Advancing Retrievers in Agentic Search Systems
by: Zhao, Yilun, et al.
Published: (2026)
by: Zhao, Yilun, et al.
Published: (2026)
Reason to Retrieve: Enhancing Query Understanding through Decomposition and Interpretation
by: Zhong, Yunfei, et al.
Published: (2025)
by: Zhong, Yunfei, et al.
Published: (2025)
Synthetic Data Powers Product Retrieval for Long-tail Knowledge-Intensive Queries in E-commerce Search
by: Ling, Gui, et al.
Published: (2026)
by: Ling, Gui, et al.
Published: (2026)
Knowledge-aware Diffusion-Enhanced Multimedia Recommendation
by: Mo, Xian, et al.
Published: (2025)
by: Mo, Xian, et al.
Published: (2025)
Bridging Search and Recommendation through Latent Cross Reasoning
by: Shi, Teng, et al.
Published: (2025)
by: Shi, Teng, et al.
Published: (2025)
Enhancing Knowledge Retrieval with In-Context Learning and Semantic Search through Generative AI
by: Ghali, Mohammed-Khalil, et al.
Published: (2024)
by: Ghali, Mohammed-Khalil, et al.
Published: (2024)
Following the TRAIL: Predicting and Explaining Tomorrow's Hits with a Fine-Tuned LLM
by: Zhang, Yinan, et al.
Published: (2026)
by: Zhang, Yinan, et al.
Published: (2026)
SRR-Judge: Step-Level Rating and Refinement for Enhancing Search-Integrated Reasoning in Search Agents
by: Zhang, Chen, et al.
Published: (2026)
by: Zhang, Chen, et al.
Published: (2026)
It is Never Too Late to Mend: Separate Learning for Multimedia Recommendation
by: He, Zhuangzhuang, et al.
Published: (2024)
by: He, Zhuangzhuang, et al.
Published: (2024)
Fine-Tuning Topics through Weighting Aspect Keywords
by: Nazari, Ali, et al.
Published: (2025)
by: Nazari, Ali, et al.
Published: (2025)
Introducing Semantic Capability in LinkedIn's Content Search Engine
by: Yang, Xin, et al.
Published: (2024)
by: Yang, Xin, et al.
Published: (2024)
Towards Context-aware Reasoning-enhanced Generative Searching in E-commerce
by: Liu, Zhiding, et al.
Published: (2025)
by: Liu, Zhiding, et al.
Published: (2025)
From Reasoning LLMs to BERT: A Two-Stage Distillation Framework for Search Relevance
by: Xia, Runze, et al.
Published: (2025)
by: Xia, Runze, et al.
Published: (2025)
MM-BRIGHT: A Multi-Task Multimodal Benchmark for Reasoning-Intensive Retrieval
by: Abdallah, Abdelrahman, et al.
Published: (2026)
by: Abdallah, Abdelrahman, et al.
Published: (2026)
TEMPO: A Realistic Multi-Domain Benchmark for Temporal Reasoning-Intensive Retrieval
by: Abdallah, Abdelrahman, et al.
Published: (2026)
by: Abdallah, Abdelrahman, et al.
Published: (2026)
HIVE: Query, Hypothesize, Verify An LLM Framework for Multimodal Reasoning-Intensive Retrieval
by: Abdalla, Mahmoud, et al.
Published: (2026)
by: Abdalla, Mahmoud, et al.
Published: (2026)
Optimizing Recommendations using Fine-Tuned LLMs
by: Cheema, Prabhdeep, et al.
Published: (2025)
by: Cheema, Prabhdeep, et al.
Published: (2025)
ReRec: Reasoning-Augmented LLM-based Recommendation Assistant via Reinforcement Fine-tuning
by: Huang, Jiani, et al.
Published: (2026)
by: Huang, Jiani, et al.
Published: (2026)
Unified Dual-Intent Translation for Joint Modeling of Search and Recommendation
by: Zhang, Yuting, et al.
Published: (2024)
by: Zhang, Yuting, et al.
Published: (2024)
Beyond Sequential Reranking: Reranker-Guided Search Improves Reasoning Intensive Retrieval
by: Xu, Haike, et al.
Published: (2025)
by: Xu, Haike, et al.
Published: (2025)
How Relevance Emerges: Interpreting LoRA Fine-Tuning in Reranking LLMs
by: Nijasure, Atharva, et al.
Published: (2025)
by: Nijasure, Atharva, et al.
Published: (2025)
Similar Items
-
An Agent Framework for Real-Time Financial Information Searching with Large Language Models
by: Li, Jinzheng, et al.
Published: (2024) -
Reinforcement Fine-Tuning for Reasoning towards Multi-Step Multi-Source Search in Large Language Models
by: Shi, Wentao, et al.
Published: (2025) -
FinSphere, a Real-Time Stock Analysis Agent Powered by Instruction-Tuned LLMs and Domain Tools
by: Han, Shijie, et al.
Published: (2025) -
Formalizing Multimedia Recommendation through Multimodal Deep Learning
by: Malitesta, Daniele, et al.
Published: (2023) -
ReasonEmbed: Enhanced Text Embeddings for Reasoning-Intensive Document Retrieval
by: Chen, Jianlyu, et al.
Published: (2025)