Enhancing Transformer-Based Rerankers with Synthetic Data and LLM-Based Supervision
Fuente:
arXiv
Guardado en:
| Autores principales: | Peshevski, Dimitar, Blazhevski, Kiril, Popovski, Martin, Madjarov, Gjorgji |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
AI Agent-Driven Framework for Automated Product Knowledge Graph Construction in E-Commerce
por: Peshevski, Dimitar, et al.
Publicado: (2025)
por: Peshevski, Dimitar, et al.
Publicado: (2025)
Enhancing Hallucination Detection through Perturbation-Based Synthetic Data Generation in System Responses
por: Zhang, Dongxu, et al.
Publicado: (2024)
por: Zhang, Dongxu, et al.
Publicado: (2024)
Efficiency-Effectiveness Reranking FLOPs for LLM-based Rerankers
por: Peng, Zhiyuan, et al.
Publicado: (2025)
por: Peng, Zhiyuan, et al.
Publicado: (2025)
Building a Macedonian Recipe Dataset: Collection, Parsing, and Comparative Analysis
por: Sasanski, Darko, et al.
Publicado: (2025)
por: Sasanski, Darko, et al.
Publicado: (2025)
Kinship Data Benchmark for Multi-hop Reasoning
por: Sun, Tianda, et al.
Publicado: (2026)
por: Sun, Tianda, et al.
Publicado: (2026)
LLM-Confidence Reranker: A Training-Free Approach for Enhancing Retrieval-Augmented Generation Systems
por: Song, Zhipeng, et al.
Publicado: (2026)
por: Song, Zhipeng, et al.
Publicado: (2026)
TextMineX: Data, Evaluation Framework and Ontology-guided LLM Pipeline for Humanitarian Mine Action
por: Zhou, Chenyue, et al.
Publicado: (2025)
por: Zhou, Chenyue, et al.
Publicado: (2025)
Enhancing LLM-Based Data Annotation with Error Decomposition
por: Xu, Zhen, et al.
Publicado: (2026)
por: Xu, Zhen, et al.
Publicado: (2026)
ChatLang-8: An LLM-Based Synthetic Data Generation Framework for Grammatical Error Correction
por: Park, Jeiyoon, et al.
Publicado: (2024)
por: Park, Jeiyoon, et al.
Publicado: (2024)
GraphGen: Enhancing Supervised Fine-Tuning for LLMs with Knowledge-Driven Synthetic Data Generation
por: Chen, Zihong, et al.
Publicado: (2025)
por: Chen, Zihong, et al.
Publicado: (2025)
CIKMar: A Dual-Encoder Approach to Prompt-Based Reranking in Educational Dialogue Systems
por: Lopo, Joanito Agili, et al.
Publicado: (2024)
por: Lopo, Joanito Agili, et al.
Publicado: (2024)
Repurposing Synthetic Data for Fine-grained Search Agent Supervision
por: Zhao, Yida, et al.
Publicado: (2025)
por: Zhao, Yida, et al.
Publicado: (2025)
SciRerankBench: Benchmarking Rerankers Towards Scientific Retrieval-Augmented Generated LLMs
por: Chen, Haotian, et al.
Publicado: (2025)
por: Chen, Haotian, et al.
Publicado: (2025)
Solving the Content Gap in Roblox Game Recommendations: LLM-Based Profile Generation and Reranking
por: Wang, Chen, et al.
Publicado: (2025)
por: Wang, Chen, et al.
Publicado: (2025)
QCG-Rerank: Chunks Graph Rerank with Query Expansion in Retrieval-Augmented LLMs for Tourism Domain
por: Wei, Qikai, et al.
Publicado: (2024)
por: Wei, Qikai, et al.
Publicado: (2024)
Few-shot LLM Synthetic Data with Distribution Matching
por: Ren, Jiyuan, et al.
Publicado: (2025)
por: Ren, Jiyuan, et al.
Publicado: (2025)
CHIMERA: Compact Synthetic Data for Generalizable LLM Reasoning
por: Zhu, Xinyu, et al.
Publicado: (2026)
por: Zhu, Xinyu, et al.
Publicado: (2026)
SynthEHR-Eviction: Enhancing Eviction SDoH Detection with LLM-Augmented Synthetic EHR Data
por: Yao, Zonghai, et al.
Publicado: (2025)
por: Yao, Zonghai, et al.
Publicado: (2025)
MemRerank: Preference Memory for Personalized Product Reranking
por: Peng, Zhiyuan, et al.
Publicado: (2026)
por: Peng, Zhiyuan, et al.
Publicado: (2026)
Optimizing RAG Rerankers with LLM Feedback via Reinforcement Learning
por: Wu, Yuhang, et al.
Publicado: (2026)
por: Wu, Yuhang, et al.
Publicado: (2026)
Towards the Development of Balanced Synthetic Data for Correcting Grammatical Errors in Arabic: An Approach Based on Error Tagging Model and Synthetic Data Generating Model
por: Alrehili, Ahlam, et al.
Publicado: (2025)
por: Alrehili, Ahlam, et al.
Publicado: (2025)
FinCARDS: Card-Based Analyst Reranking for Financial Document Question Answering
por: Zhou, Yixi, et al.
Publicado: (2026)
por: Zhou, Yixi, et al.
Publicado: (2026)
ViRanker: A BGE-M3 & Blockwise Parallel Transformer Cross-Encoder for Vietnamese Reranking
por: Dang, Phuong-Nam, et al.
Publicado: (2025)
por: Dang, Phuong-Nam, et al.
Publicado: (2025)
CrowdSelect: Synthetic Instruction Data Selection with Multi-LLM Wisdom
por: Li, Yisen, et al.
Publicado: (2025)
por: Li, Yisen, et al.
Publicado: (2025)
AgentQuest: A Modular Benchmark Framework to Measure Progress and Improve LLM Agents
por: Gioacchini, Luca, et al.
Publicado: (2024)
por: Gioacchini, Luca, et al.
Publicado: (2024)
Multimodal Reranking for Knowledge-Intensive Visual Question Answering
por: Wen, Haoyang, et al.
Publicado: (2024)
por: Wen, Haoyang, et al.
Publicado: (2024)
Enhancing Robustness of LLM-Synthetic Text Detectors for Academic Writing: A Comprehensive Analysis
por: Dou, Zhicheng, et al.
Publicado: (2024)
por: Dou, Zhicheng, et al.
Publicado: (2024)
Enhanced Multimodal Aspect-Based Sentiment Analysis by LLM-Generated Rationales
por: Cao, Jun, et al.
Publicado: (2025)
por: Cao, Jun, et al.
Publicado: (2025)
FRIDA to the Rescue! Analyzing Synthetic Data Effectiveness in Object-Based Common Sense Reasoning for Disaster Response
por: Shichman, Mollie, et al.
Publicado: (2025)
por: Shichman, Mollie, et al.
Publicado: (2025)
Utilizing Large Language Models to Generate Synthetic Data to Increase the Performance of BERT-Based Neural Networks
por: Woolsey, Chancellor R., et al.
Publicado: (2024)
por: Woolsey, Chancellor R., et al.
Publicado: (2024)
Token Cleaning: Fine-Grained Data Selection for LLM Supervised Fine-Tuning
por: Pang, Jinlong, et al.
Publicado: (2025)
por: Pang, Jinlong, et al.
Publicado: (2025)
LLM-guided Semi-Supervised Approaches for Social Media Crisis Data Classification
por: Ativo, Jacob, et al.
Publicado: (2026)
por: Ativo, Jacob, et al.
Publicado: (2026)
Insight Agents: An LLM-Based Multi-Agent System for Data Insights
por: Bai, Jincheng, et al.
Publicado: (2026)
por: Bai, Jincheng, et al.
Publicado: (2026)
MEDSAGE: Enhancing Robustness of Medical Dialogue Summarization to ASR Errors with LLM-generated Synthetic Dialogues
por: Binici, Kuluhan, et al.
Publicado: (2024)
por: Binici, Kuluhan, et al.
Publicado: (2024)
An LLM-Based Approach for Insight Generation in Data Analysis
por: Pérez, Alberto Sánchez, et al.
Publicado: (2025)
por: Pérez, Alberto Sánchez, et al.
Publicado: (2025)
Persona-Based Synthetic Data Generation Using Multi-Stage Conditioning with Large Language Models for Emotion Recognition
por: Inoshita, Keito, et al.
Publicado: (2025)
por: Inoshita, Keito, et al.
Publicado: (2025)
Enhancing Document-Level Machine Translation via Filtered Synthetic Corpora and Two-Stage LLM Adaptation
por: Kim, Ireh, et al.
Publicado: (2026)
por: Kim, Ireh, et al.
Publicado: (2026)
An Enhanced Prompt-Based LLM Reasoning Scheme via Knowledge Graph-Integrated Collaboration
por: Li, Yihao, et al.
Publicado: (2024)
por: Li, Yihao, et al.
Publicado: (2024)
CAR: Query-Guided Confidence-Aware Reranking for Retrieval-Augmented Generation
por: Song, Zhipeng, et al.
Publicado: (2026)
por: Song, Zhipeng, et al.
Publicado: (2026)
JudgeRank: Leveraging Large Language Models for Reasoning-Intensive Reranking
por: Niu, Tong, et al.
Publicado: (2024)
por: Niu, Tong, et al.
Publicado: (2024)
Ejemplares similares
-
AI Agent-Driven Framework for Automated Product Knowledge Graph Construction in E-Commerce
por: Peshevski, Dimitar, et al.
Publicado: (2025) -
Enhancing Hallucination Detection through Perturbation-Based Synthetic Data Generation in System Responses
por: Zhang, Dongxu, et al.
Publicado: (2024) -
Efficiency-Effectiveness Reranking FLOPs for LLM-based Rerankers
por: Peng, Zhiyuan, et al.
Publicado: (2025) -
Building a Macedonian Recipe Dataset: Collection, Parsing, and Comparative Analysis
por: Sasanski, Darko, et al.
Publicado: (2025) -
Kinship Data Benchmark for Multi-hop Reasoning
por: Sun, Tianda, et al.
Publicado: (2026)