SCARV: Structure-Constrained Aggregation for Stable Sample Ranking in Redundant NLP Datasets
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zheng, Xu, Wu, Feiyu, Wu, Linhong, Wang, Zhuocheng, Li, Hui |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Beyond Catalogue Counts: the Dataset Visibility Asymmetry in Low-Resource Multilingual NLP
par: Tan, Zhiyin, et autres
Publié: (2026)
par: Tan, Zhiyin, et autres
Publié: (2026)
LLM-RankFusion: Mitigating Intrinsic Inconsistency in LLM-based Ranking
par: Zeng, Yifan, et autres
Publié: (2024)
par: Zeng, Yifan, et autres
Publié: (2024)
OnePiece: Bringing Context Engineering and Reasoning to Industrial Cascade Ranking System
par: Dai, Sunhao, et autres
Publié: (2025)
par: Dai, Sunhao, et autres
Publié: (2025)
ScrapeGraphAI-100k: Dataset for Schema-Constrained LLM Generation
par: Brach, William, et autres
Publié: (2026)
par: Brach, William, et autres
Publié: (2026)
ScIRGen: Synthesize Realistic and Large-Scale RAG Dataset for Scientific Research
par: Lin, Junyong, et autres
Publié: (2025)
par: Lin, Junyong, et autres
Publié: (2025)
Explainable LLM-driven Multi-dimensional Distillation for E-Commerce Relevance Learning
par: Zhao, Gang, et autres
Publié: (2024)
par: Zhao, Gang, et autres
Publié: (2024)
AdaGReS:Adaptive Greedy Context Selection via Redundancy-Aware Scoring for Token-Budgeted RAG
par: Peng, Chao, et autres
Publié: (2025)
par: Peng, Chao, et autres
Publié: (2025)
RGAlign-Rec: Ranking-Guided Alignment for Latent Query Reasoning in Recommendation Systems
par: Liu, Junhua, et autres
Publié: (2026)
par: Liu, Junhua, et autres
Publié: (2026)
Structure-R1: Dynamically Leveraging Structural Knowledge in LLM Reasoning through Reinforcement Learning
par: Wu, Junlin, et autres
Publié: (2025)
par: Wu, Junlin, et autres
Publié: (2025)
RaFe: Ranking Feedback Improves Query Rewriting for RAG
par: Mao, Shengyu, et autres
Publié: (2024)
par: Mao, Shengyu, et autres
Publié: (2024)
Paper2SysArch: Structure-Constrained System Architecture Generation from Scientific Papers
par: Guo, Ziyi, et autres
Publié: (2025)
par: Guo, Ziyi, et autres
Publié: (2025)
Context Retrieval via Normalized Contextual Latent Interaction for Conversational Agent
par: Liu, Junfeng, et autres
Publié: (2023)
par: Liu, Junfeng, et autres
Publié: (2023)
Evaluating Structured Decoding for Text-to-Table Generation: Evidence from Three Datasets
par: Oestreich, Julian, et autres
Publié: (2025)
par: Oestreich, Julian, et autres
Publié: (2025)
Structured Attention Matters to Multimodal LLMs in Document Understanding
par: Liu, Chang, et autres
Publié: (2025)
par: Liu, Chang, et autres
Publié: (2025)
The Whole is Better than the Sum: Using Aggregated Demonstrations in In-Context Learning for Sequential Recommendation
par: Wang, Lei, et autres
Publié: (2024)
par: Wang, Lei, et autres
Publié: (2024)
EXCLAIM: An Explainable Cross-Modal Agentic System for Misinformation Detection with Hierarchical Retrieval
par: Wu, Yin, et autres
Publié: (2025)
par: Wu, Yin, et autres
Publié: (2025)
Toward General Semantic Chunking: A Discriminative Framework for Ultra-Long Documents
par: Wu, Kaifeng, et autres
Publié: (2025)
par: Wu, Kaifeng, et autres
Publié: (2025)
Controlling Output Rankings in Generative Engines for LLM-based Search
par: Jin, Haibo, et autres
Publié: (2026)
par: Jin, Haibo, et autres
Publié: (2026)
Are LLMs Reliable Rankers? Rank Manipulation via Two-Stage Token Optimization
par: Xing, Tiancheng, et autres
Publié: (2025)
par: Xing, Tiancheng, et autres
Publié: (2025)
DoTA-RAG: Dynamic of Thought Aggregation RAG
par: Ruangtanusak, Saksorn, et autres
Publié: (2025)
par: Ruangtanusak, Saksorn, et autres
Publié: (2025)
StepSearch: Igniting LLMs Search Ability via Step-Wise Proximal Policy Optimization
par: Wang, Ziliang, et autres
Publié: (2025)
par: Wang, Ziliang, et autres
Publié: (2025)
MARA: A Multimodal Adaptive Retrieval-Augmented Framework for Document Question Answering
par: Wu, Hui, et autres
Publié: (2026)
par: Wu, Hui, et autres
Publié: (2026)
E2Rank: Your Text Embedding can Also be an Effective and Efficient Listwise Reranker
par: Liu, Qi, et autres
Publié: (2025)
par: Liu, Qi, et autres
Publié: (2025)
Rethinking the Necessity of Adaptive Retrieval-Augmented Generation through the Lens of Adaptive Listwise Ranking
par: Feng, Jun, et autres
Publié: (2026)
par: Feng, Jun, et autres
Publié: (2026)
FineTuneBench: How well do commercial fine-tuning APIs infuse knowledge into LLMs?
par: Wu, Eric, et autres
Publié: (2024)
par: Wu, Eric, et autres
Publié: (2024)
Scientific Paper Retrieval with LLM-Guided Semantic-Based Ranking
par: Zhang, Yunyi, et autres
Publié: (2025)
par: Zhang, Yunyi, et autres
Publié: (2025)
Multimodal Quantitative Language for Generative Recommendation
par: Zhai, Jianyang, et autres
Publié: (2025)
par: Zhai, Jianyang, et autres
Publié: (2025)
Advancing Event Causality Identification via Heuristic Semantic Dependency Inquiry Network
par: Li, Haoran, et autres
Publié: (2024)
par: Li, Haoran, et autres
Publié: (2024)
BeLink: Biomedical Entity Linking Meets Generative Re-Ranking
par: Shlyk, Darya, et autres
Publié: (2026)
par: Shlyk, Darya, et autres
Publié: (2026)
Towards Fair RAG: On the Impact of Fair Ranking in Retrieval-Augmented Generation
par: Kim, To Eun, et autres
Publié: (2024)
par: Kim, To Eun, et autres
Publié: (2024)
Quantifying Divergence in Inter-LLM Communication Through API Retrieval and Ranking
par: Al-Masri, Eyhab
Publié: (2026)
par: Al-Masri, Eyhab
Publié: (2026)
Erase to Improve: Erasable Reinforcement Learning for Search-Augmented LLMs
par: Wang, Ziliang, et autres
Publié: (2025)
par: Wang, Ziliang, et autres
Publié: (2025)
What Drives Cross-lingual Ranking? Retrieval Approaches with Multilingual Language Models
par: Goworek, Roksana, et autres
Publié: (2025)
par: Goworek, Roksana, et autres
Publié: (2025)
Optimizing RAG Rerankers with LLM Feedback via Reinforcement Learning
par: Wu, Yuhang, et autres
Publié: (2026)
par: Wu, Yuhang, et autres
Publié: (2026)
SCP-116K: A High-Quality Problem-Solution Dataset and a Generalized Pipeline for Automated Extraction in the Higher Education Science Domain
par: Lu, Dakuan, et autres
Publié: (2025)
par: Lu, Dakuan, et autres
Publié: (2025)
LLM-MedQA: Enhancing Medical Question Answering through Case Studies in Large Language Models
par: Yang, Hang, et autres
Publié: (2024)
par: Yang, Hang, et autres
Publié: (2024)
PerLTQA: A Personal Long-Term Memory Dataset for Memory Classification, Retrieval, and Synthesis in Question Answering
par: Du, Yiming, et autres
Publié: (2024)
par: Du, Yiming, et autres
Publié: (2024)
When Large Language Models Meet Personalization: Perspectives of Challenges and Opportunities
par: Chen, Jin, et autres
Publié: (2023)
par: Chen, Jin, et autres
Publié: (2023)
OAEI-LLM: A Benchmark Dataset for Understanding Large Language Model Hallucinations in Ontology Matching
par: Qiang, Zhangcheng, et autres
Publié: (2024)
par: Qiang, Zhangcheng, et autres
Publié: (2024)
Doc2SAR: A Synergistic Framework for High-Fidelity Extraction of Structure-Activity Relationships from Scientific Documents
par: Zhuang, Jiaxi, et autres
Publié: (2025)
par: Zhuang, Jiaxi, et autres
Publié: (2025)
Documents similaires
-
Beyond Catalogue Counts: the Dataset Visibility Asymmetry in Low-Resource Multilingual NLP
par: Tan, Zhiyin, et autres
Publié: (2026) -
LLM-RankFusion: Mitigating Intrinsic Inconsistency in LLM-based Ranking
par: Zeng, Yifan, et autres
Publié: (2024) -
OnePiece: Bringing Context Engineering and Reasoning to Industrial Cascade Ranking System
par: Dai, Sunhao, et autres
Publié: (2025) -
ScrapeGraphAI-100k: Dataset for Schema-Constrained LLM Generation
par: Brach, William, et autres
Publié: (2026) -
ScIRGen: Synthesize Realistic and Large-Scale RAG Dataset for Scientific Research
par: Lin, Junyong, et autres
Publié: (2025)