A comparative analysis of embedding models for patent similarity
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ascione, Grazia Sveva, Sterzi, Valerio |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Presenting Terrorizer: an algorithm for consolidating company names in patent assignees
par: Ascione, Grazia Sveva, et autres
Publié: (2024)
par: Ascione, Grazia Sveva, et autres
Publié: (2024)
From scratch to silver: Creating trustworthy training data for patent-SDG classification using Large Language Models
par: Ascione, Grazia Sveva, et autres
Publié: (2025)
par: Ascione, Grazia Sveva, et autres
Publié: (2025)
Benchmarking pre-trained text embedding models in aligning built asset information
par: Shahinmoghadam, Mehrzad, et autres
Publié: (2024)
par: Shahinmoghadam, Mehrzad, et autres
Publié: (2024)
A comparison of latent semantic analysis and correspondence analysis of document-term matrices
par: Qi, Qianqian, et autres
Publié: (2021)
par: Qi, Qianqian, et autres
Publié: (2021)
KGLink: A column type annotation method that combines knowledge graph and pre-trained language model
par: Wang, Yubo, et autres
Publié: (2024)
par: Wang, Yubo, et autres
Publié: (2024)
ELIXIR: Efficient and LIghtweight model for eXplaIning Recommendations
par: Kabongo, Ben, et autres
Publié: (2025)
par: Kabongo, Ben, et autres
Publié: (2025)
Large language model as user daily behavior data generator: balancing population diversity and individual personality
par: Li, Haoxin, et autres
Publié: (2025)
par: Li, Haoxin, et autres
Publié: (2025)
Challenges and Considerations in Annotating Legal Data: A Comprehensive Overview
par: Darji, Harshil, et autres
Publié: (2024)
par: Darji, Harshil, et autres
Publié: (2024)
A Trio Neural Model for Dynamic Entity Relatedness Ranking
par: Nguyen, Tu, et autres
Publié: (2018)
par: Nguyen, Tu, et autres
Publié: (2018)
Revisit and Outstrip Entity Alignment: A Perspective of Generative Models
par: Guo, Lingbing, et autres
Publié: (2023)
par: Guo, Lingbing, et autres
Publié: (2023)
A Benchmark Suite of Reddit-Derived Datasets for Mental Health Detection
par: Hasan, Khalid, et autres
Publié: (2026)
par: Hasan, Khalid, et autres
Publié: (2026)
mmBERT: A Modern Multilingual Encoder with Annealed Language Learning
par: Marone, Marc, et autres
Publié: (2025)
par: Marone, Marc, et autres
Publié: (2025)
LTR-ICD: A Learning-to-Rank Approach for Automatic ICD Coding
par: Mansoori, Mohammad, et autres
Publié: (2025)
par: Mansoori, Mohammad, et autres
Publié: (2025)
A Platform for Investigating Public Health Content with Efficient Concern Classification
par: Li, Christopher, et autres
Publié: (2025)
par: Li, Christopher, et autres
Publié: (2025)
GraphEx: A Graph-based Extraction Method for Advertiser Keyphrase Recommendation
par: Mishra, Ashirbad, et autres
Publié: (2024)
par: Mishra, Ashirbad, et autres
Publié: (2024)
Concept Drift Adaptation in Text Stream Mining Settings: A Systematic Review
par: Garcia, Cristiano Mesquita, et autres
Publié: (2023)
par: Garcia, Cristiano Mesquita, et autres
Publié: (2023)
Lightweight Query Routing for Adaptive RAG: A Baseline Study on RAGRouter-Bench
par: Bansal, Prakhar, et autres
Publié: (2026)
par: Bansal, Prakhar, et autres
Publié: (2026)
LegalRAG: A Hybrid RAG System for Multilingual Legal Information Retrieval
par: Kabir, Muhammad Rafsan, et autres
Publié: (2025)
par: Kabir, Muhammad Rafsan, et autres
Publié: (2025)
Complete Evidence Extraction with Model Ensembles: A Case Study on Medical Coding
par: Beckh, Katharina, et autres
Publié: (2025)
par: Beckh, Katharina, et autres
Publié: (2025)
LaMP-QA: A Benchmark for Personalized Long-form Question Answering
par: Salemi, Alireza, et autres
Publié: (2025)
par: Salemi, Alireza, et autres
Publié: (2025)
Dynamic-KGQA: A Scalable Framework for Generating Adaptive Question Answering Datasets
par: Dammu, Preetam Prabhu Srikar, et autres
Publié: (2025)
par: Dammu, Preetam Prabhu Srikar, et autres
Publié: (2025)
SQaLe: A Large Text-to-SQL Corpus Grounded in Real Schemas
par: Wolff, Cornelius, et autres
Publié: (2025)
par: Wolff, Cornelius, et autres
Publié: (2025)
Atomic Information Flow: A Network Flow Model for Tool Attributions in RAG Systems
par: Gao, James, et autres
Publié: (2026)
par: Gao, James, et autres
Publié: (2026)
What's happening in your neighborhood? A Weakly Supervised Approach to Detect Local News
par: Shah, Deven Santosh, et autres
Publié: (2023)
par: Shah, Deven Santosh, et autres
Publié: (2023)
How do Large Language Models Understand Relevance? A Mechanistic Interpretability Perspective
par: Liu, Qi, et autres
Publié: (2025)
par: Liu, Qi, et autres
Publié: (2025)
A Language-Driven Framework for Improving Personalized Recommendations: Merging LLMs with Traditional Algorithms
par: Goldstein, Aaron, et autres
Publié: (2025)
par: Goldstein, Aaron, et autres
Publié: (2025)
Towards Realistic Synthetic User-Generated Content: A Scaffolding Approach to Generating Online Discussions
par: Balog, Krisztian, et autres
Publié: (2024)
par: Balog, Krisztian, et autres
Publié: (2024)
S2 Chunking: A Hybrid Framework for Document Segmentation Through Integrated Spatial and Semantic Analysis
par: Verma, Prashant
Publié: (2025)
par: Verma, Prashant
Publié: (2025)
A Dynamic Framework for Semantic Grouping of Common Data Elements (CDE) Using Embeddings and Clustering
par: Krishnamurthy, Madan, et autres
Publié: (2025)
par: Krishnamurthy, Madan, et autres
Publié: (2025)
A Breadth-First Catalog of Text Processing, Speech Processing and Multimodal Research in South Asian Languages
par: Gupta, Pranav
Publié: (2024)
par: Gupta, Pranav
Publié: (2024)
Enhancing Q&A Text Retrieval with Ranking Models: Benchmarking, fine-tuning and deploying Rerankers for RAG
par: Moreira, Gabriel de Souza P., et autres
Publié: (2024)
par: Moreira, Gabriel de Souza P., et autres
Publié: (2024)
NANOGPT: A Query-Driven Large Language Model Retrieval-Augmented Generation System for Nanotechnology Research
par: Chandrasekhar, Achuth, et autres
Publié: (2025)
par: Chandrasekhar, Achuth, et autres
Publié: (2025)
Do Recommender Systems Really Leverage Multimodal Content? A Comprehensive Analysis on Multimodal Representations for Recommendation
par: Pomo, Claudio, et autres
Publié: (2025)
par: Pomo, Claudio, et autres
Publié: (2025)
NLP-Powered Repository and Search Engine for Academic Papers: A Case Study on Cyber Risk Literature with CyLit
par: Zhang, Linfeng, et autres
Publié: (2024)
par: Zhang, Linfeng, et autres
Publié: (2024)
M3: A Multi-Task Mixed-Objective Learning Framework for Open-Domain Multi-Hop Dense Sentence Retrieval
par: Bai, Yang, et autres
Publié: (2024)
par: Bai, Yang, et autres
Publié: (2024)
PashtoCorp: A 1.25-Billion-Word Corpus, Evaluation Suite, and Reproducible Pipeline for Low-Resource Language Development
par: Rahman, Hanif
Publié: (2026)
par: Rahman, Hanif
Publié: (2026)
Combining topic modelling and citation network analysis to study case law from the European Court on Human Rights on the right to respect for private and family life
par: Mohammadi, M., et autres
Publié: (2024)
par: Mohammadi, M., et autres
Publié: (2024)
SLMRec: Distilling Large Language Models into Small for Sequential Recommendation
par: Xu, Wujiang, et autres
Publié: (2024)
par: Xu, Wujiang, et autres
Publié: (2024)
SetCSE: Set Operations using Contrastive Learning of Sentence Embeddings
par: Liu, Kang
Publié: (2024)
par: Liu, Kang
Publié: (2024)
ConvKGYarn: Spinning Configurable and Scalable Conversational Knowledge Graph QA datasets with Large Language Models
par: Pradeep, Ronak, et autres
Publié: (2024)
par: Pradeep, Ronak, et autres
Publié: (2024)
Documents similaires
-
Presenting Terrorizer: an algorithm for consolidating company names in patent assignees
par: Ascione, Grazia Sveva, et autres
Publié: (2024) -
From scratch to silver: Creating trustworthy training data for patent-SDG classification using Large Language Models
par: Ascione, Grazia Sveva, et autres
Publié: (2025) -
Benchmarking pre-trained text embedding models in aligning built asset information
par: Shahinmoghadam, Mehrzad, et autres
Publié: (2024) -
A comparison of latent semantic analysis and correspondence analysis of document-term matrices
par: Qi, Qianqian, et autres
Publié: (2021) -
KGLink: A column type annotation method that combines knowledge graph and pre-trained language model
par: Wang, Yubo, et autres
Publié: (2024)