Revisiting a Pain in the Neck: Semantic Phrase Processing Benchmark for Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Yang, Qin, Melissa Xiaohui, Li, Hongming, Huang, Chao |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Study on Bias Detection and Classification in Natural Language Processing
par: Evans, Ana Sofia, et autres
Publié: (2024)
par: Evans, Ana Sofia, et autres
Publié: (2024)
Multi-chain Graph Refinement and Selection for Reliable Reasoning in Large Language Models
par: Yang, Yujiao, et autres
Publié: (2025)
par: Yang, Yujiao, et autres
Publié: (2025)
CLMN: Concept based Language Models via Neural Symbolic Reasoning
par: Yang, Yibo
Publié: (2025)
par: Yang, Yibo
Publié: (2025)
Topeax -- An Improved Clustering Topic Model with Density Peak Detection and Lexical-Semantic Term Importance
par: Kardos, Márton
Publié: (2026)
par: Kardos, Márton
Publié: (2026)
Decouple Searching from Training: Scaling Data Mixing via Model Merging for Large Language Model Pre-training
par: Li, Shengrui, et autres
Publié: (2026)
par: Li, Shengrui, et autres
Publié: (2026)
LayerTracer: A Joint Task-Particle and Vulnerable-Layer Analysis framework for Arbitrary Large Language Model Architectures
par: Wu, Yuhang, et autres
Publié: (2026)
par: Wu, Yuhang, et autres
Publié: (2026)
DYNAMICQA: Tracing Internal Knowledge Conflicts in Language Models
par: Marjanović, Sara Vera, et autres
Publié: (2024)
par: Marjanović, Sara Vera, et autres
Publié: (2024)
A Comprehensive Survey of Compression Algorithms for Language Models
par: Park, Seungcheol, et autres
Publié: (2024)
par: Park, Seungcheol, et autres
Publié: (2024)
Give it Space! Explicit Disentangling of Positional and Semantic Representations in Encoders
par: Lequeu, Pierre-Antoine, et autres
Publié: (2026)
par: Lequeu, Pierre-Antoine, et autres
Publié: (2026)
Raw Text is All you Need: Knowledge-intensive Multi-turn Instruction Tuning for Large Language Model
par: Hou, Xia, et autres
Publié: (2024)
par: Hou, Xia, et autres
Publié: (2024)
The Impact of Role Design in In-Context Learning for Large Language Models
par: Rouzegar, Hamidreza, et autres
Publié: (2025)
par: Rouzegar, Hamidreza, et autres
Publié: (2025)
Revealing the Parametric Knowledge of Language Models: A Unified Framework for Attribution Methods
par: Yu, Haeun, et autres
Publié: (2024)
par: Yu, Haeun, et autres
Publié: (2024)
Efficient Adaptive Rejection Sampling for Accelerating Speculative Decoding in Large Language Models
par: Sun, Chendong, et autres
Publié: (2025)
par: Sun, Chendong, et autres
Publié: (2025)
MORABLES: A Benchmark for Assessing Abstract Moral Reasoning in LLMs with Fables
par: Marcuzzo, Matteo, et autres
Publié: (2025)
par: Marcuzzo, Matteo, et autres
Publié: (2025)
Semantic Synergy: Unlocking Policy Insights and Learning Pathways Through Advanced Skill Mapping
par: Koundouri, Phoebe, et autres
Publié: (2025)
par: Koundouri, Phoebe, et autres
Publié: (2025)
ADE: Adaptive Dictionary Embeddings -- Scaling Multi-Anchor Representations to Large Language Models
par: Demirci, Orhan, et autres
Publié: (2026)
par: Demirci, Orhan, et autres
Publié: (2026)
Large Language Models Report Subjective Experience Under Self-Referential Processing
par: Berg, Cameron, et autres
Publié: (2025)
par: Berg, Cameron, et autres
Publié: (2025)
Model Misalignment and Language Change: Traces of AI-Associated Language in Unscripted Spoken English
par: Anderson, Bryce, et autres
Publié: (2025)
par: Anderson, Bryce, et autres
Publié: (2025)
ExpliCa: Evaluating Explicit Causal Reasoning in Large Language Models
par: Miliani, Martina, et autres
Publié: (2025)
par: Miliani, Martina, et autres
Publié: (2025)
Language corpora for the Dutch medical domain
par: van Es, B.
Publié: (2026)
par: van Es, B.
Publié: (2026)
ToxiFrench: Benchmarking and Enhancing Language Models via CoT Fine-Tuning for French Toxicity Detection
par: Delaval, Axel, et autres
Publié: (2025)
par: Delaval, Axel, et autres
Publié: (2025)
A Knowledge Enhanced Learning and Semantic Composition Model for Multi-Claim Fact Checking
par: Wang, Shuai, et autres
Publié: (2021)
par: Wang, Shuai, et autres
Publié: (2021)
Task Complexity Matters: An Empirical Study of Reasoning in LLMs for Sentiment Analysis
par: Huang, Donghao, et autres
Publié: (2026)
par: Huang, Donghao, et autres
Publié: (2026)
UnifiedCrawl: Aggregated Common Crawl for Affordable Adaptation of LLMs on Low-Resource Languages
par: Tessema, Bethel Melesse, et autres
Publié: (2024)
par: Tessema, Bethel Melesse, et autres
Publié: (2024)
Empowering Tabular Data Preparation with Language Models: Why and How?
par: Chen, Mengshi, et autres
Publié: (2025)
par: Chen, Mengshi, et autres
Publié: (2025)
S2vNTM: Semi-supervised vMF Neural Topic Modeling
par: Xu, Weijie, et autres
Publié: (2023)
par: Xu, Weijie, et autres
Publié: (2023)
Omni-SafetyBench: A Benchmark for Safety Evaluation of Audio-Visual Large Language Models
par: Pan, Leyi, et autres
Publié: (2025)
par: Pan, Leyi, et autres
Publié: (2025)
Multi-Model Synthetic Training for Mission-Critical Small Language Models
par: Platt, Nolan, et autres
Publié: (2025)
par: Platt, Nolan, et autres
Publié: (2025)
ProSwitch: Knowledge-Guided Instruction Tuning to Switch Between Professional and Non-Professional Responses
par: Zong, Chang, et autres
Publié: (2024)
par: Zong, Chang, et autres
Publié: (2024)
Triad: A Framework Leveraging a Multi-Role LLM-based Agent to Solve Knowledge Base Question Answering
par: Zong, Chang, et autres
Publié: (2024)
par: Zong, Chang, et autres
Publié: (2024)
Lightweight Transformers for Clinical Natural Language Processing
par: Rohanian, Omid, et autres
Publié: (2023)
par: Rohanian, Omid, et autres
Publié: (2023)
Learning When to Think: Shaping Adaptive Reasoning in R1-Style Models via Multi-Stage RL
par: Tu, Songjun, et autres
Publié: (2025)
par: Tu, Songjun, et autres
Publié: (2025)
Copyright Detection in Large Language Models: An Ethical Approach to Generative AI Development
par: Szczecina, David, et autres
Publié: (2025)
par: Szczecina, David, et autres
Publié: (2025)
HR-MultiWOZ: A Task Oriented Dialogue (TOD) Dataset for HR LLM Agent
par: Xu, Weijie, et autres
Publié: (2024)
par: Xu, Weijie, et autres
Publié: (2024)
Exploring the Effectiveness of Instruction Tuning in Biomedical Language Processing
par: Rohanian, Omid, et autres
Publié: (2023)
par: Rohanian, Omid, et autres
Publié: (2023)
TRUE: A Trustworthy Unified Explanation Framework for Large Language Model Reasoning
par: Yang, Yujiao
Publié: (2026)
par: Yang, Yujiao
Publié: (2026)
Generative AI for Research Data Processing: Lessons Learnt From Three Use Cases
par: Mitra, Modhurita, et autres
Publié: (2025)
par: Mitra, Modhurita, et autres
Publié: (2025)
An NLP-Driven Framework for Curriculum-Labor Market Alignment: Schema-Constrained LLM Extraction, ESCO-Anchored Semantic Matching, and Multi-Dimensional Gap Quantification
par: Turaev, Sherzod, et autres
Publié: (2026)
par: Turaev, Sherzod, et autres
Publié: (2026)
Prompting Encoder Models for Zero-Shot Classification: A Cross-Domain Study in Italian
par: Auriemma, Serena, et autres
Publié: (2024)
par: Auriemma, Serena, et autres
Publié: (2024)
LAraBench: Benchmarking Arabic AI with Large Language Models
par: Abdelali, Ahmed, et autres
Publié: (2023)
par: Abdelali, Ahmed, et autres
Publié: (2023)
Documents similaires
-
A Study on Bias Detection and Classification in Natural Language Processing
par: Evans, Ana Sofia, et autres
Publié: (2024) -
Multi-chain Graph Refinement and Selection for Reliable Reasoning in Large Language Models
par: Yang, Yujiao, et autres
Publié: (2025) -
CLMN: Concept based Language Models via Neural Symbolic Reasoning
par: Yang, Yibo
Publié: (2025) -
Topeax -- An Improved Clustering Topic Model with Density Peak Detection and Lexical-Semantic Term Importance
par: Kardos, Márton
Publié: (2026) -
Decouple Searching from Training: Scaling Data Mixing via Model Merging for Large Language Model Pre-training
par: Li, Shengrui, et autres
Publié: (2026)