SMCLM: Semantically Meaningful Causal Language Modeling for Autoregressive Paraphrase Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Perełkiewicz, Michał, Dadas, Sławomir, Poświata, Rafał |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PL-MTEB: Polish Massive Text Embedding Benchmark
par: Poświata, Rafał, et autres
Publié: (2024)
par: Poświata, Rafał, et autres
Publié: (2024)
PIRB: A Comprehensive Benchmark of Polish Dense and Hybrid Text Retrieval Methods
par: Dadas, Sławomir, et autres
Publié: (2024)
par: Dadas, Sławomir, et autres
Publié: (2024)
Evaluating Polish linguistic and cultural competency in large language models
par: Dadas, Sławomir, et autres
Publié: (2025)
par: Dadas, Sławomir, et autres
Publié: (2025)
Unveiling Dual Quality in Product Reviews: An NLP-Based Approach
par: Poświata, Rafał, et autres
Publié: (2025)
par: Poświata, Rafał, et autres
Publié: (2025)
A Review of the Challenges with Massive Web-mined Corpora Used in Large Language Models Pre-Training
par: Perełkiewicz, Michał, et autres
Publié: (2024)
par: Perełkiewicz, Michał, et autres
Publié: (2024)
Long-Context Encoder Models for Polish Language Understanding
par: Dadas, Sławomir, et autres
Publié: (2026)
par: Dadas, Sławomir, et autres
Publié: (2026)
Assessing generalization capability of text ranking models in Polish
par: Dadas, Sławomir, et autres
Publié: (2024)
par: Dadas, Sławomir, et autres
Publié: (2024)
Monotonic Paraphrasing Improves Generalization of Language Model Prompting
par: Liu, Qin, et autres
Publié: (2024)
par: Liu, Qin, et autres
Publié: (2024)
Causal Autoregressive Diffusion Language Model
par: Ruan, Junhao, et autres
Publié: (2026)
par: Ruan, Junhao, et autres
Publié: (2026)
Language Modeling and Understanding Through Paraphrase Generation and Detection
par: Wahle, Jan Philip
Publié: (2026)
par: Wahle, Jan Philip
Publié: (2026)
Semantic Search as Extractive Paraphrase Span Detection
par: Kanerva, Jenna, et autres
Publié: (2021)
par: Kanerva, Jenna, et autres
Publié: (2021)
RoParQ: Paraphrase-Aware Alignment of Large Language Models Towards Robustness to Paraphrased Questions
par: Choi, Minjoon
Publié: (2025)
par: Choi, Minjoon
Publié: (2025)
Paraphrase Types for Generation and Detection
par: Wahle, Jan Philip, et autres
Publié: (2023)
par: Wahle, Jan Philip, et autres
Publié: (2023)
Linguistically-Controlled Paraphrase Generation
par: Elgaar, Mohamed, et autres
Publié: (2024)
par: Elgaar, Mohamed, et autres
Publié: (2024)
Retrieve, Generate, Evaluate: A Case Study for Medical Paraphrases Generation with Small Language Models
par: Buhnila, Ioana, et autres
Publié: (2024)
par: Buhnila, Ioana, et autres
Publié: (2024)
Learning to Adapt to Low-Resource Paraphrase Generation
par: Li, Zhigen, et autres
Publié: (2024)
par: Li, Zhigen, et autres
Publié: (2024)
MahaParaphrase: A Marathi Paraphrase Detection Corpus and BERT-based Models
par: Jadhav, Suramya, et autres
Publié: (2025)
par: Jadhav, Suramya, et autres
Publié: (2025)
How Large Language Models are Transforming Machine-Paraphrased Plagiarism
par: Wahle, Jan Philip, et autres
Publié: (2022)
par: Wahle, Jan Philip, et autres
Publié: (2022)
Human Speech Perception in Noise: Can Large Language Models Paraphrase to Improve It?
par: Chingacham, Anupama, et autres
Publié: (2024)
par: Chingacham, Anupama, et autres
Publié: (2024)
AdParaphrase v2.0: Generating Attractive Ad Texts Using a Preference-Annotated Paraphrase Dataset
par: Murakami, Soichiro, et autres
Publié: (2025)
par: Murakami, Soichiro, et autres
Publié: (2025)
AdParaphrase: Paraphrase Dataset for Analyzing Linguistic Features toward Generating Attractive Ad Texts
par: Murakami, Soichiro, et autres
Publié: (2025)
par: Murakami, Soichiro, et autres
Publié: (2025)
Improved Paraphrase Generation via Controllable Latent Diffusion
par: Zou, Wei, et autres
Publié: (2024)
par: Zou, Wei, et autres
Publié: (2024)
Target-Side Paraphrase Augmentation for Sign Language Translation with Large Language Models
par: Bianco, Pedro Dal, et autres
Publié: (2026)
par: Bianco, Pedro Dal, et autres
Publié: (2026)
Towards Human Understanding of Paraphrase Types in Large Language Models
par: Meier, Dominik, et autres
Publié: (2024)
par: Meier, Dominik, et autres
Publié: (2024)
Latent Paraphrasing: Perturbation on Layers Improves Knowledge Injection in Language Models
par: Kang, Minki, et autres
Publié: (2024)
par: Kang, Minki, et autres
Publié: (2024)
Task-Oriented Paraphrase Analytics
par: Gohsen, Marcel, et autres
Publié: (2024)
par: Gohsen, Marcel, et autres
Publié: (2024)
Paraphrase-Aligned Machine Translation
par: Chang, Ke-Ching, et autres
Publié: (2024)
par: Chang, Ke-Ching, et autres
Publié: (2024)
On the Impact of Language Nuances on Sentiment Analysis with Large Language Models: Paraphrasing, Sarcasm, and Emojis
par: Bhargava, Naman, et autres
Publié: (2025)
par: Bhargava, Naman, et autres
Publié: (2025)
Meaningful Pose-Based Sign Language Evaluation
par: Jiang, Zifan, et autres
Publié: (2025)
par: Jiang, Zifan, et autres
Publié: (2025)
Mitigating Paraphrase Attacks on Machine-Text Detectors via Paraphrase Inversion
par: Soto, Rafael Rivera, et autres
Publié: (2024)
par: Soto, Rafael Rivera, et autres
Publié: (2024)
Domino: Decoupling Causal Modeling from Autoregressive Drafting in Speculative Decoding
par: Huang, Jianuo, et autres
Publié: (2026)
par: Huang, Jianuo, et autres
Publié: (2026)
Adversarial Paraphrasing: A Universal Attack for Humanizing AI-Generated Text
par: Cheng, Yize, et autres
Publié: (2025)
par: Cheng, Yize, et autres
Publié: (2025)
A Ship of Theseus: Curious Cases of Paraphrasing in LLM-Generated Texts
par: Tripto, Nafis Irtiza, et autres
Publié: (2023)
par: Tripto, Nafis Irtiza, et autres
Publié: (2023)
FrameEOL: Semantic Frame Induction using Causal Language Models
par: Yano, Chihiro, et autres
Publié: (2025)
par: Yano, Chihiro, et autres
Publié: (2025)
Paraphrase-Induced Output-Mode Collapse: When LLMs Break Character Under Semantically Equivalent Inputs
par: Liu, Aofan, et autres
Publié: (2026)
par: Liu, Aofan, et autres
Publié: (2026)
Differences in Text Generated by Diffusion and Autoregressive Language Models
par: Zhang, Zeyang, et autres
Publié: (2026)
par: Zhang, Zeyang, et autres
Publié: (2026)
Dissecting Paraphrases: The Impact of Prompt Syntax and supplementary Information on Knowledge Retrieval from Pretrained Language Models
par: Linzbach, Stephan, et autres
Publié: (2024)
par: Linzbach, Stephan, et autres
Publié: (2024)
Meaningful Learning: Enhancing Abstract Reasoning in Large Language Models via Generic Fact Guidance
par: Xiong, Kai, et autres
Publié: (2024)
par: Xiong, Kai, et autres
Publié: (2024)
Reversal Invariance in Autoregressive Language Models
par: Sahasrabudhe, Mihir
Publié: (2025)
par: Sahasrabudhe, Mihir
Publié: (2025)
Paraphrase and Aggregate with Large Language Models for Minimizing Intent Classification Errors
par: Yadav, Vikas, et autres
Publié: (2024)
par: Yadav, Vikas, et autres
Publié: (2024)
Documents similaires
-
PL-MTEB: Polish Massive Text Embedding Benchmark
par: Poświata, Rafał, et autres
Publié: (2024) -
PIRB: A Comprehensive Benchmark of Polish Dense and Hybrid Text Retrieval Methods
par: Dadas, Sławomir, et autres
Publié: (2024) -
Evaluating Polish linguistic and cultural competency in large language models
par: Dadas, Sławomir, et autres
Publié: (2025) -
Unveiling Dual Quality in Product Reviews: An NLP-Based Approach
par: Poświata, Rafał, et autres
Publié: (2025) -
A Review of the Challenges with Massive Web-mined Corpora Used in Large Language Models Pre-Training
par: Perełkiewicz, Michał, et autres
Publié: (2024)