Guardado en:
| Autores principales: | Chen, Yanran, Zhao, Wei, Breitbarth, Anne, Stoeckel, Manuel, Mehler, Alexander, Eger, Steffen |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2402.11549 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
How Good Are LLMs for Literary Translation, Really? Literary Translation Evaluation with Humans and LLMs
por: Zhang, Ran, et al.
Publicado: (2024)
por: Zhang, Ran, et al.
Publicado: (2024)
Do Emotions Really Affect Argument Convincingness? A Dynamic Approach with LLM-based Manipulation Checks
por: Chen, Yanran, et al.
Publicado: (2025)
por: Chen, Yanran, et al.
Publicado: (2025)
LiTransProQA: an LLM-based Literary Translation evaluation metric with Professional Question Answering
por: Zhang, Ran, et al.
Publicado: (2025)
por: Zhang, Ran, et al.
Publicado: (2025)
Is there really a Citation Age Bias in NLP?
por: Nguyen, Hoa, et al.
Publicado: (2024)
por: Nguyen, Hoa, et al.
Publicado: (2024)
TikZilla: Scaling Text-to-TikZ with High-Quality Data and Reinforcement Learning
por: Greisinger, Christian, et al.
Publicado: (2026)
por: Greisinger, Christian, et al.
Publicado: (2026)
Evaluating Large Language Models for Structured Science Summarization in the Open Research Knowledge Graph
por: Nechakhin, Vladyslav, et al.
Publicado: (2024)
por: Nechakhin, Vladyslav, et al.
Publicado: (2024)
NLLG Quarterly arXiv Report 09/24: What are the most influential current AI Papers?
por: Leiter, Christoph, et al.
Publicado: (2024)
por: Leiter, Christoph, et al.
Publicado: (2024)
GLoRIA: Gated Low-Rank Interpretable Adaptation for Dialectal ASR
por: Mehralian, Pouya, et al.
Publicado: (2026)
por: Mehralian, Pouya, et al.
Publicado: (2026)
Beyond Reproduction: A Paired-Task Framework for Assessing LLM Comprehension and Creativity in Literary Translation
por: Zhang, Ran, et al.
Publicado: (2026)
por: Zhang, Ran, et al.
Publicado: (2026)
Syntactic Evolution in Language Usage
por: Kumar, Surbhit
Publicado: (2025)
por: Kumar, Surbhit
Publicado: (2025)
A Systematic Study of Compositional Syntactic Transformer Language Models
por: Zhao, Yida, et al.
Publicado: (2025)
por: Zhao, Yida, et al.
Publicado: (2025)
LLLMs: A Data-Driven Survey of Evolving Research on Limitations of Large Language Models
por: Kostikova, Aida, et al.
Publicado: (2025)
por: Kostikova, Aida, et al.
Publicado: (2025)
Evaluating Diversity in Automatic Poetry Generation
por: Chen, Yanran, et al.
Publicado: (2024)
por: Chen, Yanran, et al.
Publicado: (2024)
Who Annotates in NLP? A Large-scale Assessment of Human Annotation Reporting between 2018 and 2025
por: Kunilovskaya, Maria, et al.
Publicado: (2026)
por: Kunilovskaya, Maria, et al.
Publicado: (2026)
Generative Pretrained Structured Transformers: Unsupervised Syntactic Language Models at Scale
por: Hu, Xiang, et al.
Publicado: (2024)
por: Hu, Xiang, et al.
Publicado: (2024)
Understanding or Memorizing? A Case Study of German Definite Articles in Language Models
por: Drechsel, Jonathan, et al.
Publicado: (2026)
por: Drechsel, Jonathan, et al.
Publicado: (2026)
Prototypicality Bias Reveals Blindspots in Multimodal Evaluation Metrics
por: Roy, Subhadeep, et al.
Publicado: (2026)
por: Roy, Subhadeep, et al.
Publicado: (2026)
BMX: Boosting Natural Language Generation Metrics with Explainability
por: Leiter, Christoph, et al.
Publicado: (2022)
por: Leiter, Christoph, et al.
Publicado: (2022)
Same Meaning, Different Scores: Lexical and Syntactic Sensitivity in LLM Evaluation
por: Kostić, Bogdan, et al.
Publicado: (2026)
por: Kostić, Bogdan, et al.
Publicado: (2026)
Syntactic Control of Language Models by Posterior Inference
por: Xefteri, Vicky, et al.
Publicado: (2025)
por: Xefteri, Vicky, et al.
Publicado: (2025)
S$^4$C: Speculative Sampling with Syntactic and Semantic Coherence for Efficient Inference of Large Language Models
por: He, Tao, et al.
Publicado: (2025)
por: He, Tao, et al.
Publicado: (2025)
Evaluating Semantic and Syntactic Understanding in Large Language Models for Payroll Systems
por: Maclean, Hendrika, et al.
Publicado: (2026)
por: Maclean, Hendrika, et al.
Publicado: (2026)
ScImage: How Good Are Multimodal Large Language Models at Scientific Text-to-Image Generation?
por: Zhang, Leixin, et al.
Publicado: (2024)
por: Zhang, Leixin, et al.
Publicado: (2024)
USCORE: An Effective Approach to Fully Unsupervised Evaluation Metrics for Machine Translation
por: Belouadi, Jonas, et al.
Publicado: (2022)
por: Belouadi, Jonas, et al.
Publicado: (2022)
Llama-GENBA-10B: A Trilingual Large Language Model for German, English and Bavarian
por: Hoffmann, Michael, et al.
Publicado: (2025)
por: Hoffmann, Michael, et al.
Publicado: (2025)
Automatic Prediction of the Performance of Every Parser
por: Biçici, Ergun
Publicado: (2024)
por: Biçici, Ergun
Publicado: (2024)
Emotionally Charged, Logically Blurred: AI-driven Emotional Framing Impairs Human Fallacy Detection
por: Chen, Yanran, et al.
Publicado: (2025)
por: Chen, Yanran, et al.
Publicado: (2025)
PromptOptMe: Error-Aware Prompt Compression for LLM-based MT Evaluation Metrics
por: Larionov, Daniil, et al.
Publicado: (2024)
por: Larionov, Daniil, et al.
Publicado: (2024)
LLMs Underperform Graph-Based Parsers on Supervised Relation Extraction for Complex Graphs
por: Gajo, Paolo, et al.
Publicado: (2026)
por: Gajo, Paolo, et al.
Publicado: (2026)
KELPS: A Framework for Verified Multi-Language Autoformalization via Semantic-Syntactic Alignment
por: Zhang, Jiyao, et al.
Publicado: (2025)
por: Zhang, Jiyao, et al.
Publicado: (2025)
The Grammar of Transformers: A Systematic Review of Interpretability Research on Syntactic Knowledge in Language Models
por: Graichen, Nora, et al.
Publicado: (2026)
por: Graichen, Nora, et al.
Publicado: (2026)
Syntactic and Semantic Control of Large Language Models via Sequential Monte Carlo
por: Loula, João, et al.
Publicado: (2025)
por: Loula, João, et al.
Publicado: (2025)
Classification of Human- and AI-Generated Texts for English, French, German, and Spanish
por: Schaaff, Kristina, et al.
Publicado: (2023)
por: Schaaff, Kristina, et al.
Publicado: (2023)
TreePrompt: Leveraging Hierarchical Few-Shot Example Selection for Improved English-Persian and English-German Translation
por: Kakavand, Ramtin, et al.
Publicado: (2025)
por: Kakavand, Ramtin, et al.
Publicado: (2025)
SparkUI-Parser: Enhancing GUI Perception with Robust Grounding and Parsing
por: Jing, Hongyi, et al.
Publicado: (2025)
por: Jing, Hongyi, et al.
Publicado: (2025)
An Analysis on Automated Metrics for Evaluating Japanese-English Chat Translation
por: Rusli, Andre, et al.
Publicado: (2024)
por: Rusli, Andre, et al.
Publicado: (2024)
Negation Triplet Extraction with Syntactic Dependency and Semantic Consistency
por: Shi, Yuchen, et al.
Publicado: (2024)
por: Shi, Yuchen, et al.
Publicado: (2024)
Infinity Parser: Layout Aware Reinforcement Learning for Scanned Document Parsing
por: Wang, Baode, et al.
Publicado: (2025)
por: Wang, Baode, et al.
Publicado: (2025)
OTESGN: Optimal Transport-Enhanced Syntactic-Semantic Graph Networks for Aspect-Based Sentiment Analysis
por: Liao, Xinfeng, et al.
Publicado: (2025)
por: Liao, Xinfeng, et al.
Publicado: (2025)
The Role of Syntactic Span Preferences in Post-Hoc Explanation Disagreement
por: Kamp, Jonathan, et al.
Publicado: (2024)
por: Kamp, Jonathan, et al.
Publicado: (2024)
Ejemplares similares
-
How Good Are LLMs for Literary Translation, Really? Literary Translation Evaluation with Humans and LLMs
por: Zhang, Ran, et al.
Publicado: (2024) -
Do Emotions Really Affect Argument Convincingness? A Dynamic Approach with LLM-based Manipulation Checks
por: Chen, Yanran, et al.
Publicado: (2025) -
LiTransProQA: an LLM-based Literary Translation evaluation metric with Professional Question Answering
por: Zhang, Ran, et al.
Publicado: (2025) -
Is there really a Citation Age Bias in NLP?
por: Nguyen, Hoa, et al.
Publicado: (2024) -
TikZilla: Scaling Text-to-TikZ with High-Quality Data and Reinforcement Learning
por: Greisinger, Christian, et al.
Publicado: (2026)