Salvato in:
| Autori principali: | Xu, Hongfei, Song, Yang, Liu, Qiuhui, van Genabith, Josef, Xiong, Deyi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2020
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2007.06257 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Why Does Reinforcement Learning Generalize? A Feature-Level Mechanistic Study of Post-Training in Large Language Models
di: Shi, Dan, et al.
Pubblicazione: (2026)
di: Shi, Dan, et al.
Pubblicazione: (2026)
Disentangling Mathematical Reasoning in LLMs: A Methodological Investigation of Internal Mechanisms
di: Baeumel, Tanja, et al.
Pubblicazione: (2026)
di: Baeumel, Tanja, et al.
Pubblicazione: (2026)
Probing Context Localization of Polysemous Words in Pre-trained Language Model Sub-Layers
di: Vijayakumar, Soniya, et al.
Pubblicazione: (2024)
di: Vijayakumar, Soniya, et al.
Pubblicazione: (2024)
The Lookahead Limitation: Why Multi-Operand Addition is Hard for LLMs
di: Baeumel, Tanja, et al.
Pubblicazione: (2025)
di: Baeumel, Tanja, et al.
Pubblicazione: (2025)
Sign Language Translation with Sentence Embedding Supervision
di: Hamidullah, Yasser, et al.
Pubblicazione: (2025)
di: Hamidullah, Yasser, et al.
Pubblicazione: (2025)
Spatio-temporal Sign Language Representation and Translation
di: Hamidullah, Yasser, et al.
Pubblicazione: (2025)
di: Hamidullah, Yasser, et al.
Pubblicazione: (2025)
On Multilingual Encoder Language Model Compression for Low-Resource Languages
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
When Scale Meets Diversity: Evaluating Language Models on Fine-Grained Multilingual Claim Verification
di: Shcharbakova, Hanna, et al.
Pubblicazione: (2025)
di: Shcharbakova, Hanna, et al.
Pubblicazione: (2025)
Small Models, Big Impact: Efficient Corpus and Graph-Based Adaptation of Small Multilingual Language Models for Low-Resource Languages
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
Sparse Subnetwork Enhancement for Underrepresented Languages in Large Language Models
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
When Flores Bloomz Wrong: Cross-Direction Contamination in Machine Translation Evaluation
di: Tan, David, et al.
Pubblicazione: (2026)
di: Tan, David, et al.
Pubblicazione: (2026)
Seeing, Signing, and Saying: A Vision-Language Model-Assisted Pipeline for Sign Language Data Acquisition and Curation from Social Media
di: Yazdani, Shakib, et al.
Pubblicazione: (2025)
di: Yazdani, Shakib, et al.
Pubblicazione: (2025)
Measuring Spurious Correlation in Classification: 'Clever Hans' in Translationese
di: Borah, Angana, et al.
Pubblicazione: (2023)
di: Borah, Angana, et al.
Pubblicazione: (2023)
The Latin Substrate: How Language Models Represent and Mediate Script Choice
di: Gurgurov, Daniil, et al.
Pubblicazione: (2026)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2026)
When your Cousin has the Right Connections: Unsupervised Bilingual Lexicon Induction for Related Data-Imbalanced Languages
di: Bafna, Niyati, et al.
Pubblicazione: (2023)
di: Bafna, Niyati, et al.
Pubblicazione: (2023)
A Critical Study of Automatic Evaluation in Sign Language Translation
di: Yazdani, Shakib, et al.
Pubblicazione: (2025)
di: Yazdani, Shakib, et al.
Pubblicazione: (2025)
SONAR-SLT: Multilingual Sign Language Translation via Language-Agnostic Sentence Embedding Supervision
di: Hamidullah, Yasser, et al.
Pubblicazione: (2025)
di: Hamidullah, Yasser, et al.
Pubblicazione: (2025)
Multilingual Political Views of Large Language Models: Identification and Steering
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
PETra: A Multilingual Corpus of Pragmatic Explicitation in Translation
di: Osmelak, Doreen, et al.
Pubblicazione: (2025)
di: Osmelak, Doreen, et al.
Pubblicazione: (2025)
Modular Arithmetic: Language Models Solve Math Digit by Digit
di: Baeumel, Tanja, et al.
Pubblicazione: (2025)
di: Baeumel, Tanja, et al.
Pubblicazione: (2025)
ReasonXL: Shifting LLM Reasoning Language Without Sacrificing Performance
di: Gurgurov, Daniil, et al.
Pubblicazione: (2026)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2026)
Language Arithmetics: Towards Systematic Language Neuron Identification and Manipulation
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
Multilingual Steering by Design: Multilingual Sparse Autoencoders and Principled Layer Selection
di: Ghussin, Yusser Al, et al.
Pubblicazione: (2026)
di: Ghussin, Yusser Al, et al.
Pubblicazione: (2026)
Automatic Fact-checking in English and Telugu
di: Chikkala, Ravi Kiran, et al.
Pubblicazione: (2025)
di: Chikkala, Ravi Kiran, et al.
Pubblicazione: (2025)
CRiskEval: A Chinese Multi-Level Risk Evaluation Benchmark Dataset for Large Language Models
di: Shi, Ling, et al.
Pubblicazione: (2024)
di: Shi, Ling, et al.
Pubblicazione: (2024)
DFKI-MLT at SemEval-2026 TASK 7: Steering Multilingual Models Towards Cultural Knowledge
di: Ghussin, Yusser Al, et al.
Pubblicazione: (2026)
di: Ghussin, Yusser Al, et al.
Pubblicazione: (2026)
AdaPonderLM: Gated Pondering Language Models with Token-Wise Adaptive Depth
di: Song, Shixiang, et al.
Pubblicazione: (2026)
di: Song, Shixiang, et al.
Pubblicazione: (2026)
AutoPsyC: Automatic Recognition of Psychodynamic Conflicts from Semi-structured Interviews with Large Language Models
di: Hossain, Sayed Muddashir, et al.
Pubblicazione: (2025)
di: Hossain, Sayed Muddashir, et al.
Pubblicazione: (2025)
LLMCheckup: Conversational Examination of Large Language Models via Interpretability Tools and Self-Explanations
di: Wang, Qianli, et al.
Pubblicazione: (2024)
di: Wang, Qianli, et al.
Pubblicazione: (2024)
LFED: A Literary Fiction Evaluation Dataset for Large Language Models
di: Yu, Linhao, et al.
Pubblicazione: (2024)
di: Yu, Linhao, et al.
Pubblicazione: (2024)
Towards Understanding Multi-Task Learning (Generalization) of LLMs via Detecting and Exploring Task-Specific Neurons
di: Leng, Yongqi, et al.
Pubblicazione: (2024)
di: Leng, Yongqi, et al.
Pubblicazione: (2024)
An Empirical Study on the Robustness of Massively Multilingual Neural Machine Translation
di: Supryadi, et al.
Pubblicazione: (2024)
di: Supryadi, et al.
Pubblicazione: (2024)
A Local Perturbation Theory for Cross-Domain Interference and Recovery in Multi-Domain RL
di: Yang, Lei, et al.
Pubblicazione: (2026)
di: Yang, Lei, et al.
Pubblicazione: (2026)
StockBot 2.0: Vanilla LSTMs Outperform Transformer-based Forecasting for Stock Prices
di: Mohanty, Shaswat
Pubblicazione: (2026)
di: Mohanty, Shaswat
Pubblicazione: (2026)
Aligning LLM Uncertainty with Human Disagreement in Subjectivity Analysis
di: Lu, Junyu, et al.
Pubblicazione: (2026)
di: Lu, Junyu, et al.
Pubblicazione: (2026)
Reverse Probing: Evaluating Knowledge Transfer via Finetuned Task Embeddings for Coreference Resolution
di: Anikina, Tatiana, et al.
Pubblicazione: (2025)
di: Anikina, Tatiana, et al.
Pubblicazione: (2025)
DCIS: Efficient Length Extrapolation of LLMs via Divide-and-Conquer Scaling Factor Search
di: Yang, Lei, et al.
Pubblicazione: (2024)
di: Yang, Lei, et al.
Pubblicazione: (2024)
Self-Pluralising Culture Alignment for Large Language Models
di: Xu, Shaoyang, et al.
Pubblicazione: (2024)
di: Xu, Shaoyang, et al.
Pubblicazione: (2024)
Evaluating Discourse Cohesion in Pre-trained Language Models
di: He, Jie, et al.
Pubblicazione: (2025)
di: He, Jie, et al.
Pubblicazione: (2025)
LHMKE: A Large-scale Holistic Multi-subject Knowledge Evaluation Benchmark for Chinese Large Language Models
di: Liu, Chuang, et al.
Pubblicazione: (2024)
di: Liu, Chuang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Why Does Reinforcement Learning Generalize? A Feature-Level Mechanistic Study of Post-Training in Large Language Models
di: Shi, Dan, et al.
Pubblicazione: (2026) -
Disentangling Mathematical Reasoning in LLMs: A Methodological Investigation of Internal Mechanisms
di: Baeumel, Tanja, et al.
Pubblicazione: (2026) -
Probing Context Localization of Polysemous Words in Pre-trained Language Model Sub-Layers
di: Vijayakumar, Soniya, et al.
Pubblicazione: (2024) -
The Lookahead Limitation: Why Multi-Operand Addition is Hard for LLMs
di: Baeumel, Tanja, et al.
Pubblicazione: (2025) -
Sign Language Translation with Sentence Embedding Supervision
di: Hamidullah, Yasser, et al.
Pubblicazione: (2025)