Simple and Effective Input Reformulations for Translation
Fuente:
arXiv
Guardado en:
| Autores principales: | Yu, Brian, Lillemark, Hansen, Keutzer, Kurt |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
One Model is All You Need: ByT5-Sanskrit, a Unified Model for Sanskrit NLP Tasks
por: Nehrdich, Sebastian, et al.
Publicado: (2024)
por: Nehrdich, Sebastian, et al.
Publicado: (2024)
Characterizing Prompt Compression Methods for Long Context Inference
por: Jha, Siddharth, et al.
Publicado: (2024)
por: Jha, Siddharth, et al.
Publicado: (2024)
QFT: Quantized Full-parameter Tuning of LLMs with Affordable Resources
por: Li, Zhikai, et al.
Publicado: (2023)
por: Li, Zhikai, et al.
Publicado: (2023)
ESURF: Simple and Effective EDU Segmentation
por: Sediqin, Mohammadreza, et al.
Publicado: (2025)
por: Sediqin, Mohammadreza, et al.
Publicado: (2025)
CDLM: Consistency Diffusion Language Models For Faster Sampling
por: Kim, Minseo, et al.
Publicado: (2025)
por: Kim, Minseo, et al.
Publicado: (2025)
SqueezeLLM: Dense-and-Sparse Quantization
por: Kim, Sehoon, et al.
Publicado: (2023)
por: Kim, Sehoon, et al.
Publicado: (2023)
MITRA: A Large-Scale Parallel Corpus and Multilingual Pretrained Language Model for Machine Translation and Semantic Retrieval for Pāli, Sanskrit, Buddhist Chinese, and Tibetan
por: Nehrdich, Sebastian, et al.
Publicado: (2026)
por: Nehrdich, Sebastian, et al.
Publicado: (2026)
Solving Situation Puzzles with Large Language Model and External Reformulation
por: Li, Kun, et al.
Publicado: (2025)
por: Li, Kun, et al.
Publicado: (2025)
Learned Best-Effort LLM Serving
por: Jha, Siddharth, et al.
Publicado: (2024)
por: Jha, Siddharth, et al.
Publicado: (2024)
Multipole Attention for Efficient Long Context Reasoning
por: Hooper, Coleman, et al.
Publicado: (2025)
por: Hooper, Coleman, et al.
Publicado: (2025)
FoldGPT: Simple and Effective Large Language Model Compression Scheme
por: Liu, Songwei, et al.
Publicado: (2024)
por: Liu, Songwei, et al.
Publicado: (2024)
References Indeed Matter? Reference-Free Preference Optimization for Conversational Query Reformulation
por: Kim, Doyoung, et al.
Publicado: (2025)
por: Kim, Doyoung, et al.
Publicado: (2025)
Jet-RL: Enabling On-Policy FP8 Reinforcement Learning with Unified Training and Rollout Precision Flow
por: Xi, Haocheng, et al.
Publicado: (2026)
por: Xi, Haocheng, et al.
Publicado: (2026)
Efficient and Scalable Estimation of Tool Representations in Vector Space
por: Moon, Suhong, et al.
Publicado: (2024)
por: Moon, Suhong, et al.
Publicado: (2024)
TinyAgent: Function Calling at the Edge
por: Erdogan, Lutfi Eren, et al.
Publicado: (2024)
por: Erdogan, Lutfi Eren, et al.
Publicado: (2024)
Simple and Effective Masked Diffusion Language Models
por: Sahoo, Subham Sekhar, et al.
Publicado: (2024)
por: Sahoo, Subham Sekhar, et al.
Publicado: (2024)
The Unreasonable Effectiveness of Random Target Embeddings for Continuous-Output Neural Machine Translation
por: Tokarchuk, Evgeniia, et al.
Publicado: (2023)
por: Tokarchuk, Evgeniia, et al.
Publicado: (2023)
Beyond Next-Token Prediction: A Performance Characterization of Diffusion versus Autoregressive Language Models
por: Kim, Minseo, et al.
Publicado: (2025)
por: Kim, Minseo, et al.
Publicado: (2025)
SSR-Zero: Simple Self-Rewarding Reinforcement Learning for Machine Translation
por: Yang, Wenjie, et al.
Publicado: (2025)
por: Yang, Wenjie, et al.
Publicado: (2025)
Batch-ICL: Effective, Efficient, and Order-Agnostic In-Context Learning
por: Zhang, Kaiyi, et al.
Publicado: (2024)
por: Zhang, Kaiyi, et al.
Publicado: (2024)
LoSA: Locality Aware Sparse Attention for Block-Wise Diffusion Language Models
por: Xi, Haocheng, et al.
Publicado: (2026)
por: Xi, Haocheng, et al.
Publicado: (2026)
Advancing Translation Preference Modeling with RLHF: A Step Towards Cost-Effective Solution
por: Xu, Nuo, et al.
Publicado: (2024)
por: Xu, Nuo, et al.
Publicado: (2024)
FactorLLM: Factorizing Knowledge via Mixture of Experts for Large Language Models
por: Zhao, Zhongyu, et al.
Publicado: (2024)
por: Zhao, Zhongyu, et al.
Publicado: (2024)
LLoCO: Learning Long Contexts Offline
por: Tan, Sijun, et al.
Publicado: (2024)
por: Tan, Sijun, et al.
Publicado: (2024)
$\texttt{SPECS}$: Faster Test-Time Scaling through Speculative Drafts
por: Cemri, Mert, et al.
Publicado: (2025)
por: Cemri, Mert, et al.
Publicado: (2025)
A Simple and Effective Pruning Approach for Large Language Models
por: Sun, Mingjie, et al.
Publicado: (2023)
por: Sun, Mingjie, et al.
Publicado: (2023)
Reformulation is All You Need: Addressing Malicious Text Features in DNNs
por: Jiang, Yi, et al.
Publicado: (2025)
por: Jiang, Yi, et al.
Publicado: (2025)
Incorporating Exponential Smoothing into MLP: A Simple but Effective Sequence Model
por: Chu, Jiqun, et al.
Publicado: (2024)
por: Chu, Jiqun, et al.
Publicado: (2024)
SimPO: Simple Preference Optimization with a Reference-Free Reward
por: Meng, Yu, et al.
Publicado: (2024)
por: Meng, Yu, et al.
Publicado: (2024)
Simple Yet Effective: An Information-Theoretic Approach to Multi-LLM Uncertainty Quantification
por: Kruse, Maya, et al.
Publicado: (2025)
por: Kruse, Maya, et al.
Publicado: (2025)
Cog-DRIFT: Exploration on Adaptively Reformulated Instances Enables Learning from Hard Reasoning Problems
por: Chen, Justin Chih-Yao, et al.
Publicado: (2026)
por: Chen, Justin Chih-Yao, et al.
Publicado: (2026)
Dense Retrievers Can Fail on Simple Queries: Revealing The Granularity Dilemma of Embeddings
por: Xu, Liyan, et al.
Publicado: (2025)
por: Xu, Liyan, et al.
Publicado: (2025)
Arbitrage: Efficient Reasoning via Advantage-Aware Speculation
por: Maheswaran, Monishwaran, et al.
Publicado: (2025)
por: Maheswaran, Monishwaran, et al.
Publicado: (2025)
TableTime: Reformulating Time Series Classification as Training-Free Table Understanding with Large Language Models
por: Wang, Jiahao, et al.
Publicado: (2024)
por: Wang, Jiahao, et al.
Publicado: (2024)
Translate Policy to Language: Flow Matching Generated Rewards for LLM Explanations
por: Yang, Xinyi, et al.
Publicado: (2025)
por: Yang, Xinyi, et al.
Publicado: (2025)
Frayed RoPE and Long Inputs: A Geometric Perspective
por: Wertheimer, Davis, et al.
Publicado: (2026)
por: Wertheimer, Davis, et al.
Publicado: (2026)
Reward-based Input Construction for Cross-document Relation Extraction
por: Na, Byeonghu, et al.
Publicado: (2024)
por: Na, Byeonghu, et al.
Publicado: (2024)
Understanding Gated Neurons in Transformers from Their Input-Output Functionality
por: Gerstner, Sebastian, et al.
Publicado: (2025)
por: Gerstner, Sebastian, et al.
Publicado: (2025)
Token Distillation: Attention-aware Input Embeddings For New Tokens
por: Dobler, Konstantin, et al.
Publicado: (2025)
por: Dobler, Konstantin, et al.
Publicado: (2025)
RLVR Training of LLMs Does Not Improve Thinking Ability for General QA: Evaluation Method and a Simple Solution
por: Li, Kaiyuan, et al.
Publicado: (2026)
por: Li, Kaiyuan, et al.
Publicado: (2026)
Ejemplares similares
-
One Model is All You Need: ByT5-Sanskrit, a Unified Model for Sanskrit NLP Tasks
por: Nehrdich, Sebastian, et al.
Publicado: (2024) -
Characterizing Prompt Compression Methods for Long Context Inference
por: Jha, Siddharth, et al.
Publicado: (2024) -
QFT: Quantized Full-parameter Tuning of LLMs with Affordable Resources
por: Li, Zhikai, et al.
Publicado: (2023) -
ESURF: Simple and Effective EDU Segmentation
por: Sediqin, Mohammadreza, et al.
Publicado: (2025) -
CDLM: Consistency Diffusion Language Models For Faster Sampling
por: Kim, Minseo, et al.
Publicado: (2025)