Salvato in:
| Autori principali: | Yu, Brian, Lillemark, Hansen, Keutzer, Kurt |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2311.06696 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
One Model is All You Need: ByT5-Sanskrit, a Unified Model for Sanskrit NLP Tasks
di: Nehrdich, Sebastian, et al.
Pubblicazione: (2024)
di: Nehrdich, Sebastian, et al.
Pubblicazione: (2024)
Characterizing Prompt Compression Methods for Long Context Inference
di: Jha, Siddharth, et al.
Pubblicazione: (2024)
di: Jha, Siddharth, et al.
Pubblicazione: (2024)
QFT: Quantized Full-parameter Tuning of LLMs with Affordable Resources
di: Li, Zhikai, et al.
Pubblicazione: (2023)
di: Li, Zhikai, et al.
Pubblicazione: (2023)
Learned Best-Effort LLM Serving
di: Jha, Siddharth, et al.
Pubblicazione: (2024)
di: Jha, Siddharth, et al.
Pubblicazione: (2024)
CDLM: Consistency Diffusion Language Models For Faster Sampling
di: Kim, Minseo, et al.
Pubblicazione: (2025)
di: Kim, Minseo, et al.
Pubblicazione: (2025)
SqueezeLLM: Dense-and-Sparse Quantization
di: Kim, Sehoon, et al.
Pubblicazione: (2023)
di: Kim, Sehoon, et al.
Pubblicazione: (2023)
ESURF: Simple and Effective EDU Segmentation
di: Sediqin, Mohammadreza, et al.
Pubblicazione: (2025)
di: Sediqin, Mohammadreza, et al.
Pubblicazione: (2025)
MITRA: A Large-Scale Parallel Corpus and Multilingual Pretrained Language Model for Machine Translation and Semantic Retrieval for Pāli, Sanskrit, Buddhist Chinese, and Tibetan
di: Nehrdich, Sebastian, et al.
Pubblicazione: (2026)
di: Nehrdich, Sebastian, et al.
Pubblicazione: (2026)
Multipole Attention for Efficient Long Context Reasoning
di: Hooper, Coleman, et al.
Pubblicazione: (2025)
di: Hooper, Coleman, et al.
Pubblicazione: (2025)
Efficient and Scalable Estimation of Tool Representations in Vector Space
di: Moon, Suhong, et al.
Pubblicazione: (2024)
di: Moon, Suhong, et al.
Pubblicazione: (2024)
Jet-RL: Enabling On-Policy FP8 Reinforcement Learning with Unified Training and Rollout Precision Flow
di: Xi, Haocheng, et al.
Pubblicazione: (2026)
di: Xi, Haocheng, et al.
Pubblicazione: (2026)
Solving Situation Puzzles with Large Language Model and External Reformulation
di: Li, Kun, et al.
Pubblicazione: (2025)
di: Li, Kun, et al.
Pubblicazione: (2025)
TinyAgent: Function Calling at the Edge
di: Erdogan, Lutfi Eren, et al.
Pubblicazione: (2024)
di: Erdogan, Lutfi Eren, et al.
Pubblicazione: (2024)
Beyond Next-Token Prediction: A Performance Characterization of Diffusion versus Autoregressive Language Models
di: Kim, Minseo, et al.
Pubblicazione: (2025)
di: Kim, Minseo, et al.
Pubblicazione: (2025)
FoldGPT: Simple and Effective Large Language Model Compression Scheme
di: Liu, Songwei, et al.
Pubblicazione: (2024)
di: Liu, Songwei, et al.
Pubblicazione: (2024)
FactorLLM: Factorizing Knowledge via Mixture of Experts for Large Language Models
di: Zhao, Zhongyu, et al.
Pubblicazione: (2024)
di: Zhao, Zhongyu, et al.
Pubblicazione: (2024)
LLoCO: Learning Long Contexts Offline
di: Tan, Sijun, et al.
Pubblicazione: (2024)
di: Tan, Sijun, et al.
Pubblicazione: (2024)
$\texttt{SPECS}$: Faster Test-Time Scaling through Speculative Drafts
di: Cemri, Mert, et al.
Pubblicazione: (2025)
di: Cemri, Mert, et al.
Pubblicazione: (2025)
References Indeed Matter? Reference-Free Preference Optimization for Conversational Query Reformulation
di: Kim, Doyoung, et al.
Pubblicazione: (2025)
di: Kim, Doyoung, et al.
Pubblicazione: (2025)
Simple and Effective Masked Diffusion Language Models
di: Sahoo, Subham Sekhar, et al.
Pubblicazione: (2024)
di: Sahoo, Subham Sekhar, et al.
Pubblicazione: (2024)
LoSA: Locality Aware Sparse Attention for Block-Wise Diffusion Language Models
di: Xi, Haocheng, et al.
Pubblicazione: (2026)
di: Xi, Haocheng, et al.
Pubblicazione: (2026)
SSR-Zero: Simple Self-Rewarding Reinforcement Learning for Machine Translation
di: Yang, Wenjie, et al.
Pubblicazione: (2025)
di: Yang, Wenjie, et al.
Pubblicazione: (2025)
Batch-ICL: Effective, Efficient, and Order-Agnostic In-Context Learning
di: Zhang, Kaiyi, et al.
Pubblicazione: (2024)
di: Zhang, Kaiyi, et al.
Pubblicazione: (2024)
The Unreasonable Effectiveness of Random Target Embeddings for Continuous-Output Neural Machine Translation
di: Tokarchuk, Evgeniia, et al.
Pubblicazione: (2023)
di: Tokarchuk, Evgeniia, et al.
Pubblicazione: (2023)
A Simple and Effective Pruning Approach for Large Language Models
di: Sun, Mingjie, et al.
Pubblicazione: (2023)
di: Sun, Mingjie, et al.
Pubblicazione: (2023)
Reformulation is All You Need: Addressing Malicious Text Features in DNNs
di: Jiang, Yi, et al.
Pubblicazione: (2025)
di: Jiang, Yi, et al.
Pubblicazione: (2025)
Advancing Translation Preference Modeling with RLHF: A Step Towards Cost-Effective Solution
di: Xu, Nuo, et al.
Pubblicazione: (2024)
di: Xu, Nuo, et al.
Pubblicazione: (2024)
Incorporating Exponential Smoothing into MLP: A Simple but Effective Sequence Model
di: Chu, Jiqun, et al.
Pubblicazione: (2024)
di: Chu, Jiqun, et al.
Pubblicazione: (2024)
Arbitrage: Efficient Reasoning via Advantage-Aware Speculation
di: Maheswaran, Monishwaran, et al.
Pubblicazione: (2025)
di: Maheswaran, Monishwaran, et al.
Pubblicazione: (2025)
Simple Yet Effective: An Information-Theoretic Approach to Multi-LLM Uncertainty Quantification
di: Kruse, Maya, et al.
Pubblicazione: (2025)
di: Kruse, Maya, et al.
Pubblicazione: (2025)
SimPO: Simple Preference Optimization with a Reference-Free Reward
di: Meng, Yu, et al.
Pubblicazione: (2024)
di: Meng, Yu, et al.
Pubblicazione: (2024)
Cog-DRIFT: Exploration on Adaptively Reformulated Instances Enables Learning from Hard Reasoning Problems
di: Chen, Justin Chih-Yao, et al.
Pubblicazione: (2026)
di: Chen, Justin Chih-Yao, et al.
Pubblicazione: (2026)
TableTime: Reformulating Time Series Classification as Training-Free Table Understanding with Large Language Models
di: Wang, Jiahao, et al.
Pubblicazione: (2024)
di: Wang, Jiahao, et al.
Pubblicazione: (2024)
Dense Retrievers Can Fail on Simple Queries: Revealing The Granularity Dilemma of Embeddings
di: Xu, Liyan, et al.
Pubblicazione: (2025)
di: Xu, Liyan, et al.
Pubblicazione: (2025)
Information Gain-based Policy Optimization: A Simple and Effective Approach for Multi-Turn Search Agents
di: Wang, Guoqing, et al.
Pubblicazione: (2025)
di: Wang, Guoqing, et al.
Pubblicazione: (2025)
Simple Is Effective: The Roles of Graphs and Large Language Models in Knowledge-Graph-Based Retrieval-Augmented Generation
di: Li, Mufei, et al.
Pubblicazione: (2024)
di: Li, Mufei, et al.
Pubblicazione: (2024)
Flow Equivariant World Models: Memory for Partially Observed Dynamic Environments
di: Lillemark, Hansen Jin, et al.
Pubblicazione: (2026)
di: Lillemark, Hansen Jin, et al.
Pubblicazione: (2026)
Translate Policy to Language: Flow Matching Generated Rewards for LLM Explanations
di: Yang, Xinyi, et al.
Pubblicazione: (2025)
di: Yang, Xinyi, et al.
Pubblicazione: (2025)
It's Not That Simple. An Analysis of Simple Test-Time Scaling
di: Wu, Guojun
Pubblicazione: (2025)
di: Wu, Guojun
Pubblicazione: (2025)
SOLAR 10.7B: Scaling Large Language Models with Simple yet Effective Depth Up-Scaling
di: Kim, Dahyun, et al.
Pubblicazione: (2023)
di: Kim, Dahyun, et al.
Pubblicazione: (2023)
Documenti analoghi
-
One Model is All You Need: ByT5-Sanskrit, a Unified Model for Sanskrit NLP Tasks
di: Nehrdich, Sebastian, et al.
Pubblicazione: (2024) -
Characterizing Prompt Compression Methods for Long Context Inference
di: Jha, Siddharth, et al.
Pubblicazione: (2024) -
QFT: Quantized Full-parameter Tuning of LLMs with Affordable Resources
di: Li, Zhikai, et al.
Pubblicazione: (2023) -
Learned Best-Effort LLM Serving
di: Jha, Siddharth, et al.
Pubblicazione: (2024) -
CDLM: Consistency Diffusion Language Models For Faster Sampling
di: Kim, Minseo, et al.
Pubblicazione: (2025)