Neural Search Space in Gboard Decoder
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Yanxiang, Zhang, Yuanbo, Sun, Haicheng, Wang, Yun, Dou, Billy, Sivek, Gary, Zhai, Shumin |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Proofread: Fixes All Errors with One Tap
par: Liu, Renjie, et autres
Publié: (2024)
par: Liu, Renjie, et autres
Publié: (2024)
Can Capacitive Touch Images Enhance Mobile Keyboard Decoding?
par: Lertvittayakumjorn, Piyawat, et autres
Publié: (2024)
par: Lertvittayakumjorn, Piyawat, et autres
Publié: (2024)
Prompt Public Large Language Models to Synthesize Data for Private On-device Applications
par: Wu, Shanshan, et autres
Publié: (2024)
par: Wu, Shanshan, et autres
Publié: (2024)
Synthesizing and Adapting Error Correction Data for Mobile Large Language Model Applications
par: Zhang, Yanxiang, et autres
Publié: (2025)
par: Zhang, Yanxiang, et autres
Publié: (2025)
Private federated discovery of out-of-vocabulary words for Gboard
par: Sun, Ziteng, et autres
Publié: (2024)
par: Sun, Ziteng, et autres
Publié: (2024)
Wide-In, Narrow-Out: Revokable Decoding for Efficient and Effective DLLMs
par: Hong, Feng, et autres
Publié: (2025)
par: Hong, Feng, et autres
Publié: (2025)
Eliciting Chain-of-Thought in Base LLMs via Gradient-Based Representation Optimization
par: Wang, Zijian, et autres
Publié: (2025)
par: Wang, Zijian, et autres
Publié: (2025)
Deductive Beam Search: Decoding Deducible Rationale for Chain-of-Thought Reasoning
par: Zhu, Tinghui, et autres
Publié: (2024)
par: Zhu, Tinghui, et autres
Publié: (2024)
Improving Minimum Bayes Risk Decoding with Multi-Prompt
par: Heineman, David, et autres
Publié: (2024)
par: Heineman, David, et autres
Publié: (2024)
MLLM can see? Dynamic Correction Decoding for Hallucination Mitigation
par: Wang, Chenxi, et autres
Publié: (2024)
par: Wang, Chenxi, et autres
Publié: (2024)
Improving Diffusion Language Model Decoding through Joint Search in Generation Order and Token Space
par: Shen, Yangyi, et autres
Publié: (2026)
par: Shen, Yangyi, et autres
Publié: (2026)
SIA: A Synthesize-Inject-Align Framework for Knowledge-Grounded and Secure E-commerce Search LLMs with Industrial Deployment
par: Zhai, Zhouwei, et autres
Publié: (2026)
par: Zhai, Zhouwei, et autres
Publié: (2026)
You Only Cache Once: Decoder-Decoder Architectures for Language Models
par: Sun, Yutao, et autres
Publié: (2024)
par: Sun, Yutao, et autres
Publié: (2024)
LogitsCoder: Towards Efficient Chain-of-Thought Path Search via Logits Preference Decoding for Code Generation
par: Chen, Jizheng, et autres
Publié: (2026)
par: Chen, Jizheng, et autres
Publié: (2026)
NanoSpec: Accelerating Speculative Decoding using Minimalist In-Context Vocabularies
par: Chen, Zhiyang, et autres
Publié: (2026)
par: Chen, Zhiyang, et autres
Publié: (2026)
LM-Searcher: Cross-domain Neural Architecture Search with LLMs via Unified Numerical Encoding
par: Hu, Yuxuan, et autres
Publié: (2025)
par: Hu, Yuxuan, et autres
Publié: (2025)
DART: Diffusion-Inspired Speculative Decoding for Fast LLM Inference
par: Liu, Fuliang, et autres
Publié: (2026)
par: Liu, Fuliang, et autres
Publié: (2026)
Decoding at the Speed of Thought: Harnessing Parallel Decoding of Lexical Units for LLMs
par: Sun, Chenxi, et autres
Publié: (2024)
par: Sun, Chenxi, et autres
Publié: (2024)
Encoder-Decoder or Decoder-Only? Revisiting Encoder-Decoder Large Language Model
par: Zhang, Biao, et autres
Publié: (2025)
par: Zhang, Biao, et autres
Publié: (2025)
VisualSpeech: Enhancing Prosody Modeling in TTS Using Video
par: Que, Shumin, et autres
Publié: (2025)
par: Que, Shumin, et autres
Publié: (2025)
Towards Building Multilingual Language Model for Medicine
par: Qiu, Pengcheng, et autres
Publié: (2024)
par: Qiu, Pengcheng, et autres
Publié: (2024)
OpenDecoder: Open Large Language Model Decoding to Incorporate Document Quality in RAG
par: Mo, Fengran, et autres
Publié: (2026)
par: Mo, Fengran, et autres
Publié: (2026)
MT-SNN: Enhance Spiking Neural Network with Multiple Thresholds
par: Wang, Xiaoting, et autres
Publié: (2023)
par: Wang, Xiaoting, et autres
Publié: (2023)
NeuSpeech: Decode Neural signal as Speech
par: Yang, Yiqian, et autres
Publié: (2024)
par: Yang, Yiqian, et autres
Publié: (2024)
PEARL: Parallel Speculative Decoding with Adaptive Draft Length
par: Liu, Tianyu, et autres
Publié: (2024)
par: Liu, Tianyu, et autres
Publié: (2024)
Language-Informed Beam Search Decoding for Multilingual Machine Translation
par: Yang, Yilin, et autres
Publié: (2024)
par: Yang, Yilin, et autres
Publié: (2024)
Fine-grained Conversational Decoding via Isotropic and Proximal Search
par: Yao, Yuxuan, et autres
Publié: (2023)
par: Yao, Yuxuan, et autres
Publié: (2023)
Search-o1: Agentic Search-Enhanced Large Reasoning Models
par: Li, Xiaoxi, et autres
Publié: (2025)
par: Li, Xiaoxi, et autres
Publié: (2025)
Multi-Drafter Speculative Decoding with Alignment Feedback
par: Kim, Taehyeon, et autres
Publié: (2026)
par: Kim, Taehyeon, et autres
Publié: (2026)
Accelerate Speculative Decoding with Sparse Computation in Verification
par: Wang, Jikai, et autres
Publié: (2025)
par: Wang, Jikai, et autres
Publié: (2025)
Ouroboros: Generating Longer Drafts Phrase by Phrase for Faster Speculative Decoding
par: Zhao, Weilin, et autres
Publié: (2024)
par: Zhao, Weilin, et autres
Publié: (2024)
Generalization or Memorization: Dynamic Decoding for Mode Steering
par: Zhang, Xuanming
Publié: (2025)
par: Zhang, Xuanming
Publié: (2025)
Gradual Forgetting: Logarithmic Compression for Extending Transformer Context Windows
par: Dickson, Billy, et autres
Publié: (2025)
par: Dickson, Billy, et autres
Publié: (2025)
Fast Best-of-N Decoding via Speculative Rejection
par: Sun, Hanshi, et autres
Publié: (2024)
par: Sun, Hanshi, et autres
Publié: (2024)
A Survey of Conversational Search
par: Mo, Fengran, et autres
Publié: (2024)
par: Mo, Fengran, et autres
Publié: (2024)
Using Learning Progressions to Guide AI Feedback for Science Learning
par: Xia, Xin, et autres
Publié: (2026)
par: Xia, Xin, et autres
Publié: (2026)
Decoding the Multimodal Mind: Generalizable Brain-to-Text Translation via Multimodal Alignment and Adaptive Routing
par: Ye, Chunyu, et autres
Publié: (2025)
par: Ye, Chunyu, et autres
Publié: (2025)
Why Prompt Design Matters and Works: A Complexity Analysis of Prompt Search Space in LLMs
par: Zhang, Xiang, et autres
Publié: (2025)
par: Zhang, Xiang, et autres
Publié: (2025)
ZeroSearch: Incentivize the Search Capability of LLMs without Searching
par: Sun, Hao, et autres
Publié: (2025)
par: Sun, Hao, et autres
Publié: (2025)
Astra: Activation-Space Tail-Eigenvector Low-Rank Adaptation of Large Language Models
par: Liu, Kainan, et autres
Publié: (2026)
par: Liu, Kainan, et autres
Publié: (2026)
Documents similaires
-
Proofread: Fixes All Errors with One Tap
par: Liu, Renjie, et autres
Publié: (2024) -
Can Capacitive Touch Images Enhance Mobile Keyboard Decoding?
par: Lertvittayakumjorn, Piyawat, et autres
Publié: (2024) -
Prompt Public Large Language Models to Synthesize Data for Private On-device Applications
par: Wu, Shanshan, et autres
Publié: (2024) -
Synthesizing and Adapting Error Correction Data for Mobile Large Language Model Applications
par: Zhang, Yanxiang, et autres
Publié: (2025) -
Private federated discovery of out-of-vocabulary words for Gboard
par: Sun, Ziteng, et autres
Publié: (2024)