To be Continuous, or to be Discrete, Those are Bits of Questions
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Yiran, Utiyama, Masao |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
On Eliciting Syntax from Language Models via Hashing
par: Wang, Yiran, et autres
Publié: (2024)
par: Wang, Yiran, et autres
Publié: (2024)
OptiMer: Optimal Distribution Vector Merging Is Better than Data Mixing for Continual Pre-Training
par: Song, Haiyue, et autres
Publié: (2026)
par: Song, Haiyue, et autres
Publié: (2026)
Structured Document Translation via Format Reinforcement Learning
par: Song, Haiyue, et autres
Publié: (2025)
par: Song, Haiyue, et autres
Publié: (2025)
Minimum Bayes Risk Decoding for Error Span Detection in Reference-Free Automatic Machine Translation Evaluation
par: Lyu, Boxuan, et autres
Publié: (2025)
par: Lyu, Boxuan, et autres
Publié: (2025)
The Best Instruction-Tuning Data are Those That Fit
par: Zhang, Dylan, et autres
Publié: (2025)
par: Zhang, Dylan, et autres
Publié: (2025)
MoBiQuant: Mixture-of-Bits Quantization for Token-Adaptive Any-Precision LLM
par: Wang, Dongwei, et autres
Publié: (2026)
par: Wang, Dongwei, et autres
Publié: (2026)
LittleBit: Ultra Low-Bit Quantization via Latent Factorization
par: Lee, Banseok, et autres
Publié: (2025)
par: Lee, Banseok, et autres
Publié: (2025)
Continuous Diffusion Scales Competitively with Discrete Diffusion for Language
par: Yang, Zhihan, et autres
Publié: (2026)
par: Yang, Zhihan, et autres
Publié: (2026)
Unifying Continuous and Discrete Text Diffusion with Non-simultaneous Diffusion Processes
par: Li, Bocheng, et autres
Publié: (2025)
par: Li, Bocheng, et autres
Publié: (2025)
FOREVER: Forgetting Curve-Inspired Memory Replay for Language Model Continual Learning
par: Feng, Yujie, et autres
Publié: (2026)
par: Feng, Yujie, et autres
Publié: (2026)
Discrete Markov Bridge
par: Li, Hengli, et autres
Publié: (2025)
par: Li, Hengli, et autres
Publié: (2025)
Unleashing Low-Bit Inference on Ascend NPUs: A Comprehensive Evaluation of HiFloat Formats
par: Zhao, Pengxiang, et autres
Publié: (2026)
par: Zhao, Pengxiang, et autres
Publié: (2026)
An Extra RMSNorm is All You Need for Fine Tuning to 1.58 Bits
par: Steinmetz, Cody, et autres
Publié: (2025)
par: Steinmetz, Cody, et autres
Publié: (2025)
More Than Bits: Multi-Envelope Double Binary Factorization for Extreme Quantization
par: Ichikawa, Yuma, et autres
Publié: (2025)
par: Ichikawa, Yuma, et autres
Publié: (2025)
Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models
par: Park, Jungwoo, et autres
Publié: (2025)
par: Park, Jungwoo, et autres
Publié: (2025)
RotateKV: Accurate and Robust 2-Bit KV Cache Quantization for LLMs via Outlier-Aware Adaptive Rotations
par: Su, Zunhai, et autres
Publié: (2025)
par: Su, Zunhai, et autres
Publié: (2025)
LogQuant: Log-Distributed 2-Bit Quantization of KV Cache with Superior Accuracy Preservation
par: Chen, Han, et autres
Publié: (2025)
par: Chen, Han, et autres
Publié: (2025)
Parameter-Efficient Fine-Tuning with Discrete Fourier Transform
par: Gao, Ziqi, et autres
Publié: (2024)
par: Gao, Ziqi, et autres
Publié: (2024)
Generalized Interpolating Discrete Diffusion
par: von Rütte, Dimitri, et autres
Publié: (2025)
par: von Rütte, Dimitri, et autres
Publié: (2025)
I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models
par: Hu, Xing, et autres
Publié: (2024)
par: Hu, Xing, et autres
Publié: (2024)
What Makes Low-Bit Quantization-Aware Training Work for Reasoning LLMs? A Systematic Study
par: Lv, Keyu, et autres
Publié: (2026)
par: Lv, Keyu, et autres
Publié: (2026)
Synthetic Multimodal Question Generation
par: Wu, Ian, et autres
Publié: (2024)
par: Wu, Ian, et autres
Publié: (2024)
Unlocking the Theory Behind Scaling 1-Bit Neural Networks
par: Daliri, Majid, et autres
Publié: (2024)
par: Daliri, Majid, et autres
Publié: (2024)
When Answers Stray from Questions: Hallucination Detection via Question-Answer Orthogonal Decomposition
par: Yao, Siyang, et autres
Publié: (2026)
par: Yao, Siyang, et autres
Publié: (2026)
Retrieval Augmented Question Answering: When Should LLMs Admit Ignorance?
par: Wang, Dingmin, et autres
Publié: (2025)
par: Wang, Dingmin, et autres
Publié: (2025)
UQ: Assessing Language Models on Unsolved Questions
par: Nie, Fan, et autres
Publié: (2025)
par: Nie, Fan, et autres
Publié: (2025)
COMPKE: Complex Question Answering under Knowledge Editing
par: Cheng, Keyuan, et autres
Publié: (2025)
par: Cheng, Keyuan, et autres
Publié: (2025)
UniMoT: Unified Molecule-Text Language Model with Discrete Token Representation
par: Guo, Shuhan, et autres
Publié: (2024)
par: Guo, Shuhan, et autres
Publié: (2024)
Simultaneous Multi-objective Alignment Across Verifiable and Non-verifiable Rewards
par: Shen, Yiran, et autres
Publié: (2025)
par: Shen, Yiran, et autres
Publié: (2025)
Generalized Discrete Diffusion from Snapshots
par: Zekri, Oussama, et autres
Publié: (2026)
par: Zekri, Oussama, et autres
Publié: (2026)
Examining LLMs' Uncertainty Expression Towards Questions Outside Parametric Knowledge
par: Liu, Genglin, et autres
Publié: (2023)
par: Liu, Genglin, et autres
Publié: (2023)
Interpretable Question Answering with Knowledge Graphs
par: Aneja, Kartikeya, et autres
Publié: (2025)
par: Aneja, Kartikeya, et autres
Publié: (2025)
Multi-hop Question Answering under Temporal Knowledge Editing
par: Cheng, Keyuan, et autres
Publié: (2024)
par: Cheng, Keyuan, et autres
Publié: (2024)
COIN: Uncertainty-Guarding Selective Question Answering for Foundation Models with Provable Risk Guarantees
par: Wang, Zhiyuan, et autres
Publié: (2025)
par: Wang, Zhiyuan, et autres
Publié: (2025)
FlashSampling: Fast and Memory-Efficient Exact Sampling
par: Ruiz, Tomas, et autres
Publié: (2026)
par: Ruiz, Tomas, et autres
Publié: (2026)
DRESSing Up LLM: Efficient Stylized Question-Answering via Style Subspace Editing
par: Ma, Xinyu, et autres
Publié: (2025)
par: Ma, Xinyu, et autres
Publié: (2025)
A Semantic-Sampling Framework for Evaluating Calibration in Open-Ended Question Answering
par: Wang, Zhanliang, et autres
Publié: (2026)
par: Wang, Zhanliang, et autres
Publié: (2026)
Time-MQA: Time Series Multi-Task Question Answering with Context Enhancement
par: Kong, Yaxuan, et autres
Publié: (2025)
par: Kong, Yaxuan, et autres
Publié: (2025)
ThinkRouter: Efficient Reasoning via Routing Thinking between Latent and Discrete Spaces
par: Xu, Xin, et autres
Publié: (2026)
par: Xu, Xin, et autres
Publié: (2026)
Non-Markovian Discrete Diffusion with Causal Language Models
par: Zhang, Yangtian, et autres
Publié: (2025)
par: Zhang, Yangtian, et autres
Publié: (2025)
Documents similaires
-
On Eliciting Syntax from Language Models via Hashing
par: Wang, Yiran, et autres
Publié: (2024) -
OptiMer: Optimal Distribution Vector Merging Is Better than Data Mixing for Continual Pre-Training
par: Song, Haiyue, et autres
Publié: (2026) -
Structured Document Translation via Format Reinforcement Learning
par: Song, Haiyue, et autres
Publié: (2025) -
Minimum Bayes Risk Decoding for Error Span Detection in Reference-Free Automatic Machine Translation Evaluation
par: Lyu, Boxuan, et autres
Publié: (2025) -
The Best Instruction-Tuning Data are Those That Fit
par: Zhang, Dylan, et autres
Publié: (2025)