BitTP: The Lightweight Trajectory Prediction Model with BitLLM for Edge-Devices
Fuente:
arXiv
Guardado en:
| Autores principales: | Kang, Mincheol, Lim, Hyunjin, Kang, Bomin, Park, Daehee |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
BitMar: Low-Bit Multimodal Fusion with Episodic Memory for Edge Devices
por: Aman, Euhid, et al.
Publicado: (2025)
por: Aman, Euhid, et al.
Publicado: (2025)
Vec-LUT: Vector Table Lookup for Parallel Ultra-Low-Bit LLM Inference on Edge Devices
por: Li, Xiangyu, et al.
Publicado: (2025)
por: Li, Xiangyu, et al.
Publicado: (2025)
Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models
por: Park, Jungwoo, et al.
Publicado: (2025)
por: Park, Jungwoo, et al.
Publicado: (2025)
FlashCommunication V2: Bit Splitting and Spike Reserving for Any Bit Communication
por: Li, Qingyuan, et al.
Publicado: (2025)
por: Li, Qingyuan, et al.
Publicado: (2025)
Q-Palette: Fractional-Bit Quantizers Toward Optimal Bit Allocation for Efficient LLM Deployment
por: Lee, Deokjae, et al.
Publicado: (2025)
por: Lee, Deokjae, et al.
Publicado: (2025)
BitsMoE: Efficient Spectral Energy-Guided Bit Allocation for MoE LLM Quantization
por: Zhao, Jiayu, et al.
Publicado: (2026)
por: Zhao, Jiayu, et al.
Publicado: (2026)
From Bits to Boardrooms: A Cutting-Edge Multi-Agent LLM Framework for Business Excellence
por: Wang, Zihao, et al.
Publicado: (2025)
por: Wang, Zihao, et al.
Publicado: (2025)
T-MAC: CPU Renaissance via Table Lookup for Low-Bit LLM Deployment on Edge
por: Wei, Jianyu, et al.
Publicado: (2024)
por: Wei, Jianyu, et al.
Publicado: (2024)
BitHydra: Towards Bit-flip Inference Cost Attack against Large Language Models
por: Yan, Xiaobei, et al.
Publicado: (2025)
por: Yan, Xiaobei, et al.
Publicado: (2025)
Targeted Bit-Flip Attacks on LLM-Based Agents
por: Wang, Jialai, et al.
Publicado: (2026)
por: Wang, Jialai, et al.
Publicado: (2026)
MAGNET: Autonomous Expert Model Generation via Decentralized Autoresearch and BitNet Training
por: Kim, Yongwan, et al.
Publicado: (2026)
por: Kim, Yongwan, et al.
Publicado: (2026)
MoBiQuant: Mixture-of-Bits Quantization for Token-Adaptive Any-Precision LLM
por: Wang, Dongwei, et al.
Publicado: (2026)
por: Wang, Dongwei, et al.
Publicado: (2026)
LittleBit: Ultra Low-Bit Quantization via Latent Factorization
por: Lee, Banseok, et al.
Publicado: (2025)
por: Lee, Banseok, et al.
Publicado: (2025)
LM-Fix: Lightweight Bit-Flip Detection and Rapid Recovery Framework for Language Models
por: Tahmasivand, Ahmad, et al.
Publicado: (2025)
por: Tahmasivand, Ahmad, et al.
Publicado: (2025)
Hybrid Bit and Semantic Communications
por: Yu, Kaiwen, et al.
Publicado: (2024)
por: Yu, Kaiwen, et al.
Publicado: (2024)
BitCal-TTS: Bit-Calibrated Test-Time Scaling for Quantized Reasoning Models
por: Patarlapalli, Sai Babu, et al.
Publicado: (2026)
por: Patarlapalli, Sai Babu, et al.
Publicado: (2026)
Multi-agent Long-term 3D Human Pose Forecasting via Interaction-aware Trajectory Conditioning
por: Jeong, Jaewoo, et al.
Publicado: (2024)
por: Jeong, Jaewoo, et al.
Publicado: (2024)
InfoQuant: Shaping Activation Distributions for Low-Bit LLM Quantization
por: Li, Ke, et al.
Publicado: (2026)
por: Li, Ke, et al.
Publicado: (2026)
Learning Grouped Lattice Vector Quantizers for Low-Bit LLM Compression
por: Zhang, Xi, et al.
Publicado: (2025)
por: Zhang, Xi, et al.
Publicado: (2025)
Why Do Some Inputs Break Low-Bit LLM Quantization?
por: Chang, Ting-Yun, et al.
Publicado: (2025)
por: Chang, Ting-Yun, et al.
Publicado: (2025)
UltraSketchLLM: Saliency-Driven Sketching for Ultra-Low Bit LLM Compression
por: Zou, Sunan, et al.
Publicado: (2025)
por: Zou, Sunan, et al.
Publicado: (2025)
Row-Column Hybrid Grouping for Fault-Resilient Multi-Bit Weight Representation on IMC Arrays
por: Jeon, Kang Eun, et al.
Publicado: (2025)
por: Jeon, Kang Eun, et al.
Publicado: (2025)
Tiled Bit Networks: Sub-Bit Neural Network Compression Through Reuse of Learnable Binary Vectors
por: Gorbett, Matt, et al.
Publicado: (2024)
por: Gorbett, Matt, et al.
Publicado: (2024)
XMark: Reliable Multi-Bit Watermarking for LLM-Generated Texts
por: Xu, Jiahao, et al.
Publicado: (2026)
por: Xu, Jiahao, et al.
Publicado: (2026)
Ontology-Free General-Domain Knowledge Graph-to-Text Generation Dataset Synthesis using Large Language Model
por: Kim, Daehee, et al.
Publicado: (2024)
por: Kim, Daehee, et al.
Publicado: (2024)
Generative Semantic Communication: Diffusion Models Beyond Bit Recovery
por: Grassucci, Eleonora, et al.
Publicado: (2023)
por: Grassucci, Eleonora, et al.
Publicado: (2023)
Normalized Architectures are Natively 4-Bit
por: Fishman, Maxim, et al.
Publicado: (2026)
por: Fishman, Maxim, et al.
Publicado: (2026)
Every Bit, Everywhere, All at Once: A Binomial Multibit LLM Watermark
por: Gloaguen, Thibaud, et al.
Publicado: (2026)
por: Gloaguen, Thibaud, et al.
Publicado: (2026)
LittleBit-2: Maximizing the Spectral Energy Gain in Sub-1-Bit LLMs via Latent Geometry Alignment
por: Lee, Banseok, et al.
Publicado: (2026)
por: Lee, Banseok, et al.
Publicado: (2026)
Quant-dLLM: Post-Training Extreme Low-Bit Quantization for Diffusion Large Language Models
por: Zhang, Tianao, et al.
Publicado: (2025)
por: Zhang, Tianao, et al.
Publicado: (2025)
Evolution Strategy-Based Calibration for Low-Bit Quantization of Speech Models
por: Rakotoarivony, Lucas
Publicado: (2026)
por: Rakotoarivony, Lucas
Publicado: (2026)
CredID: Credible Multi-Bit Watermark for Large Language Models Identification
por: Jiang, Haoyu, et al.
Publicado: (2024)
por: Jiang, Haoyu, et al.
Publicado: (2024)
BitDecoding: Unlocking Tensor Cores for Long-Context LLMs with Low-Bit KV Cache
por: Du, Dayou, et al.
Publicado: (2025)
por: Du, Dayou, et al.
Publicado: (2025)
FlipLLM: Efficient Bit-Flip Attacks on Multimodal LLMs using Reinforcement Learning
por: Khalil, Khurram, et al.
Publicado: (2025)
por: Khalil, Khurram, et al.
Publicado: (2025)
Quantization Meets Reasoning: Exploring LLM Low-Bit Quantization Degradation for Mathematical Reasoning
por: Li, Zhen, et al.
Publicado: (2025)
por: Li, Zhen, et al.
Publicado: (2025)
Human-aligned Chess with a Bit of Search
por: Zhang, Yiming, et al.
Publicado: (2024)
por: Zhang, Yiming, et al.
Publicado: (2024)
Easy Come, Easy Go? Examining the Perceptions and Learning Effects of LLM-based Chatbot in the Context of Search-as-Learning
por: Yang, Yeonsun, et al.
Publicado: (2024)
por: Yang, Yeonsun, et al.
Publicado: (2024)
Collaborative-Distilled Diffusion Models (CDDM) for Accelerated and Lightweight Trajectory Prediction
por: Wang, Bingzhang, et al.
Publicado: (2025)
por: Wang, Bingzhang, et al.
Publicado: (2025)
To be Continuous, or to be Discrete, Those are Bits of Questions
por: Wang, Yiran, et al.
Publicado: (2024)
por: Wang, Yiran, et al.
Publicado: (2024)
Nearly Lossless Adaptive Bit Switching
por: Huang, Haiduo, et al.
Publicado: (2025)
por: Huang, Haiduo, et al.
Publicado: (2025)
Ejemplares similares
-
BitMar: Low-Bit Multimodal Fusion with Episodic Memory for Edge Devices
por: Aman, Euhid, et al.
Publicado: (2025) -
Vec-LUT: Vector Table Lookup for Parallel Ultra-Low-Bit LLM Inference on Edge Devices
por: Li, Xiangyu, et al.
Publicado: (2025) -
Outlier-Safe Pre-Training for Robust 4-Bit Quantization of Large Language Models
por: Park, Jungwoo, et al.
Publicado: (2025) -
FlashCommunication V2: Bit Splitting and Spike Reserving for Any Bit Communication
por: Li, Qingyuan, et al.
Publicado: (2025) -
Q-Palette: Fractional-Bit Quantizers Toward Optimal Bit Allocation for Efficient LLM Deployment
por: Lee, Deokjae, et al.
Publicado: (2025)