Salvato in:
| Autori principali: | Zheng, Xinzhe, Yang, Zhen-Qun, Liu, Zishan, Xie, Haoran, Qin, S. Joe, Chen, Arlene, Lin, Fangzhen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2509.03054 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SplitQuantV2: Enhancing Low-Bit Quantization of LLMs Without GPUs
di: Song, Jaewoo, et al.
Pubblicazione: (2025)
di: Song, Jaewoo, et al.
Pubblicazione: (2025)
SplitQuant: Layer Splitting for Low-Bit Neural Network Quantization
di: Song, Jaewoo, et al.
Pubblicazione: (2025)
di: Song, Jaewoo, et al.
Pubblicazione: (2025)
DAQ: Density-Aware Post-Training Weight-Only Quantization For LLMs
di: Luo, Yingsong, et al.
Pubblicazione: (2024)
di: Luo, Yingsong, et al.
Pubblicazione: (2024)
Predicting Multi-Type Talented Students in Secondary School Using Semi-Supervised Machine Learning
di: Zheng, Xinzhe, et al.
Pubblicazione: (2025)
di: Zheng, Xinzhe, et al.
Pubblicazione: (2025)
Emotion-Enhanced Multi-Task Learning with LLMs for Aspect Category Sentiment Analysis
di: Chai, Yaping, et al.
Pubblicazione: (2025)
di: Chai, Yaping, et al.
Pubblicazione: (2025)
Unsupervised Accelerated MRI Reconstruction via Ground-Truth-Free Flow Matching
di: Luo, Xinzhe, et al.
Pubblicazione: (2025)
di: Luo, Xinzhe, et al.
Pubblicazione: (2025)
Predicting Student Dropout Risk With A Dual-Modal Abrupt Behavioral Changes Approach
di: Cheng, Jiabei, et al.
Pubblicazione: (2025)
di: Cheng, Jiabei, et al.
Pubblicazione: (2025)
Imagine a City: CityGenAgent for Procedural 3D City Generation
di: Liu, Zishan, et al.
Pubblicazione: (2026)
di: Liu, Zishan, et al.
Pubblicazione: (2026)
When LLMs Team Up: The Emergence of Collaborative Affective Computing
di: Lai, Wenna, et al.
Pubblicazione: (2025)
di: Lai, Wenna, et al.
Pubblicazione: (2025)
DAST: Context-Aware Compression in LLMs via Dynamic Allocation of Soft Tokens
di: Chen, Shaoshen, et al.
Pubblicazione: (2025)
di: Chen, Shaoshen, et al.
Pubblicazione: (2025)
Similarity-as-Evidence: Calibrating Overconfident VLMs for Interpretable and Label-Efficient Medical Active Learning
di: Xie, Zhuofan, et al.
Pubblicazione: (2026)
di: Xie, Zhuofan, et al.
Pubblicazione: (2026)
SINQ: Sinkhorn-Normalized Quantization for Calibration-Free Low-Precision LLM Weights
di: Müller, Lorenz K., et al.
Pubblicazione: (2025)
di: Müller, Lorenz K., et al.
Pubblicazione: (2025)
Emergent Hierarchical Reasoning in LLMs through Reinforcement Learning
di: Wang, Haozhe, et al.
Pubblicazione: (2025)
di: Wang, Haozhe, et al.
Pubblicazione: (2025)
Efficiently Integrate Large Language Models with Visual Perception: A Survey from the Training Paradigm Perspective
di: Ma, Xiaorui, et al.
Pubblicazione: (2025)
di: Ma, Xiaorui, et al.
Pubblicazione: (2025)
Text Data Augmentation for Large Language Models: A Comprehensive Survey of Methods, Challenges, and Opportunities
di: Chai, Yaping, et al.
Pubblicazione: (2025)
di: Chai, Yaping, et al.
Pubblicazione: (2025)
Semantic-preserved Augmentation with Confidence-weighted Fine-tuning for Aspect Category Sentiment Analysis
di: Chai, Yaping, et al.
Pubblicazione: (2025)
di: Chai, Yaping, et al.
Pubblicazione: (2025)
Task-Routed Mixture-of-Experts with Cognitive Appraisal for Implicit Sentiment Analysis
di: Chai, Yaping, et al.
Pubblicazione: (2026)
di: Chai, Yaping, et al.
Pubblicazione: (2026)
Constant-Memory Strategies in Stochastic Games: Best Responses and Equilibria
di: Zhu, Fengming, et al.
Pubblicazione: (2025)
di: Zhu, Fengming, et al.
Pubblicazione: (2025)
Computing Universal Plans for Partially Observable Multi-Agent Routing Using Answer Set Programming
di: Zhu, Fengming, et al.
Pubblicazione: (2023)
di: Zhu, Fengming, et al.
Pubblicazione: (2023)
Single-Agent Planning in a Multi-Agent System: A Unified Framework for Type-Based Planners
di: Zhu, Fengming, et al.
Pubblicazione: (2025)
di: Zhu, Fengming, et al.
Pubblicazione: (2025)
CondAmbigQA: A Benchmark and Dataset for Conditional Ambiguous Question Answering
di: Li, Zongxi, et al.
Pubblicazione: (2025)
di: Li, Zongxi, et al.
Pubblicazione: (2025)
UPMRI: Unsupervised Parallel MRI Reconstruction via Projected Conditional Flow Matching
di: Luo, Xinzhe, et al.
Pubblicazione: (2025)
di: Luo, Xinzhe, et al.
Pubblicazione: (2025)
Accurate LoRA-Finetuning Quantization of LLMs via Information Retention
di: Qin, Haotong, et al.
Pubblicazione: (2024)
di: Qin, Haotong, et al.
Pubblicazione: (2024)
HARGPT: Are LLMs Zero-Shot Human Activity Recognizers?
di: Ji, Sijie, et al.
Pubblicazione: (2024)
di: Ji, Sijie, et al.
Pubblicazione: (2024)
TileQ: Efficient Low-Rank Quantization of Mixture-of-Experts with 2D Tiling
di: Gu, Hongyaoxing, et al.
Pubblicazione: (2026)
di: Gu, Hongyaoxing, et al.
Pubblicazione: (2026)
Quantized Delta Weight Is Safety Keeper
di: Liu, Yule, et al.
Pubblicazione: (2024)
di: Liu, Yule, et al.
Pubblicazione: (2024)
Optimize Weight Rounding via Signed Gradient Descent for the Quantization of LLMs
di: Cheng, Wenhua, et al.
Pubblicazione: (2023)
di: Cheng, Wenhua, et al.
Pubblicazione: (2023)
AdpQ: A Zero-shot Calibration Free Adaptive Post Training Quantization Method for LLMs
di: Ghaffari, Alireza, et al.
Pubblicazione: (2024)
di: Ghaffari, Alireza, et al.
Pubblicazione: (2024)
Rethinking ChatGPT's Success: Usability and Cognitive Behaviors Enabled by Auto-regressive LLMs' Prompting
di: Li, Xinzhe, et al.
Pubblicazione: (2024)
di: Li, Xinzhe, et al.
Pubblicazione: (2024)
Grouped Sequency-arranged Rotation: Optimizing Rotation Transformation for Quantization for Free
di: Choi, Euntae, et al.
Pubblicazione: (2025)
di: Choi, Euntae, et al.
Pubblicazione: (2025)
Fine-grained Verification via Diagnostic Reasoning Supervision for Aspect Sentiment Triplet Extraction
di: Lai, Wenna, et al.
Pubblicazione: (2026)
di: Lai, Wenna, et al.
Pubblicazione: (2026)
Computational Explorations About Photoinduced Behaviors for 2‐(2‐hydroxyphenyl)benzoxazole Derivatives by Substituted Alkyl Groups: A TDDFT Study
di: Junping Xiao, et al.
Pubblicazione: (2025)
di: Junping Xiao, et al.
Pubblicazione: (2025)
DMP_AI: An AI-Aided K-12 System for Teaching and Learning in Diverse Schools
di: Yang, Zhen-Qun, et al.
Pubblicazione: (2024)
di: Yang, Zhen-Qun, et al.
Pubblicazione: (2024)
Weight Group-wise Post-Training Quantization for Medical Foundation Model
di: Chen, Yineng, et al.
Pubblicazione: (2026)
di: Chen, Yineng, et al.
Pubblicazione: (2026)
Scaling Image Tokenizers with Grouped Spherical Quantization
di: Wang, Jiangtao, et al.
Pubblicazione: (2024)
di: Wang, Jiangtao, et al.
Pubblicazione: (2024)
DeNAS-ViT: Data Efficient NAS-Optimized Vision Transformer for Ultrasound Image Segmentation
di: Chen, Renqi, et al.
Pubblicazione: (2024)
di: Chen, Renqi, et al.
Pubblicazione: (2024)
Training-Free Vector Quantization via Gaussian VAEs
di: Xu, Tongda, et al.
Pubblicazione: (2025)
di: Xu, Tongda, et al.
Pubblicazione: (2025)
MVR-cache: Optimizing Semantic Caching via Multi-Vector Retrieval and Learned Prompt Segmentation
di: Noshad, Ali, et al.
Pubblicazione: (2026)
di: Noshad, Ali, et al.
Pubblicazione: (2026)
Quantization Meets Reasoning: Exploring LLM Low-Bit Quantization Degradation for Mathematical Reasoning
di: Li, Zhen, et al.
Pubblicazione: (2025)
di: Li, Zhen, et al.
Pubblicazione: (2025)
Integer Scale: A Free Lunch for Faster Fine-grained Quantization of LLMs
di: Li, Qingyuan, et al.
Pubblicazione: (2024)
di: Li, Qingyuan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
SplitQuantV2: Enhancing Low-Bit Quantization of LLMs Without GPUs
di: Song, Jaewoo, et al.
Pubblicazione: (2025) -
SplitQuant: Layer Splitting for Low-Bit Neural Network Quantization
di: Song, Jaewoo, et al.
Pubblicazione: (2025) -
DAQ: Density-Aware Post-Training Weight-Only Quantization For LLMs
di: Luo, Yingsong, et al.
Pubblicazione: (2024) -
Predicting Multi-Type Talented Students in Secondary School Using Semi-Supervised Machine Learning
di: Zheng, Xinzhe, et al.
Pubblicazione: (2025) -
Emotion-Enhanced Multi-Task Learning with LLMs for Aspect Category Sentiment Analysis
di: Chai, Yaping, et al.
Pubblicazione: (2025)