PersonalQ: Select, Quantize, and Serve Personalized Diffusion Models for Efficient Inference
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Qirui, Guo, Qi, Sun, Yiding, Yang, Junkai, Zhang, Dongxu, Pang, Shanmin, Guo, Qing |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Knowledge-Refined Dual Context-Aware Network for Partially Relevant Video Retrieval
par: Yang, Junkai, et autres
Publié: (2026)
par: Yang, Junkai, et autres
Publié: (2026)
Efficient Personalization of Quantized Diffusion Model without Backpropagation
par: Seo, Hoigi, et autres
Publié: (2025)
par: Seo, Hoigi, et autres
Publié: (2025)
CFMS: A Coarse-to-Fine Multimodal Synthesis Framework for Enhanced Tabular Reasoning
par: Huang, Qixian, et autres
Publié: (2026)
par: Huang, Qixian, et autres
Publié: (2026)
Efficient Generation of Targeted and Transferable Adversarial Examples for Vision-Language Models Via Diffusion Models
par: Guo, Qi, et autres
Publié: (2024)
par: Guo, Qi, et autres
Publié: (2024)
Offline Policy Optimization with Posterior Sampling
par: Lin, Hongqiang, et autres
Publié: (2026)
par: Lin, Hongqiang, et autres
Publié: (2026)
RDKV: Rate-Distortion Bit Allocation for Joint Eviction and Quantization of the KV Cache
par: Zhang, Junkai, et autres
Publié: (2026)
par: Zhang, Junkai, et autres
Publié: (2026)
ESTAR: Early-Stopping Token-Aware Reasoning For Efficient Inference
par: Wang, Junda, et autres
Publié: (2026)
par: Wang, Junda, et autres
Publié: (2026)
PerQ: Efficient Evaluation of Multilingual Text Personalization Quality
par: Macko, Dominik, et autres
Publié: (2025)
par: Macko, Dominik, et autres
Publié: (2025)
A Comparative Study of Large Language Models and Human Personality Traits
par: Jiaqi, Wang, et autres
Publié: (2025)
par: Jiaqi, Wang, et autres
Publié: (2025)
NanoResearch: Co-Evolving Skills, Memory, and Policy for Personalized Research Automation
par: Xu, Jinhang, et autres
Publié: (2026)
par: Xu, Jinhang, et autres
Publié: (2026)
PFedDST: Personalized Federated Learning with Decentralized Selection Training
par: Fan, Mengchen, et autres
Publié: (2025)
par: Fan, Mengchen, et autres
Publié: (2025)
ToolSpectrum : Towards Personalized Tool Utilization for Large Language Models
par: Cheng, Zihao, et autres
Publié: (2025)
par: Cheng, Zihao, et autres
Publié: (2025)
Personality-Guided Code Generation Using Large Language Models
par: Guo, Yaoqi, et autres
Publié: (2024)
par: Guo, Yaoqi, et autres
Publié: (2024)
Fints: Efficient Inference-Time Personalization for LLMs with Fine-Grained Instance-Tailored Steering
par: Du, Kounianhua, et autres
Publié: (2025)
par: Du, Kounianhua, et autres
Publié: (2025)
SwiftDiffusion: Efficient Diffusion Model Serving with Add-on Modules
par: Li, Suyi, et autres
Publié: (2024)
par: Li, Suyi, et autres
Publié: (2024)
When Personalization Legitimizes Risks: Uncovering Safety Vulnerabilities in Personalized Dialogue Agents
par: Guo, Jiahe, et autres
Publié: (2026)
par: Guo, Jiahe, et autres
Publié: (2026)
Efficient Controllable Diffusion via Optimal Classifier Guidance
par: Oertell, Owen, et autres
Publié: (2025)
par: Oertell, Owen, et autres
Publié: (2025)
Towards Realistic Personalization: Evaluating Long-Horizon Preference Following in Personalized User-LLM Interactions
par: Guo, Qianyun, et autres
Publié: (2026)
par: Guo, Qianyun, et autres
Publié: (2026)
GPMFS: Global Foundation and Personalized Optimization for Multi-Label Feature Selection
par: Cao, Yifan, et autres
Publié: (2025)
par: Cao, Yifan, et autres
Publié: (2025)
CMHANet: A Cross-Modal Hybrid Attention Network for Point Cloud Registration
par: Zhang, Dongxu, et autres
Publié: (2026)
par: Zhang, Dongxu, et autres
Publié: (2026)
Privacy Preserving Inference of Personalized Content for Out of Matrix Users
par: Sun, Michael, et autres
Publié: (2025)
par: Sun, Michael, et autres
Publié: (2025)
Context Steering: Controllable Personalization at Inference Time
par: He, Jerry Zhi-Yang, et autres
Publié: (2024)
par: He, Jerry Zhi-Yang, et autres
Publié: (2024)
M2I2: Learning Efficient Multi-Agent Communication via Masked State Modeling and Intention Inference
par: Sun, Chuxiong, et autres
Publié: (2024)
par: Sun, Chuxiong, et autres
Publié: (2024)
Efficient Personalized Reranking with Semi-Autoregressive Generation and Online Knowledge Distillation
par: Cheng, Kai, et autres
Publié: (2026)
par: Cheng, Kai, et autres
Publié: (2026)
Robust Regularized Policy Iteration under Transition Uncertainty
par: Lin, Hongqiang, et autres
Publié: (2026)
par: Lin, Hongqiang, et autres
Publié: (2026)
The Reward Model Selection Crisis in Personalized Alignment
par: Rezk, Fady, et autres
Publié: (2025)
par: Rezk, Fady, et autres
Publié: (2025)
Reasoning Language Model Inference Serving Unveiled: An Empirical Study
par: Li, Qi, et autres
Publié: (2025)
par: Li, Qi, et autres
Publié: (2025)
Explain Less, Understand More: Jargon Detection via Personalized Parameter-Efficient Fine-tuning
par: Wu, Bohao, et autres
Publié: (2025)
par: Wu, Bohao, et autres
Publié: (2025)
A Forced-Choice Neural Cognitive Diagnostic Model of Personality Testing
par: Li, Xiaoyu, et autres
Publié: (2025)
par: Li, Xiaoyu, et autres
Publié: (2025)
Quantization Meets dLLMs: A Systematic Study of Post-training Quantization for Diffusion LLMs
par: Lin, Haokun, et autres
Publié: (2025)
par: Lin, Haokun, et autres
Publié: (2025)
SPECTRE: Hybrid Ordinary-Parallel Speculative Serving for Resource-Efficient LLM Inference
par: Xie, Jincheng, et autres
Publié: (2026)
par: Xie, Jincheng, et autres
Publié: (2026)
Personalized Federated Training of Diffusion Models with Privacy Guarantees
par: Patel, Kumar Kshitij, et autres
Publié: (2025)
par: Patel, Kumar Kshitij, et autres
Publié: (2025)
Few-for-Many Personalized Federated Learning
par: Guo, Ping, et autres
Publié: (2026)
par: Guo, Ping, et autres
Publié: (2026)
I-Design: Personalized LLM Interior Designer
par: Çelen, Ata, et autres
Publié: (2024)
par: Çelen, Ata, et autres
Publié: (2024)
Personalized Turn-Level User Conversation Satisfaction Benchmark
par: Wang, Zhefan, et autres
Publié: (2026)
par: Wang, Zhefan, et autres
Publié: (2026)
Efficient LLM Serving on Hybrid Real-time and Best-effort Requests
par: Borui, Wan, et autres
Publié: (2025)
par: Borui, Wan, et autres
Publié: (2025)
Personalized Topic Selection Model for Topic-Grounded Dialogue
par: Fan, Shixuan, et autres
Publié: (2024)
par: Fan, Shixuan, et autres
Publié: (2024)
PRIME: Large Language Model Personalization with Cognitive Dual-Memory and Personalized Thought Process
par: Zhang, Xinliang Frederick, et autres
Publié: (2025)
par: Zhang, Xinliang Frederick, et autres
Publié: (2025)
Synthesizing Efficient Data with Diffusion Models for Person Re-Identification Pre-Training
par: Niu, Ke, et autres
Publié: (2024)
par: Niu, Ke, et autres
Publié: (2024)
Efficient Serving of LLM Applications with Probabilistic Demand Modeling
par: Liu, Yifei, et autres
Publié: (2025)
par: Liu, Yifei, et autres
Publié: (2025)
Documents similaires
-
Knowledge-Refined Dual Context-Aware Network for Partially Relevant Video Retrieval
par: Yang, Junkai, et autres
Publié: (2026) -
Efficient Personalization of Quantized Diffusion Model without Backpropagation
par: Seo, Hoigi, et autres
Publié: (2025) -
CFMS: A Coarse-to-Fine Multimodal Synthesis Framework for Enhanced Tabular Reasoning
par: Huang, Qixian, et autres
Publié: (2026) -
Efficient Generation of Targeted and Transferable Adversarial Examples for Vision-Language Models Via Diffusion Models
par: Guo, Qi, et autres
Publié: (2024) -
Offline Policy Optimization with Posterior Sampling
par: Lin, Hongqiang, et autres
Publié: (2026)