PersonalQ: Select, Quantize, and Serve Personalized Diffusion Models for Efficient Inference
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wang, Qirui, Guo, Qi, Sun, Yiding, Yang, Junkai, Zhang, Dongxu, Pang, Shanmin, Guo, Qing |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Knowledge-Refined Dual Context-Aware Network for Partially Relevant Video Retrieval
von: Yang, Junkai, et al.
Veröffentlicht: (2026)
von: Yang, Junkai, et al.
Veröffentlicht: (2026)
Efficient Personalization of Quantized Diffusion Model without Backpropagation
von: Seo, Hoigi, et al.
Veröffentlicht: (2025)
von: Seo, Hoigi, et al.
Veröffentlicht: (2025)
CFMS: A Coarse-to-Fine Multimodal Synthesis Framework for Enhanced Tabular Reasoning
von: Huang, Qixian, et al.
Veröffentlicht: (2026)
von: Huang, Qixian, et al.
Veröffentlicht: (2026)
Efficient Generation of Targeted and Transferable Adversarial Examples for Vision-Language Models Via Diffusion Models
von: Guo, Qi, et al.
Veröffentlicht: (2024)
von: Guo, Qi, et al.
Veröffentlicht: (2024)
Offline Policy Optimization with Posterior Sampling
von: Lin, Hongqiang, et al.
Veröffentlicht: (2026)
von: Lin, Hongqiang, et al.
Veröffentlicht: (2026)
RDKV: Rate-Distortion Bit Allocation for Joint Eviction and Quantization of the KV Cache
von: Zhang, Junkai, et al.
Veröffentlicht: (2026)
von: Zhang, Junkai, et al.
Veröffentlicht: (2026)
ESTAR: Early-Stopping Token-Aware Reasoning For Efficient Inference
von: Wang, Junda, et al.
Veröffentlicht: (2026)
von: Wang, Junda, et al.
Veröffentlicht: (2026)
PerQ: Efficient Evaluation of Multilingual Text Personalization Quality
von: Macko, Dominik, et al.
Veröffentlicht: (2025)
von: Macko, Dominik, et al.
Veröffentlicht: (2025)
A Comparative Study of Large Language Models and Human Personality Traits
von: Jiaqi, Wang, et al.
Veröffentlicht: (2025)
von: Jiaqi, Wang, et al.
Veröffentlicht: (2025)
NanoResearch: Co-Evolving Skills, Memory, and Policy for Personalized Research Automation
von: Xu, Jinhang, et al.
Veröffentlicht: (2026)
von: Xu, Jinhang, et al.
Veröffentlicht: (2026)
PFedDST: Personalized Federated Learning with Decentralized Selection Training
von: Fan, Mengchen, et al.
Veröffentlicht: (2025)
von: Fan, Mengchen, et al.
Veröffentlicht: (2025)
ToolSpectrum : Towards Personalized Tool Utilization for Large Language Models
von: Cheng, Zihao, et al.
Veröffentlicht: (2025)
von: Cheng, Zihao, et al.
Veröffentlicht: (2025)
Personality-Guided Code Generation Using Large Language Models
von: Guo, Yaoqi, et al.
Veröffentlicht: (2024)
von: Guo, Yaoqi, et al.
Veröffentlicht: (2024)
Fints: Efficient Inference-Time Personalization for LLMs with Fine-Grained Instance-Tailored Steering
von: Du, Kounianhua, et al.
Veröffentlicht: (2025)
von: Du, Kounianhua, et al.
Veröffentlicht: (2025)
SwiftDiffusion: Efficient Diffusion Model Serving with Add-on Modules
von: Li, Suyi, et al.
Veröffentlicht: (2024)
von: Li, Suyi, et al.
Veröffentlicht: (2024)
When Personalization Legitimizes Risks: Uncovering Safety Vulnerabilities in Personalized Dialogue Agents
von: Guo, Jiahe, et al.
Veröffentlicht: (2026)
von: Guo, Jiahe, et al.
Veröffentlicht: (2026)
Efficient Controllable Diffusion via Optimal Classifier Guidance
von: Oertell, Owen, et al.
Veröffentlicht: (2025)
von: Oertell, Owen, et al.
Veröffentlicht: (2025)
Towards Realistic Personalization: Evaluating Long-Horizon Preference Following in Personalized User-LLM Interactions
von: Guo, Qianyun, et al.
Veröffentlicht: (2026)
von: Guo, Qianyun, et al.
Veröffentlicht: (2026)
GPMFS: Global Foundation and Personalized Optimization for Multi-Label Feature Selection
von: Cao, Yifan, et al.
Veröffentlicht: (2025)
von: Cao, Yifan, et al.
Veröffentlicht: (2025)
CMHANet: A Cross-Modal Hybrid Attention Network for Point Cloud Registration
von: Zhang, Dongxu, et al.
Veröffentlicht: (2026)
von: Zhang, Dongxu, et al.
Veröffentlicht: (2026)
Privacy Preserving Inference of Personalized Content for Out of Matrix Users
von: Sun, Michael, et al.
Veröffentlicht: (2025)
von: Sun, Michael, et al.
Veröffentlicht: (2025)
Context Steering: Controllable Personalization at Inference Time
von: He, Jerry Zhi-Yang, et al.
Veröffentlicht: (2024)
von: He, Jerry Zhi-Yang, et al.
Veröffentlicht: (2024)
M2I2: Learning Efficient Multi-Agent Communication via Masked State Modeling and Intention Inference
von: Sun, Chuxiong, et al.
Veröffentlicht: (2024)
von: Sun, Chuxiong, et al.
Veröffentlicht: (2024)
Efficient Personalized Reranking with Semi-Autoregressive Generation and Online Knowledge Distillation
von: Cheng, Kai, et al.
Veröffentlicht: (2026)
von: Cheng, Kai, et al.
Veröffentlicht: (2026)
Robust Regularized Policy Iteration under Transition Uncertainty
von: Lin, Hongqiang, et al.
Veröffentlicht: (2026)
von: Lin, Hongqiang, et al.
Veröffentlicht: (2026)
The Reward Model Selection Crisis in Personalized Alignment
von: Rezk, Fady, et al.
Veröffentlicht: (2025)
von: Rezk, Fady, et al.
Veröffentlicht: (2025)
Reasoning Language Model Inference Serving Unveiled: An Empirical Study
von: Li, Qi, et al.
Veröffentlicht: (2025)
von: Li, Qi, et al.
Veröffentlicht: (2025)
Explain Less, Understand More: Jargon Detection via Personalized Parameter-Efficient Fine-tuning
von: Wu, Bohao, et al.
Veröffentlicht: (2025)
von: Wu, Bohao, et al.
Veröffentlicht: (2025)
A Forced-Choice Neural Cognitive Diagnostic Model of Personality Testing
von: Li, Xiaoyu, et al.
Veröffentlicht: (2025)
von: Li, Xiaoyu, et al.
Veröffentlicht: (2025)
Quantization Meets dLLMs: A Systematic Study of Post-training Quantization for Diffusion LLMs
von: Lin, Haokun, et al.
Veröffentlicht: (2025)
von: Lin, Haokun, et al.
Veröffentlicht: (2025)
SPECTRE: Hybrid Ordinary-Parallel Speculative Serving for Resource-Efficient LLM Inference
von: Xie, Jincheng, et al.
Veröffentlicht: (2026)
von: Xie, Jincheng, et al.
Veröffentlicht: (2026)
Personalized Federated Training of Diffusion Models with Privacy Guarantees
von: Patel, Kumar Kshitij, et al.
Veröffentlicht: (2025)
von: Patel, Kumar Kshitij, et al.
Veröffentlicht: (2025)
Few-for-Many Personalized Federated Learning
von: Guo, Ping, et al.
Veröffentlicht: (2026)
von: Guo, Ping, et al.
Veröffentlicht: (2026)
I-Design: Personalized LLM Interior Designer
von: Çelen, Ata, et al.
Veröffentlicht: (2024)
von: Çelen, Ata, et al.
Veröffentlicht: (2024)
Personalized Turn-Level User Conversation Satisfaction Benchmark
von: Wang, Zhefan, et al.
Veröffentlicht: (2026)
von: Wang, Zhefan, et al.
Veröffentlicht: (2026)
Efficient LLM Serving on Hybrid Real-time and Best-effort Requests
von: Borui, Wan, et al.
Veröffentlicht: (2025)
von: Borui, Wan, et al.
Veröffentlicht: (2025)
Personalized Topic Selection Model for Topic-Grounded Dialogue
von: Fan, Shixuan, et al.
Veröffentlicht: (2024)
von: Fan, Shixuan, et al.
Veröffentlicht: (2024)
PRIME: Large Language Model Personalization with Cognitive Dual-Memory and Personalized Thought Process
von: Zhang, Xinliang Frederick, et al.
Veröffentlicht: (2025)
von: Zhang, Xinliang Frederick, et al.
Veröffentlicht: (2025)
Synthesizing Efficient Data with Diffusion Models for Person Re-Identification Pre-Training
von: Niu, Ke, et al.
Veröffentlicht: (2024)
von: Niu, Ke, et al.
Veröffentlicht: (2024)
Efficient Serving of LLM Applications with Probabilistic Demand Modeling
von: Liu, Yifei, et al.
Veröffentlicht: (2025)
von: Liu, Yifei, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Knowledge-Refined Dual Context-Aware Network for Partially Relevant Video Retrieval
von: Yang, Junkai, et al.
Veröffentlicht: (2026) -
Efficient Personalization of Quantized Diffusion Model without Backpropagation
von: Seo, Hoigi, et al.
Veröffentlicht: (2025) -
CFMS: A Coarse-to-Fine Multimodal Synthesis Framework for Enhanced Tabular Reasoning
von: Huang, Qixian, et al.
Veröffentlicht: (2026) -
Efficient Generation of Targeted and Transferable Adversarial Examples for Vision-Language Models Via Diffusion Models
von: Guo, Qi, et al.
Veröffentlicht: (2024) -
Offline Policy Optimization with Posterior Sampling
von: Lin, Hongqiang, et al.
Veröffentlicht: (2026)