Chameleon: Taming Dynamic Operator Sequences for Memory-Intensive LLM Training
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Zibo, Zhou, Yuhang, Wang, Zhibin, Li, Shipeng, Huang, Xinjing, Cai, Chendong, Mu, Bingxu, Sun, Yuqing, Hu, Zhiheng, She, Bin, You, Shu, Fang, Guanghuan, Gu, Rong, Dou, Wanchun, Chen, Guihai, Tian, Chen |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Chameleon: Adaptive Fault Tolerance for Distributed Training via Real-time Policy Selection
par: Zhou, Yuhang, et autres
Publié: (2025)
par: Zhou, Yuhang, et autres
Publié: (2025)
Revisiting Service Level Objectives and System Level Metrics in Large Language Model Serving
par: Wang, Zhibin, et autres
Publié: (2024)
par: Wang, Zhibin, et autres
Publié: (2024)
Echo: Efficient Co-Scheduling of Hybrid Online-Offline Tasks for Large Language Model Serving
par: Wang, Zhibin, et autres
Publié: (2025)
par: Wang, Zhibin, et autres
Publié: (2025)
Chameleon: Episodic Memory for Long-Horizon Robotic Manipulation
par: Guo, Xinying, et autres
Publié: (2026)
par: Guo, Xinying, et autres
Publié: (2026)
STAR: Decode-Phase Rescheduling for LLM Inference
par: Wang, Zhibin, et autres
Publié: (2025)
par: Wang, Zhibin, et autres
Publié: (2025)
Optimizing Feature Extraction for On-device Model Inference with User Behavior Sequences
par: Gong, Chen, et autres
Publié: (2026)
par: Gong, Chen, et autres
Publié: (2026)
Accelerating Mixture-of-Experts Inference by Hiding Offloading Latency with Speculative Decoding
par: Wang, Zhibin, et autres
Publié: (2025)
par: Wang, Zhibin, et autres
Publié: (2025)
Climate change, institution, and the economy
par: Haichao Fan, et autres
Publié: (2024)
par: Haichao Fan, et autres
Publié: (2024)
MemCam: Memory-Augmented Camera Control for Consistent Video Generation
par: Gao, Xinhang, et autres
Publié: (2026)
par: Gao, Xinhang, et autres
Publié: (2026)
AscendKernelGen: A Systematic Study of LLM-Based Kernel Generation for Neural Processing Units
par: Cao, Xinzi, et autres
Publié: (2026)
par: Cao, Xinzi, et autres
Publié: (2026)
Treating Brain-inspired Memories as Priors for Diffusion Model to Forecast Multivariate Time Series
par: Wang, Muyao, et autres
Publié: (2024)
par: Wang, Muyao, et autres
Publié: (2024)
DART: Diffusion-Inspired Speculative Decoding for Fast LLM Inference
par: Liu, Fuliang, et autres
Publié: (2026)
par: Liu, Fuliang, et autres
Publié: (2026)
Goal-oriented Transmission Scheduling: Structure-guided DRL with a Unified Dual On-policy and Off-policy Approach
par: Chen, Jiazheng, et autres
Publié: (2025)
par: Chen, Jiazheng, et autres
Publié: (2025)
Liouville theorems for fractional elliptic systems with different orders
par: Xinjing Wang, et autres
Publié: (2025)
par: Xinjing Wang, et autres
Publié: (2025)
CodeChameleon: Personalized Encryption Framework for Jailbreaking Large Language Models
par: Lv, Huijie, et autres
Publié: (2024)
par: Lv, Huijie, et autres
Publié: (2024)
How Well Are State-Dependent Local Projections Capturing Nonlinearities?
par: You, Zhiheng
Publié: (2026)
par: You, Zhiheng
Publié: (2026)
Using Prior Studies to Design Experiments: An Empirical Bayes Approach
par: You, Zhiheng
Publié: (2026)
par: You, Zhiheng
Publié: (2026)
Chameleon2++: An Efficient and Scalable Variant Of Chameleon Clustering
par: Singh, Priyanshu, et autres
Publié: (2025)
par: Singh, Priyanshu, et autres
Publié: (2025)
Synthesis of Polyether Ester Plasticizer and Its Application Performance in Hydrogenated Nitrile Butadiene Rubber
par: Hui Li, et autres
Publié: (2025)
par: Hui Li, et autres
Publié: (2025)
Reference Recommendation based Membership Inference Attack against Hybrid-based Recommender Systems
par: Chi, Xiaoxiao, et autres
Publié: (2025)
par: Chi, Xiaoxiao, et autres
Publié: (2025)
Not All Pixels Are Equal: Pixel-wise Meta-Learning for Medical Segmentation with Noisy Labels
par: Mu, Chenyu, et autres
Publié: (2025)
par: Mu, Chenyu, et autres
Publié: (2025)
Controllable Multi‐Exciton Zero‐Dimensional Antimony‐Based Metal Halides for White‐light Emission and β‐Ray Detection
par: Chang‐hong Wei, et autres
Publié: (2024)
par: Chang‐hong Wei, et autres
Publié: (2024)
FedLPS: Heterogeneous Federated Learning for Multiple Tasks with Local Parameter Sharing
par: Jia, Yongzhe, et autres
Publié: (2024)
par: Jia, Yongzhe, et autres
Publié: (2024)
Chameleon: Benchmarking Detection and Backtracking on Commercial-Grade AI-Generated Videos
par: Liao, Xingming, et autres
Publié: (2025)
par: Liao, Xingming, et autres
Publié: (2025)
A Secure and Communication‐Efficient Federated Recommendation Method With Blockchain
par: Sheng Lu, et autres
Publié: (2025)
par: Sheng Lu, et autres
Publié: (2025)
SSV: Sparse Speculative Verification for Efficient LLM Inference
par: Wang, Zhibin, et autres
Publié: (2026)
par: Wang, Zhibin, et autres
Publié: (2026)
Nova: Real-Time Agentic Vision-Language Model Serving with Adaptive Cross-Stage Parallelization
par: Xu, Yuhang, et autres
Publié: (2025)
par: Xu, Yuhang, et autres
Publié: (2025)
Modeling Elastic-Body Dynamics of Robotic Fish Using a Variational Framework
par: Chen, Zhiheng, et autres
Publié: (2025)
par: Chen, Zhiheng, et autres
Publié: (2025)
Dynamic Modeling and Efficient Data-Driven Optimal Control for Micro Autonomous Surface Vehicles
par: Chen, Zhiheng, et autres
Publié: (2025)
par: Chen, Zhiheng, et autres
Publié: (2025)
On higher Du Bois singularities and $K$-regularity
par: Shen, Wanchun
Publié: (2025)
par: Shen, Wanchun
Publié: (2025)
Improvement of Solid-Fluid Interaction Scheme in Lattice Boltzmann Immiscible Pseudopotential Models
par: Chen, Yizhong, et autres
Publié: (2025)
par: Chen, Yizhong, et autres
Publié: (2025)
A Corrected Open Boundary Framework for Lattice Boltzmann Immiscible Pseudopotential Models
par: Chen, Yizhong, et autres
Publié: (2025)
par: Chen, Yizhong, et autres
Publié: (2025)
MCFuser: High-Performance and Rapid Fusion of Memory-Bound Compute-Intensive Operators
par: Zhang, Zheng, et autres
Publié: (2025)
par: Zhang, Zheng, et autres
Publié: (2025)
Britain. Chameleon Clarke
Publié: (1994)
Publié: (1994)
Knowledge-Intensive Video Generation
par: Wang, Chenxu, et autres
Publié: (2026)
par: Wang, Chenxu, et autres
Publié: (2026)
RASP: Reliability ab initio simulation package of MOSFETs based on all-state model
par: Guo, Xinjing, et autres
Publié: (2026)
par: Guo, Xinjing, et autres
Publié: (2026)
Si/SiO$_\text{2}$ MOSFET Reliability Physics: From Four-State Model to All-State Model
par: Guo, Xinjing, et autres
Publié: (2024)
par: Guo, Xinjing, et autres
Publié: (2024)
Text2Mem: A Unified Memory Operation Language for Memory Operating System
par: Wang, Yi, et autres
Publié: (2025)
par: Wang, Yi, et autres
Publié: (2025)
Leveraging Genetic Instrumental Variables and Sequencing Analysis to Identify a Prognostic Signature Based on Epithelial Cell Markers in Lung Adenocarcinoma
par: Jiaye Lao, et autres
Publié: (2026)
par: Jiaye Lao, et autres
Publié: (2026)
A High‐Voltage Solid State Electrolyte Based on Spinel‐Like Chloride Made of Low‐Cost and Abundant Resources
par: Yuran Yu, et autres
Publié: (2024)
par: Yuran Yu, et autres
Publié: (2024)
Documents similaires
-
Chameleon: Adaptive Fault Tolerance for Distributed Training via Real-time Policy Selection
par: Zhou, Yuhang, et autres
Publié: (2025) -
Revisiting Service Level Objectives and System Level Metrics in Large Language Model Serving
par: Wang, Zhibin, et autres
Publié: (2024) -
Echo: Efficient Co-Scheduling of Hybrid Online-Offline Tasks for Large Language Model Serving
par: Wang, Zhibin, et autres
Publié: (2025) -
Chameleon: Episodic Memory for Long-Horizon Robotic Manipulation
par: Guo, Xinying, et autres
Publié: (2026) -
STAR: Decode-Phase Rescheduling for LLM Inference
par: Wang, Zhibin, et autres
Publié: (2025)