Scalable Co-Clustering for Large-Scale Data through Dynamic Partitioning and Hierarchical Merging
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wu, Zihan, Huang, Zhaoke, Yan, Hong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Heuristic Search Space Partitioning for Low-Latency Multi-Tenant Cloud Queries
par: Pathak, Prashant Kumar, et autres
Publié: (2026)
par: Pathak, Prashant Kumar, et autres
Publié: (2026)
Challenges of Heterogeneity in Big Data: A Comparative Study of Classification in Large-Scale Structured and Unstructured Domains
par: Eduardo, González Trigueros Jesús, et autres
Publié: (2025)
par: Eduardo, González Trigueros Jesús, et autres
Publié: (2025)
Scalability Optimization in Cloud-Based AI Inference Services: Strategies for Real-Time Load Balancing and Automated Scaling
par: Jin, Yihong, et autres
Publié: (2025)
par: Jin, Yihong, et autres
Publié: (2025)
Spark-LLM-Eval: A Distributed Framework for Statistically Rigorous Large Language Model Evaluation
par: Mitra, Subhadip
Publié: (2026)
par: Mitra, Subhadip
Publié: (2026)
Cost-Aware Logging: Measuring the Financial Impact of Excessive Log Retention in Small-Scale Cloud Deployments
par: Putra, Jody Almaida
Publié: (2026)
par: Putra, Jody Almaida
Publié: (2026)
Learning Interpretable Scheduling Algorithms for Data Processing Clusters
par: Hu, Zhibo, et autres
Publié: (2024)
par: Hu, Zhibo, et autres
Publié: (2024)
Deploy, Calibrate, Monitor, Heal -- No Human Required: An Autonomous AI SRE Agent for Elasticsearch
par: Mukkolakkal, Muhamed Ramees Cheriya
Publié: (2026)
par: Mukkolakkal, Muhamed Ramees Cheriya
Publié: (2026)
Operational Memory Architecture for Kubernetes:Preserving Causal Context Across the Evidence Horizon
par: Khan, Shamsher
Publié: (2026)
par: Khan, Shamsher
Publié: (2026)
Experimentally Evaluating the Resource Efficiency of Big Data Autoscaling
par: Will, Jonathan, et autres
Publié: (2025)
par: Will, Jonathan, et autres
Publié: (2025)
Efficient Construction of Large Search Spaces for Auto-Tuning
par: Willemsen, Floris-Jan, et autres
Publié: (2025)
par: Willemsen, Floris-Jan, et autres
Publié: (2025)
Analysis of Design Patterns and Benchmark Practices in Apache Kafka Event-Streaming Systems
par: Mohammad, Muzeeb
Publié: (2025)
par: Mohammad, Muzeeb
Publié: (2025)
Deadline-Aware Joint Task Scheduling and Offloading in Mobile Edge Computing Systems
par: Nguyen, Ngoc Hung, et autres
Publié: (2025)
par: Nguyen, Ngoc Hung, et autres
Publié: (2025)
N2N: A Parallel Framework for Large-Scale MILP under Distributed Memory
par: Wang, Longfei, et autres
Publié: (2025)
par: Wang, Longfei, et autres
Publié: (2025)
Token Arena: A Continuous Benchmark Unifying Energy and Cognition in AI Inference
par: Gao, Yuxuan, et autres
Publié: (2026)
par: Gao, Yuxuan, et autres
Publié: (2026)
FLEdge: Benchmarking Federated Machine Learning Applications in Edge Computing Systems
par: Woisetschläger, Herbert, et autres
Publié: (2023)
par: Woisetschläger, Herbert, et autres
Publié: (2023)
Theseus: A Distributed and Scalable GPU-Accelerated Query Processing Platform Optimized for Efficient Data Movement
par: Aramburú, Felipe, et autres
Publié: (2025)
par: Aramburú, Felipe, et autres
Publié: (2025)
The Energy-Throughput Trade-off in Lossless-Compressed Source Code Storage
par: Ferragina, Paolo, et autres
Publié: (2026)
par: Ferragina, Paolo, et autres
Publié: (2026)
Massively Parallel Genetic Optimization through Asynchronous Propagation of Populations
par: Taubert, Oskar, et autres
Publié: (2023)
par: Taubert, Oskar, et autres
Publié: (2023)
Evaluating the Overhead of the Performance Profiler Cloudprofiler With MooBench
par: Yang, Shinhyung, et autres
Publié: (2024)
par: Yang, Shinhyung, et autres
Publié: (2024)
Federated Fine-Tuning of LLMs on the Very Edge: The Good, the Bad, the Ugly
par: Woisetschläger, Herbert, et autres
Publié: (2023)
par: Woisetschläger, Herbert, et autres
Publié: (2023)
A Semantic Partitioning Method for Large-Scale Training of Knowledge Graph Embeddings
par: Bai, Yuhe
Publié: (2025)
par: Bai, Yuhe
Publié: (2025)
Revisiting Reliability in Large-Scale Machine Learning Research Clusters
par: Kokolis, Apostolos, et autres
Publié: (2024)
par: Kokolis, Apostolos, et autres
Publié: (2024)
PRISM: Dynamic Primitive-Based Forecasting for Large-Scale GPU Cluster Workloads
par: Wu, Xin, et autres
Publié: (2026)
par: Wu, Xin, et autres
Publié: (2026)
Evaluating Large Language Models for Workload Mapping and Scheduling in Heterogeneous HPC Systems
par: Sharma, Aasish Kumar, et autres
Publié: (2025)
par: Sharma, Aasish Kumar, et autres
Publié: (2025)
AsyncHZP: Hierarchical ZeRO Parallelism with Asynchronous Scheduling for Scalable LLM Training
par: Bai, Huawei, et autres
Publié: (2025)
par: Bai, Huawei, et autres
Publié: (2025)
SiDA-MoE: Sparsity-Inspired Data-Aware Serving for Efficient and Scalable Large Mixture-of-Experts Models
par: Du, Zhixu, et autres
Publié: (2023)
par: Du, Zhixu, et autres
Publié: (2023)
Scalable High-Dimensional Multivariate Linear Regression for Feature-Distributed Data
par: Huang, Shuo-Chieh, et autres
Publié: (2023)
par: Huang, Shuo-Chieh, et autres
Publié: (2023)
Arena: Efficiently Training Large Models via Dynamic Scheduling and Adaptive Parallelism Co-Design
par: Xue, Chunyu, et autres
Publié: (2024)
par: Xue, Chunyu, et autres
Publié: (2024)
ASTRA-sim2.0: Modeling Hierarchical Networks and Disaggregated Systems for Large-model Training at Scale
par: Won, William, et autres
Publié: (2023)
par: Won, William, et autres
Publié: (2023)
sVIRGO: A Scalable Virtual Tree Hierarchical Framework for Distributed Systems
par: Huang, Lican
Publié: (2026)
par: Huang, Lican
Publié: (2026)
Decoupled Vertical Federated Learning for Practical Training on Vertically Partitioned Data
par: Amalanshu, Avi, et autres
Publié: (2024)
par: Amalanshu, Avi, et autres
Publié: (2024)
Learning the Optimal Path and DNN Partition for Collaborative Edge Inference
par: Huang, Yin, et autres
Publié: (2024)
par: Huang, Yin, et autres
Publié: (2024)
Deep RC: A Scalable Data Engineering and Deep Learning Pipeline
par: Sarker, Arup Kumar, et autres
Publié: (2025)
par: Sarker, Arup Kumar, et autres
Publié: (2025)
PRISM: Probabilistic Runtime Insights and Scalable Performance Modeling for Large-Scale Distributed Training
par: Golden, Alicia, et autres
Publié: (2025)
par: Golden, Alicia, et autres
Publié: (2025)
FedClust: Optimizing Federated Learning on Non-IID Data through Weight-Driven Client Clustering
par: Islam, Md Sirajul, et autres
Publié: (2024)
par: Islam, Md Sirajul, et autres
Publié: (2024)
EmbedPart: Embedding-Driven Graph Partitioning for Scalable Graph Neural Network Training
par: Merkel, Nikolai, et autres
Publié: (2026)
par: Merkel, Nikolai, et autres
Publié: (2026)
Rethinking Personalized Federated Learning with Clustering-based Dynamic Graph Propagation
par: Wang, Jiaqi, et autres
Publié: (2024)
par: Wang, Jiaqi, et autres
Publié: (2024)
Understanding Large-Scale HPC System Behavior Through Cluster-Based Visual Analytics
par: Austin, Allison, et autres
Publié: (2026)
par: Austin, Allison, et autres
Publié: (2026)
Large-Scale Graph Building in Dynamic Environments: Low Latency and High Quality
par: de Almeida, Filipe Miguel Gonçalves, et autres
Publié: (2025)
par: de Almeida, Filipe Miguel Gonçalves, et autres
Publié: (2025)
Cross-Silo Federated Learning for Multi-Tier Networks with Vertical and Horizontal Data Partitioning
par: Das, Anirban, et autres
Publié: (2021)
par: Das, Anirban, et autres
Publié: (2021)
Documents similaires
-
Heuristic Search Space Partitioning for Low-Latency Multi-Tenant Cloud Queries
par: Pathak, Prashant Kumar, et autres
Publié: (2026) -
Challenges of Heterogeneity in Big Data: A Comparative Study of Classification in Large-Scale Structured and Unstructured Domains
par: Eduardo, González Trigueros Jesús, et autres
Publié: (2025) -
Scalability Optimization in Cloud-Based AI Inference Services: Strategies for Real-Time Load Balancing and Automated Scaling
par: Jin, Yihong, et autres
Publié: (2025) -
Spark-LLM-Eval: A Distributed Framework for Statistically Rigorous Large Language Model Evaluation
par: Mitra, Subhadip
Publié: (2026) -
Cost-Aware Logging: Measuring the Financial Impact of Excessive Log Retention in Small-Scale Cloud Deployments
par: Putra, Jody Almaida
Publié: (2026)