Guardado en:
| Autores principales: | Li, Yuanpeng, Hestness, Joel, Elhoseiny, Mohamed, Zhao, Liang, Church, Kenneth |
|---|---|
| Formato: | Preprint |
| Publicado: |
2022
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2201.01942 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Sparse maximal update parameterization: A holistic approach to sparse training dynamics
por: Dey, Nolan, et al.
Publicado: (2024)
por: Dey, Nolan, et al.
Publicado: (2024)
No Culture Left Behind: ArtELingo-28, a Benchmark of WikiArt with Captions in 28 Languages
por: Mohamed, Youssef, et al.
Publicado: (2024)
por: Mohamed, Youssef, et al.
Publicado: (2024)
Predicting Training Re-evaluation Curves Enables Effective Data Curriculums for LLMs
por: Bergsma, Shane, et al.
Publicado: (2025)
por: Bergsma, Shane, et al.
Publicado: (2025)
MediSwift: Efficient Sparse Pre-trained Biomedical Language Models
por: Thangarasa, Vithursan, et al.
Publicado: (2024)
por: Thangarasa, Vithursan, et al.
Publicado: (2024)
Normalization Layer Per-Example Gradients are Sufficient to Predict Gradient Noise Scale in Transformers
por: Gray, Gavia, et al.
Publicado: (2024)
por: Gray, Gavia, et al.
Publicado: (2024)
Structural Disentanglement of Causal and Correlated Concepts
por: Zhao, Qilong, et al.
Publicado: (2024)
por: Zhao, Qilong, et al.
Publicado: (2024)
Disentangled Representations for Causal Cognition
por: Torresan, Filippo, et al.
Publicado: (2024)
por: Torresan, Filippo, et al.
Publicado: (2024)
Disentangled Representation Learning for Causal Inference with Instruments
por: Cheng, Debo, et al.
Publicado: (2024)
por: Cheng, Debo, et al.
Publicado: (2024)
Scaling with Collapse: Efficient and Predictable Training of LLM Families
por: Bergsma, Shane, et al.
Publicado: (2025)
por: Bergsma, Shane, et al.
Publicado: (2025)
Learning Causally Disentangled Representations via the Principle of Independent Causal Mechanisms
por: Komanduri, Aneesh, et al.
Publicado: (2023)
por: Komanduri, Aneesh, et al.
Publicado: (2023)
Intervening to Learn and Compose Causally Disentangled Representations
por: Markham, Alex, et al.
Publicado: (2025)
por: Markham, Alex, et al.
Publicado: (2025)
Causal Flow-based Variational Auto-Encoder for Disentangled Causal Representation Learning
por: Fan, Di, et al.
Publicado: (2023)
por: Fan, Di, et al.
Publicado: (2023)
Linear Causal Representation Learning by Topological Ordering, Pruning, and Disentanglement
por: Chen, Hao, et al.
Publicado: (2025)
por: Chen, Hao, et al.
Publicado: (2025)
Disentangling Causal Substructures for Interpretable and Generalizable Drug Synergy Prediction
por: Luo, Yi, et al.
Publicado: (2025)
por: Luo, Yi, et al.
Publicado: (2025)
Causality-Driven Disentangled Representation Learning in Multiplex Graphs
por: Nasiri, Saba, et al.
Publicado: (2026)
por: Nasiri, Saba, et al.
Publicado: (2026)
CoRPO: Adding a Correctness Bias to GRPO Improves Generalization
por: Garg, Anisha, et al.
Publicado: (2025)
por: Garg, Anisha, et al.
Publicado: (2025)
A Theoretical Analysis of Compositional Generalization in Neural Networks: A Necessary and Sufficient Condition
por: Li, Yuanpeng
Publicado: (2025)
por: Li, Yuanpeng
Publicado: (2025)
Disentangling Dynamical Systems: Causal Representation Learning Meets Local Sparse Attention
por: Baumgartner, Markus W., et al.
Publicado: (2026)
por: Baumgartner, Markus W., et al.
Publicado: (2026)
Power Lines: Scaling Laws for Weight Decay and Batch Size in LLM Pre-training
por: Bergsma, Shane, et al.
Publicado: (2025)
por: Bergsma, Shane, et al.
Publicado: (2025)
Domain-Aware Continual Zero-Shot Learning
por: Yi, Kai, et al.
Publicado: (2021)
por: Yi, Kai, et al.
Publicado: (2021)
Fair Graph Representation Learning via Sensitive Attribute Disentanglement
por: Zhu, Yuchang, et al.
Publicado: (2024)
por: Zhu, Yuchang, et al.
Publicado: (2024)
Temporal Positive-unlabeled Learning for Biomedical Hypothesis Generation via Risk Estimation
por: Akujuobi, Uchenna, et al.
Publicado: (2020)
por: Akujuobi, Uchenna, et al.
Publicado: (2020)
Straight to Zero: Why Linearly Decaying the Learning Rate to Zero Works Best for LLMs
por: Bergsma, Shane, et al.
Publicado: (2025)
por: Bergsma, Shane, et al.
Publicado: (2025)
Bi-Factorial Preference Optimization: Balancing Safety-Helpfulness in Language Models
por: Zhang, Wenxuan, et al.
Publicado: (2024)
por: Zhang, Wenxuan, et al.
Publicado: (2024)
CompoSE: Compositional Synthesis and Editing of 3D Shapes via Part-Aware Control
por: Slim, Habib, et al.
Publicado: (2026)
por: Slim, Habib, et al.
Publicado: (2026)
Disentangled Double Machine Learning for Accurate Causal Effect Estimation
por: Xiang, Guodu, et al.
Publicado: (2026)
por: Xiang, Guodu, et al.
Publicado: (2026)
Variational Learning of Disentangled Representations
por: Slavutsky, Yuli, et al.
Publicado: (2025)
por: Slavutsky, Yuli, et al.
Publicado: (2025)
A Shared Valence Axis Across Modern LLMs and Human EEG: The Saturation Regularity
por: Radwan, Yousef A., et al.
Publicado: (2026)
por: Radwan, Yousef A., et al.
Publicado: (2026)
Rethinking State Disentanglement in Causal Reinforcement Learning
por: Cao, Haiyao, et al.
Publicado: (2024)
por: Cao, Haiyao, et al.
Publicado: (2024)
Freshness-Aware Prioritized Experience Replay for LLM/VLM Reinforcement Learning
por: Ma, Weiyu, et al.
Publicado: (2026)
por: Ma, Weiyu, et al.
Publicado: (2026)
Disentangled Representation Learning
por: Wang, Xin, et al.
Publicado: (2022)
por: Wang, Xin, et al.
Publicado: (2022)
Query-based Knowledge Transfer for Heterogeneous Learning Environments
por: Alballa, Norah, et al.
Publicado: (2025)
por: Alballa, Norah, et al.
Publicado: (2025)
Disentangled Representation Learning via Flow Matching
por: Chi, Jinjin, et al.
Publicado: (2026)
por: Chi, Jinjin, et al.
Publicado: (2026)
Federated Granger Causality Learning for Interdependent Clients with State Space Representation
por: Mohanty, Ayush, et al.
Publicado: (2025)
por: Mohanty, Ayush, et al.
Publicado: (2025)
Don't be lazy: CompleteP enables compute-efficient deep transformers
por: Dey, Nolan, et al.
Publicado: (2025)
por: Dey, Nolan, et al.
Publicado: (2025)
Continual Learning on a Diet: Learning from Sparsely Labeled Streams Under Constrained Computation
por: Zhang, Wenxuan, et al.
Publicado: (2024)
por: Zhang, Wenxuan, et al.
Publicado: (2024)
Inductive Subgraphs as Shortcuts: Causal Disentanglement for Heterophilic Graph Learning
por: Wang, Xiangmeng, et al.
Publicado: (2026)
por: Wang, Xiangmeng, et al.
Publicado: (2026)
Disentangled Generative Graph Representation Learning
por: Hu, Xinyue, et al.
Publicado: (2024)
por: Hu, Xinyue, et al.
Publicado: (2024)
Learning Time-Aware Causal Representation for Model Generalization in Evolving Domains
por: He, Zhuo, et al.
Publicado: (2025)
por: He, Zhuo, et al.
Publicado: (2025)
Disentangled Hyperbolic Representation Learning for Heterogeneous Graphs
por: Bai, Qijie, et al.
Publicado: (2024)
por: Bai, Qijie, et al.
Publicado: (2024)
Ejemplares similares
-
Sparse maximal update parameterization: A holistic approach to sparse training dynamics
por: Dey, Nolan, et al.
Publicado: (2024) -
No Culture Left Behind: ArtELingo-28, a Benchmark of WikiArt with Captions in 28 Languages
por: Mohamed, Youssef, et al.
Publicado: (2024) -
Predicting Training Re-evaluation Curves Enables Effective Data Curriculums for LLMs
por: Bergsma, Shane, et al.
Publicado: (2025) -
MediSwift: Efficient Sparse Pre-trained Biomedical Language Models
por: Thangarasa, Vithursan, et al.
Publicado: (2024) -
Normalization Layer Per-Example Gradients are Sufficient to Predict Gradient Noise Scale in Transformers
por: Gray, Gavia, et al.
Publicado: (2024)