Saved in:
| Main Authors: | Shi, Kexuan, Li, Hanxuan, Qiu, Zeju, Wen, Yandong, Buchholz, Simon, Liu, Weiyang |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2605.12492 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Reparameterized LLM Training via Orthogonal Equivalence Transformation
by: Qiu, Zeju, et al.
Published: (2025)
by: Qiu, Zeju, et al.
Published: (2025)
Model Merging with Functional Dual Anchors
by: Shi, Kexuan, et al.
Published: (2025)
by: Shi, Kexuan, et al.
Published: (2025)
Orthogonal Model Merging
by: Yang, Sihan, et al.
Published: (2026)
by: Yang, Sihan, et al.
Published: (2026)
POET-X: Memory-efficient LLM Training by Scaling Orthogonal Transformation
by: Qiu, Zeju, et al.
Published: (2026)
by: Qiu, Zeju, et al.
Published: (2026)
Orthogonal Finetuning Made Scalable
by: Qiu, Zeju, et al.
Published: (2025)
by: Qiu, Zeju, et al.
Published: (2025)
PEFT-Arena: Understanding Parameter-Efficient Finetuning from a Stability-Plasticity Perspective
by: Huang, Yangyi, et al.
Published: (2026)
by: Huang, Yangyi, et al.
Published: (2026)
Symbolic Graphics Programming with Large Language Models
by: Chen, Yamei, et al.
Published: (2025)
by: Chen, Yamei, et al.
Published: (2025)
Parameter-Efficient Orthogonal Finetuning via Butterfly Factorization
by: Liu, Weiyang, et al.
Published: (2023)
by: Liu, Weiyang, et al.
Published: (2023)
Controlling Text-to-Image Diffusion by Orthogonal Finetuning
by: Qiu, Zeju, et al.
Published: (2023)
by: Qiu, Zeju, et al.
Published: (2023)
Rigidity-Aware Geometric Pretraining for Protein Design and Conformational Ensembles
by: Ni, Zhanghan, et al.
Published: (2026)
by: Ni, Zhanghan, et al.
Published: (2026)
Circuit Transformer: A Transformer That Preserves Logical Equivalence
by: Li, Xihan, et al.
Published: (2024)
by: Li, Xihan, et al.
Published: (2024)
AMO: Adaptive Muon Orthogonalization
by: Zhuang, Xinlin, et al.
Published: (2026)
by: Zhuang, Xinlin, et al.
Published: (2026)
Multicalibration Boosting: Theory, Convergence, and Transferability
by: Ye, Hanxuan, et al.
Published: (2026)
by: Ye, Hanxuan, et al.
Published: (2026)
Joint User Priority and Power Scheduling for QoS-Aware WMMSE Precoding: A Constrained-Actor Attentive-Critic Approach
by: Wang, Kexuan, et al.
Published: (2025)
by: Wang, Kexuan, et al.
Published: (2025)
A Lightweight RL-Driven Deep Unfolding Network for Robust WMMSE Precoding in Massive MU-MIMO-OFDM Systems
by: Wang, Kexuan, et al.
Published: (2025)
by: Wang, Kexuan, et al.
Published: (2025)
Drifting Preference Optimization for One-Step Generative Models
by: Jiang, Zhou, et al.
Published: (2026)
by: Jiang, Zhou, et al.
Published: (2026)
Learning Label Refinement and Threshold Adjustment for Imbalanced Semi-Supervised Learning
by: Li, Zeju, et al.
Published: (2024)
by: Li, Zeju, et al.
Published: (2024)
Accelerating Transformers with Spectrum-Preserving Token Merging
by: Tran, Hoai-Chau, et al.
Published: (2024)
by: Tran, Hoai-Chau, et al.
Published: (2024)
LNN-PINN: A Unified Physics-Only Training Framework with Liquid Residual Blocks
by: Tao, Ze, et al.
Published: (2025)
by: Tao, Ze, et al.
Published: (2025)
A Deep Latent Space Model for Graph Representation Learning
by: Yang, Hanxuan, et al.
Published: (2021)
by: Yang, Hanxuan, et al.
Published: (2021)
Efficient Diversity-Preserving Diffusion Alignment via Gradient-Informed GFlowNets
by: Liu, Zhen, et al.
Published: (2024)
by: Liu, Zhen, et al.
Published: (2024)
A Single-Loop Deep Actor-Critic Algorithm for Constrained Reinforcement Learning with Provable Convergence
by: Wang, Kexuan, et al.
Published: (2023)
by: Wang, Kexuan, et al.
Published: (2023)
Robustness of Nonlinear Representation Learning
by: Buchholz, Simon, et al.
Published: (2025)
by: Buchholz, Simon, et al.
Published: (2025)
Context-aware Constrained Reinforcement Learning Based Energy-Efficient Power Scheduling for Non-stationary XR Data Traffic
by: Wang, Kexuan, et al.
Published: (2025)
by: Wang, Kexuan, et al.
Published: (2025)
OLinear: A Linear Model for Time Series Forecasting in Orthogonally Transformed Domain
by: Yue, Wenzhen, et al.
Published: (2025)
by: Yue, Wenzhen, et al.
Published: (2025)
COMPOT: Calibration-Optimized Matrix Procrustes Orthogonalization for Transformers Compression
by: Makhov, Denis, et al.
Published: (2026)
by: Makhov, Denis, et al.
Published: (2026)
Emergency Preemption Without Online Exploration: A Decision Transformer Approach
by: Su, Haoran, et al.
Published: (2026)
by: Su, Haoran, et al.
Published: (2026)
DiffHLS: Differential Learning for High-Level Synthesis QoR Prediction with GNNs and LLM Code Embeddings
by: Peng, Zedong, et al.
Published: (2026)
by: Peng, Zedong, et al.
Published: (2026)
On the Spectral Structure and Objective Equivalence of Orthogonal Multilabel Fisher Discriminants
by: Keith-Norambuena, Brian, et al.
Published: (2026)
by: Keith-Norambuena, Brian, et al.
Published: (2026)
Latent Context Compilation: Distilling Long Context into Compact Portable Memory
by: Li, Zeju, et al.
Published: (2026)
by: Li, Zeju, et al.
Published: (2026)
LightSplit: Practical Privacy-Preserving Split Learning via Orthogonal Projections
by: Cihangiroglu, Mert, et al.
Published: (2026)
by: Cihangiroglu, Mert, et al.
Published: (2026)
LGDC: Latent Graph Diffusion via Spectrum-Preserving Coarsening
by: Osman, Nagham, et al.
Published: (2025)
by: Osman, Nagham, et al.
Published: (2025)
Variational Graph Auto-Encoder Based Inductive Learning Method for Semi-Supervised Classification
by: Yang, Hanxuan, et al.
Published: (2024)
by: Yang, Hanxuan, et al.
Published: (2024)
Understanding Uncertainty Sampling via Equivalent Loss
by: Liu, Shang, et al.
Published: (2023)
by: Liu, Shang, et al.
Published: (2023)
MSCMHMST: A traffic flow prediction model based on Transformer
by: Geng, Weiyang, et al.
Published: (2025)
by: Geng, Weiyang, et al.
Published: (2025)
A Reductions Approach to Risk-Sensitive Reinforcement Learning with Optimized Certainty Equivalents
by: Wang, Kaiwen, et al.
Published: (2024)
by: Wang, Kaiwen, et al.
Published: (2024)
An Interpretable Power System Transient Stability Assessment Method with Expert Guiding Neural-Regression-Tree
by: Wang, Hanxuan, et al.
Published: (2024)
by: Wang, Hanxuan, et al.
Published: (2024)
Spatiotemporal Decision Transformer for Traffic Coordination
by: Su, Haoran, et al.
Published: (2026)
by: Su, Haoran, et al.
Published: (2026)
Can Large Language Models Understand Symbolic Graphics Programs?
by: Qiu, Zeju, et al.
Published: (2024)
by: Qiu, Zeju, et al.
Published: (2024)
Physics-Guided Tiny-Mamba Transformer for Reliability-Aware Early Fault Warning
by: Li, Changyu, et al.
Published: (2026)
by: Li, Changyu, et al.
Published: (2026)
Similar Items
-
Reparameterized LLM Training via Orthogonal Equivalence Transformation
by: Qiu, Zeju, et al.
Published: (2025) -
Model Merging with Functional Dual Anchors
by: Shi, Kexuan, et al.
Published: (2025) -
Orthogonal Model Merging
by: Yang, Sihan, et al.
Published: (2026) -
POET-X: Memory-efficient LLM Training by Scaling Orthogonal Transformation
by: Qiu, Zeju, et al.
Published: (2026) -
Orthogonal Finetuning Made Scalable
by: Qiu, Zeju, et al.
Published: (2025)