CHASM: Cross-frequency Harmonized Axis-Separable Mixing for Spectral Token Operators
Fuente:
arXiv
Saved in:
| Main Authors: | Fang, Pengcheng, Chen, Hongli, Chen, Yuxia, Sun, Tengjiao, Liu, Jiaxin, Cai, Xiaohao |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MOGO: Residual Quantized Hierarchical Causal Transformer for High-Quality and Real-Time 3D Human Motion Generation
by: Fu, Dongjie, et al.
Published: (2025)
by: Fu, Dongjie, et al.
Published: (2025)
HiFi-Mamba: Dual-Stream W-Laplacian Enhanced Mamba for High-Fidelity MRI Reconstruction
by: Chen, Hongli, et al.
Published: (2025)
by: Chen, Hongli, et al.
Published: (2025)
AnchorRoute: Human Motion Synthesis with Interval-Routed Sparse Contro
by: Fang, Pengcheng, et al.
Published: (2026)
by: Fang, Pengcheng, et al.
Published: (2026)
HiFi-MambaV2: Hierarchical Shared-Routed MoE for High-Fidelity MRI Reconstruction
by: Fang, Pengcheng, et al.
Published: (2025)
by: Fang, Pengcheng, et al.
Published: (2025)
When and What: Diffusion-Grounded VideoLLM with Entity Aware Segmentation for Long Video Understanding
by: Fang, Pengcheng, et al.
Published: (2025)
by: Fang, Pengcheng, et al.
Published: (2025)
CHASM: Unveiling Covert Advertisements on Chinese Social Media
by: Zheng, Jingyi, et al.
Published: (2026)
by: Zheng, Jingyi, et al.
Published: (2026)
UMo: Unified Sparse Motion Modeling for Real-Time Co-Speech Avatars
by: Zhan, Xiaoyu, et al.
Published: (2026)
by: Zhan, Xiaoyu, et al.
Published: (2026)
Hi-ResNet: Edge Detail Enhancement for High-Resolution Remote Sensing Segmentation
by: Chen, Yuxia, et al.
Published: (2023)
by: Chen, Yuxia, et al.
Published: (2023)
The CHASM-SWPC Dataset for Coronal Hole Detection & Analysis
by: Beck, Cutter, et al.
Published: (2025)
by: Beck, Cutter, et al.
Published: (2025)
Revisiting Cross-Domain Problem for LiDAR-based 3D Object Detection
by: Zhang, Ruixiao, et al.
Published: (2024)
by: Zhang, Ruixiao, et al.
Published: (2024)
GRASPTrack: Geometry-Reasoned Association via Segmentation and Projection for Multi-Object Tracking
by: Han, Xudong, et al.
Published: (2025)
by: Han, Xudong, et al.
Published: (2025)
Image Tokenizer Needs Post-Training
by: Qiu, Kai, et al.
Published: (2025)
by: Qiu, Kai, et al.
Published: (2025)
Detect Closer Surfaces that can be Seen: New Modeling and Evaluation in Cross-domain 3D Object Detection
by: Zhang, Ruixiao, et al.
Published: (2024)
by: Zhang, Ruixiao, et al.
Published: (2024)
IDPruner: Harmonizing Importance and Diversity in Visual Token Pruning for MLLMs
by: Tan, Yifan, et al.
Published: (2026)
by: Tan, Yifan, et al.
Published: (2026)
Exploring Unbiased Deepfake Detection via Token-Level Shuffling and Mixing
by: Fu, Xinghe, et al.
Published: (2025)
by: Fu, Xinghe, et al.
Published: (2025)
FSCA-Net: Feature-Separated Cross-Attention Network for Robust Multi-Dataset Training
by: Chen, Yuehai
Published: (2026)
by: Chen, Yuehai
Published: (2026)
G$^2$TR: Generation-Guided Visual Token Reduction for Separate-Encoder Unified Multimodal Models
by: Li, Junxian, et al.
Published: (2026)
by: Li, Junxian, et al.
Published: (2026)
UniToken: Harmonizing Multimodal Understanding and Generation through Unified Visual Encoding
by: Jiao, Yang, et al.
Published: (2025)
by: Jiao, Yang, et al.
Published: (2025)
Language-Guided Token Compression with Reinforcement Learning in Large Vision-Language Models
by: Cao, Sihan, et al.
Published: (2026)
by: Cao, Sihan, et al.
Published: (2026)
VIGOR: VIdeo Geometry-Oriented Reward for Temporal Generative Alignment
by: Yin, Tengjiao, et al.
Published: (2026)
by: Yin, Tengjiao, et al.
Published: (2026)
iVPT: Improving Task-relevant Information Sharing in Visual Prompt Tuning by Cross-layer Dynamic Connection
by: Zhou, Nan, et al.
Published: (2024)
by: Zhou, Nan, et al.
Published: (2024)
HYDRA: Unifying Multi-modal Generation and Understanding via Representation-Harmonized Tokenization
by: Qiu, Xuerui, et al.
Published: (2026)
by: Qiu, Xuerui, et al.
Published: (2026)
Graph-guided Cross-composition Feature Disentanglement for Compositional Zero-shot Learning
by: Geng, Yuxia, et al.
Published: (2024)
by: Geng, Yuxia, et al.
Published: (2024)
The Diffusion Duet: Harmonizing Dual Channels with Wavelet Suppression for Image Separation
by: Li, Jingwei, et al.
Published: (2026)
by: Li, Jingwei, et al.
Published: (2026)
SEIS: Subspace-based Equivariance and Invariance Scores for Neural Representations
by: Lin, Huahua, et al.
Published: (2026)
by: Lin, Huahua, et al.
Published: (2026)
Discrepancy-based Diffusion Models for Lesion Detection in Brain MRI
by: Fan, Keqiang, et al.
Published: (2024)
by: Fan, Keqiang, et al.
Published: (2024)
Non-negative Subspace Feature Representation for Few-shot Learning in Medical Imaging
by: Fan, Keqiang, et al.
Published: (2024)
by: Fan, Keqiang, et al.
Published: (2024)
MixReorg: Cross-Modal Mixed Patch Reorganization is a Good Mask Learner for Open-World Semantic Segmentation
by: Cai, Kaixin, et al.
Published: (2023)
by: Cai, Kaixin, et al.
Published: (2023)
Spectral Image Tokenizer
by: Esteves, Carlos, et al.
Published: (2024)
by: Esteves, Carlos, et al.
Published: (2024)
Rotation-Invariant Completion Network
by: Chen, Yu, et al.
Published: (2023)
by: Chen, Yu, et al.
Published: (2023)
Delving into Spectral Clustering with Vision-Language Representations
by: Peng, Bo, et al.
Published: (2026)
by: Peng, Bo, et al.
Published: (2026)
Halo Separation-guided Underwater Multi-scale Image Restoration
by: Yang, Jiaxin, et al.
Published: (2026)
by: Yang, Jiaxin, et al.
Published: (2026)
Spectral Normalization and Dual Contrastive Regularization for Image-to-Image Translation
by: Zhao, Chen, et al.
Published: (2023)
by: Zhao, Chen, et al.
Published: (2023)
Joint Architecture-Token-Bitwidth Multi-Axis Optimization of Vision Transformers for Semiconductor IC Packaging
by: Nguyen, Phat, et al.
Published: (2026)
by: Nguyen, Phat, et al.
Published: (2026)
MaxQ: Multi-Axis Query for N:M Sparsity Network
by: Xiang, Jingyang, et al.
Published: (2023)
by: Xiang, Jingyang, et al.
Published: (2023)
MAC-Lookup: Multi-Axis Conditional Lookup Model for Underwater Image Enhancement
by: Yi, Fanghai, et al.
Published: (2025)
by: Yi, Fanghai, et al.
Published: (2025)
Large Motion Video Autoencoding with Cross-modal Video VAE
by: Xing, Yazhou, et al.
Published: (2024)
by: Xing, Yazhou, et al.
Published: (2024)
VMDiff: Visual Mixing Diffusion for Limitless Cross-Object Synthesis
by: Xiong, Zeren, et al.
Published: (2025)
by: Xiong, Zeren, et al.
Published: (2025)
IVGF: The Fusion-Guided Infrared and Visible General Framework
by: Liu, Fangcen, et al.
Published: (2024)
by: Liu, Fangcen, et al.
Published: (2024)
Dual-Pathway Circuits of Object Hallucination in Vision-Language Models
by: Liu, Jiaxin, et al.
Published: (2026)
by: Liu, Jiaxin, et al.
Published: (2026)
Similar Items
-
MOGO: Residual Quantized Hierarchical Causal Transformer for High-Quality and Real-Time 3D Human Motion Generation
by: Fu, Dongjie, et al.
Published: (2025) -
HiFi-Mamba: Dual-Stream W-Laplacian Enhanced Mamba for High-Fidelity MRI Reconstruction
by: Chen, Hongli, et al.
Published: (2025) -
AnchorRoute: Human Motion Synthesis with Interval-Routed Sparse Contro
by: Fang, Pengcheng, et al.
Published: (2026) -
HiFi-MambaV2: Hierarchical Shared-Routed MoE for High-Fidelity MRI Reconstruction
by: Fang, Pengcheng, et al.
Published: (2025) -
When and What: Diffusion-Grounded VideoLLM with Entity Aware Segmentation for Long Video Understanding
by: Fang, Pengcheng, et al.
Published: (2025)