Guardado en:
| Autores principales: | Mikhailov, Dmitrii, Letunovskiy, Aleksey, Kovaleva, Maria, Arkhipkin, Vladimir, Korviakov, Vladimir, Polovnikov, Vladimir, Vasilev, Viacheslav, Sidorova, Evelina, Dimitrov, Denis |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2507.13546 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
VIVAT: Virtuous Improving VAE Training through Artifact Mitigation
por: Novitskiy, Lev, et al.
Publicado: (2025)
por: Novitskiy, Lev, et al.
Publicado: (2025)
Kandinsky 5.0: A Family of Foundation Models for Image and Video Generation
por: Arkhipkin, Vladimir, et al.
Publicado: (2025)
por: Arkhipkin, Vladimir, et al.
Publicado: (2025)
NeoNeXt: Novel neural network operator and architecture based on the patch-wise matrix multiplications
por: Korviakov, Vladimir, et al.
Publicado: (2024)
por: Korviakov, Vladimir, et al.
Publicado: (2024)
CRAFT: Cultural Russian-Oriented Dataset Adaptation for Focused Text-to-Image Generation
por: Vasilev, Viacheslav, et al.
Publicado: (2025)
por: Vasilev, Viacheslav, et al.
Publicado: (2025)
Kandinsky 3.0 Technical Report
por: Arkhipkin, Vladimir, et al.
Publicado: (2023)
por: Arkhipkin, Vladimir, et al.
Publicado: (2023)
Kandinsky 3: Text-to-Image Synthesis for Multifunctional Generative Framework
por: Arkhipkin, Vladimir, et al.
Publicado: (2024)
por: Arkhipkin, Vladimir, et al.
Publicado: (2024)
RusCode: Russian Cultural Code Benchmark for Text-to-Image Generation
por: Vasilev, Viacheslav, et al.
Publicado: (2025)
por: Vasilev, Viacheslav, et al.
Publicado: (2025)
Semi-Supervised 3D Segmentation for Type-B Aortic Dissection with Slim UNETR
por: Mikhailapov, Denis, et al.
Publicado: (2025)
por: Mikhailapov, Denis, et al.
Publicado: (2025)
QRetinex-Net: Quaternion-Valued Retinex Decomposition for Low-Level Computer Vision Applications
por: Agaian, Sos, et al.
Publicado: (2025)
por: Agaian, Sos, et al.
Publicado: (2025)
Monitoring Horses in Stalls: From Object to Event Detection
por: Galimzianov, Dmitrii, et al.
Publicado: (2025)
por: Galimzianov, Dmitrii, et al.
Publicado: (2025)
Learning Localization of Body and Finger Animation Skeleton Joints on Three-Dimensional Models of Human Bodies
por: Novaković, Stefan, et al.
Publicado: (2024)
por: Novaković, Stefan, et al.
Publicado: (2024)
Generative inpainting of incomplete Euclidean distance matrices of trajectories generated by a fractional Brownian motion
por: Lobashev, Alexander, et al.
Publicado: (2024)
por: Lobashev, Alexander, et al.
Publicado: (2024)
Enhancing Road Crack Detection Accuracy with BsS-YOLO: Optimizing Feature Fusion and Attention Mechanisms
por: Tang, Jiaze, et al.
Publicado: (2024)
por: Tang, Jiaze, et al.
Publicado: (2024)
Training-Free Color-Aware Adversarial Diffusion Sanitization for Diffusion Stegomalware Defense at Security Gateways
por: Frants, Vladimir, et al.
Publicado: (2025)
por: Frants, Vladimir, et al.
Publicado: (2025)
Faster Neighborhood Attention: Reducing the O(n^2) Cost of Self Attention at the Threadblock Level
por: Hassani, Ali, et al.
Publicado: (2024)
por: Hassani, Ali, et al.
Publicado: (2024)
$\nabla τ$: Gradient-based and Task-Agnostic machine Unlearning
por: Trippa, Daniel, et al.
Publicado: (2024)
por: Trippa, Daniel, et al.
Publicado: (2024)
ToTMNet: FFT-Accelerated Toeplitz Temporal Mixing Network for Lightweight Remote Photoplethysmography
por: Frants, Vladimir, et al.
Publicado: (2026)
por: Frants, Vladimir, et al.
Publicado: (2026)
EdgeLDR: Quaternion Low-Displacement Rank Neural Networks for Edge-Efficient Deep Learning
por: Frants, Vladimir, et al.
Publicado: (2026)
por: Frants, Vladimir, et al.
Publicado: (2026)
CHOTA: A Higher Order Accuracy Metric for Cell Tracking
por: Kaiser, Timo, et al.
Publicado: (2024)
por: Kaiser, Timo, et al.
Publicado: (2024)
Video Object Segmentation-Aware Audio Generation
por: Viertola, Ilpo, et al.
Publicado: (2025)
por: Viertola, Ilpo, et al.
Publicado: (2025)
Color Transfer with Modulated Flows
por: Larchenko, Maria, et al.
Publicado: (2025)
por: Larchenko, Maria, et al.
Publicado: (2025)
Body Part-Based Representation Learning for Occluded Person Re-Identification
por: Somers, Vladimir, et al.
Publicado: (2022)
por: Somers, Vladimir, et al.
Publicado: (2022)
Keypoint Promptable Re-Identification
por: Somers, Vladimir, et al.
Publicado: (2024)
por: Somers, Vladimir, et al.
Publicado: (2024)
Time-Correlated Video Bridge Matching
por: Vasilev, Viacheslav, et al.
Publicado: (2025)
por: Vasilev, Viacheslav, et al.
Publicado: (2025)
Box2Flow: Instance-based Action Flow Graphs from Videos
por: Li, Jiatong, et al.
Publicado: (2024)
por: Li, Jiatong, et al.
Publicado: (2024)
Scaling Up Resonate-and-Fire Networks for Fast Deep Learning
por: Huber, Thomas E., et al.
Publicado: (2025)
por: Huber, Thomas E., et al.
Publicado: (2025)
GHOST 2.0: generative high-fidelity one shot transfer of heads
por: Groshev, Alexander, et al.
Publicado: (2025)
por: Groshev, Alexander, et al.
Publicado: (2025)
FlowOpt: Fast Optimization Through Whole Flow Processes for Training-Free Editing
por: Ronai, Or, et al.
Publicado: (2025)
por: Ronai, Or, et al.
Publicado: (2025)
NAF: Zero-Shot Feature Upsampling via Neighborhood Attention Filtering
por: Chambon, Loick, et al.
Publicado: (2025)
por: Chambon, Loick, et al.
Publicado: (2025)
Medical Image Classification with KAN-Integrated Transformers and Dilated Neighborhood Attention
por: Manzari, Omid Nejati, et al.
Publicado: (2025)
por: Manzari, Omid Nejati, et al.
Publicado: (2025)
Saliency-Guided DETR for Moment Retrieval and Highlight Detection
por: Gordeev, Aleksandr, et al.
Publicado: (2024)
por: Gordeev, Aleksandr, et al.
Publicado: (2024)
Improving Layout Representation Learning Across Inconsistently Annotated Datasets via Agentic Harmonization
por: Li, Renyu, et al.
Publicado: (2026)
por: Li, Renyu, et al.
Publicado: (2026)
CMAWRNet: Multiple Adverse Weather Removal via a Unified Quaternion Neural Architecture
por: Frants, Vladimir, et al.
Publicado: (2025)
por: Frants, Vladimir, et al.
Publicado: (2025)
Generalized Neighborhood Attention: Multi-dimensional Sparse Attention at the Speed of Light
por: Hassani, Ali, et al.
Publicado: (2025)
por: Hassani, Ali, et al.
Publicado: (2025)
A Stochastic Birth-and-Death Approach for Street Furniture Geolocation in Urban Environments
por: Murphy, Evan, et al.
Publicado: (2025)
por: Murphy, Evan, et al.
Publicado: (2025)
An Edit Friendly DDPM Noise Space: Inversion and Manipulations
por: Huberman-Spiegelglas, Inbar, et al.
Publicado: (2023)
por: Huberman-Spiegelglas, Inbar, et al.
Publicado: (2023)
The Impact of Background Removal on Performance of Neural Networks for Fashion Image Classification and Segmentation
por: Liang, Junhui, et al.
Publicado: (2023)
por: Liang, Junhui, et al.
Publicado: (2023)
Interpreting CLIP with Hierarchical Sparse Autoencoders
por: Zaigrajew, Vladimir, et al.
Publicado: (2025)
por: Zaigrajew, Vladimir, et al.
Publicado: (2025)
Persistent Robot World Models: Stabilizing Multi-Step Rollouts via Reinforcement Learning
por: Bardhan, Jai, et al.
Publicado: (2026)
por: Bardhan, Jai, et al.
Publicado: (2026)
4D Radar Semantic Segmentation of People in Field Conditions Using Temporal Multi-View Networks
por: Skog, Mikael, et al.
Publicado: (2024)
por: Skog, Mikael, et al.
Publicado: (2024)
Ejemplares similares
-
VIVAT: Virtuous Improving VAE Training through Artifact Mitigation
por: Novitskiy, Lev, et al.
Publicado: (2025) -
Kandinsky 5.0: A Family of Foundation Models for Image and Video Generation
por: Arkhipkin, Vladimir, et al.
Publicado: (2025) -
NeoNeXt: Novel neural network operator and architecture based on the patch-wise matrix multiplications
por: Korviakov, Vladimir, et al.
Publicado: (2024) -
CRAFT: Cultural Russian-Oriented Dataset Adaptation for Focused Text-to-Image Generation
por: Vasilev, Viacheslav, et al.
Publicado: (2025) -
Kandinsky 3.0 Technical Report
por: Arkhipkin, Vladimir, et al.
Publicado: (2023)