AniMatrix: An Anime Video Generation Model that Thinks in Art, Not Physics
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Tencent HY Team |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Short-Window Sliding Learning for Real-Time Violence Detection via LLM-based Auto-Labeling
par: Jung, Seoik, et autres
Publié: (2025)
par: Jung, Seoik, et autres
Publié: (2025)
Decoder Generates Manufacturable Structures: A Framework for 3D-Printable Object Synthesis
par: Kumar, Abhishek
Publié: (2026)
par: Kumar, Abhishek
Publié: (2026)
Do Generative Metrics Predict YOLO Performance? An Evaluation Across Models, Augmentation Ratios, and Dataset Complexity
par: Marian, Vasile, et autres
Publié: (2026)
par: Marian, Vasile, et autres
Publié: (2026)
Rethinking Visual Intelligence: Insights from Video Pretraining
par: Acuaviva, Pablo, et autres
Publié: (2025)
par: Acuaviva, Pablo, et autres
Publié: (2025)
Predictive Modeling of Maritime Radar Data Using Transformer Architecture
par: Qesaraku, Bjorna, et autres
Publié: (2025)
par: Qesaraku, Bjorna, et autres
Publié: (2025)
TGraphX: Tensor-Aware Graph Neural Network for Multi-Dimensional Feature Learning
par: Sajjadi, Arash, et autres
Publié: (2025)
par: Sajjadi, Arash, et autres
Publié: (2025)
Adversarial Patch Attacks on Vision-Based Cargo Occupancy Estimation via Differentiable 3D Simulation
par: Hedna, Mohamed Rissal, et autres
Publié: (2025)
par: Hedna, Mohamed Rissal, et autres
Publié: (2025)
METER: Multi-modal Evidence-based Thinking and Explainable Reasoning -- Algorithm and Benchmark
par: Yang, Xu, et autres
Publié: (2025)
par: Yang, Xu, et autres
Publié: (2025)
Motion Attribution for Video Generation
par: Wu, Xindi, et autres
Publié: (2026)
par: Wu, Xindi, et autres
Publié: (2026)
SemanticFeels: Semantic Labeling during In-Hand Manipulation
par: Khalil, Anas Al Shikh, et autres
Publié: (2026)
par: Khalil, Anas Al Shikh, et autres
Publié: (2026)
Akasha 2: Hamiltonian State Space Duality and Visual-Language Joint Embedding Predictive Architectur
par: Meziani, Yani
Publié: (2026)
par: Meziani, Yani
Publié: (2026)
Visual Categorization Across Minds and Models: Cognitive Analysis of Human Labeling and Neuro-Symbolic Integration
par: Kabgere, Chethana Prasad
Publié: (2025)
par: Kabgere, Chethana Prasad
Publié: (2025)
Sat-JEPA-Diff: Bridging Self-Supervised Learning and Generative Diffusion for Remote Sensing
par: Komurcu, Kursat, et autres
Publié: (2026)
par: Komurcu, Kursat, et autres
Publié: (2026)
AUTHENTICATION: Identifying Rare Failure Modes in Autonomous Vehicle Perception Systems using Adversarially Guided Diffusion Models
par: Zarei, Mohammad, et autres
Publié: (2025)
par: Zarei, Mohammad, et autres
Publié: (2025)
Salient Concept-Aware Generative Data Augmentation
par: Zhao, Tianchen, et autres
Publié: (2025)
par: Zhao, Tianchen, et autres
Publié: (2025)
Method of UAV Inspection of Photovoltaic Modules Using Thermal and RGB Data Fusion
par: Lysyi, Andrii, et autres
Publié: (2025)
par: Lysyi, Andrii, et autres
Publié: (2025)
SF2T: Self-supervised Fragment Finetuning of Video-LLMs for Fine-Grained Understanding
par: Hu, Yangliu, et autres
Publié: (2025)
par: Hu, Yangliu, et autres
Publié: (2025)
Developing an aeroponic smart experimental greenhouse for controlling irrigation and plant disease detection using deep learning and IoT
par: Narimani, Mohammadreza, et autres
Publié: (2025)
par: Narimani, Mohammadreza, et autres
Publié: (2025)
Attention Gathers, MLPs Compose: A Causal Analysis of an Action-Outcome Circuit in VideoViT
par: Chereddy, Sai V R
Publié: (2026)
par: Chereddy, Sai V R
Publié: (2026)
An Analysis of Layer-Freezing Strategies for Enhanced Transfer Learning in YOLO Architectures
par: Dobrzycki, Andrzej D., et autres
Publié: (2025)
par: Dobrzycki, Andrzej D., et autres
Publié: (2025)
VDPP: Video Depth Post-Processing for Speed and Scalability
par: Yoon, Daewon, et autres
Publié: (2026)
par: Yoon, Daewon, et autres
Publié: (2026)
Smelly, dense, and spreaded: The Object Detection for Olfactory References (ODOR) dataset
par: Zinnen, Mathias, et autres
Publié: (2025)
par: Zinnen, Mathias, et autres
Publié: (2025)
N-DriverMotion: Driver motion learning and prediction using an event-based camera and directly trained spiking neural networks on Loihi 2
par: Chung, Hyo Jong, et autres
Publié: (2024)
par: Chung, Hyo Jong, et autres
Publié: (2024)
What do we learn from a large-scale study of pre-trained visual representations in sim and real environments?
par: Silwal, Sneha, et autres
Publié: (2023)
par: Silwal, Sneha, et autres
Publié: (2023)
3DreamBooth: High-Fidelity 3D Subject-Driven Video Generation Model
par: Ko, Hyun-kyu, et autres
Publié: (2026)
par: Ko, Hyun-kyu, et autres
Publié: (2026)
Yolo-Key-6D: Single Stage Monocular 6D Pose Estimation with Keypoint Enhancements
par: Çetiner, Kemal Alperen, et autres
Publié: (2026)
par: Çetiner, Kemal Alperen, et autres
Publié: (2026)
Detecting 3D Line Segments for 6DoF Pose Estimation with Limited Data
par: Mok, Matej, et autres
Publié: (2026)
par: Mok, Matej, et autres
Publié: (2026)
GazeD: Context-Aware Diffusion for Accurate 3D Gaze Estimation
par: Catalini, Riccardo, et autres
Publié: (2026)
par: Catalini, Riccardo, et autres
Publié: (2026)
BID: Boundary-Interior Decoding for Unsupervised Temporal Action Localization Pre-Trainin
par: Fang, Qihang, et autres
Publié: (2024)
par: Fang, Qihang, et autres
Publié: (2024)
Learning through Creation: A Hash-Free Framework for On-the-Fly Category Discovery
par: Zhang, Bohan, et autres
Publié: (2026)
par: Zhang, Bohan, et autres
Publié: (2026)
Diffusion Features for Zero-Shot 6DoF Object Pose Estimation
par: Von Gimborn, Bernd, et autres
Publié: (2024)
par: Von Gimborn, Bernd, et autres
Publié: (2024)
Camera Pose Revisited
par: Skarbek, Władysław, et autres
Publié: (2026)
par: Skarbek, Władysław, et autres
Publié: (2026)
Cyclic Contrastive Knowledge Transfer for Open-Vocabulary Object Detection
par: Zhang, Chuhan, et autres
Publié: (2025)
par: Zhang, Chuhan, et autres
Publié: (2025)
Improving Object Detection for Time-Lapse Imagery Using Temporal Features in Wildlife Monitoring
par: Jenkins, Marcus, et autres
Publié: (2024)
par: Jenkins, Marcus, et autres
Publié: (2024)
From Gaze to Insight: Bridging Human Visual Attention and Vision Language Model Explanation for Weakly-Supervised Medical Image Segmentation
par: Chen, Jingkun, et autres
Publié: (2025)
par: Chen, Jingkun, et autres
Publié: (2025)
The Impact of Image Resolution on Face Detection: A Comparative Analysis of MTCNN, YOLOv XI and YOLOv XII models
par: Ömercikoğlu, Ahmet Can, et autres
Publié: (2025)
par: Ömercikoğlu, Ahmet Can, et autres
Publié: (2025)
Unlocking UML Class Diagram Understanding in Vision Language Models
par: Naboichenko, Artem, et autres
Publié: (2026)
par: Naboichenko, Artem, et autres
Publié: (2026)
Bayesian Differentiable Physics for Cloth Digitalization
par: Gong, Deshan, et autres
Publié: (2024)
par: Gong, Deshan, et autres
Publié: (2024)
HEDGE: Hallucination Estimation via Dense Geometric Entropy for VQA with Vision-Language Models
par: Gautam, Sushant, et autres
Publié: (2025)
par: Gautam, Sushant, et autres
Publié: (2025)
Point, Detect, Count: Multi-Task Medical Image Understanding with Instruction-Tuned Vision-Language Models
par: Gautam, Sushant, et autres
Publié: (2025)
par: Gautam, Sushant, et autres
Publié: (2025)
Documents similaires
-
Short-Window Sliding Learning for Real-Time Violence Detection via LLM-based Auto-Labeling
par: Jung, Seoik, et autres
Publié: (2025) -
Decoder Generates Manufacturable Structures: A Framework for 3D-Printable Object Synthesis
par: Kumar, Abhishek
Publié: (2026) -
Do Generative Metrics Predict YOLO Performance? An Evaluation Across Models, Augmentation Ratios, and Dataset Complexity
par: Marian, Vasile, et autres
Publié: (2026) -
Rethinking Visual Intelligence: Insights from Video Pretraining
par: Acuaviva, Pablo, et autres
Publié: (2025) -
Predictive Modeling of Maritime Radar Data Using Transformer Architecture
par: Qesaraku, Bjorna, et autres
Publié: (2025)