What Changed and What Could Have Changed? State-Change Counterfactuals for Procedure-Aware Video Representation Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Kung, Chi-Hsi, Ramirez, Frangil, Ha, Juhyung, Chen, Yi-Ting, Crandall, David, Tsai, Yi-Hsuan |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
EgoVIS@CVPR: What Changed and What Could Have Changed? State-Change Counterfactuals for Procedure-Aware Video Representation Learning
by: Kung, Chi-Hsi, et al.
Published: (2025)
by: Kung, Chi-Hsi, et al.
Published: (2025)
GateFusion: Hierarchical Gated Cross-Modal Fusion for Active Speaker Detection
by: Wang, Yu, et al.
Published: (2025)
by: Wang, Yu, et al.
Published: (2025)
Action-slot: Visual Action-centric Representations for Multi-label Atomic Activity Recognition in Traffic Scenes
by: Kung, Chi-Hsi, et al.
Published: (2023)
by: Kung, Chi-Hsi, et al.
Published: (2023)
EgoVIS@CVPR: PAIR-Net: Enhancing Egocentric Speaker Detection via Pretrained Audio-Visual Fusion and Alignment Loss
by: Wang, Yu, et al.
Published: (2025)
by: Wang, Yu, et al.
Published: (2025)
A solution to generalized learning from small training sets found in infant repeated visual experiences of individual objects
by: Ramirez, Frangil, et al.
Published: (2025)
by: Ramirez, Frangil, et al.
Published: (2025)
Anticipating Object State Changes in Long Procedural Videos
by: Manousaki, Victoria, et al.
Published: (2024)
by: Manousaki, Victoria, et al.
Published: (2024)
Multi-resolution Guided 3D GANs for Medical Image Translation
by: Ha, Juhyung, et al.
Published: (2024)
by: Ha, Juhyung, et al.
Published: (2024)
Imagine How To Change: Explicit Procedure Modeling for Change Captioning
by: Sun, Jiayang, et al.
Published: (2026)
by: Sun, Jiayang, et al.
Published: (2026)
Show Me What and Where has Changed? Question Answering and Grounding for Remote Sensing Change Detection
by: Li, Ke, et al.
Published: (2024)
by: Li, Ke, et al.
Published: (2024)
Learning Object State Changes in Videos: An Open-World Perspective
by: Xue, Zihui, et al.
Published: (2023)
by: Xue, Zihui, et al.
Published: (2023)
State-Change Learning for Prediction of Future Events in Endoscopic Videos
by: Sharma, Saurav, et al.
Published: (2025)
by: Sharma, Saurav, et al.
Published: (2025)
ATARS: An Aerial Traffic Atomic Activity Recognition and Temporal Segmentation Dataset
by: Chen, Zihao, et al.
Published: (2025)
by: Chen, Zihao, et al.
Published: (2025)
Toward Real-world BEV Perception: Depth Uncertainty Estimation via Gaussian Splatting
by: Lu, Shu-Wei, et al.
Published: (2025)
by: Lu, Shu-Wei, et al.
Published: (2025)
Motion Modes: What Could Happen Next?
by: Pandey, Karran, et al.
Published: (2024)
by: Pandey, Karran, et al.
Published: (2024)
SPOC: Spatially-Progressing Object State Change Segmentation in Video
by: Mandikal, Priyanka, et al.
Published: (2025)
by: Mandikal, Priyanka, et al.
Published: (2025)
Scene Change Detection with Vision-Language Representation Learning
by: Sheng, Diwei, et al.
Published: (2026)
by: Sheng, Diwei, et al.
Published: (2026)
OSCaR: Object State Captioning and State Change Representation
by: Nguyen, Nguyen, et al.
Published: (2024)
by: Nguyen, Nguyen, et al.
Published: (2024)
IllumiCraft: Unified Geometry and Illumination Diffusion for Controllable Video Generation
by: Lin, Yuanze, et al.
Published: (2025)
by: Lin, Yuanze, et al.
Published: (2025)
The Modern Public Library and Melvil Dewey: What He Changed, What We've Changed, and What Hasn't Changed.
by: Salmon, Laura E.
Published: (2000)
by: Salmon, Laura E.
Published: (2000)
Efficient Remote Sensing Change Detection with Change State Space Models
by: Ghazaei, Elman, et al.
Published: (2025)
by: Ghazaei, Elman, et al.
Published: (2025)
What If Trojan Horse Nanoparticles Could Change the Game for HPV Gene‐Targeted Therapies?
by: Trairong Chokwassanasakulkit, et al.
Published: (2026)
by: Trairong Chokwassanasakulkit, et al.
Published: (2026)
Attention-based Shape and Gait Representations Learning for Video-based Cloth-Changing Person Re-Identification
by: Nguyen, Vuong D., et al.
Published: (2024)
by: Nguyen, Vuong D., et al.
Published: (2024)
Learning Procedural-aware Video Representations through State-Grounded Hierarchy Unfolding
by: Zhao, Jinghan, et al.
Published: (2025)
by: Zhao, Jinghan, et al.
Published: (2025)
See What You Seek: Semantic Contextual Integration for Cloth-Changing Person Re-Identification
by: Han, Xiyu, et al.
Published: (2024)
by: Han, Xiyu, et al.
Published: (2024)
OSCBench: Benchmarking Object State Change in Text-to-Video Generation
by: Han, Xianjing, et al.
Published: (2026)
by: Han, Xianjing, et al.
Published: (2026)
What You Have is What You Track: Adaptive and Robust Multimodal Tracking
by: Tan, Yuedong, et al.
Published: (2025)
by: Tan, Yuedong, et al.
Published: (2025)
Change3D: Revisiting Change Detection and Captioning from A Video Modeling Perspective
by: Zhu, Duowang, et al.
Published: (2025)
by: Zhu, Duowang, et al.
Published: (2025)
Potential Field as Scene Affordance for Behavior Change-Based Visual Risk Object Identification
by: Pao, Pang-Yuan, et al.
Published: (2024)
by: Pao, Pang-Yuan, et al.
Published: (2024)
What has Changed? Has Anything Changed? What Needs to Change? Does Anything Need to Change? Late‐Career Reflections 1
by: Andrew Samuels
Published: (2026)
by: Andrew Samuels
Published: (2026)
Label What Matters: Modality-Balanced and Difficulty-Aware Multimodal Active Learning
by: Zeng, Yuqiao, et al.
Published: (2026)
by: Zeng, Yuqiao, et al.
Published: (2026)
PROFUSEme: PROstate Cancer Biochemical Recurrence Prediction via FUSEd Multi-modal Embeddings
by: You, Suhang, et al.
Published: (2025)
by: You, Suhang, et al.
Published: (2025)
How Video Meetings Change Your Expression
by: Sarin, Sumit, et al.
Published: (2024)
by: Sarin, Sumit, et al.
Published: (2024)
ChangeBind: A Hybrid Change Encoder for Remote Sensing Change Detection
by: Noman, Mubashir, et al.
Published: (2024)
by: Noman, Mubashir, et al.
Published: (2024)
SAM-Based Building Change Detection with Distribution-Aware Fourier Adaptation and Edge-Constrained Warping
by: Li, Yun-Cheng, et al.
Published: (2025)
by: Li, Yun-Cheng, et al.
Published: (2025)
Weakly Supervised 3D Object Detection via Multi-Level Visual Guidance
by: Huang, Kuan-Chih, et al.
Published: (2023)
by: Huang, Kuan-Chih, et al.
Published: (2023)
See More, Change Less: Anatomy-Aware Diffusion for Contrast Enhancement
by: Liu, Junqi, et al.
Published: (2025)
by: Liu, Junqi, et al.
Published: (2025)
Exemplar Masking for Multimodal Incremental Learning
by: Lee, Yi-Lun, et al.
Published: (2024)
by: Lee, Yi-Lun, et al.
Published: (2024)
Hierarchical Dual-Change Collaborative Learning for UAV Scene Change Captioning
by: Chen, Fuhai, et al.
Published: (2026)
by: Chen, Fuhai, et al.
Published: (2026)
ChangeDiff: A Multi-Temporal Change Detection Data Generator with Flexible Text Prompts via Diffusion Model
by: Zang, Qi, et al.
Published: (2024)
by: Zang, Qi, et al.
Published: (2024)
ChangeMamba: Remote Sensing Change Detection With Spatiotemporal State Space Model
by: Chen, Hongruixuan, et al.
Published: (2024)
by: Chen, Hongruixuan, et al.
Published: (2024)
Similar Items
-
EgoVIS@CVPR: What Changed and What Could Have Changed? State-Change Counterfactuals for Procedure-Aware Video Representation Learning
by: Kung, Chi-Hsi, et al.
Published: (2025) -
GateFusion: Hierarchical Gated Cross-Modal Fusion for Active Speaker Detection
by: Wang, Yu, et al.
Published: (2025) -
Action-slot: Visual Action-centric Representations for Multi-label Atomic Activity Recognition in Traffic Scenes
by: Kung, Chi-Hsi, et al.
Published: (2023) -
EgoVIS@CVPR: PAIR-Net: Enhancing Egocentric Speaker Detection via Pretrained Audio-Visual Fusion and Alignment Loss
by: Wang, Yu, et al.
Published: (2025) -
A solution to generalized learning from small training sets found in infant repeated visual experiences of individual objects
by: Ramirez, Frangil, et al.
Published: (2025)