CodeSCAN: ScreenCast ANalysis for Video Programming Tutorials
Fuente:
arXiv
Salvato in:
| Autori principali: | Naumann, Alexander, Hertlein, Felix, Höllig, Jacqueline, Cazzonelli, Lucas, Thoma, Steffen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A data-driven approach to linking design features with manufacturing process data for sustainable product development
di: Li, Jiahang, et al.
Pubblicazione: (2025)
di: Li, Jiahang, et al.
Pubblicazione: (2025)
SLANT: Spurious Logo ANalysis Toolkit
di: Qraitem, Maan, et al.
Pubblicazione: (2024)
di: Qraitem, Maan, et al.
Pubblicazione: (2024)
Tutorial on Diffusion Models for Imaging and Vision
di: Chan, Stanley H.
Pubblicazione: (2024)
di: Chan, Stanley H.
Pubblicazione: (2024)
Full Field Digital Mammography Dataset from a Population Screening Program
di: Kendall, Edward, et al.
Pubblicazione: (2024)
di: Kendall, Edward, et al.
Pubblicazione: (2024)
SimCast: Enhancing Precipitation Nowcasting with Short-to-Long Term Knowledge Distillation
di: Yin, Yifang, et al.
Pubblicazione: (2025)
di: Yin, Yifang, et al.
Pubblicazione: (2025)
AirCast: Improving Air Pollution Forecasting Through Multi-Variable Data Alignment
di: Nedungadi, Vishal, et al.
Pubblicazione: (2025)
di: Nedungadi, Vishal, et al.
Pubblicazione: (2025)
PEDESTRIAN: An Egocentric Vision Dataset for Obstacle Detection on Pavements
di: Thoma, Marios, et al.
Pubblicazione: (2025)
di: Thoma, Marios, et al.
Pubblicazione: (2025)
Step-by-Step Diffusion: An Elementary Tutorial
di: Nakkiran, Preetum, et al.
Pubblicazione: (2024)
di: Nakkiran, Preetum, et al.
Pubblicazione: (2024)
Wasserstein Distances Made Explainable: Insights Into Dataset Shifts and Transport Phenomena
di: Naumann, Philip, et al.
Pubblicazione: (2025)
di: Naumann, Philip, et al.
Pubblicazione: (2025)
DiFaReli++: Diffusion Face Relighting with Consistent Cast Shadows
di: Ponglertnapakorn, Puntawat, et al.
Pubblicazione: (2023)
di: Ponglertnapakorn, Puntawat, et al.
Pubblicazione: (2023)
FLex: Joint Pose and Dynamic Radiance Fields Optimization for Stereo Endoscopic Videos
di: Stilz, Florian Philipp, et al.
Pubblicazione: (2024)
di: Stilz, Florian Philipp, et al.
Pubblicazione: (2024)
Large-scale flood modeling and forecasting with FloodCast
di: Xu, Qingsong, et al.
Pubblicazione: (2024)
di: Xu, Qingsong, et al.
Pubblicazione: (2024)
Competitive Learning for Achieving Content-specific Filters in Video Coding for Machines
di: Zhang, Honglei, et al.
Pubblicazione: (2024)
di: Zhang, Honglei, et al.
Pubblicazione: (2024)
Data Scaling Laws for End-to-End Autonomous Driving
di: Naumann, Alexander, et al.
Pubblicazione: (2025)
di: Naumann, Alexander, et al.
Pubblicazione: (2025)
PINN-Cast: Exploring the Role of Continuous-Depth NODE in Transformers and Physics Informed Loss as Soft Physical Constraints in Short-term Weather Forecasting
di: Saleem, Hira, et al.
Pubblicazione: (2026)
di: Saleem, Hira, et al.
Pubblicazione: (2026)
TRIX- Trading Adversarial Fairness via Mixed Adversarial Training
di: Medi, Tejaswini, et al.
Pubblicazione: (2025)
di: Medi, Tejaswini, et al.
Pubblicazione: (2025)
Adapting SAM for Volumetric X-Ray Data-sets of Arbitrary Sizes
di: Gruber, Roland, et al.
Pubblicazione: (2024)
di: Gruber, Roland, et al.
Pubblicazione: (2024)
FAIR-TAT: Improving Model Fairness Using Targeted Adversarial Training
di: Medi, Tejaswini, et al.
Pubblicazione: (2024)
di: Medi, Tejaswini, et al.
Pubblicazione: (2024)
Pix2Code: Learning to Compose Neural Visual Concepts as Programs
di: Wüst, Antonia, et al.
Pubblicazione: (2024)
di: Wüst, Antonia, et al.
Pubblicazione: (2024)
PixelFlowCast: Latent-Free Precipitation Nowcasting via Pixel Mean Flows
di: Zhu, Yufeng, et al.
Pubblicazione: (2026)
di: Zhu, Yufeng, et al.
Pubblicazione: (2026)
VMDT: Decoding the Trustworthiness of Video Foundation Models
di: Potter, Yujin, et al.
Pubblicazione: (2025)
di: Potter, Yujin, et al.
Pubblicazione: (2025)
VideoOrion: Tokenizing Object Dynamics in Videos
di: Feng, Yicheng, et al.
Pubblicazione: (2024)
di: Feng, Yicheng, et al.
Pubblicazione: (2024)
Towards Scalable Newborn Screening: Automated General Movement Assessment in Uncontrolled Settings
di: Chopard, Daphné, et al.
Pubblicazione: (2024)
di: Chopard, Daphné, et al.
Pubblicazione: (2024)
Towards Improved Cervical Cancer Screening: Vision Transformer-Based Classification and Interpretability
di: Nguyen, Khoa Tuan, et al.
Pubblicazione: (2025)
di: Nguyen, Khoa Tuan, et al.
Pubblicazione: (2025)
Sparse autoencoders reveal selective remapping of visual concepts during adaptation
di: Lim, Hyesu, et al.
Pubblicazione: (2024)
di: Lim, Hyesu, et al.
Pubblicazione: (2024)
RDumb: A simple approach that questions our progress in continual test-time adaptation
di: Press, Ori, et al.
Pubblicazione: (2023)
di: Press, Ori, et al.
Pubblicazione: (2023)
MaxInfo: A Training-Free Key-Frame Selection Method Using Maximum Volume for Enhanced Video Understanding
di: Li, Pengyi, et al.
Pubblicazione: (2025)
di: Li, Pengyi, et al.
Pubblicazione: (2025)
From pre-training to downstream performance: Does domain-specific pre-training make sense?
di: Krones, Felix
Pubblicazione: (2026)
di: Krones, Felix
Pubblicazione: (2026)
Convolutions and More as Einsum: A Tensor Network Perspective with Advances for Second-Order Methods
di: Dangel, Felix
Pubblicazione: (2023)
di: Dangel, Felix
Pubblicazione: (2023)
Online Video Understanding: OVBench and VideoChat-Online
di: Huang, Zhenpeng, et al.
Pubblicazione: (2024)
di: Huang, Zhenpeng, et al.
Pubblicazione: (2024)
Video RWKV:Video Action Recognition Based RWKV
di: Yin, Zhuowen, et al.
Pubblicazione: (2024)
di: Yin, Zhuowen, et al.
Pubblicazione: (2024)
Vision2Code: A Multi-Domain Benchmark for Evaluating Image-to-Code Generation
di: Periasami, Ajay Vikram, et al.
Pubblicazione: (2026)
di: Periasami, Ajay Vikram, et al.
Pubblicazione: (2026)
Benchmarking Convolutional, Transformer, Hybrid, and Vision Language Models for Multi Disease Retinal Screening
di: Dey, Durjoy, et al.
Pubblicazione: (2026)
di: Dey, Durjoy, et al.
Pubblicazione: (2026)
EasyVideoR1: Easier RL for Video Understanding
di: Qin, Chuanyu, et al.
Pubblicazione: (2026)
di: Qin, Chuanyu, et al.
Pubblicazione: (2026)
Video Decomposition Prior: A Methodology to Decompose Videos into Layers
di: Shrivastava, Gaurav, et al.
Pubblicazione: (2024)
di: Shrivastava, Gaurav, et al.
Pubblicazione: (2024)
Improving Colorectal Cancer Screening and Risk Assessment through Predictive Modeling on Medical Images and Records
di: Jiang, Shuai, et al.
Pubblicazione: (2024)
di: Jiang, Shuai, et al.
Pubblicazione: (2024)
SKINOPATHY AI: Smartphone-Based Ophthalmic Screening and Longitudinal Tracking Using Lightweight Computer Vision
di: Kalaycioglu, S., et al.
Pubblicazione: (2026)
di: Kalaycioglu, S., et al.
Pubblicazione: (2026)
VideoFlexTok: Flexible-Length Coarse-to-Fine Video Tokenization
di: Atanov, Andrei, et al.
Pubblicazione: (2026)
di: Atanov, Andrei, et al.
Pubblicazione: (2026)
VideoChat-Flash: Hierarchical Compression for Long-Context Video Modeling
di: Li, Xinhao, et al.
Pubblicazione: (2024)
di: Li, Xinhao, et al.
Pubblicazione: (2024)
Video Parallel Scaling: Aggregating Diverse Frame Subsets for VideoLLMs
di: Chung, Hyungjin, et al.
Pubblicazione: (2025)
di: Chung, Hyungjin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
A data-driven approach to linking design features with manufacturing process data for sustainable product development
di: Li, Jiahang, et al.
Pubblicazione: (2025) -
SLANT: Spurious Logo ANalysis Toolkit
di: Qraitem, Maan, et al.
Pubblicazione: (2024) -
Tutorial on Diffusion Models for Imaging and Vision
di: Chan, Stanley H.
Pubblicazione: (2024) -
Full Field Digital Mammography Dataset from a Population Screening Program
di: Kendall, Edward, et al.
Pubblicazione: (2024) -
SimCast: Enhancing Precipitation Nowcasting with Short-to-Long Term Knowledge Distillation
di: Yin, Yifang, et al.
Pubblicazione: (2025)