PuzLM: Solving Jigsaw Puzzles with Sequence-to-Sequence Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Elkin, Gur, Shahar, Ofir Itzhak, Ben-Shahar, Ohad |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
The Missing GAP: From Solving Square Jigsaw Puzzles to Handling Real World Archaeological Fragments
by: Shahar, Ofir Itzhak, et al.
Published: (2026)
by: Shahar, Ofir Itzhak, et al.
Published: (2026)
Solving Convex Partition Visual Jigsaw Puzzles
by: Ohayon, Yaniv, et al.
Published: (2025)
by: Ohayon, Yaniv, et al.
Published: (2025)
Pairwise Alignment & Compatibility for Arbitrarily Irregular Image Fragments
by: Shahar, Ofir Itzhak, et al.
Published: (2025)
by: Shahar, Ofir Itzhak, et al.
Published: (2025)
Recognizing Artistic Style of Archaeological Image Fragments Using Deep Style Extrapolation
by: Elkin, Gur, et al.
Published: (2025)
by: Elkin, Gur, et al.
Published: (2025)
Pictorial and apictorial polygonal jigsaw puzzles from arbitrary number of crossing cuts
by: Shahar, Peleg Harel Ofir Itzhak, et al.
Published: (2020)
by: Shahar, Peleg Harel Ofir Itzhak, et al.
Published: (2020)
EMAG: Differentiable 4D Gaussian Mixture Splatting for EEG Spatial Super-Resolution
by: Lazarovich, Alex, et al.
Published: (2026)
by: Lazarovich, Alex, et al.
Published: (2026)
Solving Masked Jigsaw Puzzles with Diffusion Vision Transformers
by: Liu, Jinyang, et al.
Published: (2024)
by: Liu, Jinyang, et al.
Published: (2024)
Solving Jigsaw Puzzles in the Wild: Human-Guided Reconstruction of Cultural Heritage Fragments
by: Safaei, Omidreza, et al.
Published: (2026)
by: Safaei, Omidreza, et al.
Published: (2026)
A Unified Masked Jigsaw Puzzle Framework for Vision and Language Models
by: Ye, Weixin, et al.
Published: (2026)
by: Ye, Weixin, et al.
Published: (2026)
ERL-MPP: Evolutionary Reinforcement Learning with Multi-head Puzzle Perception for Solving Large-scale Jigsaw Puzzles of Eroded Gaps
by: Song, Xingke, et al.
Published: (2025)
by: Song, Xingke, et al.
Published: (2025)
Re-assembling the past: The RePAIR dataset and benchmark for real world 2D and 3D puzzle solving
by: Tsesmelis, Theodore, et al.
Published: (2024)
by: Tsesmelis, Theodore, et al.
Published: (2024)
Benchmarking Content-Based Puzzle Solvers on Corrupted Jigsaw Puzzles
by: Dirauf, Richard, et al.
Published: (2025)
by: Dirauf, Richard, et al.
Published: (2025)
Deep BI-RADS Network for Improved Cancer Detection from Mammograms
by: Ben-Artzi, Gil, et al.
Published: (2024)
by: Ben-Artzi, Gil, et al.
Published: (2024)
Jigsaw-R1: A Study of Rule-based Visual Reinforcement Learning with Jigsaw Puzzles
by: Wang, Zifu, et al.
Published: (2025)
by: Wang, Zifu, et al.
Published: (2025)
Ham2Pose: Animating Sign Language Notation into Pose Sequences
by: Shalev-Arkushin, Rotem, et al.
Published: (2022)
by: Shalev-Arkushin, Rotem, et al.
Published: (2022)
Spatially Aware Deep Learning for Microclimate Prediction from High-Resolution Geospatial Imagery
by: Sulami, Idan, et al.
Published: (2026)
by: Sulami, Idan, et al.
Published: (2026)
Synthetic Data Generation for 3D Myocardium Deformation Analysis
by: Zuler, Shahar, et al.
Published: (2024)
by: Zuler, Shahar, et al.
Published: (2024)
Lever LM: Configuring In-Context Sequence to Lever Large Vision Language Models
by: Yang, Xu, et al.
Published: (2023)
by: Yang, Xu, et al.
Published: (2023)
Not Every Image is Worth a Thousand Words: Quantifying Originality in Stable Diffusion
by: Haviv, Adi, et al.
Published: (2024)
by: Haviv, Adi, et al.
Published: (2024)
Non-autoregressive Sequence-to-Sequence Vision-Language Models
by: Shi, Kunyu, et al.
Published: (2024)
by: Shi, Kunyu, et al.
Published: (2024)
Not All Similarities Are Created Equal: Leveraging Data-Driven Biases to Inform GenAI Copyright Disputes
by: Hacohen, Uri, et al.
Published: (2024)
by: Hacohen, Uri, et al.
Published: (2024)
Detection of adrenal anomalous findings in spinal CT images using multi model graph aggregation
by: Shabalin, Carmel, et al.
Published: (2024)
by: Shabalin, Carmel, et al.
Published: (2024)
Unified Sequence-to-Sequence Learning for Single- and Multi-Modal Visual Object Tracking
by: Chen, Xin, et al.
Published: (2023)
by: Chen, Xin, et al.
Published: (2023)
Cracking Instance Jigsaw Puzzles: An Alternative to Multiple Instance Learning for Whole Slide Image Analysis
by: Chen, Xiwen, et al.
Published: (2025)
by: Chen, Xiwen, et al.
Published: (2025)
Neural Fingerprints for Adversarial Attack Detection
by: Fisher, Haim, et al.
Published: (2024)
by: Fisher, Haim, et al.
Published: (2024)
VisFocus: Prompt-Guided Vision Encoders for OCR-Free Dense Document Understanding
by: Abramovich, Ofir, et al.
Published: (2024)
by: Abramovich, Ofir, et al.
Published: (2024)
Nash Meets Wertheimer: Using Good Continuation in Jigsaw Puzzles
by: Khoroshiltseva, Marina, et al.
Published: (2024)
by: Khoroshiltseva, Marina, et al.
Published: (2024)
PuzzleBench: A Fully Dynamic Evaluation Framework for Large Multimodal Models on Puzzle Solving
by: Zhang, Zeyu, et al.
Published: (2025)
by: Zhang, Zeyu, et al.
Published: (2025)
VERIDAH: Solving Enumeration Anomaly Aware Vertebra Labeling across Imaging Sequences
by: Möller, Hendrik, et al.
Published: (2026)
by: Möller, Hendrik, et al.
Published: (2026)
L-SR1: Learned Symmetric-Rank-One Preconditioning
by: Lifshitz, Gal, et al.
Published: (2025)
by: Lifshitz, Gal, et al.
Published: (2025)
DODO: Discrete OCR Diffusion Models
by: Man, Sean, et al.
Published: (2026)
by: Man, Sean, et al.
Published: (2026)
MambaMIL: Enhancing Long Sequence Modeling with Sequence Reordering in Computational Pathology
by: Yang, Shu, et al.
Published: (2024)
by: Yang, Shu, et al.
Published: (2024)
Scaling Sequence-to-Sequence Generative Neural Rendering
by: Liu, Shikun, et al.
Published: (2025)
by: Liu, Shikun, et al.
Published: (2025)
Accelerating Text-to-Video Generation with Calibrated Sparse Attention
by: Yehezkel, Shai, et al.
Published: (2026)
by: Yehezkel, Shai, et al.
Published: (2026)
Winner Team Mia at TextVQA Challenge 2021: Vision-and-Language Representation Learning with Pre-trained Sequence-to-Sequence Model
by: Qiao, Yixuan, et al.
Published: (2021)
by: Qiao, Yixuan, et al.
Published: (2021)
Visual Jigsaw Post-Training Improves MLLMs
by: Wu, Penghao, et al.
Published: (2025)
by: Wu, Penghao, et al.
Published: (2025)
Jigsaw Regularization in Whole-Slide Image Classification
by: Jeong, So Won, et al.
Published: (2026)
by: Jeong, So Won, et al.
Published: (2026)
SMM-Conv: Scalar Matrix Multiplication with Zero Packing for Accelerated Convolution
by: Ofir, Amir, et al.
Published: (2024)
by: Ofir, Amir, et al.
Published: (2024)
TimePoint: Accelerated Time Series Alignment via Self-Supervised Keypoint and Descriptor Learning
by: Weber, Ron Shapira, et al.
Published: (2025)
by: Weber, Ron Shapira, et al.
Published: (2025)
HOIGPT: Learning Long Sequence Hand-Object Interaction with Language Models
by: Huang, Mingzhen, et al.
Published: (2025)
by: Huang, Mingzhen, et al.
Published: (2025)
Similar Items
-
The Missing GAP: From Solving Square Jigsaw Puzzles to Handling Real World Archaeological Fragments
by: Shahar, Ofir Itzhak, et al.
Published: (2026) -
Solving Convex Partition Visual Jigsaw Puzzles
by: Ohayon, Yaniv, et al.
Published: (2025) -
Pairwise Alignment & Compatibility for Arbitrarily Irregular Image Fragments
by: Shahar, Ofir Itzhak, et al.
Published: (2025) -
Recognizing Artistic Style of Archaeological Image Fragments Using Deep Style Extrapolation
by: Elkin, Gur, et al.
Published: (2025) -
Pictorial and apictorial polygonal jigsaw puzzles from arbitrary number of crossing cuts
by: Shahar, Peleg Harel Ofir Itzhak, et al.
Published: (2020)