PictOBI-20k: Unveiling Large Multimodal Models in Visual Decipherment for Pictographic Oracle Bone Characters
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Zijian, Hua, Wenjie, Li, Jinhao, Deng, Lirong, Du, Fan, Chen, Tingzhu, Zhai, Guangtao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
OBI-Bench: Can LMMs Aid in Study of Ancient Script on Oracle Bones?
por: Chen, Zijian, et al.
Publicado: (2024)
por: Chen, Zijian, et al.
Publicado: (2024)
Mitigating Long-tail Distribution in Oracle Bone Inscriptions: Dataset, Model, and Benchmark
por: Li, Jinhao, et al.
Publicado: (2025)
por: Li, Jinhao, et al.
Publicado: (2025)
Interpretable Oracle Bone Script Decipherment through Radical and Pictographic Analysis with LVLMs
por: Peng, Kaixin, et al.
Publicado: (2025)
por: Peng, Kaixin, et al.
Publicado: (2025)
OBIFormer: A Fast Attentive Denoising Framework for Oracle Bone Inscriptions
por: Li, Jinhao, et al.
Publicado: (2025)
por: Li, Jinhao, et al.
Publicado: (2025)
Find Them All: Unveiling MLLMs for Versatile Person Re-identification
por: Li, Jinhao, et al.
Publicado: (2025)
por: Li, Jinhao, et al.
Publicado: (2025)
OracleFusion: Assisting the Decipherment of Oracle Bone Script with Structurally Constrained Semantic Typography
por: Li, Caoshuo, et al.
Publicado: (2025)
por: Li, Caoshuo, et al.
Publicado: (2025)
Bridging Vision, Language, and Mathematics: Pictographic Character Reconstruction with Bézier Curves
por: Wan, Zihao, et al.
Publicado: (2025)
por: Wan, Zihao, et al.
Publicado: (2025)
Can Large Models Fool the Eye? A New Turing Test for Biological Animation
por: Chen, Zijian, et al.
Publicado: (2025)
por: Chen, Zijian, et al.
Publicado: (2025)
Evaluating from Benign to Dynamic Adversarial: A Squid Game for Large Language Models
por: Chen, Zijian, et al.
Publicado: (2025)
por: Chen, Zijian, et al.
Publicado: (2025)
GTPred: Benchmarking MLLMs for Interpretable Geo-localization and Time-of-capture Prediction
por: Li, Jinnao, et al.
Publicado: (2026)
por: Li, Jinnao, et al.
Publicado: (2026)
KidVis: Do Multimodal Large Language Models Possess the Visual Perceptual Capabilities of a 6-Year-Old?
por: Wang, Xianfeng, et al.
Publicado: (2026)
por: Wang, Xianfeng, et al.
Publicado: (2026)
Oracle-MNIST: a Dataset of Oracle Characters for Benchmarking Machine Learning Algorithms
por: Wang, Mei, et al.
Publicado: (2022)
por: Wang, Mei, et al.
Publicado: (2022)
OracleAgent: A Multimodal Reasoning Agent for Oracle Bone Script Research
por: Li, Caoshuo, et al.
Publicado: (2025)
por: Li, Caoshuo, et al.
Publicado: (2025)
Writing from Invention to Decipherment
Publicado: (2024)
Publicado: (2024)
PictSure: Pretraining Embeddings Matters for In-Context Learning Image Classifiers
por: Schiesser, Lukas, et al.
Publicado: (2025)
por: Schiesser, Lukas, et al.
Publicado: (2025)
InteChar: A Unified Oracle Bone Character List for Ancient Chinese Language Modeling
por: Diao, Xiaolei, et al.
Publicado: (2025)
por: Diao, Xiaolei, et al.
Publicado: (2025)
OracleSage: Towards Unified Visual-Linguistic Understanding of Oracle Bone Scripts through Cross-Modal Knowledge Fusion
por: Jiang, Hanqi, et al.
Publicado: (2024)
por: Jiang, Hanqi, et al.
Publicado: (2024)
Unsupervised Attention Regularization Based Domain Adaptation for Oracle Character Recognition
por: Wang, Mei, et al.
Publicado: (2024)
por: Wang, Mei, et al.
Publicado: (2024)
Just Noticeable Difference for Large Multimodal Models
por: Chen, Zijian, et al.
Publicado: (2025)
por: Chen, Zijian, et al.
Publicado: (2025)
Oracle Bone Script Similiar Character Screening Approach Based on Simsiam Contrastive Learning and Supervised Learning
por: Weng, Xinying, et al.
Publicado: (2024)
por: Weng, Xinying, et al.
Publicado: (2024)
MACEval: A Multi-Agent Continual Evaluation Network for Large Models
por: Chen, Zijian, et al.
Publicado: (2025)
por: Chen, Zijian, et al.
Publicado: (2025)
Laser-induced electron diffraction in the over-the-barrier ionization (OBI) regime
por: Belsa, B., et al.
Publicado: (2022)
por: Belsa, B., et al.
Publicado: (2022)
AGAV-Rater: Adapting Large Multimodal Model for AI-Generated Audio-Visual Quality Assessment
por: Cao, Yuqin, et al.
Publicado: (2025)
por: Cao, Yuqin, et al.
Publicado: (2025)
Diff-Oracle: Deciphering Oracle Bone Scripts with Controllable Diffusion Model
por: Li, Jing, et al.
Publicado: (2023)
por: Li, Jing, et al.
Publicado: (2023)
PriceSeer: Evaluating Large Language Models in Real-Time Stock Prediction
por: Liang, Bohan, et al.
Publicado: (2025)
por: Liang, Bohan, et al.
Publicado: (2025)
Development of Pictographic Odia-Odia Baby Term Dictionary for Understanding Language Utterance
por: Mohapatra, Rudranarayan
Publicado: (2019)
por: Mohapatra, Rudranarayan
Publicado: (2019)
Free-VSC: Free Semantics from Visual Foundation Models for Unsupervised Video Semantic Compression
por: Tian, Yuan, et al.
Publicado: (2024)
por: Tian, Yuan, et al.
Publicado: (2024)
Reasoning Over the Glyphs: Evaluation of LLM's Decipherment of Rare Scripts
por: Shih, Yu-Fei, et al.
Publicado: (2025)
por: Shih, Yu-Fei, et al.
Publicado: (2025)
Decipherment-Aware Multilingual Learning in Jointly Trained Language Models
por: Lee, Grandee
Publicado: (2024)
por: Lee, Grandee
Publicado: (2024)
Bactrian in Issyk‐Kushan Script: Additional Readings and Decipherments 1
por: Jakob Halfmann, et al.
Publicado: (2026)
por: Jakob Halfmann, et al.
Publicado: (2026)
VITAL: Vision-Encoder-centered Pre-training for LMMs in Visual Quality Assessment
por: Jia, Ziheng, et al.
Publicado: (2025)
por: Jia, Ziheng, et al.
Publicado: (2025)
Engagement Prediction of Short Videos with Large Multimodal Models
por: Sun, Wei, et al.
Publicado: (2025)
por: Sun, Wei, et al.
Publicado: (2025)
relOBI: A Reliable Low-latency Interconnect for Tightly-Coupled On-chip Communication
por: Rogenmoser, Michael, et al.
Publicado: (2025)
por: Rogenmoser, Michael, et al.
Publicado: (2025)
Mapping the structure and dynamics of global high‐tech aerospace trade
por: Xiya Li, et al.
Publicado: (2024)
por: Xiya Li, et al.
Publicado: (2024)
Double Oracle Algorithm for Game-Theoretic Robot Allocation on Graphs
por: An, Zijian, et al.
Publicado: (2023)
por: An, Zijian, et al.
Publicado: (2023)
Decoding Ancient Oracle Bone Script via Generative Dictionary Retrieval
por: Wu, Yin, et al.
Publicado: (2026)
por: Wu, Yin, et al.
Publicado: (2026)
GeoR-Bench: Evaluating Geoscience Visual Reasoning
por: Zheng, Yushuo, et al.
Publicado: (2026)
por: Zheng, Yushuo, et al.
Publicado: (2026)
Deciphering Oracle Bone Language with Diffusion Models
por: Guan, Haisu, et al.
Publicado: (2024)
por: Guan, Haisu, et al.
Publicado: (2024)
Oracle Bone Inscriptions Multi-modal Dataset
por: Li, Bang, et al.
Publicado: (2024)
por: Li, Bang, et al.
Publicado: (2024)
The Oracle Bone Inscriptions from Huayuanzhuang East
por: Schwartz, Adam C.
Publicado: (2020)
por: Schwartz, Adam C.
Publicado: (2020)
Ejemplares similares
-
OBI-Bench: Can LMMs Aid in Study of Ancient Script on Oracle Bones?
por: Chen, Zijian, et al.
Publicado: (2024) -
Mitigating Long-tail Distribution in Oracle Bone Inscriptions: Dataset, Model, and Benchmark
por: Li, Jinhao, et al.
Publicado: (2025) -
Interpretable Oracle Bone Script Decipherment through Radical and Pictographic Analysis with LVLMs
por: Peng, Kaixin, et al.
Publicado: (2025) -
OBIFormer: A Fast Attentive Denoising Framework for Oracle Bone Inscriptions
por: Li, Jinhao, et al.
Publicado: (2025) -
Find Them All: Unveiling MLLMs for Versatile Person Re-identification
por: Li, Jinhao, et al.
Publicado: (2025)