Enabling Stroke-Level Structural Analysis of Hieroglyphic Scripts without Language-Specific Priors
Fuente:
arXiv
Guardado en:
| Autores principales: | Luo, Fuwen, Wan, Zihao, Wang, Ziyue, Liu, Yaluo, Xu, Pau Tong Lin, Qiao, Xuanjia, Wang, Xiaolong, Li, Peng, Liu, Yang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Bridging Vision, Language, and Mathematics: Pictographic Character Reconstruction with Bézier Curves
por: Wan, Zihao, et al.
Publicado: (2025)
por: Wan, Zihao, et al.
Publicado: (2025)
Perspective Transition of Large Language Models for Solving Subjective Tasks
por: Wang, Xiaolong, et al.
Publicado: (2025)
por: Wang, Xiaolong, et al.
Publicado: (2025)
CODIS: Benchmarking Context-Dependent Visual Comprehension for Multimodal Large Language Models
por: Luo, Fuwen, et al.
Publicado: (2024)
por: Luo, Fuwen, et al.
Publicado: (2024)
Exploring Large Language Models for Communication Games: An Empirical Study on Werewolf
por: Xu, Yuzhuang, et al.
Publicado: (2023)
por: Xu, Yuzhuang, et al.
Publicado: (2023)
ActiView: Evaluating Active Perception Ability for Multimodal Large Language Models
por: Wang, Ziyue, et al.
Publicado: (2024)
por: Wang, Ziyue, et al.
Publicado: (2024)
Reasoning in Conversation: Solving Subjective Tasks through Dialogue Simulation for Large Language Models
por: Wang, Xiaolong, et al.
Publicado: (2024)
por: Wang, Xiaolong, et al.
Publicado: (2024)
Thinking with Visual Abstract: Enhancing Multimodal Reasoning via Visual Abstraction
por: Liu, Dairu, et al.
Publicado: (2025)
por: Liu, Dairu, et al.
Publicado: (2025)
Fine-Grained Representation Learning via Multi-Level Contrastive Learning without Class Priors
por: Jiang, Houwang, et al.
Publicado: (2024)
por: Jiang, Houwang, et al.
Publicado: (2024)
Evaluating Time Awareness and Cross-modal Active Perception of Large Models via 4D Escape Room Task
por: Dong, Yurui, et al.
Publicado: (2026)
por: Dong, Yurui, et al.
Publicado: (2026)
Model Composition for Multimodal Large Language Models
por: Chen, Chi, et al.
Publicado: (2024)
por: Chen, Chi, et al.
Publicado: (2024)
ArchSeek: Retrieving Architectural Case Studies Using Vision-Language Models
por: Li, Danrui, et al.
Publicado: (2025)
por: Li, Danrui, et al.
Publicado: (2025)
EscapeCraft: A 3D Room Escape Environment for Benchmarking Complex Multimodal Reasoning Ability
por: Wang, Ziyue, et al.
Publicado: (2025)
por: Wang, Ziyue, et al.
Publicado: (2025)
DongbaMIE: A Multimodal Information Extraction Dataset for Evaluating Semantic Understanding of Dongba Pictograms
por: Bi, Xiaojun, et al.
Publicado: (2025)
por: Bi, Xiaojun, et al.
Publicado: (2025)
HieroLM: Egyptian Hieroglyph Recovery with Next Word Prediction Language Model
por: Cai, Xuheng, et al.
Publicado: (2025)
por: Cai, Xuheng, et al.
Publicado: (2025)
StreamingBench: Assessing the Gap for MLLMs to Achieve Streaming Video Understanding
por: Lin, Junming, et al.
Publicado: (2024)
por: Lin, Junming, et al.
Publicado: (2024)
Data Contamination in Neural Hieroglyphic Translation: A Reproducibility Study
por: Toutou, Ammar, et al.
Publicado: (2026)
por: Toutou, Ammar, et al.
Publicado: (2026)
TimeChat-Captioner: Scripting Multi-Scene Videos with Time-Aware and Structural Audio-Visual Captions
por: Yao, Linli, et al.
Publicado: (2026)
por: Yao, Linli, et al.
Publicado: (2026)
Browse and Concentrate: Comprehending Multimodal Content via prior-LLM Context Fusion
por: Wang, Ziyue, et al.
Publicado: (2024)
por: Wang, Ziyue, et al.
Publicado: (2024)
Neural Style Transfer for Synthesising a Dataset of Ancient Egyptian Hieroglyphs
por: Creed, Lewis Matheson
Publicado: (2025)
por: Creed, Lewis Matheson
Publicado: (2025)
Filling the Image Information Gap for VQA: Prompting Large Language Models to Proactively Ask Questions
por: Wang, Ziyue, et al.
Publicado: (2023)
por: Wang, Ziyue, et al.
Publicado: (2023)
LangSAMP: Language-Script Aware Multilingual Pretraining
por: Liu, Yihong, et al.
Publicado: (2024)
por: Liu, Yihong, et al.
Publicado: (2024)
MUSEG: Reinforcing Video Temporal Understanding via Timestamp-Aware Multi-Segment Grounding
por: Luo, Fuwen, et al.
Publicado: (2025)
por: Luo, Fuwen, et al.
Publicado: (2025)
Optimizing Case-Based Reasoning System for Functional Test Script Generation with Large Language Models
por: Guo, Siyuan, et al.
Publicado: (2025)
por: Guo, Siyuan, et al.
Publicado: (2025)
GGTalker: Talking Head Systhesis with Generalizable Gaussian Priors and Identity-Specific Adaptation
por: Hu, Wentao, et al.
Publicado: (2025)
por: Hu, Wentao, et al.
Publicado: (2025)
HieroGlyphTranslator: Automatic Recognition and Translation of Egyptian Hieroglyphs to English
por: Nasser, Ahmed, et al.
Publicado: (2025)
por: Nasser, Ahmed, et al.
Publicado: (2025)
MUCAR: Benchmarking Multilingual Cross-Modal Ambiguity Resolution for Multimodal Large Language Models
por: Wang, Xiaolong, et al.
Publicado: (2025)
por: Wang, Xiaolong, et al.
Publicado: (2025)
CoSpace: Benchmarking Continuous Space Perception Ability for Vision-Language Models
por: Zhu, Yiqi, et al.
Publicado: (2025)
por: Zhu, Yiqi, et al.
Publicado: (2025)
Enhancing Multilingual Capabilities of Large Language Models through Self-Distillation from Resource-Rich Languages
por: Zhang, Yuanchi, et al.
Publicado: (2024)
por: Zhang, Yuanchi, et al.
Publicado: (2024)
StrokeNUWA: Tokenizing Strokes for Vector Graphic Synthesis
por: Tang, Zecheng, et al.
Publicado: (2024)
por: Tang, Zecheng, et al.
Publicado: (2024)
OracleFusion: Assisting the Decipherment of Oracle Bone Script with Structurally Constrained Semantic Typography
por: Li, Caoshuo, et al.
Publicado: (2025)
por: Li, Caoshuo, et al.
Publicado: (2025)
PathReasoner-R1: Instilling Structured Reasoning into Pathology Vision-Language Model via Knowledge-Guided Policy Optimization
por: Jiang, Songhan, et al.
Publicado: (2026)
por: Jiang, Songhan, et al.
Publicado: (2026)
Selective Latent Thinking: Adaptive Compression of LLM Reasoning Chains
por: Xie, Hui, et al.
Publicado: (2026)
por: Xie, Hui, et al.
Publicado: (2026)
Script-Agnostic Language Identification
por: Agarwal, Milind, et al.
Publicado: (2024)
por: Agarwal, Milind, et al.
Publicado: (2024)
Multilingual Language Models Encode Script Over Linguistic Structure
por: Verma, Aastha A K, et al.
Publicado: (2026)
por: Verma, Aastha A K, et al.
Publicado: (2026)
SceneScript: Reconstructing Scenes With An Autoregressive Structured Language Model
por: Avetisyan, Armen, et al.
Publicado: (2024)
por: Avetisyan, Armen, et al.
Publicado: (2024)
SLearnLLM: A Self-Learning Framework for Efficient Domain-Specific Adaptation of Large Language Models
por: Liu, Xiang, et al.
Publicado: (2025)
por: Liu, Xiang, et al.
Publicado: (2025)
Exploiting Diffusion Prior for Real-World Image Dehazing with Unpaired Training
por: Lan, Yunwei, et al.
Publicado: (2025)
por: Lan, Yunwei, et al.
Publicado: (2025)
One Language, Two Scripts: Probing Script-Invariance in LLM Concept Representations
por: Karne, Sripad
Publicado: (2026)
por: Karne, Sripad
Publicado: (2026)
Breaking the Script Barrier: Enabling Automatic Alignment for PoS-based ASR Error Analysis in Non-Latin Scripts
por: Mudi, Prasenjit K, et al.
Publicado: (2026)
por: Mudi, Prasenjit K, et al.
Publicado: (2026)
SLGNet: Synergizing Structural Priors and Language-Guided Modulation for Multimodal Object Detection
por: Xiang, Xiantai, et al.
Publicado: (2026)
por: Xiang, Xiantai, et al.
Publicado: (2026)
Ejemplares similares
-
Bridging Vision, Language, and Mathematics: Pictographic Character Reconstruction with Bézier Curves
por: Wan, Zihao, et al.
Publicado: (2025) -
Perspective Transition of Large Language Models for Solving Subjective Tasks
por: Wang, Xiaolong, et al.
Publicado: (2025) -
CODIS: Benchmarking Context-Dependent Visual Comprehension for Multimodal Large Language Models
por: Luo, Fuwen, et al.
Publicado: (2024) -
Exploring Large Language Models for Communication Games: An Empirical Study on Werewolf
por: Xu, Yuzhuang, et al.
Publicado: (2023) -
ActiView: Evaluating Active Perception Ability for Multimodal Large Language Models
por: Wang, Ziyue, et al.
Publicado: (2024)