Guardado en:
| Autores principales: | Sarkhel, Ritesh, Ren, Xiaoqi, Costa, Lauro Beltrao, Su, Guolong, Perot, Vincent, Xie, Yanan, Koukoumidis, Emmanouil, Nandi, Arnab |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2404.00488 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Cross-Modal Entity Matching for Visually Rich Documents
por: Sarkhel, Ritesh, et al.
Publicado: (2023)
por: Sarkhel, Ritesh, et al.
Publicado: (2023)
LMDX: Language Model-based Document Information Extraction and Localization
por: Perot, Vincent, et al.
Publicado: (2023)
por: Perot, Vincent, et al.
Publicado: (2023)
Can a Single Model Master Both Multi-turn Conversations and Tool Use? CoALM: A Unified Conversational Agentic Language Model
por: Acikgoz, Emre Can, et al.
Publicado: (2025)
por: Acikgoz, Emre Can, et al.
Publicado: (2025)
Direct Alignment of Language Models via Quality-Aware Self-Refinement
por: Yu, Runsheng, et al.
Publicado: (2024)
por: Yu, Runsheng, et al.
Publicado: (2024)
Consistency-Aware Editing for Entity-level Unlearning in Language Models
por: Han, Xiaoqi, et al.
Publicado: (2025)
por: Han, Xiaoqi, et al.
Publicado: (2025)
SuperRAG: Beyond RAG with Layout-Aware Graph Modeling
por: Yang, Jeff, et al.
Publicado: (2025)
por: Yang, Jeff, et al.
Publicado: (2025)
From Pixels to Policies: Reinforcing Spatial Reasoning in Language Models for Content-Aware Layout Design
por: Li, Sha, et al.
Publicado: (2026)
por: Li, Sha, et al.
Publicado: (2026)
Lorecast: Layout-Aware Performance and Power Forecasting from Natural Language
por: Wang, Runzhi, et al.
Publicado: (2025)
por: Wang, Runzhi, et al.
Publicado: (2025)
CodecLM: Aligning Language Models with Tailored Synthetic Data
por: Wang, Zifeng, et al.
Publicado: (2024)
por: Wang, Zifeng, et al.
Publicado: (2024)
Source-Aware Training Enables Knowledge Attribution in Language Models
por: Khalifa, Muhammad, et al.
Publicado: (2024)
por: Khalifa, Muhammad, et al.
Publicado: (2024)
Enhancing Large Language Model for Knowledge Graph Completion via Structure-Aware Alignment-Tuning
por: Liu, Yu, et al.
Publicado: (2025)
por: Liu, Yu, et al.
Publicado: (2025)
Token-Level Uncertainty-Aware Objective for Language Model Post-Training
por: Liu, Tingkai, et al.
Publicado: (2025)
por: Liu, Tingkai, et al.
Publicado: (2025)
Multimodal Policy Internalization for Conversational Agents
por: Wang, Zhenhailong, et al.
Publicado: (2025)
por: Wang, Zhenhailong, et al.
Publicado: (2025)
Mitigating Shortcut Reasoning in Language Models: A Gradient-Aware Training Approach
por: Cao, Hongyu, et al.
Publicado: (2026)
por: Cao, Hongyu, et al.
Publicado: (2026)
SASQ: Static Activation Scaling for Quantization-Aware Training in Large Language Models
por: Mao, Shizhuo, et al.
Publicado: (2025)
por: Mao, Shizhuo, et al.
Publicado: (2025)
Aware First, Think Less: Dynamic Boundary Self-Awareness Drives Extreme Reasoning Efficiency in Large Language Models
por: Chen, Qiguang, et al.
Publicado: (2025)
por: Chen, Qiguang, et al.
Publicado: (2025)
EfficientQAT: Efficient Quantization-Aware Training for Large Language Models
por: Chen, Mengzhao, et al.
Publicado: (2024)
por: Chen, Mengzhao, et al.
Publicado: (2024)
SiLQ: Simple Large Language Model Quantization-Aware Training
por: Esser, Steven K., et al.
Publicado: (2025)
por: Esser, Steven K., et al.
Publicado: (2025)
Towards Evaluating Proactive Risk Awareness of Multimodal Language Models
por: Yuan, Youliang, et al.
Publicado: (2025)
por: Yuan, Youliang, et al.
Publicado: (2025)
Training Text-to-Molecule Models with Context-Aware Tokenization
por: Kim, Seojin, et al.
Publicado: (2025)
por: Kim, Seojin, et al.
Publicado: (2025)
Cross-Cultural Value Awareness in Large Vision-Language Models
por: Howard, Phillip, et al.
Publicado: (2026)
por: Howard, Phillip, et al.
Publicado: (2026)
Leveraging Human Revisions for Improving Text-to-Layout Models
por: Xie, Amber, et al.
Publicado: (2024)
por: Xie, Amber, et al.
Publicado: (2024)
Time-Aware Feature Selection: Adaptive Temporal Masking for Stable Sparse Autoencoder Training
por: Li, T. Ed, et al.
Publicado: (2025)
por: Li, T. Ed, et al.
Publicado: (2025)
Quantization-Aware and Tensor-Compressed Training of Transformers for Natural Language Understanding
por: Yang, Zi, et al.
Publicado: (2023)
por: Yang, Zi, et al.
Publicado: (2023)
Adaptive Pruning for Large Language Models with Structural Importance Awareness
por: Zheng, Haotian, et al.
Publicado: (2024)
por: Zheng, Haotian, et al.
Publicado: (2024)
HAPO: Training Language Models to Reason Concisely via History-Aware Policy Optimization
por: Huang, Chengyu, et al.
Publicado: (2025)
por: Huang, Chengyu, et al.
Publicado: (2025)
Infinity Parser: Layout Aware Reinforcement Learning for Scanned Document Parsing
por: Wang, Baode, et al.
Publicado: (2025)
por: Wang, Baode, et al.
Publicado: (2025)
Tabular PDF Information Extraction with Local LLMs and Layout-Aware Parsing: A Reliability Evaluation
por: Hilmi, Muhammad Anis Al, et al.
Publicado: (2026)
por: Hilmi, Muhammad Anis Al, et al.
Publicado: (2026)
PARAMANU-GANITA: Can Small Math Language Models Rival with Large Language Models on Mathematical Reasoning?
por: Niyogi, Mitodru, et al.
Publicado: (2024)
por: Niyogi, Mitodru, et al.
Publicado: (2024)
Probing and Steering Evaluation Awareness of Language Models
por: Nguyen, Jord, et al.
Publicado: (2025)
por: Nguyen, Jord, et al.
Publicado: (2025)
Emergent Introspective Awareness in Large Language Models
por: Lindsey, Jack
Publicado: (2026)
por: Lindsey, Jack
Publicado: (2026)
Inference-Aware Fine-Tuning for Best-of-N Sampling in Large Language Models
por: Chow, Yinlam, et al.
Publicado: (2024)
por: Chow, Yinlam, et al.
Publicado: (2024)
Pointer-Guided Pre-Training: Infusing Large Language Models with Paragraph-Level Contextual Awareness
por: Hillebrand, Lars, et al.
Publicado: (2024)
por: Hillebrand, Lars, et al.
Publicado: (2024)
Paramanu: Compact and Competitive Monolingual Language Models for Low-Resource Morphologically Rich Indian Languages
por: Niyogi, Mitodru, et al.
Publicado: (2024)
por: Niyogi, Mitodru, et al.
Publicado: (2024)
Safety-Aware Fine-Tuning of Large Language Models
por: Choi, Hyeong Kyu, et al.
Publicado: (2024)
por: Choi, Hyeong Kyu, et al.
Publicado: (2024)
FLAME: Factuality-Aware Alignment for Large Language Models
por: Lin, Sheng-Chieh, et al.
Publicado: (2024)
por: Lin, Sheng-Chieh, et al.
Publicado: (2024)
SMAR: Soft Modality-Aware Routing Strategy for MoE-based Multimodal Large Language Models Preserving Language Capabilities
por: Xia, Guoyang, et al.
Publicado: (2025)
por: Xia, Guoyang, et al.
Publicado: (2025)
Training-Trajectory-Aware Token Selection
por: Shen, Zhanming, et al.
Publicado: (2026)
por: Shen, Zhanming, et al.
Publicado: (2026)
$A^3$: Attention-Aware Accurate KV Cache Fusion for Fast Large Language Model Serving
por: Zhou, Yuechi, et al.
Publicado: (2025)
por: Zhou, Yuechi, et al.
Publicado: (2025)
Sink-Aware Pruning for Diffusion Language Models
por: Myrzakhan, Aidar, et al.
Publicado: (2026)
por: Myrzakhan, Aidar, et al.
Publicado: (2026)
Ejemplares similares
-
Cross-Modal Entity Matching for Visually Rich Documents
por: Sarkhel, Ritesh, et al.
Publicado: (2023) -
LMDX: Language Model-based Document Information Extraction and Localization
por: Perot, Vincent, et al.
Publicado: (2023) -
Can a Single Model Master Both Multi-turn Conversations and Tool Use? CoALM: A Unified Conversational Agentic Language Model
por: Acikgoz, Emre Can, et al.
Publicado: (2025) -
Direct Alignment of Language Models via Quality-Aware Self-Refinement
por: Yu, Runsheng, et al.
Publicado: (2024) -
Consistency-Aware Editing for Entity-level Unlearning in Language Models
por: Han, Xiaoqi, et al.
Publicado: (2025)