Entropy, Thermodynamics and the Geometrization of the Language Model
Fuente:
arXiv
Guardado en:
| Autor principal: | Yang, Wenzhe |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Controlling Long-Horizon Behavior in Language Model Agents with Explicit State Dynamics
por: Subaharan, Sukesh
Publicado: (2026)
por: Subaharan, Sukesh
Publicado: (2026)
SATA-BENCH: Select All That Apply Benchmark for Multiple Choice Questions
por: Xu, Weijie, et al.
Publicado: (2025)
por: Xu, Weijie, et al.
Publicado: (2025)
Epidemic Information Extraction for Event-Based Surveillance using Large Language Models
por: Consoli, Sergio, et al.
Publicado: (2024)
por: Consoli, Sergio, et al.
Publicado: (2024)
BEATS: Bias Evaluation and Assessment Test Suite for Large Language Models
por: Abhishek, Alok, et al.
Publicado: (2025)
por: Abhishek, Alok, et al.
Publicado: (2025)
Low-Resource Neural Machine Translation Using Recurrent Neural Networks and Transfer Learning: A Case Study on English-to-Igbo
por: Ekle, Ocheme Anthony, et al.
Publicado: (2025)
por: Ekle, Ocheme Anthony, et al.
Publicado: (2025)
SHARP: Social Harm Analysis via Risk Profiles for Measuring Inequities in Large Language Models
por: Abhishek, Alok, et al.
Publicado: (2026)
por: Abhishek, Alok, et al.
Publicado: (2026)
Large Language Models are Inconsistent and Biased Evaluators
por: Stureborg, Rickard, et al.
Publicado: (2024)
por: Stureborg, Rickard, et al.
Publicado: (2024)
Solving Zebra Puzzles Using Constraint-Guided Multi-Agent Systems
por: Berman, Shmuel, et al.
Publicado: (2024)
por: Berman, Shmuel, et al.
Publicado: (2024)
From MTEB to MTOB: Retrieval-Augmented Classification for Descriptive Grammars
por: Kornilov, Albert, et al.
Publicado: (2024)
por: Kornilov, Albert, et al.
Publicado: (2024)
TSDS: Data Selection for Task-Specific Model Finetuning
por: Liu, Zifan, et al.
Publicado: (2024)
por: Liu, Zifan, et al.
Publicado: (2024)
An Automatic Text Classification Method Based on Hierarchical Taxonomies, Neural Networks and Document Embedding: The NETHIC Tool
por: Lomasto, Luigi, et al.
Publicado: (2026)
por: Lomasto, Luigi, et al.
Publicado: (2026)
Data and AI governance: Promoting equity, ethics, and fairness in large language models
por: Abhishek, Alok, et al.
Publicado: (2025)
por: Abhishek, Alok, et al.
Publicado: (2025)
Reasoning Promotes Robustness in Theory of Mind Tasks
por: de Haan, Ian B., et al.
Publicado: (2026)
por: de Haan, Ian B., et al.
Publicado: (2026)
CLMN: Concept based Language Models via Neural Symbolic Reasoning
por: Yang, Yibo
Publicado: (2025)
por: Yang, Yibo
Publicado: (2025)
Evaluating Pixel Language Models on Non-Standardized Languages
por: Muñoz-Ortiz, Alberto, et al.
Publicado: (2024)
por: Muñoz-Ortiz, Alberto, et al.
Publicado: (2024)
NurValues: Real-World Nursing Values Evaluation for Large Language Models in Clinical Context
por: Yao, Ben, et al.
Publicado: (2025)
por: Yao, Ben, et al.
Publicado: (2025)
Tailoring Vaccine Messaging with Common-Ground Opinions
por: Stureborg, Rickard, et al.
Publicado: (2024)
por: Stureborg, Rickard, et al.
Publicado: (2024)
The Superalignment of Superhuman Intelligence with Large Language Models
por: Huang, Minlie, et al.
Publicado: (2024)
por: Huang, Minlie, et al.
Publicado: (2024)
An Unforgeable Publicly Verifiable Watermark for Large Language Models
por: Liu, Aiwei, et al.
Publicado: (2023)
por: Liu, Aiwei, et al.
Publicado: (2023)
Exploring State Tracking Capabilities of Large Language Models
por: Rezaee, Kiamehr, et al.
Publicado: (2025)
por: Rezaee, Kiamehr, et al.
Publicado: (2025)
CUBO: Self-Contained Retrieval-Augmented Generation on Consumer Laptops 10 GB Corpora, 16 GB RAM, Single-Device Deployment
por: Astrino, Paolo
Publicado: (2026)
por: Astrino, Paolo
Publicado: (2026)
Morphological Synthesizer for Ge'ez Language: Addressing Morphological Complexity and Resource Limitations
por: Gebremariam, Gebrearegawi, et al.
Publicado: (2025)
por: Gebremariam, Gebrearegawi, et al.
Publicado: (2025)
Distilling Large Language Models for Efficient Clinical Information Extraction
por: Vedula, Karthik S., et al.
Publicado: (2024)
por: Vedula, Karthik S., et al.
Publicado: (2024)
A Survey of Text Watermarking in the Era of Large Language Models
por: Liu, Aiwei, et al.
Publicado: (2023)
por: Liu, Aiwei, et al.
Publicado: (2023)
Adaptive Steering and Remasking for Safe Generation in Diffusion Language Models
por: Lee, Yejin, et al.
Publicado: (2026)
por: Lee, Yejin, et al.
Publicado: (2026)
Triplètoile: Extraction of Knowledge from Microblogging Text
por: Zavarella, Vanni, et al.
Publicado: (2024)
por: Zavarella, Vanni, et al.
Publicado: (2024)
Towards Effective and Efficient Continual Pre-training of Large Language Models
por: Chen, Jie, et al.
Publicado: (2024)
por: Chen, Jie, et al.
Publicado: (2024)
Accurate Retraining-free Pruning for Pretrained Encoder-based Language Models
por: Park, Seungcheol, et al.
Publicado: (2023)
por: Park, Seungcheol, et al.
Publicado: (2023)
Co-NAML-LSTUR: A Combined Model with Attentive Multi-View Learning and Long- and Short-term User Representations for News Recommendation
por: Nguyen, Minh Hoang, et al.
Publicado: (2025)
por: Nguyen, Minh Hoang, et al.
Publicado: (2025)
Arithmetic Without Algorithms: Language Models Solve Math With a Bag of Heuristics
por: Nikankin, Yaniv, et al.
Publicado: (2024)
por: Nikankin, Yaniv, et al.
Publicado: (2024)
Setting Standards in Turkish NLP: TR-MMLU for Large Language Model Evaluation
por: Bayram, M. Ali, et al.
Publicado: (2024)
por: Bayram, M. Ali, et al.
Publicado: (2024)
Unifying Uniform and Binary-coding Quantization for Accurate Compression of Large Language Models
por: Park, Seungcheol, et al.
Publicado: (2025)
por: Park, Seungcheol, et al.
Publicado: (2025)
Accurate Sublayer Pruning for Large Language Models by Exploiting Latency and Tunability Information
por: Park, Seungcheol, et al.
Publicado: (2025)
por: Park, Seungcheol, et al.
Publicado: (2025)
Direct Large Language Model Alignment Through Self-Rewarding Contrastive Prompt Distillation
por: Liu, Aiwei, et al.
Publicado: (2024)
por: Liu, Aiwei, et al.
Publicado: (2024)
Large Language Models(LLMs) on Tabular Data: Prediction, Generation, and Understanding -- A Survey
por: Fang, Xi, et al.
Publicado: (2024)
por: Fang, Xi, et al.
Publicado: (2024)
d-TreeRPO: Towards More Reliable Policy Optimization for Diffusion Language Models
por: Pan, Leyi, et al.
Publicado: (2025)
por: Pan, Leyi, et al.
Publicado: (2025)
WeDLM: Reconciling Diffusion Language Models with Standard Causal Attention for Fast Inference
por: Liu, Aiwei, et al.
Publicado: (2025)
por: Liu, Aiwei, et al.
Publicado: (2025)
Benchmarking Energy Efficiency of Large Language Models Using vLLM
por: Pronk, K., et al.
Publicado: (2025)
por: Pronk, K., et al.
Publicado: (2025)
Omni-SafetyBench: A Benchmark for Safety Evaluation of Audio-Visual Large Language Models
por: Pan, Leyi, et al.
Publicado: (2025)
por: Pan, Leyi, et al.
Publicado: (2025)
The Paradox of Poetic Intent in Back-Translation: Evaluating the Quality of Large Language Models in Chinese Translation
por: Weigang, Li, et al.
Publicado: (2025)
por: Weigang, Li, et al.
Publicado: (2025)
Ejemplares similares
-
Controlling Long-Horizon Behavior in Language Model Agents with Explicit State Dynamics
por: Subaharan, Sukesh
Publicado: (2026) -
SATA-BENCH: Select All That Apply Benchmark for Multiple Choice Questions
por: Xu, Weijie, et al.
Publicado: (2025) -
Epidemic Information Extraction for Event-Based Surveillance using Large Language Models
por: Consoli, Sergio, et al.
Publicado: (2024) -
BEATS: Bias Evaluation and Assessment Test Suite for Large Language Models
por: Abhishek, Alok, et al.
Publicado: (2025) -
Low-Resource Neural Machine Translation Using Recurrent Neural Networks and Transfer Learning: A Case Study on English-to-Igbo
por: Ekle, Ocheme Anthony, et al.
Publicado: (2025)