Towards Latent Diffusion Suitable For Text
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Midavaine, Nesta, Naesseth, Christian A., Bartosh, Grigory |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
von: Oketunji, Abiodun Finbarrs
Veröffentlicht: (2023)
von: Oketunji, Abiodun Finbarrs
Veröffentlicht: (2023)
Reinforcement Learning for Latent-Space Thinking in LLMs
von: Özeren, Enes, et al.
Veröffentlicht: (2025)
von: Özeren, Enes, et al.
Veröffentlicht: (2025)
Efficacy of ByT5 in Multilingual Translation of Biblical Texts for Underrepresented Languages
von: Aars, Corinne, et al.
Veröffentlicht: (2024)
von: Aars, Corinne, et al.
Veröffentlicht: (2024)
GenAI Content Detection Task 3: Cross-Domain Machine-Generated Text Detection Challenge
von: Dugan, Liam, et al.
Veröffentlicht: (2025)
von: Dugan, Liam, et al.
Veröffentlicht: (2025)
Sparsing Law: Towards Large Language Models with Greater Activation Sparsity
von: Luo, Yuqi, et al.
Veröffentlicht: (2024)
von: Luo, Yuqi, et al.
Veröffentlicht: (2024)
Combining Language and Topic Models for Hierarchical Text Classification
von: Toit, Jaco du, et al.
Veröffentlicht: (2025)
von: Toit, Jaco du, et al.
Veröffentlicht: (2025)
Stratified Hazard Sampling: Minimal-Variance Event Scheduling for CTMC/DTMC Discrete Diffusion and Flow Models
von: Jang, Seunghwan, et al.
Veröffentlicht: (2026)
von: Jang, Seunghwan, et al.
Veröffentlicht: (2026)
Large Language Model (LLM) Bias Index -- LLMBI
von: Oketunji, Abiodun Finbarrs, et al.
Veröffentlicht: (2023)
von: Oketunji, Abiodun Finbarrs, et al.
Veröffentlicht: (2023)
Engineering A Large Language Model From Scratch
von: Oketunji, Abiodun Finbarrs
Veröffentlicht: (2024)
von: Oketunji, Abiodun Finbarrs
Veröffentlicht: (2024)
Arithmetic OOD Failure Unfolds in Stages in Minimal GPTs
von: Shintani, Seine A.
Veröffentlicht: (2026)
von: Shintani, Seine A.
Veröffentlicht: (2026)
RBCorr: Response Bias Correction in Language Models
von: Bhatt, Om, et al.
Veröffentlicht: (2026)
von: Bhatt, Om, et al.
Veröffentlicht: (2026)
Uncovering Latent Human Wellbeing in Language Model Embeddings
von: Freire, Pedro, et al.
Veröffentlicht: (2024)
von: Freire, Pedro, et al.
Veröffentlicht: (2024)
KenSwQuAD -- A Question Answering Dataset for Swahili Low Resource Language
von: Wanjawa, Barack W., et al.
Veröffentlicht: (2022)
von: Wanjawa, Barack W., et al.
Veröffentlicht: (2022)
A Framework for Fine-Tuning LLMs using Heterogeneous Feedback
von: Aponte, Ryan, et al.
Veröffentlicht: (2024)
von: Aponte, Ryan, et al.
Veröffentlicht: (2024)
RomanLens: The Role Of Latent Romanization In Multilinguality In LLMs
von: Saji, Alan, et al.
Veröffentlicht: (2025)
von: Saji, Alan, et al.
Veröffentlicht: (2025)
Improving Discrete Diffusion Unmasking Policies Beyond Explicit Reference Policies
von: Hong, Chunsan, et al.
Veröffentlicht: (2025)
von: Hong, Chunsan, et al.
Veröffentlicht: (2025)
Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding
von: Chen, Haolin, et al.
Veröffentlicht: (2024)
von: Chen, Haolin, et al.
Veröffentlicht: (2024)
SpectralLoRA: Is Low-Frequency Structure Sufficient for LoRA Adaptation? A Spectral Analysis of Weight Updates
von: Singh, Rajveer
Veröffentlicht: (2026)
von: Singh, Rajveer
Veröffentlicht: (2026)
FIM-LoRA: Task-Informative Rank Allocation for LoRA via Calibration-Time Gradient-Variance Estimation
von: Sathyavageeswaran, Ramakrishnan
Veröffentlicht: (2026)
von: Sathyavageeswaran, Ramakrishnan
Veröffentlicht: (2026)
Where Should LoRA Go? Component-Type Placement in Hybrid Language Models
von: Borobia, Hector, et al.
Veröffentlicht: (2026)
von: Borobia, Hector, et al.
Veröffentlicht: (2026)
RightNow-Arabic-0.5B-Turbo: An Open Sub-1B Arabic Language Model via Vocabulary Injection and Edge-First Deployment
von: Jaber, Jaber, et al.
Veröffentlicht: (2026)
von: Jaber, Jaber, et al.
Veröffentlicht: (2026)
Structured-Sparse Attention for Entity Tracking with Subquadratic Sequence Complexity
von: Zhao, Hangyue, et al.
Veröffentlicht: (2026)
von: Zhao, Hangyue, et al.
Veröffentlicht: (2026)
PowLU: An Activation Function for Stable Pre-Training of LLMs
von: Jiang, Peijie, et al.
Veröffentlicht: (2026)
von: Jiang, Peijie, et al.
Veröffentlicht: (2026)
Resonant Context Anchoring: Decoupling Attention Routing and Signal Gain at Inference Time
von: Zhao, Mingkuan, et al.
Veröffentlicht: (2026)
von: Zhao, Mingkuan, et al.
Veröffentlicht: (2026)
Structure-Guided Entity Resolution: Fine-Tuning LLMs for Robust Name Matching in Complex Linguistic Contexts
von: Chourasia, Shivam, et al.
Veröffentlicht: (2026)
von: Chourasia, Shivam, et al.
Veröffentlicht: (2026)
Hardware Co-Design Scaling Laws via Roofline Modelling for On-Device LLMs
von: Sun, Luoyang, et al.
Veröffentlicht: (2026)
von: Sun, Luoyang, et al.
Veröffentlicht: (2026)
Trading Complexity for Expressivity Through Structured Generalized Linear Token Mixing
von: Fagnou, Erwan, et al.
Veröffentlicht: (2026)
von: Fagnou, Erwan, et al.
Veröffentlicht: (2026)
An experimental study of KV cache reuse strategies in chunk-level caching systems
von: Cestola, Samuel, et al.
Veröffentlicht: (2026)
von: Cestola, Samuel, et al.
Veröffentlicht: (2026)
Compact Example-Based Explanations for Language Models
von: Schoenegger, Loris, et al.
Veröffentlicht: (2026)
von: Schoenegger, Loris, et al.
Veröffentlicht: (2026)
Less Is More: Cognitive Load and the Single-Prompt Ceiling in LLM Mathematical Reasoning
von: Cazares, Manuel Israel
Veröffentlicht: (2026)
von: Cazares, Manuel Israel
Veröffentlicht: (2026)
Enhancing Automated Essay Scoring with Three Techniques: Two-Stage Fine-Tuning, Score Alignment, and Self-Training
von: Choi, Hongseok, et al.
Veröffentlicht: (2026)
von: Choi, Hongseok, et al.
Veröffentlicht: (2026)
Decoding-Time Debiasing via Process Reward Models: From Controlled Fill-in to Open-Ended Generation
von: Khan, Muneeb Ur Raheem
Veröffentlicht: (2026)
von: Khan, Muneeb Ur Raheem
Veröffentlicht: (2026)
BrahmicTokenizer-131K: An Indic-Capable Drop-In Replacement for o200k_base
von: Shravan, Rohan
Veröffentlicht: (2026)
von: Shravan, Rohan
Veröffentlicht: (2026)
Geometric Deviation as an Unsupervised Pre-Generation Reliability Signal: Probing LLM Representations for Answerability
von: Du, Yucheng
Veröffentlicht: (2026)
von: Du, Yucheng
Veröffentlicht: (2026)
Better and Worse with Scale: How Contextual Entrainment Diverges with Model Size
von: Kukreja, Dikshant, et al.
Veröffentlicht: (2026)
von: Kukreja, Dikshant, et al.
Veröffentlicht: (2026)
MMSciBench: Benchmarking Language Models on Chinese Multimodal Scientific Problems
von: Ye, Xinwu, et al.
Veröffentlicht: (2025)
von: Ye, Xinwu, et al.
Veröffentlicht: (2025)
Influence-driven Curriculum Learning for Pre-training on Limited Data
von: Schoenegger, Loris, et al.
Veröffentlicht: (2025)
von: Schoenegger, Loris, et al.
Veröffentlicht: (2025)
BLP-2023 Task 2: Sentiment Analysis
von: Hasan, Md. Arid, et al.
Veröffentlicht: (2023)
von: Hasan, Md. Arid, et al.
Veröffentlicht: (2023)
Have Faith in Faithfulness: Going Beyond Circuit Overlap When Finding Model Mechanisms
von: Hanna, Michael, et al.
Veröffentlicht: (2024)
von: Hanna, Michael, et al.
Veröffentlicht: (2024)
Integrating Expert Labels into LLM-based Emission Goal Detection: Example Selection vs Automatic Prompt Design
von: Wrzalik, Marco, et al.
Veröffentlicht: (2024)
von: Wrzalik, Marco, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
von: Oketunji, Abiodun Finbarrs
Veröffentlicht: (2023) -
Reinforcement Learning for Latent-Space Thinking in LLMs
von: Özeren, Enes, et al.
Veröffentlicht: (2025) -
Efficacy of ByT5 in Multilingual Translation of Biblical Texts for Underrepresented Languages
von: Aars, Corinne, et al.
Veröffentlicht: (2024) -
GenAI Content Detection Task 3: Cross-Domain Machine-Generated Text Detection Challenge
von: Dugan, Liam, et al.
Veröffentlicht: (2025) -
Sparsing Law: Towards Large Language Models with Greater Activation Sparsity
von: Luo, Yuqi, et al.
Veröffentlicht: (2024)