A Large-Scale Sensitivity Analysis on Latent Embeddings and Dimensionality Reductions for Text Spatializations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Atzberger, Daniel, Cech, Tim, Scheibel, Willy, Döllner, Jürgen, Behrisch, Michael, Schreck, Tobias |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Standardness Clouds Meaning: A Position Regarding the Informed Usage of Standard Datasets
par: Cech, Tim, et autres
Publié: (2024)
par: Cech, Tim, et autres
Publié: (2024)
Athena: Smart order routing on centralized crypto exchanges using a unified order book
par: Robert Henker, et autres
Publié: (2024)
par: Robert Henker, et autres
Publié: (2024)
FDive: Learning Relevance Models using Pattern-based Similarity Measures
par: Dennig, Frederik L., et autres
Publié: (2019)
par: Dennig, Frederik L., et autres
Publié: (2019)
Improving Clustering on Occupational Text Data through Dimensionality Reduction
par: García, Iago Xabier Vázquez, et autres
Publié: (2025)
par: García, Iago Xabier Vázquez, et autres
Publié: (2025)
An Improved Deep Learning Model for Word Embeddings Based Clustering for Large Text Datasets
par: Sutrakar, Vijay Kumar, et autres
Publié: (2025)
par: Sutrakar, Vijay Kumar, et autres
Publié: (2025)
Guided Perturbation Sensitivity (GPS): Detecting Adversarial Text via Embedding Stability and Word Importance
par: Tuck, Bryan E., et autres
Publié: (2025)
par: Tuck, Bryan E., et autres
Publié: (2025)
Large Language Models Are Overparameterized Text Encoders
par: K, Thennal D, et autres
Publié: (2024)
par: K, Thennal D, et autres
Publié: (2024)
LCIP: Loss-Controlled Inverse Projection of High-Dimensional Image Data
par: Wang, Yu, et autres
Publié: (2026)
par: Wang, Yu, et autres
Publié: (2026)
Embedding Trust: Semantic Isotropy Predicts Nonfactuality in Long-Form Text Generation
par: Bhardwaj, Dhrupad, et autres
Publié: (2025)
par: Bhardwaj, Dhrupad, et autres
Publié: (2025)
When Latent Geometry Is Not Enough: Draft-Conditioned Latent Refinement for Non-Autoregressive Text Generation
par: Zhang, De Shuai
Publié: (2026)
par: Zhang, De Shuai
Publié: (2026)
Bridging the Dimensional Chasm: Uncover Layer-wise Dimensional Reduction in Transformers through Token Correlation
par: Song, Zhuo-Yang, et autres
Publié: (2025)
par: Song, Zhuo-Yang, et autres
Publié: (2025)
On Debiasing Text Embeddings Through Context Injection
par: Uriot, Thomas
Publié: (2024)
par: Uriot, Thomas
Publié: (2024)
Scaling Embedding Layers in Language Models
par: Yu, Da, et autres
Publié: (2025)
par: Yu, Da, et autres
Publié: (2025)
MSVD-Indonesian: A Benchmark for Multimodal Video-Text Tasks in Indonesian
par: Hendria, Willy Fitra
Publié: (2023)
par: Hendria, Willy Fitra
Publié: (2023)
Tabular Embeddings for Tables with Bi-Dimensional Hierarchical Metadata and Nesting
par: Shrestha, Gyanendra, et autres
Publié: (2025)
par: Shrestha, Gyanendra, et autres
Publié: (2025)
Challenging Assumptions in Learning Generic Text Style Embeddings
par: Ostheimer, Phil, et autres
Publié: (2025)
par: Ostheimer, Phil, et autres
Publié: (2025)
Luxical: High-Speed Lexical-Dense Text Embeddings
par: DatologyAI, et autres
Publié: (2025)
par: DatologyAI, et autres
Publié: (2025)
Unsupervised Text Embedding Space Generation Using Generative Adversarial Networks for Text Synthesis
par: Lee, Jun-Min, et autres
Publié: (2023)
par: Lee, Jun-Min, et autres
Publié: (2023)
The Illusion of Superposition? A Principled Analysis of Latent Thinking in Language Models
par: Rizvi-Martel, Michael, et autres
Publié: (2026)
par: Rizvi-Martel, Michael, et autres
Publié: (2026)
To MRL or not to MRL: Text Embeddings are Robust to Truncation Without Matryoshka Learning, Except In Heavy Truncation Scenarios
par: Takeshita, Sotaro, et autres
Publié: (2026)
par: Takeshita, Sotaro, et autres
Publié: (2026)
Revisiting Prompt Sensitivity in Large Language Models for Text Classification: The Role of Prompt Underspecification
par: Pecher, Branislav, et autres
Publié: (2026)
par: Pecher, Branislav, et autres
Publié: (2026)
Better Embeddings with Coupled Adam
par: Stollenwerk, Felix, et autres
Publié: (2025)
par: Stollenwerk, Felix, et autres
Publié: (2025)
Reconciling Kaplan and Chinchilla Scaling Laws
par: Pearce, Tim, et autres
Publié: (2024)
par: Pearce, Tim, et autres
Publié: (2024)
SPIN: Sparsifying and Integrating Internal Neurons in Large Language Models for Text Classification
par: Jiao, Difan, et autres
Publié: (2023)
par: Jiao, Difan, et autres
Publié: (2023)
Controlling Large Language Model with Latent Actions
par: Jia, Chengxing, et autres
Publié: (2025)
par: Jia, Chengxing, et autres
Publié: (2025)
Latent Performance Profiling of Large Language Models
par: Chakraborty, Tanmoy, et autres
Publié: (2026)
par: Chakraborty, Tanmoy, et autres
Publié: (2026)
An Empirical Comparison of Text Summarization: A Multi-Dimensional Evaluation of Large Language Models
par: Janakiraman, Anantharaman, et autres
Publié: (2025)
par: Janakiraman, Anantharaman, et autres
Publié: (2025)
A Formal Framework for Uncertainty Analysis of Text Generation with Large Language Models
par: Herbold, Steffen, et autres
Publié: (2026)
par: Herbold, Steffen, et autres
Publié: (2026)
Non-Monotonic Latency in Apple MPS Decoding: KV Cache Interactions and Execution Regimes
par: Hendria, Willy Fitra
Publié: (2026)
par: Hendria, Willy Fitra
Publié: (2026)
AnglE-optimized Text Embeddings
par: Li, Xianming, et autres
Publié: (2023)
par: Li, Xianming, et autres
Publié: (2023)
Hakim: Farsi Text Embedding Model
par: Sarmadi, Mehran, et autres
Publié: (2025)
par: Sarmadi, Mehran, et autres
Publié: (2025)
RiverText: A Python Library for Training and Evaluating Incremental Word Embeddings from Text Data Streams
par: Iturra-Bocaz, Gabriel, et autres
Publié: (2025)
par: Iturra-Bocaz, Gabriel, et autres
Publié: (2025)
Latent Recurrent Transformer: Architecture Exploration, Training Strategies, and Scaling Behavior
par: Huang, Zeyi, et autres
Publié: (2026)
par: Huang, Zeyi, et autres
Publié: (2026)
Towards Latent Diffusion Suitable For Text
par: Midavaine, Nesta, et autres
Publié: (2026)
par: Midavaine, Nesta, et autres
Publié: (2026)
Text-ADBench: Text Anomaly Detection Benchmark based on LLMs Embedding
par: Xiao, Feng, et autres
Publié: (2025)
par: Xiao, Feng, et autres
Publié: (2025)
GISTEmbed: Guided In-sample Selection of Training Negatives for Text Embedding Fine-tuning
par: Solatorio, Aivin V.
Publié: (2024)
par: Solatorio, Aivin V.
Publié: (2024)
Unsupervised Text Segmentation via Kernel Change-Point Detection on Sentence Embeddings
par: Jia, Mumin, et autres
Publié: (2026)
par: Jia, Mumin, et autres
Publié: (2026)
Scaling Embeddings Outperforms Scaling Experts in Language Models
par: Liu, Hong, et autres
Publié: (2026)
par: Liu, Hong, et autres
Publié: (2026)
BookSQL: A Large Scale Text-to-SQL Dataset for Accounting Domain
par: Kumar, Rahul, et autres
Publié: (2024)
par: Kumar, Rahul, et autres
Publié: (2024)
Factor Augmented Supervised Learning with Text Embeddings
par: Luo, Zhanye, et autres
Publié: (2025)
par: Luo, Zhanye, et autres
Publié: (2025)
Documents similaires
-
Standardness Clouds Meaning: A Position Regarding the Informed Usage of Standard Datasets
par: Cech, Tim, et autres
Publié: (2024) -
Athena: Smart order routing on centralized crypto exchanges using a unified order book
par: Robert Henker, et autres
Publié: (2024) -
FDive: Learning Relevance Models using Pattern-based Similarity Measures
par: Dennig, Frederik L., et autres
Publié: (2019) -
Improving Clustering on Occupational Text Data through Dimensionality Reduction
par: García, Iago Xabier Vázquez, et autres
Publié: (2025) -
An Improved Deep Learning Model for Word Embeddings Based Clustering for Large Text Datasets
par: Sutrakar, Vijay Kumar, et autres
Publié: (2025)