Enregistré dans:
| Auteurs principaux: | Tokarchuk, Evgeniia, Bakker, Hua Chang, Niculae, Vlad |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2502.08231 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Unreasonable Effectiveness of Random Target Embeddings for Continuous-Output Neural Machine Translation
par: Tokarchuk, Evgeniia, et autres
Publié: (2023)
par: Tokarchuk, Evgeniia, et autres
Publié: (2023)
Angular Dispersion Accelerates $k$-Nearest Neighbors Machine Translation
par: Tokarchuk, Evgeniia, et autres
Publié: (2025)
par: Tokarchuk, Evgeniia, et autres
Publié: (2025)
Representation Collapse in Machine Translation Through the Lens of Angular Dispersion
par: Tokarchuk, Evgeniia, et autres
Publié: (2026)
par: Tokarchuk, Evgeniia, et autres
Publié: (2026)
Sparse and Structured Hopfield Networks
par: Santos, Saul, et autres
Publié: (2024)
par: Santos, Saul, et autres
Publié: (2024)
Hopfield-Fenchel-Young Networks: A Unified Framework for Associative Memory Retrieval
par: Santos, Saul, et autres
Publié: (2024)
par: Santos, Saul, et autres
Publié: (2024)
Discrete Latent Structure in Neural Networks
par: Niculae, Vlad, et autres
Publié: (2023)
par: Niculae, Vlad, et autres
Publié: (2023)
Control the Temperature: Selective Sampling for Diverse and High-Quality LLM Outputs
par: Troshin, Sergey, et autres
Publié: (2025)
par: Troshin, Sergey, et autres
Publié: (2025)
AdaSplash-2: Faster Differentiable Sparse Attention
par: Gonçalves, Nuno, et autres
Publié: (2026)
par: Gonçalves, Nuno, et autres
Publié: (2026)
A Simpler Alternative to Variational Regularized Counterfactual Risk Minimization
par: Bakker, Hua Chang, et autres
Publié: (2024)
par: Bakker, Hua Chang, et autres
Publié: (2024)
An embedding-based distance for temporal graphs
par: Dall'Amico, Lorenzo, et autres
Publié: (2024)
par: Dall'Amico, Lorenzo, et autres
Publié: (2024)
Context Composing for Full Line Code Completion
par: Semenkin, Anton, et autres
Publié: (2024)
par: Semenkin, Anton, et autres
Publié: (2024)
Keep the Lights On, Keep the Lengths in Check: Plug-In Adversarial Detection for Time-Series LLMs in Energy Forecasting
par: Ma, Hua, et autres
Publié: (2025)
par: Ma, Hua, et autres
Publié: (2025)
Turbo your multi-modal classification with contrastive learning
par: Zhang, Zhiyu, et autres
Publié: (2024)
par: Zhang, Zhiyu, et autres
Publié: (2024)
Hard-constraining Neumann boundary conditions in physics-informed neural networks via Fourier feature embeddings
par: Straub, Christopher, et autres
Publié: (2025)
par: Straub, Christopher, et autres
Publié: (2025)
Context-Aware or Context-Insensitive? Assessing LLMs' Performance in Document-Level Translation
par: Mohammed, Wafaa, et autres
Publié: (2024)
par: Mohammed, Wafaa, et autres
Publié: (2024)
On Measuring Context Utilization in Document-Level MT Systems
par: Mohammed, Wafaa, et autres
Publié: (2024)
par: Mohammed, Wafaa, et autres
Publié: (2024)
On the Reproducibility of "FairCLIP: Harnessing Fairness in Vision-Language Learning''
par: Bakker, Hua Chang, et autres
Publié: (2025)
par: Bakker, Hua Chang, et autres
Publié: (2025)
Streaming Generation of Co-Speech Gestures via Accelerated Rolling Diffusion
par: Vu, Evgeniia, et autres
Publié: (2025)
par: Vu, Evgeniia, et autres
Publié: (2025)
kNN For Whisper And Its Effect On Bias And Speaker Adaptation
par: Nachesa, Maya K., et autres
Publié: (2024)
par: Nachesa, Maya K., et autres
Publié: (2024)
Online learning of smooth functions on $\mathbb{R}$
par: Geneson, Jesse, et autres
Publié: (2026)
par: Geneson, Jesse, et autres
Publié: (2026)
How deep is your network? Deep vs. shallow learning of transfer operators
par: Tabish, Mohammad, et autres
Publié: (2025)
par: Tabish, Mohammad, et autres
Publié: (2025)
Fast unsupervised ground metric learning with tree-Wasserstein distance
par: Düsterwald, Kira M., et autres
Publié: (2024)
par: Düsterwald, Kira M., et autres
Publié: (2024)
On minimizing the training set fill distance in machine learning regression
par: Climaco, Paolo, et autres
Publié: (2023)
par: Climaco, Paolo, et autres
Publié: (2023)
IKUN: Initialization to Keep snn training and generalization great with sUrrogate-stable variaNce
par: Chang, Da, et autres
Publié: (2024)
par: Chang, Da, et autres
Publié: (2024)
Is your model predicting the past?
par: Hardt, Moritz, et autres
Publié: (2022)
par: Hardt, Moritz, et autres
Publié: (2022)
Is your algorithm unlearning or untraining?
par: Triantafillou, Eleni, et autres
Publié: (2026)
par: Triantafillou, Eleni, et autres
Publié: (2026)
Protein generation with embedding learning for motif diversification
par: Michalewicz, Kevin, et autres
Publié: (2025)
par: Michalewicz, Kevin, et autres
Publié: (2025)
HardML: A Benchmark For Evaluating Data Science And Machine Learning knowledge and reasoning in AI
par: Pricope, Tidor-Vlad
Publié: (2025)
par: Pricope, Tidor-Vlad
Publié: (2025)
Isolating authorship from content with semantic embeddings and contrastive learning
par: Huertas-Tato, Javier, et autres
Publié: (2024)
par: Huertas-Tato, Javier, et autres
Publié: (2024)
GATE: How to Keep Out Intrusive Neighbors
par: Mustafa, Nimrah, et autres
Publié: (2024)
par: Mustafa, Nimrah, et autres
Publié: (2024)
Surrogate uncertainty estimation for your time series forecasting black-box: learn when to trust
par: Erlygin, Leonid, et autres
Publié: (2023)
par: Erlygin, Leonid, et autres
Publié: (2023)
Efficient Hamiltonian, structure and trace distance learning of Gaussian states
par: Fanizza, Marco, et autres
Publié: (2024)
par: Fanizza, Marco, et autres
Publié: (2024)
Distinct hydrologic response patterns and trends worldwide revealed by physics-embedded learning
par: Ji, Haoyu, et autres
Publié: (2025)
par: Ji, Haoyu, et autres
Publié: (2025)
Transfer learning for atomistic simulations using GNNs and kernel mean embeddings
par: Falk, John, et autres
Publié: (2023)
par: Falk, John, et autres
Publié: (2023)
Dissecting embedding method: learning higher-order structures from data
par: Tupikina, Liubov, et autres
Publié: (2024)
par: Tupikina, Liubov, et autres
Publié: (2024)
Unlocking Latent Discourse Translation in LLMs Through Quality-Aware Decoding
par: Mohammed, Wafaa, et autres
Publié: (2025)
par: Mohammed, Wafaa, et autres
Publié: (2025)
On the Low-Rank Parametrization of Reward Models for Controlled Language Generation
par: Troshin, Sergey, et autres
Publié: (2024)
par: Troshin, Sergey, et autres
Publié: (2024)
Torus embeddings
par: Stowell, Dan
Publié: (2026)
par: Stowell, Dan
Publié: (2026)
$\mathbb{X}$-Sample Contrastive Loss: Improving Contrastive Learning with Sample Similarity Graphs
par: Sobal, Vlad, et autres
Publié: (2024)
par: Sobal, Vlad, et autres
Publié: (2024)
Transformers trained on proteins can learn to attend to Euclidean distance
par: Ellmen, Isaac, et autres
Publié: (2025)
par: Ellmen, Isaac, et autres
Publié: (2025)
Documents similaires
-
The Unreasonable Effectiveness of Random Target Embeddings for Continuous-Output Neural Machine Translation
par: Tokarchuk, Evgeniia, et autres
Publié: (2023) -
Angular Dispersion Accelerates $k$-Nearest Neighbors Machine Translation
par: Tokarchuk, Evgeniia, et autres
Publié: (2025) -
Representation Collapse in Machine Translation Through the Lens of Angular Dispersion
par: Tokarchuk, Evgeniia, et autres
Publié: (2026) -
Sparse and Structured Hopfield Networks
par: Santos, Saul, et autres
Publié: (2024) -
Hopfield-Fenchel-Young Networks: A Unified Framework for Associative Memory Retrieval
par: Santos, Saul, et autres
Publié: (2024)