Enregistré dans:
| Auteurs principaux: | Magal, Nicholas, Tran, Minh, Arakawa, Riku, Nie, Suzanne |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2501.00865 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
IMUCoCo: Enabling Flexible On-Body IMU Placement for Human Pose Estimation and Activity Recognition
par: Zhou, Haozhe, et autres
Publié: (2025)
par: Zhou, Haozhe, et autres
Publié: (2025)
DPad: Efficient Diffusion Language Models with Suffix Dropout
par: Chen, Xinhua, et autres
Publié: (2025)
par: Chen, Xinhua, et autres
Publié: (2025)
Supporting Experts with a Multimodal Machine-Learning-Based Tool for Human Behavior Analysis of Conversational Videos
par: Arakawa, Riku, et autres
Publié: (2024)
par: Arakawa, Riku, et autres
Publié: (2024)
Investigating the Synergistic Effects of Dropout and Residual Connections on Language Model Training
par: Li, Qingyang, et autres
Publié: (2024)
par: Li, Qingyang, et autres
Publié: (2024)
Deep Augmentation: Dropout as Augmentation for Self-Supervised Learning
par: Brüel-Gabrielsson, Rickard, et autres
Publié: (2023)
par: Brüel-Gabrielsson, Rickard, et autres
Publié: (2023)
Pretraining Language Models with Subword Regularization: An Empirical Study of BPE Dropout in Low-Resource NLP
par: Visser, Ruan, et autres
Publié: (2026)
par: Visser, Ruan, et autres
Publié: (2026)
Negation Neglect: When models fail to learn negations in training
par: Mayne, Harry, et autres
Publié: (2026)
par: Mayne, Harry, et autres
Publié: (2026)
Re-examining learning linear functions in context
par: Naim, Omar, et autres
Publié: (2024)
par: Naim, Omar, et autres
Publié: (2024)
Sensitivity-Positional Co-Localization in GQA Transformers
par: Rao, Manoj Chandrashekar
Publié: (2026)
par: Rao, Manoj Chandrashekar
Publié: (2026)
PANDAS: Improving Many-shot Jailbreaking via Positive Affirmation, Negative Demonstration, and Adaptive Sampling
par: Ma, Avery, et autres
Publié: (2025)
par: Ma, Avery, et autres
Publié: (2025)
Predicting First Year Dropout from Pre Enrolment Motivation Statements Using Text Mining
par: Soppe, K. F. B., et autres
Publié: (2025)
par: Soppe, K. F. B., et autres
Publié: (2025)
TrafficVLM: A Controllable Visual Language Model for Traffic Video Captioning
par: Dinh, Quang Minh, et autres
Publié: (2024)
par: Dinh, Quang Minh, et autres
Publié: (2024)
Con Instruction: Universal Jailbreaking of Multimodal Large Language Models via Non-Textual Modalities
par: Geng, Jiahui, et autres
Publié: (2025)
par: Geng, Jiahui, et autres
Publié: (2025)
Modality-Balancing Preference Optimization of Large Multimodal Models by Adversarial Negative Mining
par: Liu, Chenxi, et autres
Publié: (2025)
par: Liu, Chenxi, et autres
Publié: (2025)
JNLP at SemEval-2025 Task 11: Cross-Lingual Multi-Label Emotion Detection Using Generative Models
par: Xue, Jieying, et autres
Publié: (2025)
par: Xue, Jieying, et autres
Publié: (2025)
Extracting Small Translation Specialists from LLMs by Aggressively Pruning Experts
par: Martin, Liu O., et autres
Publié: (2026)
par: Martin, Liu O., et autres
Publié: (2026)
Text-Enhanced Data-free Approach for Federated Class-Incremental Learning
par: Tran, Minh-Tuan, et autres
Publié: (2024)
par: Tran, Minh-Tuan, et autres
Publié: (2024)
The Surprising Effectiveness of Negative Reinforcement in LLM Reasoning
par: Zhu, Xinyu, et autres
Publié: (2025)
par: Zhu, Xinyu, et autres
Publié: (2025)
TaCo: Targeted Concept Erasure Prevents Non-Linear Classifiers From Detecting Protected Attributes
par: Jourdan, Fanny, et autres
Publié: (2023)
par: Jourdan, Fanny, et autres
Publié: (2023)
Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models
par: Le, Quang-Hung, et autres
Publié: (2024)
par: Le, Quang-Hung, et autres
Publié: (2024)
On the Effect of Negative Gradient in Group Relative Deep Reinforcement Optimization
par: Deng, Wenlong, et autres
Publié: (2025)
par: Deng, Wenlong, et autres
Publié: (2025)
Data Augmentation for Classification of Negative Pregnancy Outcomes in Imbalanced Data
par: Biswas, Md Badsha
Publié: (2025)
par: Biswas, Md Badsha
Publié: (2025)
Effective Context Modeling Framework for Emotion Recognition in Conversations
par: Van, Cuong Tran, et autres
Publié: (2024)
par: Van, Cuong Tran, et autres
Publié: (2024)
$μ^2$Tokenizer: Differentiable Multi-Scale Multi-Modal Tokenizer for Radiology Report Generation
par: Li, Siyou, et autres
Publié: (2025)
par: Li, Siyou, et autres
Publié: (2025)
Selective Rotary Position Embedding
par: Movahedi, Sajad, et autres
Publié: (2025)
par: Movahedi, Sajad, et autres
Publié: (2025)
On the Geometry of Positional Encodings in Transformers
par: Cirrincione, Giansalvo
Publié: (2026)
par: Cirrincione, Giansalvo
Publié: (2026)
Position Information Emerges in Causal Transformers Without Positional Encodings via Similarity of Nearby Embeddings
par: Zuo, Chunsheng, et autres
Publié: (2024)
par: Zuo, Chunsheng, et autres
Publié: (2024)
CoCA: Fusing Position Embedding with Collinear Constrained Attention in Transformers for Long Context Window Extending
par: Zhu, Shiyi, et autres
Publié: (2023)
par: Zhu, Shiyi, et autres
Publié: (2023)
GISTEmbed: Guided In-sample Selection of Training Negatives for Text Embedding Fine-tuning
par: Solatorio, Aivin V.
Publié: (2024)
par: Solatorio, Aivin V.
Publié: (2024)
AF-KAN: Activation Function-Based Kolmogorov-Arnold Networks for Efficient Representation Learning
par: Ta, Hoang-Thang, et autres
Publié: (2025)
par: Ta, Hoang-Thang, et autres
Publié: (2025)
Reward-Based Online LLM Routing via NeuralUCB
par: Tsai, Ming-Hua, et autres
Publié: (2026)
par: Tsai, Ming-Hua, et autres
Publié: (2026)
Detecting and Rectifying Noisy Labels: A Similarity-based Approach
par: Huu-Tien, Dang, et autres
Publié: (2025)
par: Huu-Tien, Dang, et autres
Publié: (2025)
LUNE: Efficient LLM Unlearning via LoRA Fine-Tuning with Negative Examples
par: Liu, Yezi, et autres
Publié: (2025)
par: Liu, Yezi, et autres
Publié: (2025)
ScoNe: Benchmarking Negation Reasoning in Language Models With Fine-Tuning and In-Context Learning
par: She, Jingyuan Selena, et autres
Publié: (2023)
par: She, Jingyuan Selena, et autres
Publié: (2023)
Unified Interpretation of Smoothing Methods for Negative Sampling Loss Functions in Knowledge Graph Embedding
par: Feng, Xincan, et autres
Publié: (2024)
par: Feng, Xincan, et autres
Publié: (2024)
More Expressive Attention with Negative Weights
par: Lv, Ang, et autres
Publié: (2024)
par: Lv, Ang, et autres
Publié: (2024)
Beyond Forgetting: Machine Unlearning Elicits Controllable Side Behaviors and Capabilities
par: Dang, Tien, et autres
Publié: (2026)
par: Dang, Tien, et autres
Publié: (2026)
Multi-Modal Framing Analysis of News
par: Arora, Arnav, et autres
Publié: (2025)
par: Arora, Arnav, et autres
Publié: (2025)
One STEP at a time: Language Agents are Stepwise Planners
par: Nguyen, Minh, et autres
Publié: (2024)
par: Nguyen, Minh, et autres
Publié: (2024)
Tokens for Learning, Tokens for Unlearning: Mitigating Membership Inference Attacks in Large Language Models via Dual-Purpose Training
par: Tran, Toan, et autres
Publié: (2025)
par: Tran, Toan, et autres
Publié: (2025)
Documents similaires
-
IMUCoCo: Enabling Flexible On-Body IMU Placement for Human Pose Estimation and Activity Recognition
par: Zhou, Haozhe, et autres
Publié: (2025) -
DPad: Efficient Diffusion Language Models with Suffix Dropout
par: Chen, Xinhua, et autres
Publié: (2025) -
Supporting Experts with a Multimodal Machine-Learning-Based Tool for Human Behavior Analysis of Conversational Videos
par: Arakawa, Riku, et autres
Publié: (2024) -
Investigating the Synergistic Effects of Dropout and Residual Connections on Language Model Training
par: Li, Qingyang, et autres
Publié: (2024) -
Deep Augmentation: Dropout as Augmentation for Self-Supervised Learning
par: Brüel-Gabrielsson, Rickard, et autres
Publié: (2023)