DenoSent: A Denoising Objective for Self-Supervised Sentence Representation Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Xinghao, He, Junliang, Wang, Pengyu, Zhou, Yunhua, Sun, Tianxiang, Qiu, Xipeng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
BitStack: Any-Size Compression of Large Language Models in Variable Memory Environments
por: Wang, Xinghao, et al.
Publicado: (2024)
por: Wang, Xinghao, et al.
Publicado: (2024)
The Open-World Lottery Ticket Hypothesis for OOD Intent Classification
por: Zhou, Yunhua, et al.
Publicado: (2022)
por: Zhou, Yunhua, et al.
Publicado: (2022)
S2Sent: Nested Selectivity Aware Sentence Representation Learning
por: Zang, Jianxiang, et al.
Publicado: (2025)
por: Zang, Jianxiang, et al.
Publicado: (2025)
RobustSentEmbed: Robust Sentence Embeddings Using Adversarial Self-Supervised Contrastive Learning
por: Asl, Javad Rafiei, et al.
Publicado: (2024)
por: Asl, Javad Rafiei, et al.
Publicado: (2024)
SentGuard: Sentence-Level Streaming Guardrails for Large Language Models
por: Yu, Jiaqi, et al.
Publicado: (2026)
por: Yu, Jiaqi, et al.
Publicado: (2026)
Data Mixing Laws: Optimizing Data Mixtures by Predicting Language Modeling Performance
por: Ye, Jiasheng, et al.
Publicado: (2024)
por: Ye, Jiasheng, et al.
Publicado: (2024)
Making Large Language Models Better Reasoners with Orchestrated Streaming Experiences
por: Liu, Xiangyang, et al.
Publicado: (2025)
por: Liu, Xiangyang, et al.
Publicado: (2025)
ProtSent: Protein Sentence Transformers
por: Ofer, Dan, et al.
Publicado: (2026)
por: Ofer, Dan, et al.
Publicado: (2026)
Data-free Weight Compress and Denoise for Large Language Models
por: Peng, Runyu, et al.
Publicado: (2024)
por: Peng, Runyu, et al.
Publicado: (2024)
In-Memory Learning: A Declarative Learning Framework for Large Language Models
por: Wang, Bo, et al.
Publicado: (2024)
por: Wang, Bo, et al.
Publicado: (2024)
SentGraph: Hierarchical Sentence Graph for Multi-hop Retrieval-Augmented Question Answering
por: Liang, Junli, et al.
Publicado: (2026)
por: Liang, Junli, et al.
Publicado: (2026)
Decoupled Proxy Alignment: Mitigating Language Prior Conflict for Multimodal Alignment in MLLM
por: Tan, Chenkun, et al.
Publicado: (2025)
por: Tan, Chenkun, et al.
Publicado: (2025)
InferAligner: Inference-Time Alignment for Harmlessness through Cross-Model Guidance
por: Wang, Pengyu, et al.
Publicado: (2024)
por: Wang, Pengyu, et al.
Publicado: (2024)
Prism: Spectral-Aware Block-Sparse Attention
por: Wang, Xinghao, et al.
Publicado: (2026)
por: Wang, Xinghao, et al.
Publicado: (2026)
Towards Universality: Studying Mechanistic Similarity Across Language Model Architectures
por: Wang, Junxuan, et al.
Publicado: (2024)
por: Wang, Junxuan, et al.
Publicado: (2024)
UnifiedVisual: A Framework for Constructing Unified Vision-Language Datasets
por: Wang, Pengyu, et al.
Publicado: (2025)
por: Wang, Pengyu, et al.
Publicado: (2025)
Agent Alignment in Evolving Social Norms
por: Li, Shimin, et al.
Publicado: (2024)
por: Li, Shimin, et al.
Publicado: (2024)
Doc-Guided Sent2Sent++: A Sent2Sent++ Agent with Doc-Guided memory for Document-level Machine Translation
por: Guo, Jiaxin, et al.
Publicado: (2025)
por: Guo, Jiaxin, et al.
Publicado: (2025)
Evolution of Concepts in Language Model Pre-Training
por: Ge, Xuyang, et al.
Publicado: (2025)
por: Ge, Xuyang, et al.
Publicado: (2025)
SpeechAgents: Human-Communication Simulation with Multi-Modal Multi-Agent Systems
por: Zhang, Dong, et al.
Publicado: (2024)
por: Zhang, Dong, et al.
Publicado: (2024)
LLM can Achieve Self-Regulation via Hyperparameter Aware Generation
por: Wang, Siyin, et al.
Publicado: (2024)
por: Wang, Siyin, et al.
Publicado: (2024)
Revisiting the Test-Time Scaling of o1-like Models: Do they Truly Possess Test-Time Scaling Capabilities?
por: Zeng, Zhiyuan, et al.
Publicado: (2025)
por: Zeng, Zhiyuan, et al.
Publicado: (2025)
DALR: Dual-level Alignment Learning for Multimodal Sentence Representation Learning
por: He, Kang, et al.
Publicado: (2025)
por: He, Kang, et al.
Publicado: (2025)
Sparser Block-Sparse Attention via Token Permutation
por: Wang, Xinghao, et al.
Publicado: (2025)
por: Wang, Xinghao, et al.
Publicado: (2025)
How Attention Sinks Emerge in Large Language Models: An Interpretability Perspective
por: Peng, Runyu, et al.
Publicado: (2026)
por: Peng, Runyu, et al.
Publicado: (2026)
Turn Waste into Worth: Rectifying Top-$k$ Router of MoE
por: Zeng, Zhiyuan, et al.
Publicado: (2024)
por: Zeng, Zhiyuan, et al.
Publicado: (2024)
MetaAlign: Align Large Language Models with Diverse Preferences during Inference Time
por: Zhang, Mozhi, et al.
Publicado: (2024)
por: Zhang, Mozhi, et al.
Publicado: (2024)
Explicit Multi-head Attention for Inter-head Interaction in Large Language Models
por: Peng, Runyu, et al.
Publicado: (2026)
por: Peng, Runyu, et al.
Publicado: (2026)
Pixel Sentence Representation Learning
por: Xiao, Chenghao, et al.
Publicado: (2024)
por: Xiao, Chenghao, et al.
Publicado: (2024)
Data-CUBE: Data Curriculum for Instruction-based Sentence Representation Learning
por: Min, Yingqian, et al.
Publicado: (2024)
por: Min, Yingqian, et al.
Publicado: (2024)
Dimensional Collapse in Transformer Attention Outputs: A Challenge for Sparse Dictionary Learning
por: Wang, Junxuan, et al.
Publicado: (2025)
por: Wang, Junxuan, et al.
Publicado: (2025)
Computational Sentence-level Metrics Predicting Human Sentence Comprehension
por: Sun, Kun, et al.
Publicado: (2024)
por: Sun, Kun, et al.
Publicado: (2024)
LLatrieval: LLM-Verified Retrieval for Verifiable Generation
por: Li, Xiaonan, et al.
Publicado: (2023)
por: Li, Xiaonan, et al.
Publicado: (2023)
SpeechAlign: Aligning Speech Generation to Human Preferences
por: Zhang, Dong, et al.
Publicado: (2024)
por: Zhang, Dong, et al.
Publicado: (2024)
Lex2Sent: A bagging approach to unsupervised sentiment analysis
por: Lange, Kai-Robin, et al.
Publicado: (2022)
por: Lange, Kai-Robin, et al.
Publicado: (2022)
Label Confidence Weighted Learning for Target-level Sentence Simplification
por: Qiu, Xinying, et al.
Publicado: (2024)
por: Qiu, Xinying, et al.
Publicado: (2024)
Large Language Models can Contrastively Refine their Generation for Better Sentence Representation Learning
por: Wang, Huiming, et al.
Publicado: (2023)
por: Wang, Huiming, et al.
Publicado: (2023)
Enhancing EEG-to-Text Decoding through Transferable Representations from Pre-trained Contrastive EEG-Text Masked Autoencoder
por: Wang, Jiaqi, et al.
Publicado: (2024)
por: Wang, Jiaqi, et al.
Publicado: (2024)
Sign Language Translation with Sentence Embedding Supervision
por: Hamidullah, Yasser, et al.
Publicado: (2025)
por: Hamidullah, Yasser, et al.
Publicado: (2025)
SIRAG: Towards Stable and Interpretable RAG with A Process-Supervised Multi-Agent Framework
por: Wang, Junlin, et al.
Publicado: (2025)
por: Wang, Junlin, et al.
Publicado: (2025)
Ejemplares similares
-
BitStack: Any-Size Compression of Large Language Models in Variable Memory Environments
por: Wang, Xinghao, et al.
Publicado: (2024) -
The Open-World Lottery Ticket Hypothesis for OOD Intent Classification
por: Zhou, Yunhua, et al.
Publicado: (2022) -
S2Sent: Nested Selectivity Aware Sentence Representation Learning
por: Zang, Jianxiang, et al.
Publicado: (2025) -
RobustSentEmbed: Robust Sentence Embeddings Using Adversarial Self-Supervised Contrastive Learning
por: Asl, Javad Rafiei, et al.
Publicado: (2024) -
SentGuard: Sentence-Level Streaming Guardrails for Large Language Models
por: Yu, Jiaqi, et al.
Publicado: (2026)