Style Extraction on Text Embeddings Using VAE and Parallel Dataset
Fuente:
arXiv
Guardado en:
| Autores principales: | Kong, InJin, Kang, Shinyee, Park, Yuna, Kim, Sooyong, Park, Sanghyun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SpiralThinker: Latent Reasoning through an Iterative Process with Text-Latent Interleaving
por: Piao, Shengmin, et al.
Publicado: (2025)
por: Piao, Shengmin, et al.
Publicado: (2025)
LitE-SQL: A Lightweight and Efficient Text-to-SQL Framework with Vector-based Schema Linking and Execution-Guided Self-Correction
por: Piao, Shengmin, et al.
Publicado: (2025)
por: Piao, Shengmin, et al.
Publicado: (2025)
TinyThinker: Distilling Reasoning through Coarse-to-Fine Knowledge Internalization with Self-Reflection
por: Piao, Shengmin, et al.
Publicado: (2024)
por: Piao, Shengmin, et al.
Publicado: (2024)
GeneralThinker: Domain-General Reasoning through Likelihood-Guided Answer-Conditioned Optimization
por: Piao, Shengmin, et al.
Publicado: (2026)
por: Piao, Shengmin, et al.
Publicado: (2026)
Thinking with Many Minds: Using Large Language Models for Multi-Perspective Problem-Solving
por: Park, Sanghyun, et al.
Publicado: (2025)
por: Park, Sanghyun, et al.
Publicado: (2025)
Detecting Redundant Health Survey Questions Using Language-agnostic BERT Sentence Embedding (LaBSE)
por: Kang, Sunghoon, et al.
Publicado: (2024)
por: Kang, Sunghoon, et al.
Publicado: (2024)
Multi-Response Preference Optimization with Augmented Ranking Dataset
por: Gwon, Hansle, et al.
Publicado: (2024)
por: Gwon, Hansle, et al.
Publicado: (2024)
Unlocking Fine-Grained and Within-Utterance Speaking Style Control in Prompt-Based Text-to-Speech Models
por: Kang, Jaehoon, et al.
Publicado: (2026)
por: Kang, Jaehoon, et al.
Publicado: (2026)
StyleDistance: Stronger Content-Independent Style Embeddings with Synthetic Parallel Examples
por: Patel, Ajay, et al.
Publicado: (2024)
por: Patel, Ajay, et al.
Publicado: (2024)
Do Music Preferences Reflect Cultural Values? A Cross-National Analysis Using Music Embedding and World Values Survey
por: Kim, Yongjae, et al.
Publicado: (2025)
por: Kim, Yongjae, et al.
Publicado: (2025)
M2S: Multi-turn to Single-turn jailbreak in Red Teaming for LLMs
por: Ha, Junwoo, et al.
Publicado: (2025)
por: Ha, Junwoo, et al.
Publicado: (2025)
AnimeScore: A Preference-Based Dataset and Framework for Evaluating Anime-Like Speech Style
por: Park, Joonyong, et al.
Publicado: (2026)
por: Park, Joonyong, et al.
Publicado: (2026)
Forecasting Future International Events: A Reliable Dataset for Text-Based Event Modeling
por: Gwak, Daehoon, et al.
Publicado: (2024)
por: Gwak, Daehoon, et al.
Publicado: (2024)
Challenging Assumptions in Learning Generic Text Style Embeddings
por: Ostheimer, Phil, et al.
Publicado: (2025)
por: Ostheimer, Phil, et al.
Publicado: (2025)
MCS-SQL: Leveraging Multiple Prompts and Multiple-Choice Selection For Text-to-SQL Generation
por: Lee, Dongjun, et al.
Publicado: (2024)
por: Lee, Dongjun, et al.
Publicado: (2024)
Multilingual Text Style Transfer: Datasets & Models for Indian Languages
por: Mukherjee, Sourabrata, et al.
Publicado: (2024)
por: Mukherjee, Sourabrata, et al.
Publicado: (2024)
Persona Extraction Through Semantic Similarity for Emotional Support Conversation Generation
por: Han, Seunghee, et al.
Publicado: (2024)
por: Han, Seunghee, et al.
Publicado: (2024)
TinyStyler: Efficient Few-Shot Text Style Transfer with Authorship Embeddings
por: Horvitz, Zachary, et al.
Publicado: (2024)
por: Horvitz, Zachary, et al.
Publicado: (2024)
RSCF: Relation-Semantics Consistent Filter for Entity Embedding of Knowledge Graph
por: Kim, Junsik, et al.
Publicado: (2025)
por: Kim, Junsik, et al.
Publicado: (2025)
InstaTrans: An Instruction-Aware Translation Framework for Non-English Instruction Datasets
por: Kim, Yungi, et al.
Publicado: (2024)
por: Kim, Yungi, et al.
Publicado: (2024)
DART: An AIGT Detector using AMR of Rephrased Text
por: Park, Hyeonchu, et al.
Publicado: (2024)
por: Park, Hyeonchu, et al.
Publicado: (2024)
mStyleDistance: Multilingual Style Embeddings and their Evaluation
por: Qiu, Justin, et al.
Publicado: (2025)
por: Qiu, Justin, et al.
Publicado: (2025)
Safe-Embed: Unveiling the Safety-Critical Knowledge of Sentence Encoders
por: Kim, Jinseok, et al.
Publicado: (2024)
por: Kim, Jinseok, et al.
Publicado: (2024)
Soft Head Selection for Injecting ICL-Derived Task Embeddings
por: Park, Jungwon, et al.
Publicado: (2025)
por: Park, Jungwon, et al.
Publicado: (2025)
Block-wise Codeword Embedding for Reliable Multi-bit Text Watermarking
por: Kim, Joeun, et al.
Publicado: (2026)
por: Kim, Joeun, et al.
Publicado: (2026)
Mitigating Semantic Leakage in Cross-lingual Embeddings via Orthogonality Constraint
por: Ki, Dayeon, et al.
Publicado: (2024)
por: Ki, Dayeon, et al.
Publicado: (2024)
Subject-level Inference for Realistic Text Anonymization Evaluation
por: Oh, Myeong Seok, et al.
Publicado: (2026)
por: Oh, Myeong Seok, et al.
Publicado: (2026)
ObjexMT: Objective Extraction and Metacognitive Calibration for LLM-as-a-Judge under Multi-Turn Jailbreaks
por: Kim, Hyunjun, et al.
Publicado: (2025)
por: Kim, Hyunjun, et al.
Publicado: (2025)
SHARE: Shared Memory-Aware Open-Domain Long-Term Dialogue Dataset Constructed from Movie Script
por: Kim, Eunwon, et al.
Publicado: (2024)
por: Kim, Eunwon, et al.
Publicado: (2024)
Automatic Extraction of Clausal Embedding Based on Large-Scale English Text Data
por: Carslaw, Iona, et al.
Publicado: (2025)
por: Carslaw, Iona, et al.
Publicado: (2025)
PET: An Annotated Dataset for Process Extraction from Natural Language Text
por: Bellan, Patrizio, et al.
Publicado: (2022)
por: Bellan, Patrizio, et al.
Publicado: (2022)
Interpretable Depression Detection from Social Media Text Using LLM-Derived Embeddings
por: Kim, Samuel, et al.
Publicado: (2025)
por: Kim, Samuel, et al.
Publicado: (2025)
One Missing Piece for Open-Source Reasoning Models: A Dataset to Mitigate Cold-Starting Short CoT LLMs in RL
por: Chae, Hyungjoo, et al.
Publicado: (2025)
por: Chae, Hyungjoo, et al.
Publicado: (2025)
SETTP: Style Extraction and Tunable Inference via Dual-level Transferable Prompt Learning
por: Jin, Chunzhen, et al.
Publicado: (2024)
por: Jin, Chunzhen, et al.
Publicado: (2024)
Zero2Text: Zero-Training Cross-Domain Inversion Attacks on Textual Embeddings
por: Kim, Doohyun, et al.
Publicado: (2026)
por: Kim, Doohyun, et al.
Publicado: (2026)
Investigating the Influence of Prompt-Specific Shortcuts in AI Generated Text Detection
por: Park, Choonghyun, et al.
Publicado: (2024)
por: Park, Choonghyun, et al.
Publicado: (2024)
Style-Specific Neurons for Steering LLMs in Text Style Transfer
por: Lai, Wen, et al.
Publicado: (2024)
por: Lai, Wen, et al.
Publicado: (2024)
Label-aware Hard Negative Sampling Strategies with Momentum Contrastive Learning for Implicit Hate Speech Detection
por: Kim, Jaehoon, et al.
Publicado: (2024)
por: Kim, Jaehoon, et al.
Publicado: (2024)
Frustratingly Simple Prompting-based Text Denoising
por: Park, Jungyeul, et al.
Publicado: (2024)
por: Park, Jungyeul, et al.
Publicado: (2024)
Enhancing Automatic Term Extraction with Large Language Models via Syntactic Retrieval
por: Chun, Yongchan, et al.
Publicado: (2025)
por: Chun, Yongchan, et al.
Publicado: (2025)
Ejemplares similares
-
SpiralThinker: Latent Reasoning through an Iterative Process with Text-Latent Interleaving
por: Piao, Shengmin, et al.
Publicado: (2025) -
LitE-SQL: A Lightweight and Efficient Text-to-SQL Framework with Vector-based Schema Linking and Execution-Guided Self-Correction
por: Piao, Shengmin, et al.
Publicado: (2025) -
TinyThinker: Distilling Reasoning through Coarse-to-Fine Knowledge Internalization with Self-Reflection
por: Piao, Shengmin, et al.
Publicado: (2024) -
GeneralThinker: Domain-General Reasoning through Likelihood-Guided Answer-Conditioned Optimization
por: Piao, Shengmin, et al.
Publicado: (2026) -
Thinking with Many Minds: Using Large Language Models for Multi-Perspective Problem-Solving
por: Park, Sanghyun, et al.
Publicado: (2025)