Meta-DiffuB: A Contextualized Sequence-to-Sequence Text Diffusion Model with Meta-Exploration
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Chuang, Yun-Yen, Hsu, Hung-Min, Lin, Kevin, Gu, Chen-Sheng, Li, Ling Zhen, Chang, Ray-I, Lee, Hung-yi |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
SMILE: Speech Meta In-Context Learning for Low-Resource Language Automatic Speech Recognition
von: Hsu, Ming-Hao, et al.
Veröffentlicht: (2024)
von: Hsu, Ming-Hao, et al.
Veröffentlicht: (2024)
Meta-Learning for Quantum Optimization via Quantum Sequence Model
von: Lin, Yu-Cheng, et al.
Veröffentlicht: (2025)
von: Lin, Yu-Cheng, et al.
Veröffentlicht: (2025)
DiffuCOMET: Contextual Commonsense Knowledge Diffusion
von: Gao, Silin, et al.
Veröffentlicht: (2024)
von: Gao, Silin, et al.
Veröffentlicht: (2024)
Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning
von: Shen, Liang-Yeh, et al.
Veröffentlicht: (2025)
von: Shen, Liang-Yeh, et al.
Veröffentlicht: (2025)
TASTE-Streaming: Towards Streamable Text-Aligned Speech Tokenization and Embedding for Spoken Language Modeling
von: Tseng, Liang-Hsuan, et al.
Veröffentlicht: (2026)
von: Tseng, Liang-Hsuan, et al.
Veröffentlicht: (2026)
When Silence Matters: The Impact of Irrelevant Audio on Text Reasoning in Large Audio-Language Models
von: Li, Chen-An, et al.
Veröffentlicht: (2025)
von: Li, Chen-An, et al.
Veröffentlicht: (2025)
TASLA: Text-Aligned Speech Tokens with Multiple Layer-Aggregation
von: Hsu, Ming-Hao, et al.
Veröffentlicht: (2025)
von: Hsu, Ming-Hao, et al.
Veröffentlicht: (2025)
Meta-automatic Sequences
von: Campbell, John M., et al.
Veröffentlicht: (2026)
von: Campbell, John M., et al.
Veröffentlicht: (2026)
AQAScore: Evaluating Semantic Alignment in Text-to-Audio Generation via Audio Question Answering
von: Kuan, Chun-Yi, et al.
Veröffentlicht: (2026)
von: Kuan, Chun-Yi, et al.
Veröffentlicht: (2026)
Improving Sequence-to-Sequence Models for Abstractive Text Summarization Using Meta Heuristic Approaches
von: Saxena, Aditya, et al.
Veröffentlicht: (2024)
von: Saxena, Aditya, et al.
Veröffentlicht: (2024)
Can LLMs Understand the Implication of Emphasized Sentences in Dialogue?
von: Lin, Guan-Ting, et al.
Veröffentlicht: (2024)
von: Lin, Guan-Ting, et al.
Veröffentlicht: (2024)
MMMOS: Multi-domain Multi-axis Audio Quality Assessment
von: Lin, Yi-Cheng, et al.
Veröffentlicht: (2025)
von: Lin, Yi-Cheng, et al.
Veröffentlicht: (2025)
Oropharyngeal Exercise Intervention for Swallowing Function in Older Adults: A Systematic Review and Meta‐Analysis
von: Tien‐Wei Hsu, et al.
Veröffentlicht: (2025)
von: Tien‐Wei Hsu, et al.
Veröffentlicht: (2025)
Strong Partially Greedy Bases with respect to An Arbitrary Sequence
von: Chu, Hung Viet
Veröffentlicht: (2022)
von: Chu, Hung Viet
Veröffentlicht: (2022)
Prompt-Based One-Shot Exact Length-Controlled Generation with LLMs
von: Xie, Juncheng, et al.
Veröffentlicht: (2025)
von: Xie, Juncheng, et al.
Veröffentlicht: (2025)
I Need Help! Evaluating LLM's Ability to Ask for Users' Support: A Case Study on Text-to-SQL Generation
von: Wu, Cheng-Kuang, et al.
Veröffentlicht: (2024)
von: Wu, Cheng-Kuang, et al.
Veröffentlicht: (2024)
Contextualized Sequence Likelihood: Enhanced Confidence Scores for Natural Language Generation
von: Lin, Zhen, et al.
Veröffentlicht: (2024)
von: Lin, Zhen, et al.
Veröffentlicht: (2024)
Diffusion Sequence Models for Generative In-Context Meta-Learning of Robot Dynamics
von: Moroncelli, Angelo, et al.
Veröffentlicht: (2026)
von: Moroncelli, Angelo, et al.
Veröffentlicht: (2026)
Causal Tracing of Audio-Text Fusion in Large Audio Language Models
von: Chen, Wei-Chih, et al.
Veröffentlicht: (2026)
von: Chen, Wei-Chih, et al.
Veröffentlicht: (2026)
Exploring In-Context Learning of Textless Speech Language Model for Speech Classification Tasks
von: Hsu, Ming-Hao, et al.
Veröffentlicht: (2023)
von: Hsu, Ming-Hao, et al.
Veröffentlicht: (2023)
A$^2$TG: Adaptive Anisotropic Textured Gaussians for Efficient 3D Scene Representation
von: Hsu, Sheng-Chi, et al.
Veröffentlicht: (2026)
von: Hsu, Sheng-Chi, et al.
Veröffentlicht: (2026)
StreamBench: Towards Benchmarking Continuous Improvement of Language Agents
von: Wu, Cheng-Kuang, et al.
Veröffentlicht: (2024)
von: Wu, Cheng-Kuang, et al.
Veröffentlicht: (2024)
Answer, Refuse, or Guess? Investigating Risk-Aware Decision Making in Language Models
von: Wu, Cheng-Kuang, et al.
Veröffentlicht: (2025)
von: Wu, Cheng-Kuang, et al.
Veröffentlicht: (2025)
Contextual Label Projection for Cross-Lingual Structured Prediction
von: Parekh, Tanmay, et al.
Veröffentlicht: (2023)
von: Parekh, Tanmay, et al.
Veröffentlicht: (2023)
Weighted Schreier-type Sets and the Fibonacci Sequence
von: Chu, Hung Viet, et al.
Veröffentlicht: (2024)
von: Chu, Hung Viet, et al.
Veröffentlicht: (2024)
InstructionCP: A fast approach to transfer Large Language Models into target language
von: Chen, Kuang-Ming, et al.
Veröffentlicht: (2024)
von: Chen, Kuang-Ming, et al.
Veröffentlicht: (2024)
Merging Facts, Crafting Fallacies: Evaluating the Contradictory Nature of Aggregated Factual Claims in Long-Form Generations
von: Chiang, Cheng-Han, et al.
Veröffentlicht: (2024)
von: Chiang, Cheng-Han, et al.
Veröffentlicht: (2024)
Can Large Audio-Language Models Truly Hear? Tackling Hallucinations with Multi-Task Assessment and Stepwise Audio Reasoning
von: Kuan, Chun-Yi, et al.
Veröffentlicht: (2024)
von: Kuan, Chun-Yi, et al.
Veröffentlicht: (2024)
AQUA-Bench: Beyond Finding Answers to Knowing When There Are None in Audio Question Answering
von: Kuan, Chun-Yi, et al.
Veröffentlicht: (2026)
von: Kuan, Chun-Yi, et al.
Veröffentlicht: (2026)
Gender Bias in Instruction-Guided Speech Synthesis Models
von: Kuan, Chun-Yi, et al.
Veröffentlicht: (2025)
von: Kuan, Chun-Yi, et al.
Veröffentlicht: (2025)
Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples
von: Kuan, Chun-Yi, et al.
Veröffentlicht: (2025)
von: Kuan, Chun-Yi, et al.
Veröffentlicht: (2025)
From Alignment to Advancement: Bootstrapping Audio-Language Alignment with Synthetic Data
von: Kuan, Chun-Yi, et al.
Veröffentlicht: (2025)
von: Kuan, Chun-Yi, et al.
Veröffentlicht: (2025)
Over-Reasoning and Redundant Calculation of Large Language Models
von: Chiang, Cheng-Han, et al.
Veröffentlicht: (2024)
von: Chiang, Cheng-Han, et al.
Veröffentlicht: (2024)
Transferring Textual Preferences to Vision-Language Understanding through Model Merging
von: Li, Chen-An, et al.
Veröffentlicht: (2025)
von: Li, Chen-An, et al.
Veröffentlicht: (2025)
DogeRM: Equipping Reward Models with Domain Knowledge through Model Merging
von: Lin, Tzu-Han, et al.
Veröffentlicht: (2024)
von: Lin, Tzu-Han, et al.
Veröffentlicht: (2024)
MelHuBERT: A simplified HuBERT on Mel spectrograms
von: Lin, Tzu-Quan, et al.
Veröffentlicht: (2022)
von: Lin, Tzu-Quan, et al.
Veröffentlicht: (2022)
DAISY: Data Adaptive Self-Supervised Early Exit for Speech Representation Models
von: Lin, Tzu-Quan, et al.
Veröffentlicht: (2024)
von: Lin, Tzu-Quan, et al.
Veröffentlicht: (2024)
Towards General-Purpose Text-Instruction-Guided Voice Conversion
von: Kuan, Chun-Yi, et al.
Veröffentlicht: (2023)
von: Kuan, Chun-Yi, et al.
Veröffentlicht: (2023)
SAKURA: On the Multi-hop Reasoning of Large Audio-Language Models Based on Speech and Audio Information
von: Yang, Chih-Kai, et al.
Veröffentlicht: (2025)
von: Yang, Chih-Kai, et al.
Veröffentlicht: (2025)
TASTE: Text-Aligned Speech Tokenization and Embedding for Spoken Language Modeling
von: Tseng, Liang-Hsuan, et al.
Veröffentlicht: (2025)
von: Tseng, Liang-Hsuan, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
SMILE: Speech Meta In-Context Learning for Low-Resource Language Automatic Speech Recognition
von: Hsu, Ming-Hao, et al.
Veröffentlicht: (2024) -
Meta-Learning for Quantum Optimization via Quantum Sequence Model
von: Lin, Yu-Cheng, et al.
Veröffentlicht: (2025) -
DiffuCOMET: Contextual Commonsense Knowledge Diffusion
von: Gao, Silin, et al.
Veröffentlicht: (2024) -
Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning
von: Shen, Liang-Yeh, et al.
Veröffentlicht: (2025) -
TASTE-Streaming: Towards Streamable Text-Aligned Speech Tokenization and Embedding for Spoken Language Modeling
von: Tseng, Liang-Hsuan, et al.
Veröffentlicht: (2026)