TextBFGS: A Case-Based Reasoning Approach to Code Optimization via Error-Operator Retrieval
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Zizheng, Liao, Yuyang, Chen, Chen, He, Jian, Wu, Dun, Yu, Qianjin, Gao, Yanqin, Yang, Jin, Zhang, Kailai, Chng, Eng Siong, Zhong, Xionghu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Bridging Speech and Text: Enhancing ASR with Pinyin-to-Character Pre-training in LLMs
por: Yuhang, Yang, et al.
Publicado: (2024)
por: Yuhang, Yang, et al.
Publicado: (2024)
UniArray: Unified Spectral-Spatial Modeling for Array-Geometry-Agnostic Speech Separation
por: Chen, Weiguang, et al.
Publicado: (2025)
por: Chen, Weiguang, et al.
Publicado: (2025)
Noise-Aware Speech Separation with Contrastive Learning
por: Zhang, Zizheng, et al.
Publicado: (2023)
por: Zhang, Zizheng, et al.
Publicado: (2023)
Robust Zero-Shot Text-to-Speech Synthesis with Reverse Inference Optimization
por: Hu, Yuchen, et al.
Publicado: (2024)
por: Hu, Yuchen, et al.
Publicado: (2024)
Enhancing Zero-shot Text-to-Speech Synthesis with Human Feedback
por: Chen, Chen, et al.
Publicado: (2024)
por: Chen, Chen, et al.
Publicado: (2024)
Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model
por: Ma, Ziyang, et al.
Publicado: (2025)
por: Ma, Ziyang, et al.
Publicado: (2025)
Wav2code: Restore Clean Speech Representations via Codebook Lookup for Noise-Robust ASR
por: Hu, Yuchen, et al.
Publicado: (2023)
por: Hu, Yuchen, et al.
Publicado: (2023)
Zero-shot Context Biasing with Trie-based Decoding using Synthetic Multi-Pronunciation
por: Liu, Changsong, et al.
Publicado: (2025)
por: Liu, Changsong, et al.
Publicado: (2025)
Hierarchical Self-Supervised Representation Learning for Depression Detection from Speech
por: Li, Yuxin, et al.
Publicado: (2025)
por: Li, Yuxin, et al.
Publicado: (2025)
Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR
por: Peng, Yizhou, et al.
Publicado: (2025)
por: Peng, Yizhou, et al.
Publicado: (2025)
Text-based Talking Video Editing with Cascaded Conditional Diffusion
por: Han, Bo, et al.
Publicado: (2024)
por: Han, Bo, et al.
Publicado: (2024)
Proactive for Uncertainty: Cause-Aware Error Diagnosis and Interactive Clarification for Spoken Dialogue Systems
por: Peng, Yizhou, et al.
Publicado: (2026)
por: Peng, Yizhou, et al.
Publicado: (2026)
Prosodic Boundary-Aware Streaming Generation for LLM-Based TTS with Streaming Text Input
por: Liu, Changsong, et al.
Publicado: (2026)
por: Liu, Changsong, et al.
Publicado: (2026)
CS-Sum: A Benchmark for Code-Switching Dialogue Summarization and the Limits of Large Language Models
por: Suresh, Sathya Krishnan, et al.
Publicado: (2025)
por: Suresh, Sathya Krishnan, et al.
Publicado: (2025)
Code-switching Speech Recognition Under the Lens: Model- and Data-Centric Perspectives
por: Liu, Hexin, et al.
Publicado: (2025)
por: Liu, Hexin, et al.
Publicado: (2025)
StreamVoiceAnon+: Emotion-Preserving Streaming Speaker Anonymization via Frame-Level Acoustic Distillation
por: Kuzmin, Nikita, et al.
Publicado: (2026)
por: Kuzmin, Nikita, et al.
Publicado: (2026)
Punctuation Restoration for Singaporean Spoken Languages: English, Malay, and Mandarin
por: Rao, Abhinav, et al.
Publicado: (2022)
por: Rao, Abhinav, et al.
Publicado: (2022)
Noise-aware Speech Enhancement using Diffusion Probabilistic Model
por: Hu, Yuchen, et al.
Publicado: (2023)
por: Hu, Yuchen, et al.
Publicado: (2023)
VocalParse: Towards Unified and Scalable Singing Voice Transcription with Large Audio Language Models
por: Chen, Yukun, et al.
Publicado: (2026)
por: Chen, Yukun, et al.
Publicado: (2026)
EASY: Emotion-aware Speaker Anonymization via Factorized Distillation
por: Yao, Jixun, et al.
Publicado: (2025)
por: Yao, Jixun, et al.
Publicado: (2025)
Continual Learning Optimizations for Auto-regressive Decoder of Multilingual ASR systems
por: Kwok, Chin Yuen, et al.
Publicado: (2024)
por: Kwok, Chin Yuen, et al.
Publicado: (2024)
Analysis of Speaker Verification Performance Trade-offs with Neural Audio Codec Transmission
por: Thakur, Nirmalya Mallick, et al.
Publicado: (2025)
por: Thakur, Nirmalya Mallick, et al.
Publicado: (2025)
Next-Frame Feature Prediction for Multimodal Deepfake Detection and Temporal Localization
por: Anshul, Ashutosh, et al.
Publicado: (2025)
por: Anshul, Ashutosh, et al.
Publicado: (2025)
Improving Synthetic Data Training for Contextual Biasing Models with a Keyword-Aware Cost Function
por: Kwok, Chin Yuen, et al.
Publicado: (2025)
por: Kwok, Chin Yuen, et al.
Publicado: (2025)
Continual Learning with Embedding Layer Surgery and Task-wise Beam Search using Whisper
por: Kwok, Chin Yuen, et al.
Publicado: (2025)
por: Kwok, Chin Yuen, et al.
Publicado: (2025)
Mind-Paced Speaking: A Dual-Brain Approach to Real-Time Reasoning in Spoken Language Models
por: Wu, Donghang, et al.
Publicado: (2025)
por: Wu, Donghang, et al.
Publicado: (2025)
Multi-band Frequency Reconstruction for Neural Psychoacoustic Coding
por: Ng, Dianwen, et al.
Publicado: (2025)
por: Ng, Dianwen, et al.
Publicado: (2025)
Improving Code-Switching Speech Recognition with TTS Data Augmentation
por: Yeo, Yue Heng, et al.
Publicado: (2026)
por: Yeo, Yue Heng, et al.
Publicado: (2026)
GenSE: Generative Speech Enhancement via Language Models using Hierarchical Modeling
por: Yao, Jixun, et al.
Publicado: (2025)
por: Yao, Jixun, et al.
Publicado: (2025)
Cross-Modality and Within-Modality Regularization for Audio-Visual DeepFake Detection
por: Zou, Heqing, et al.
Publicado: (2024)
por: Zou, Heqing, et al.
Publicado: (2024)
Listen Again and Choose the Right Answer: A New Paradigm for Automatic Speech Recognition with Large Language Models
por: Hu, Yuchen, et al.
Publicado: (2024)
por: Hu, Yuchen, et al.
Publicado: (2024)
Aligning Speech to Languages to Enhance Code-switching Speech Recognition
por: Liu, Hexin, et al.
Publicado: (2024)
por: Liu, Hexin, et al.
Publicado: (2024)
DiaSynth: Synthetic Dialogue Generation Framework for Low Resource Dialogue Applications
por: Suresh, Sathya Krishnan, et al.
Publicado: (2024)
por: Suresh, Sathya Krishnan, et al.
Publicado: (2024)
Stream-Voice-Anon: Enhancing Utility of Real-Time Speaker Anonymization via Neural Audio Codec and Language Models
por: Kuzmin, Nikita, et al.
Publicado: (2026)
por: Kuzmin, Nikita, et al.
Publicado: (2026)
Speech Enhancement Using Continuous Embeddings of Neural Audio Codec
por: Li, Haoyang, et al.
Publicado: (2025)
por: Li, Haoyang, et al.
Publicado: (2025)
From KAN to GR-KAN: Advancing Speech Enhancement with KAN-Based Methodology
por: Li, Haoyang, et al.
Publicado: (2024)
por: Li, Haoyang, et al.
Publicado: (2024)
GenTranslate: Large Language Models are Generative Multilingual Speech and Machine Translators
por: Hu, Yuchen, et al.
Publicado: (2024)
por: Hu, Yuchen, et al.
Publicado: (2024)
LlamaPartialSpoof: An LLM-Driven Fake Speech Dataset Simulating Disinformation Generation
por: Luong, Hieu-Thi, et al.
Publicado: (2024)
por: Luong, Hieu-Thi, et al.
Publicado: (2024)
Large Language Models Meet Contrastive Learning: Zero-Shot Emotion Recognition Across Languages
por: Zou, Heqing, et al.
Publicado: (2025)
por: Zou, Heqing, et al.
Publicado: (2025)
Speech Separation using Neural Audio Codecs with Embedding Loss
por: Yip, Jia Qi, et al.
Publicado: (2024)
por: Yip, Jia Qi, et al.
Publicado: (2024)
Ejemplares similares
-
Bridging Speech and Text: Enhancing ASR with Pinyin-to-Character Pre-training in LLMs
por: Yuhang, Yang, et al.
Publicado: (2024) -
UniArray: Unified Spectral-Spatial Modeling for Array-Geometry-Agnostic Speech Separation
por: Chen, Weiguang, et al.
Publicado: (2025) -
Noise-Aware Speech Separation with Contrastive Learning
por: Zhang, Zizheng, et al.
Publicado: (2023) -
Robust Zero-Shot Text-to-Speech Synthesis with Reverse Inference Optimization
por: Hu, Yuchen, et al.
Publicado: (2024) -
Enhancing Zero-shot Text-to-Speech Synthesis with Human Feedback
por: Chen, Chen, et al.
Publicado: (2024)