LiveLongBench: Tackling Long-Context Understanding for Spoken Texts from Live Streams
Fuente:
arXiv
Guardado en:
| Autores principales: | Wu, Yongxuan, Chen, Runyu, Liu, Peiyu, Qian, Hongjin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Are Long-LLMs A Necessity For Long-Context Tasks?
por: Qian, Hongjin, et al.
Publicado: (2024)
por: Qian, Hongjin, et al.
Publicado: (2024)
Beyond Static Pipelines: Learning Dynamic Workflows for Text-to-SQL
por: Wang, Yihan, et al.
Publicado: (2026)
por: Wang, Yihan, et al.
Publicado: (2026)
AcademicEval: Live Long-Context LLM Benchmark
por: Zhang, Haozhen, et al.
Publicado: (2025)
por: Zhang, Haozhen, et al.
Publicado: (2025)
Boosting Long-Context Management via Query-Guided Activation Refilling
por: Qian, Hongjin, et al.
Publicado: (2024)
por: Qian, Hongjin, et al.
Publicado: (2024)
MemoRAG: Boosting Long Context Processing with Global Memory-Enhanced Retrieval Augmentation
por: Qian, Hongjin, et al.
Publicado: (2024)
por: Qian, Hongjin, et al.
Publicado: (2024)
LongBench Pro: A More Realistic and Comprehensive Bilingual Long-Context Evaluation Benchmark
por: Chen, Ziyang, et al.
Publicado: (2026)
por: Chen, Ziyang, et al.
Publicado: (2026)
Self-Taught Agentic Long Context Understanding
por: Zhuang, Yufan, et al.
Publicado: (2025)
por: Zhuang, Yufan, et al.
Publicado: (2025)
LiveFC: A System for Live Fact-Checking of Audio Streams
por: V, Venktesh, et al.
Publicado: (2024)
por: V, Venktesh, et al.
Publicado: (2024)
Retrieval Meets Reasoning: Dynamic In-Context Editing for Long-Text Understanding
por: Fei, Weizhi, et al.
Publicado: (2024)
por: Fei, Weizhi, et al.
Publicado: (2024)
Improving Long Text Understanding with Knowledge Distilled from Summarization Model
por: Liu, Yan, et al.
Publicado: (2024)
por: Liu, Yan, et al.
Publicado: (2024)
LooGLE: Can Long-Context Language Models Understand Long Contexts?
por: Li, Jiaqi, et al.
Publicado: (2023)
por: Li, Jiaqi, et al.
Publicado: (2023)
ESG-Bench: Benchmarking Long-Context ESG Reports for Hallucination Mitigation
por: Sun, Siqi, et al.
Publicado: (2026)
por: Sun, Siqi, et al.
Publicado: (2026)
100-LongBench: Are de facto Long-Context Benchmarks Literally Evaluating Long-Context Ability?
por: Yang, Wang, et al.
Publicado: (2025)
por: Yang, Wang, et al.
Publicado: (2025)
VideoExplorer: Think With Videos For Agentic Long-Video Understanding
por: Yuan, Huaying, et al.
Publicado: (2025)
por: Yuan, Huaying, et al.
Publicado: (2025)
LongGenBench: Long-context Generation Benchmark
por: Liu, Xiang, et al.
Publicado: (2024)
por: Liu, Xiang, et al.
Publicado: (2024)
LongBench v2: Towards Deeper Understanding and Reasoning on Realistic Long-context Multitasks
por: Bai, Yushi, et al.
Publicado: (2024)
por: Bai, Yushi, et al.
Publicado: (2024)
LIFT: Improving Long Context Understanding Through Long Input Fine-Tuning
por: Mao, Yansheng, et al.
Publicado: (2024)
por: Mao, Yansheng, et al.
Publicado: (2024)
MileBench: Benchmarking MLLMs in Long Context
por: Song, Dingjie, et al.
Publicado: (2024)
por: Song, Dingjie, et al.
Publicado: (2024)
InternLM-XComposer2.5-OmniLive: A Comprehensive Multimodal System for Long-term Streaming Video and Audio Interactions
por: Zhang, Pan, et al.
Publicado: (2024)
por: Zhang, Pan, et al.
Publicado: (2024)
AgentFugue: Agent Scaling for Long-Horizon Tasks through Collective Reasoning
por: Hu, Yuyang, et al.
Publicado: (2026)
por: Hu, Yuyang, et al.
Publicado: (2026)
LongCodeBench: Evaluating Coding LLMs at 1M Context Windows
por: Rando, Stefano, et al.
Publicado: (2025)
por: Rando, Stefano, et al.
Publicado: (2025)
MemLong: Memory-Augmented Retrieval for Long Text Modeling
por: Liu, Weijie, et al.
Publicado: (2024)
por: Liu, Weijie, et al.
Publicado: (2024)
NExtLong: Toward Effective Long-Context Training without Long Documents
por: Gao, Chaochen, et al.
Publicado: (2025)
por: Gao, Chaochen, et al.
Publicado: (2025)
LiveMathematicianBench: A Live Benchmark for Mathematician-Level Reasoning with Proof Sketches
por: He, Linyang, et al.
Publicado: (2026)
por: He, Linyang, et al.
Publicado: (2026)
VTCBench: Can Vision-Language Models Understand Long Context with Vision-Text Compression?
por: Zhao, Hongbo, et al.
Publicado: (2025)
por: Zhao, Hongbo, et al.
Publicado: (2025)
Bridging Context Gaps: Leveraging Coreference Resolution for Long Contextual Understanding
por: Liu, Yanming, et al.
Publicado: (2024)
por: Liu, Yanming, et al.
Publicado: (2024)
EntropyLong: Effective Long-Context Training via Predictive Uncertainty
por: Jia, Junlong, et al.
Publicado: (2025)
por: Jia, Junlong, et al.
Publicado: (2025)
FocusLLM: Precise Understanding of Long Context by Dynamic Condensing
por: Li, Zhenyu, et al.
Publicado: (2024)
por: Li, Zhenyu, et al.
Publicado: (2024)
Joint Learning of Context and Feedback Embeddings in Spoken Dialogue
por: Qian, Livia, et al.
Publicado: (2024)
por: Qian, Livia, et al.
Publicado: (2024)
MedMT-Bench: Can LLMs Memorize and Understand Long Multi-Turn Conversations in Medical Scenarios?
por: Yang, Lin, et al.
Publicado: (2026)
por: Yang, Lin, et al.
Publicado: (2026)
LiteLong: Resource-Efficient Long-Context Data Synthesis for LLMs
por: Jia, Junlong, et al.
Publicado: (2025)
por: Jia, Junlong, et al.
Publicado: (2025)
StreamingDialogue: Prolonged Dialogue Learning via Long Context Compression with Minimal Losses
por: Li, Jia-Nan, et al.
Publicado: (2024)
por: Li, Jia-Nan, et al.
Publicado: (2024)
FormalASR: End-to-End Spoken Chinese to Formal Text
por: Ning, Wanyi, et al.
Publicado: (2026)
por: Ning, Wanyi, et al.
Publicado: (2026)
LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models
por: Chen, Yukang, et al.
Publicado: (2023)
por: Chen, Yukang, et al.
Publicado: (2023)
Nomic Embed: Training a Reproducible Long Context Text Embedder
por: Nussbaum, Zach, et al.
Publicado: (2024)
por: Nussbaum, Zach, et al.
Publicado: (2024)
Context Memorization for Efficient Long Context Generation
por: Okoshi, Yasuyuki, et al.
Publicado: (2026)
por: Okoshi, Yasuyuki, et al.
Publicado: (2026)
CURIE: Evaluating LLMs On Multitask Scientific Long Context Understanding and Reasoning
por: Cui, Hao, et al.
Publicado: (2025)
por: Cui, Hao, et al.
Publicado: (2025)
Too Long, Didn't Model: Decomposing LLM Long-Context Understanding With Novels
por: Hamilton, Sil, et al.
Publicado: (2025)
por: Hamilton, Sil, et al.
Publicado: (2025)
SIN-Bench: Tracing Native Evidence Chains in Long-Context Multimodal Scientific Interleaved Literature
por: Ren, Yiming, et al.
Publicado: (2026)
por: Ren, Yiming, et al.
Publicado: (2026)
SpokenWOZ: A Large-Scale Speech-Text Benchmark for Spoken Task-Oriented Dialogue Agents
por: Si, Shuzheng, et al.
Publicado: (2023)
por: Si, Shuzheng, et al.
Publicado: (2023)
Ejemplares similares
-
Are Long-LLMs A Necessity For Long-Context Tasks?
por: Qian, Hongjin, et al.
Publicado: (2024) -
Beyond Static Pipelines: Learning Dynamic Workflows for Text-to-SQL
por: Wang, Yihan, et al.
Publicado: (2026) -
AcademicEval: Live Long-Context LLM Benchmark
por: Zhang, Haozhen, et al.
Publicado: (2025) -
Boosting Long-Context Management via Query-Guided Activation Refilling
por: Qian, Hongjin, et al.
Publicado: (2024) -
MemoRAG: Boosting Long Context Processing with Global Memory-Enhanced Retrieval Augmentation
por: Qian, Hongjin, et al.
Publicado: (2024)