LCFO: Long Context and Long Form Output Dataset and Benchmarking
Fuente:
arXiv
Salvato in:
| Autori principali: | Costa-jussà, Marta R., Andrews, Pierre, Meglioli, Mariano Coria, Chen, Joy, Chuang, Joe, Dale, David, Ropers, Christophe, Mourachko, Alexandre, Sánchez, Eduardo, Schwenk, Holger, Tran, Tuan, Turkatenko, Arina, Wood, Carleigh |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MuTox: Universal MUltilingual Audio-based TOXicity Dataset and Zero-shot Detector
di: Costa-jussà, Marta R., et al.
Pubblicazione: (2024)
di: Costa-jussà, Marta R., et al.
Pubblicazione: (2024)
BOUQuET: dataset, Benchmark and Open initiative for Universal Quality Evaluation in Translation
di: The Omnilingual MT Team, et al.
Pubblicazione: (2025)
di: The Omnilingual MT Team, et al.
Pubblicazione: (2025)
2M-BELEBELE: Highly Multilingual Speech and American Sign Language Comprehension Dataset
di: Costa-jussà, Marta R., et al.
Pubblicazione: (2024)
di: Costa-jussà, Marta R., et al.
Pubblicazione: (2024)
Towards Massive Multilingual Holistic Bias
di: Tan, Xiaoqing Ellen, et al.
Pubblicazione: (2024)
di: Tan, Xiaoqing Ellen, et al.
Pubblicazione: (2024)
Y-NQ: English-Yorùbá Evaluation dataset for Open-Book Reading Comprehension and Text Generation
di: Costa-jussà, Marta R., et al.
Pubblicazione: (2024)
di: Costa-jussà, Marta R., et al.
Pubblicazione: (2024)
On the Role of Speech Data in Reducing Toxicity Detection Bias
di: Bell, Samuel J., et al.
Pubblicazione: (2024)
di: Bell, Samuel J., et al.
Pubblicazione: (2024)
Large Concept Models: Language Modeling in a Sentence Representation Space
di: LCM team, et al.
Pubblicazione: (2024)
di: LCM team, et al.
Pubblicazione: (2024)
ChunkFormer: Masked Chunking Conformer For Long-Form Speech Transcription
di: Le, Khanh, et al.
Pubblicazione: (2025)
di: Le, Khanh, et al.
Pubblicazione: (2025)
Linguini: A benchmark for language-agnostic linguistic reasoning
di: Sánchez, Eduardo, et al.
Pubblicazione: (2024)
di: Sánchez, Eduardo, et al.
Pubblicazione: (2024)
Omnilingual MT: Machine Translation for 1,600 Languages
di: Omnilingual MT Team, et al.
Pubblicazione: (2026)
di: Omnilingual MT Team, et al.
Pubblicazione: (2026)
Benchmarking LLM-as-a-Judge for Long-Form Output Evaluation
di: Chen, Junjie, et al.
Pubblicazione: (2026)
di: Chen, Junjie, et al.
Pubblicazione: (2026)
LongGenBench: Benchmarking Long-Form Generation in Long Context LLMs
di: Wu, Yuhao, et al.
Pubblicazione: (2024)
di: Wu, Yuhao, et al.
Pubblicazione: (2024)
Long-Context Long-Form Question Answering for Legal Domain
di: Kulkarni, Anagha, et al.
Pubblicazione: (2026)
di: Kulkarni, Anagha, et al.
Pubblicazione: (2026)
Towards Red Teaming in Multimodal and Multilingual Translation
di: Ropers, Christophe, et al.
Pubblicazione: (2024)
di: Ropers, Christophe, et al.
Pubblicazione: (2024)
TextSeal: A Localized LLM Watermark for Provenance & Distillation Protection
di: Sander, Tom, et al.
Pubblicazione: (2026)
di: Sander, Tom, et al.
Pubblicazione: (2026)
On the uniqueness for the heat equation with density on infinite graphs
di: Meglioli, Giulia
Pubblicazione: (2024)
di: Meglioli, Giulia
Pubblicazione: (2024)
Factores que afectan la germinación de tres pastos de zonas áridas: Leptochloa crinita, Pappophorum caespitosum y Digitaria californica (Poaceae)
di: Carola Meglioli
Pubblicazione: (2024)
di: Carola Meglioli
Pubblicazione: (2024)
Shifting Long-Context LLMs Research from Input to Output
di: Wu, Yuhao, et al.
Pubblicazione: (2025)
di: Wu, Yuhao, et al.
Pubblicazione: (2025)
ThriftAttention: Selective Mixed Precision for Long-Context FP4 Attention
di: Sharratt, Joe
Pubblicazione: (2026)
di: Sharratt, Joe
Pubblicazione: (2026)
Long$^2$RAG: Evaluating Long-Context & Long-Form Retrieval-Augmented Generation with Key Point Recall
di: Qi, Zehan, et al.
Pubblicazione: (2024)
di: Qi, Zehan, et al.
Pubblicazione: (2024)
Efectos de los disturbios provocados por puestos ganaderos sobre el complejo agua-suelo-vegetación en ecosistemas áridos acoplados al acuífero freático
di: P. A. Meglioli
Pubblicazione: (2016)
di: P. A. Meglioli
Pubblicazione: (2016)
Book Review: Offenders and the Sexual Abuse of Children: Interventions and Limitations
di: Carleigh Bristol Slater
Pubblicazione: (2025)
di: Carleigh Bristol Slater
Pubblicazione: (2025)
DYCP: Dynamic Context Pruning for Long-Form Dialogue with LLMs
di: Choi, Nayoung, et al.
Pubblicazione: (2026)
di: Choi, Nayoung, et al.
Pubblicazione: (2026)
Fine-Grained Uncertainty Quantification for Long-Form Language Model Outputs: A Comparative Study
di: Bouchard, Dylan, et al.
Pubblicazione: (2026)
di: Bouchard, Dylan, et al.
Pubblicazione: (2026)
Improving Language and Modality Transfer in Translation by Character-level Modeling
di: Tsiamas, Ioannis, et al.
Pubblicazione: (2025)
di: Tsiamas, Ioannis, et al.
Pubblicazione: (2025)
CompLLM: Compression for Long Context Q&A
di: Berton, Gabriele, et al.
Pubblicazione: (2025)
di: Berton, Gabriele, et al.
Pubblicazione: (2025)
Halo: Domain-Aware Query Optimization for Long-Context Question Answering
di: Chunduri, Pramod, et al.
Pubblicazione: (2026)
di: Chunduri, Pramod, et al.
Pubblicazione: (2026)
Efficient Long-Form Speech Recognition for General Speech In-Context Learning
di: Yen, Hao, et al.
Pubblicazione: (2024)
di: Yen, Hao, et al.
Pubblicazione: (2024)
LongRecipe: Recipe for Efficient Long Context Generalization in Large Language Models
di: Hu, Zhiyuan, et al.
Pubblicazione: (2024)
di: Hu, Zhiyuan, et al.
Pubblicazione: (2024)
Uniqueness of solutions to elliptic and parabolic equations on metric graphs
di: Meglioli, Giulia, et al.
Pubblicazione: (2025)
di: Meglioli, Giulia, et al.
Pubblicazione: (2025)
Gradient flow for a class of diffusion equations with Dirichlet boundary data
di: Erbar, Matthias, et al.
Pubblicazione: (2024)
di: Erbar, Matthias, et al.
Pubblicazione: (2024)
Uniqueness in weighted $l^p$ spaces for the Schrödinger equation on infinite graphs
di: Meglioli, Giulia, et al.
Pubblicazione: (2022)
di: Meglioli, Giulia, et al.
Pubblicazione: (2022)
Omnilingual SONAR: Cross-Lingual and Cross-Modal Sentence Embeddings Bridging Massively Multilingual Text and Speech
di: Omnilingual SONAR Team, et al.
Pubblicazione: (2026)
di: Omnilingual SONAR Team, et al.
Pubblicazione: (2026)
Extending Audio Context for Long-Form Understanding in Large Audio-Language Models
di: Chaichana, Yuatyong, et al.
Pubblicazione: (2025)
di: Chaichana, Yuatyong, et al.
Pubblicazione: (2025)
Pixel Seal: Adversarial-only training for invisible image and video watermarking
di: Souček, Tomáš, et al.
Pubblicazione: (2025)
di: Souček, Tomáš, et al.
Pubblicazione: (2025)
Transferable Black-Box One-Shot Forging of Watermarks via Image Preference Models
di: Souček, Tomáš, et al.
Pubblicazione: (2025)
di: Souček, Tomáš, et al.
Pubblicazione: (2025)
Geometric Image Synchronization with Deep Watermarking
di: Fernandez, Pierre, et al.
Pubblicazione: (2025)
di: Fernandez, Pierre, et al.
Pubblicazione: (2025)
Enhancing Long Document Long Form Summarisation with Self-Planning
di: Du, Xiaotang, et al.
Pubblicazione: (2025)
di: Du, Xiaotang, et al.
Pubblicazione: (2025)
DragonVerseQA: Open-Domain Long-Form Context-Aware Question-Answering
di: Lahiri, Aritra Kumar, et al.
Pubblicazione: (2024)
di: Lahiri, Aritra Kumar, et al.
Pubblicazione: (2024)
100-LongBench: Are de facto Long-Context Benchmarks Literally Evaluating Long-Context Ability?
di: Yang, Wang, et al.
Pubblicazione: (2025)
di: Yang, Wang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MuTox: Universal MUltilingual Audio-based TOXicity Dataset and Zero-shot Detector
di: Costa-jussà, Marta R., et al.
Pubblicazione: (2024) -
BOUQuET: dataset, Benchmark and Open initiative for Universal Quality Evaluation in Translation
di: The Omnilingual MT Team, et al.
Pubblicazione: (2025) -
2M-BELEBELE: Highly Multilingual Speech and American Sign Language Comprehension Dataset
di: Costa-jussà, Marta R., et al.
Pubblicazione: (2024) -
Towards Massive Multilingual Holistic Bias
di: Tan, Xiaoqing Ellen, et al.
Pubblicazione: (2024) -
Y-NQ: English-Yorùbá Evaluation dataset for Open-Book Reading Comprehension and Text Generation
di: Costa-jussà, Marta R., et al.
Pubblicazione: (2024)