Simple Hack for Transformers against Heavy Long-Text Classification on a Time- and Memory-Limited GPU Service
Fuente:
arXiv
Salvato in:
| Autori principali: | Mutasodirin, Mirza Alim, Prasojo, Radityo Eko, Abka, Achmad F., Rasyidi, Hanif |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Investigating Text Shortening Strategy in BERT: Truncation vs Summarization
di: Mutasodirin, Mirza Alim, et al.
Pubblicazione: (2024)
di: Mutasodirin, Mirza Alim, et al.
Pubblicazione: (2024)
Context-Aware Displacement Estimation from Mobile Phone Data: A Methodological Framework
di: Idzalika, Rajius, et al.
Pubblicazione: (2026)
di: Idzalika, Rajius, et al.
Pubblicazione: (2026)
COPAL-ID: Indonesian Language Reasoning with Local Culture and Nuances
di: Wibowo, Haryo Akbarianto, et al.
Pubblicazione: (2023)
di: Wibowo, Haryo Akbarianto, et al.
Pubblicazione: (2023)
Beyond the Pipeline: Analyzing Key Factors in End-to-End Deep Learning for Historical Writer Identification
di: Rasyidi, Hanif, et al.
Pubblicazione: (2025)
di: Rasyidi, Hanif, et al.
Pubblicazione: (2025)
The Embedded Network: Institutional Constraints on Collaborative Governance in Indonesia's Aviation Safety Program
di: Oke Hendra, et al.
Pubblicazione: (2025)
di: Oke Hendra, et al.
Pubblicazione: (2025)
Settlement Mapping for Population Density Modelling in Disease Risk Spatial Analysis
di: Mutasodirin, Mirza Alim, et al.
Pubblicazione: (2024)
di: Mutasodirin, Mirza Alim, et al.
Pubblicazione: (2024)
Hacking Neural Evaluation Metrics with Single Hub Text
di: Deguchi, Hiroyuki, et al.
Pubblicazione: (2025)
di: Deguchi, Hiroyuki, et al.
Pubblicazione: (2025)
Optical Text Recognition in Nepali and Bengali: A Transformer-based Approach
di: Hasan, S M Rakib, et al.
Pubblicazione: (2024)
di: Hasan, S M Rakib, et al.
Pubblicazione: (2024)
ResFormer: All-Time Reservoir Memory for Long Sequence Classification
di: Liu, Hongbo, et al.
Pubblicazione: (2025)
di: Liu, Hongbo, et al.
Pubblicazione: (2025)
Pushing The Limit of LLM Capacity for Text Classification
di: Zhang, Yazhou, et al.
Pubblicazione: (2024)
di: Zhang, Yazhou, et al.
Pubblicazione: (2024)
A Simple Graph Contrastive Learning Framework for Short Text Classification
di: Liu, Yonghao, et al.
Pubblicazione: (2025)
di: Liu, Yonghao, et al.
Pubblicazione: (2025)
Beyond Token Limits: Assessing Language Model Performance on Long Text Classification
di: Sebők, Miklós, et al.
Pubblicazione: (2025)
di: Sebők, Miklós, et al.
Pubblicazione: (2025)
Controllable Text Generation with Residual Memory Transformer
di: Zhang, Hanqing, et al.
Pubblicazione: (2023)
di: Zhang, Hanqing, et al.
Pubblicazione: (2023)
MemLong: Memory-Augmented Retrieval for Long Text Modeling
di: Liu, Weijie, et al.
Pubblicazione: (2024)
di: Liu, Weijie, et al.
Pubblicazione: (2024)
Simple-Sampling and Hard-Mixup with Prototypes to Rebalance Contrastive Learning for Text Classification
di: Li, Mengyu, et al.
Pubblicazione: (2024)
di: Li, Mengyu, et al.
Pubblicazione: (2024)
InfiniteICL: Breaking the Limit of Context Window Size via Long Short-term Memory Transformation
di: Cao, Bowen, et al.
Pubblicazione: (2025)
di: Cao, Bowen, et al.
Pubblicazione: (2025)
A Simple Yet Strong Baseline for Long-Term Conversational Memory of LLM Agents
di: Zhou, Sizhe, et al.
Pubblicazione: (2025)
di: Zhou, Sizhe, et al.
Pubblicazione: (2025)
Mitigating Bias in Text Classification via Prompt-Based Text Transformation
di: Barker, Charmaine, et al.
Pubblicazione: (2023)
di: Barker, Charmaine, et al.
Pubblicazione: (2023)
A Survey on Long Text Modeling with Transformers
di: Dong, Zican, et al.
Pubblicazione: (2023)
di: Dong, Zican, et al.
Pubblicazione: (2023)
SpecBench: Measuring Reward Hacking in Long-Horizon Coding Agents
di: Zhao, Bingchen, et al.
Pubblicazione: (2026)
di: Zhao, Bingchen, et al.
Pubblicazione: (2026)
Fine-tuning Whisper for Pashto ASR: strategies and scale
di: Rahman, Hanif
Pubblicazione: (2026)
di: Rahman, Hanif
Pubblicazione: (2026)
Benchmarking Multilingual Speech Models on Pashto: Zero-Shot ASR, Script Failure, and Cross-Domain Evaluation
di: Rahman, Hanif
Pubblicazione: (2026)
di: Rahman, Hanif
Pubblicazione: (2026)
On the Robustness of Transformers against Context Hijacking for Linear Classification
di: Li, Tianle, et al.
Pubblicazione: (2025)
di: Li, Tianle, et al.
Pubblicazione: (2025)
A Simple Ensemble Strategy for LLM Inference: Towards More Stable Text Classification
di: Niimi, Junichiro
Pubblicazione: (2025)
di: Niimi, Junichiro
Pubblicazione: (2025)
PashtoTTS-Bench: automated screening for low-resource non-Latin-script text-to-speech
di: Rahman, Hanif
Pubblicazione: (2026)
di: Rahman, Hanif
Pubblicazione: (2026)
IndoBERT-Sentiment: Context-Conditioned Sentiment Classification for Indonesian Text
di: Saputra, Muhammad Apriandito Arya, et al.
Pubblicazione: (2026)
di: Saputra, Muhammad Apriandito Arya, et al.
Pubblicazione: (2026)
Length-Aware Multi-Kernel Transformer for Long Document Classification
di: Han, Guangzeng, et al.
Pubblicazione: (2024)
di: Han, Guangzeng, et al.
Pubblicazione: (2024)
Chunk, Align, Select: A Simple Long-sequence Processing Method for Transformers
di: Xie, Jiawen, et al.
Pubblicazione: (2023)
di: Xie, Jiawen, et al.
Pubblicazione: (2023)
Token Masking Improves Transformer-Based Text Classification
di: Xu, Xianglong, et al.
Pubblicazione: (2025)
di: Xu, Xianglong, et al.
Pubblicazione: (2025)
Generative or Discriminative? Revisiting Text Classification in the Era of Transformers
di: Kasa, Siva Rajesh, et al.
Pubblicazione: (2025)
di: Kasa, Siva Rajesh, et al.
Pubblicazione: (2025)
Fast Partial Shading Detection on PV Modules for Precise Power Loss Ratio Estimation Using Digital Image Processing
di: Eko Adhi Setiawan, et al.
Pubblicazione: (2024)
di: Eko Adhi Setiawan, et al.
Pubblicazione: (2024)
Large Language Model Hacking: Quantifying the Hidden Risks of Using LLMs for Text Annotation
di: Baumann, Joachim, et al.
Pubblicazione: (2025)
di: Baumann, Joachim, et al.
Pubblicazione: (2025)
NYT-Connections: A Deceptively Simple Text Classification Task that Stumps System-1 Thinkers
di: Lopez, Angel Yahir Loredo, et al.
Pubblicazione: (2024)
di: Lopez, Angel Yahir Loredo, et al.
Pubblicazione: (2024)
Source-to-Source Transformations for GPU Code Generation
di: de Castelnau, Julien, et al.
Pubblicazione: (2026)
di: de Castelnau, Julien, et al.
Pubblicazione: (2026)
Detecting Propaganda Techniques in Code-Switched Social Media Text
di: Salman, Muhammad Umar, et al.
Pubblicazione: (2023)
di: Salman, Muhammad Umar, et al.
Pubblicazione: (2023)
SimpleSpeech 2: Towards Simple and Efficient Text-to-Speech with Flow-based Scalar Latent Transformer Diffusion Models
di: Yang, Dongchao, et al.
Pubblicazione: (2024)
di: Yang, Dongchao, et al.
Pubblicazione: (2024)
Mela: Test-Time Memory Consolidation based on Transformation Hypothesis
di: Chen, Lungchuan
Pubblicazione: (2026)
di: Chen, Lungchuan
Pubblicazione: (2026)
Specification Self-Correction: Mitigating In-Context Reward Hacking Through Test-Time Refinement
di: Gallego, Víctor
Pubblicazione: (2025)
di: Gallego, Víctor
Pubblicazione: (2025)
READ: Reinforcement-based Adversarial Learning for Text Classification with Limited Labeled Data
di: Sharma, Rohit, et al.
Pubblicazione: (2025)
di: Sharma, Rohit, et al.
Pubblicazione: (2025)
Multi-Level Attention and Contrastive Learning for Enhanced Text Classification with an Optimized Transformer
di: Gao, Jia, et al.
Pubblicazione: (2025)
di: Gao, Jia, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Investigating Text Shortening Strategy in BERT: Truncation vs Summarization
di: Mutasodirin, Mirza Alim, et al.
Pubblicazione: (2024) -
Context-Aware Displacement Estimation from Mobile Phone Data: A Methodological Framework
di: Idzalika, Rajius, et al.
Pubblicazione: (2026) -
COPAL-ID: Indonesian Language Reasoning with Local Culture and Nuances
di: Wibowo, Haryo Akbarianto, et al.
Pubblicazione: (2023) -
Beyond the Pipeline: Analyzing Key Factors in End-to-End Deep Learning for Historical Writer Identification
di: Rasyidi, Hanif, et al.
Pubblicazione: (2025) -
The Embedded Network: Institutional Constraints on Collaborative Governance in Indonesia's Aviation Safety Program
di: Oke Hendra, et al.
Pubblicazione: (2025)