In Search of Lost DNA Sequence Pretraining
Fuente:
arXiv
Salvato in:
| Autori principali: | Tang, Zhijiang, Qi, Jiaxin, Cui, Yan, Ou, Jinli, Zheng, Yuhua, Huang, Jianqiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Comprehensive Benchmark for Electrocardiogram Time-Series
di: Tang, Zhijiang, et al.
Pubblicazione: (2025)
di: Tang, Zhijiang, et al.
Pubblicazione: (2025)
Towards Universal Gene Regulatory Network Inference: Unlocking Generalizable Regulatory Knowledge in Single-cell Foundation Models
di: Qi, Jiaxin, et al.
Pubblicazione: (2026)
di: Qi, Jiaxin, et al.
Pubblicazione: (2026)
Gene Incremental Learning for Single-Cell Transcriptomics
di: Qi, Jiaxin, et al.
Pubblicazione: (2025)
di: Qi, Jiaxin, et al.
Pubblicazione: (2025)
Graph Neural Networks as a Substitute for Transformers in Single-Cell Transcriptomics
di: Qi, Jiaxin, et al.
Pubblicazione: (2025)
di: Qi, Jiaxin, et al.
Pubblicazione: (2025)
Spatial Transcriptomics as Images for Large-Scale Pretraining
di: Zhu, Yishun, et al.
Pubblicazione: (2026)
di: Zhu, Yishun, et al.
Pubblicazione: (2026)
Long-CODE: Isolating Pure Long-Context as an Orthogonal Dimension in Video Evaluation
di: Tang, Zhijiang, et al.
Pubblicazione: (2026)
di: Tang, Zhijiang, et al.
Pubblicazione: (2026)
EvoLM: In Search of Lost Language Model Training Dynamics
di: Qi, Zhenting, et al.
Pubblicazione: (2025)
di: Qi, Zhenting, et al.
Pubblicazione: (2025)
Sequence-Model-Guided Measurement Selection for Quantum State Learning
di: Huang, Jiaxin, et al.
Pubblicazione: (2025)
di: Huang, Jiaxin, et al.
Pubblicazione: (2025)
TreeRPO: Tree Relative Policy Optimization
di: Yang, Zhicheng, et al.
Pubblicazione: (2025)
di: Yang, Zhicheng, et al.
Pubblicazione: (2025)
Scaling Test-Time Robustness of Vision-Language Models via Self-Critical Inference Framework
di: Tang, Kaihua, et al.
Pubblicazione: (2026)
di: Tang, Kaihua, et al.
Pubblicazione: (2026)
Language Models for Controllable DNA Sequence Design
di: Su, Xingyu, et al.
Pubblicazione: (2025)
di: Su, Xingyu, et al.
Pubblicazione: (2025)
Dy-mer: An Explainable DNA Sequence Representation Scheme using Dictionary Learning
di: Peng, Zhiyuan, et al.
Pubblicazione: (2024)
di: Peng, Zhiyuan, et al.
Pubblicazione: (2024)
AsyncVLA: Asynchronous Flow Matching for Vision-Language-Action Models
di: Jiang, Yuhua, et al.
Pubblicazione: (2025)
di: Jiang, Yuhua, et al.
Pubblicazione: (2025)
Pretrain Value, Not Reward: Decoupled Value Policy Optimization
di: Huang, Chenghua, et al.
Pubblicazione: (2025)
di: Huang, Chenghua, et al.
Pubblicazione: (2025)
Accordion-Thinking: Self-Regulated Step Summaries for Efficient and Readable LLM Reasoning
di: Yang, Zhicheng, et al.
Pubblicazione: (2026)
di: Yang, Zhicheng, et al.
Pubblicazione: (2026)
Toward Closed-loop Molecular Discovery via Language Model, Property Alignment and Strategic Search
di: Ji, Junkai, et al.
Pubblicazione: (2025)
di: Ji, Junkai, et al.
Pubblicazione: (2025)
PULSE-ICU: A Pretrained Unified Long-Sequence Encoder for Multi-task Prediction in Intensive Care Units
di: Jang, Sejeong, et al.
Pubblicazione: (2025)
di: Jang, Sejeong, et al.
Pubblicazione: (2025)
SeqNAS: Neural Architecture Search for Event Sequence Classification
di: Udovichenko, Igor, et al.
Pubblicazione: (2024)
di: Udovichenko, Igor, et al.
Pubblicazione: (2024)
Local Entropy Search over Descent Sequences for Bayesian Optimization
di: Stenger, David, et al.
Pubblicazione: (2025)
di: Stenger, David, et al.
Pubblicazione: (2025)
ORPR: An OR-Guided Pretrain-then-Reinforce Learning Model for Inventory Management
di: Zhao, Lingjie, et al.
Pubblicazione: (2025)
di: Zhao, Lingjie, et al.
Pubblicazione: (2025)
ParaDySe: A Parallel-Strategy Switching Framework for Dynamic Sequence Lengths in Transformer
di: Ou, Zhixin, et al.
Pubblicazione: (2025)
di: Ou, Zhixin, et al.
Pubblicazione: (2025)
Depth-Breadth Synergy in RLVR: Unlocking LLM Reasoning Gains with Adaptive Exploration
di: Yang, Zhicheng, et al.
Pubblicazione: (2025)
di: Yang, Zhicheng, et al.
Pubblicazione: (2025)
Learning Submodular Sequencing from Samples
di: Yuan, Jing, et al.
Pubblicazione: (2024)
di: Yuan, Jing, et al.
Pubblicazione: (2024)
RosettaSearch: Multi-Objective Inference-Time Search for Protein Sequence Design
di: Kshirsagar, Meghana, et al.
Pubblicazione: (2026)
di: Kshirsagar, Meghana, et al.
Pubblicazione: (2026)
DiscDiff: Latent Diffusion Model for DNA Sequence Generation
di: Li, Zehui, et al.
Pubblicazione: (2024)
di: Li, Zehui, et al.
Pubblicazione: (2024)
Extending Pretrained 10-Second ECG Foundation Models to Longer Horizons
di: Tang, Wei, et al.
Pubblicazione: (2026)
di: Tang, Wei, et al.
Pubblicazione: (2026)
On the Emergence of Cross-Task Linearity in the Pretraining-Finetuning Paradigm
di: Zhou, Zhanpeng, et al.
Pubblicazione: (2024)
di: Zhou, Zhanpeng, et al.
Pubblicazione: (2024)
Pretrained Generative Language Models as General Learning Frameworks for Sequence-Based Tasks
di: Fauber, Ben
Pubblicazione: (2024)
di: Fauber, Ben
Pubblicazione: (2024)
Lost in Serialization: Invariance and Generalization of LLM Graph Reasoners
di: Herbst, Daniel, et al.
Pubblicazione: (2025)
di: Herbst, Daniel, et al.
Pubblicazione: (2025)
Soft Policy Optimization: Online Off-Policy RL for Sequence Models
di: Cohen, Taco, et al.
Pubblicazione: (2025)
di: Cohen, Taco, et al.
Pubblicazione: (2025)
OpenECG: Benchmarking ECG Foundation Models with Public 1.2 Million Records
di: Wan, Zhijiang, et al.
Pubblicazione: (2025)
di: Wan, Zhijiang, et al.
Pubblicazione: (2025)
LPPG-RL: Lexicographically Projected Policy Gradient Reinforcement Learning with Subproblem Exploration
di: Qiu, Ruiyu, et al.
Pubblicazione: (2025)
di: Qiu, Ruiyu, et al.
Pubblicazione: (2025)
Risk-Sensitive RL for Alleviating Exploration Dilemmas in Large Language Models
di: Jiang, Yuhua, et al.
Pubblicazione: (2025)
di: Jiang, Yuhua, et al.
Pubblicazione: (2025)
Prune-OPD: Efficient and Reliable On-Policy Distillation for Long-Horizon Reasoning
di: Yang, Zhicheng, et al.
Pubblicazione: (2026)
di: Yang, Zhicheng, et al.
Pubblicazione: (2026)
Bridging Sequence and Graph Structure for Epigenetic Age Prediction
di: Li, Yao, et al.
Pubblicazione: (2026)
di: Li, Yao, et al.
Pubblicazione: (2026)
HeterCSI: Channel-Adaptive Heterogeneous CSI Pretraining Framework for Generalized Wireless Foundation Models
di: Zhang, Chenyu, et al.
Pubblicazione: (2026)
di: Zhang, Chenyu, et al.
Pubblicazione: (2026)
Uni-Mol2: Exploring Molecular Pretraining Model at Scale
di: Ji, Xiaohong, et al.
Pubblicazione: (2024)
di: Ji, Xiaohong, et al.
Pubblicazione: (2024)
ABS: Enforcing Constraint Satisfaction On Generated Sequences Via Automata-Guided Beam Search
di: Collura, Vincenzo, et al.
Pubblicazione: (2025)
di: Collura, Vincenzo, et al.
Pubblicazione: (2025)
A Scalable Pretraining Framework for Link Prediction with Efficient Adaptation
di: Song, Yu, et al.
Pubblicazione: (2025)
di: Song, Yu, et al.
Pubblicazione: (2025)
How Private Are DNA Embeddings? Inverting Foundation Model Representations of Genomic Sequences
di: Ouaari, Sofiane, et al.
Pubblicazione: (2026)
di: Ouaari, Sofiane, et al.
Pubblicazione: (2026)
Documenti analoghi
-
A Comprehensive Benchmark for Electrocardiogram Time-Series
di: Tang, Zhijiang, et al.
Pubblicazione: (2025) -
Towards Universal Gene Regulatory Network Inference: Unlocking Generalizable Regulatory Knowledge in Single-cell Foundation Models
di: Qi, Jiaxin, et al.
Pubblicazione: (2026) -
Gene Incremental Learning for Single-Cell Transcriptomics
di: Qi, Jiaxin, et al.
Pubblicazione: (2025) -
Graph Neural Networks as a Substitute for Transformers in Single-Cell Transcriptomics
di: Qi, Jiaxin, et al.
Pubblicazione: (2025) -
Spatial Transcriptomics as Images for Large-Scale Pretraining
di: Zhu, Yishun, et al.
Pubblicazione: (2026)