BigBang-Proton Technical Report: Next-Word-Prediction is Scientific Multitask Learner
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wu, Hengkui, Liu, Liujiang, He, Jihua, Wang, Qihao, Zhao, Keke, Hu, Shuyang, Fu, Renle, Liang, Dahao, Zeng, Lingyu, Liu, Bruce, Liu, Yuan, Zhan, Jin, Niu, Jiaqiang, Jia, Xinglong, Hu, Yaqin, Ji, Wenjun, Chi, Panpan, Chen, Ken, Wu, Hengyuan, Xin, Yingsi, Zhu, Yongfeng, Wang, Yuexin, Ruan, Manqi, Bian, Ningtao, Wu, Xiaohua, Xu, Weipeng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CulinaryCut-VLAP: A Vision-Language-Action-Physics Framework for Food Cutting via a Force-Aware Material Point Method
par: Koh, Hyunseo, et autres
Publié: (2026)
par: Koh, Hyunseo, et autres
Publié: (2026)
Agentic Discovery of Neural Architectures: AIRA-Compose and AIRA-Design
par: Pepe, Alberto, et autres
Publié: (2026)
par: Pepe, Alberto, et autres
Publié: (2026)
SafeAnchor: Preventing Cumulative Safety Erosion in Continual Domain Adaptation of Large Language Models
par: Guo, Dongxin, et autres
Publié: (2026)
par: Guo, Dongxin, et autres
Publié: (2026)
Evaluating Model-Agnostic Meta-Learning on MetaWorld ML10 Benchmark: Fast Adaptation in Robotic Manipulation Tasks
par: Atamuradov, Sanjar
Publié: (2025)
par: Atamuradov, Sanjar
Publié: (2025)
NeuroState-Bench: A Human-Calibrated Benchmark for Commitment Integrity in LLM Agent Profiles
par: Jia, Xiao
Publié: (2026)
par: Jia, Xiao
Publié: (2026)
Emergence of Goal-Directed Behaviors via Active Inference with Self-Prior
par: Kim, Dongmin, et autres
Publié: (2025)
par: Kim, Dongmin, et autres
Publié: (2025)
BitSkip: An Empirical Analysis of Quantization and Early Exit Composition in Transformers
par: Bhuvaneswaran, Ramshankar, et autres
Publié: (2025)
par: Bhuvaneswaran, Ramshankar, et autres
Publié: (2025)
Thinking Machines: Mathematical Reasoning in the Age of LLMs
par: Asperti, Andrea, et autres
Publié: (2025)
par: Asperti, Andrea, et autres
Publié: (2025)
AI Agents: Evolution, Architecture, and Real-World Applications
par: Krishnan, Naveen
Publié: (2025)
par: Krishnan, Naveen
Publié: (2025)
Constitution or Collapse? Exploring Constitutional AI with Llama 3-8B
par: Zhang, Xue
Publié: (2025)
par: Zhang, Xue
Publié: (2025)
Adaptive Minds: Empowering Agents with LoRA-as-Tools
par: Shekar, Pavan C, et autres
Publié: (2025)
par: Shekar, Pavan C, et autres
Publié: (2025)
XAutoLM: Efficient Fine-Tuning of Language Models via Meta-Learning and AutoML
par: Estevanell-Valladares, Ernesto L., et autres
Publié: (2025)
par: Estevanell-Valladares, Ernesto L., et autres
Publié: (2025)
FT-NCFM: An Influence-Aware Data Distillation Framework for Efficient VLA Models
par: Chen, Kewei, et autres
Publié: (2025)
par: Chen, Kewei, et autres
Publié: (2025)
ATAAT: Adaptive Threat-Aware Adversarial Tuning Framework against Backdoor Attacks on Vision-Language-Action Models
par: Chen, Kewei, et autres
Publié: (2026)
par: Chen, Kewei, et autres
Publié: (2026)
Can Large Language Models Implement Agent-Based Models? An ODD-based Replication Study
par: Fachada, Nuno, et autres
Publié: (2026)
par: Fachada, Nuno, et autres
Publié: (2026)
Training a Student Expert via Semi-Supervised Foundation Model Distillation
par: Taghavi, Pardis, et autres
Publié: (2026)
par: Taghavi, Pardis, et autres
Publié: (2026)
STRIDE: A Self-Reflective Agent Framework for Reliable Automatic Equation Discovery
par: Su, Jiarui, et autres
Publié: (2026)
par: Su, Jiarui, et autres
Publié: (2026)
Approaches to Semantic Textual Similarity in Slovak Language: From Algorithms to Transformers
par: Radosky, Lukas, et autres
Publié: (2026)
par: Radosky, Lukas, et autres
Publié: (2026)
Solving Zebra Puzzles Using Constraint-Guided Multi-Agent Systems
par: Berman, Shmuel, et autres
Publié: (2024)
par: Berman, Shmuel, et autres
Publié: (2024)
How much do LLMs learn from negative examples?
par: Hamdan, Shadi, et autres
Publié: (2025)
par: Hamdan, Shadi, et autres
Publié: (2025)
Communicative Agents for Slideshow Storytelling Video Generation based on LLMs
par: Fan, Jingxing, et autres
Publié: (2025)
par: Fan, Jingxing, et autres
Publié: (2025)
When Does Content-Based Routing Work? Representation Requirements for Selective Attention in Hybrid Sequence Models
par: Basu, Abhinaba
Publié: (2026)
par: Basu, Abhinaba
Publié: (2026)
An Improved Adaptive PID Optimizer with Enhanced Convergence and Stability for Deep Learning
par: Saini, Saurabh, et autres
Publié: (2026)
par: Saini, Saurabh, et autres
Publié: (2026)
From Noise to Diversity: Random Embedding Injection in LLM Reasoning
par: Kim, Heejun, et autres
Publié: (2026)
par: Kim, Heejun, et autres
Publié: (2026)
MAcPNN: Mutual Assisted Learning on Data Streams with Temporal Dependence
par: Giannini, Federico, et autres
Publié: (2026)
par: Giannini, Federico, et autres
Publié: (2026)
NOTAI.AI: Explainable Detection of Machine-Generated Text via Curvature and Feature Attribution
par: Breneur, Oleksandr Marchenko, et autres
Publié: (2026)
par: Breneur, Oleksandr Marchenko, et autres
Publié: (2026)
Rethinking the Multilingual Reasoning Gap with Layer Swap
par: Lasbordes, Maxence, et autres
Publié: (2026)
par: Lasbordes, Maxence, et autres
Publié: (2026)
Territory Paint Wars: Diagnosing and Mitigating Failure Modes in Competitive Multi-Agent PPO
par: Singh, Diyansha
Publié: (2026)
par: Singh, Diyansha
Publié: (2026)
Scalpel-SAM: A Semi-Supervised Paradigm for Adapting SAM to Infrared Small Object Detection
par: Liu, Zihan, et autres
Publié: (2025)
par: Liu, Zihan, et autres
Publié: (2025)
Intersymbolic AI: Interlinking Symbolic AI and Subsymbolic AI
par: Platzer, André
Publié: (2024)
par: Platzer, André
Publié: (2024)
Harnessing non-adversarial robustness in large language models
par: Zhou, Qinghua, et autres
Publié: (2026)
par: Zhou, Qinghua, et autres
Publié: (2026)
Just In Time Transformers
par: Benali, Ahmed Ala Eddine, et autres
Publié: (2024)
par: Benali, Ahmed Ala Eddine, et autres
Publié: (2024)
Flex: End-to-End Text-Instructed Visual Navigation from Foundation Model Features
par: Chahine, Makram, et autres
Publié: (2024)
par: Chahine, Makram, et autres
Publié: (2024)
Structured Basis Function Networks: Loss-Centric Multi-Hypothesis Ensembles with Controllable Diversity
par: Dominguez, Alejandro Rodriguez, et autres
Publié: (2025)
par: Dominguez, Alejandro Rodriguez, et autres
Publié: (2025)
$δ$-STEAL: LLM Stealing Attack with Local Differential Privacy
par: Dang, Kieu, et autres
Publié: (2025)
par: Dang, Kieu, et autres
Publié: (2025)
ExpReS-VLA: Specializing Vision-Language-Action Models Through Experience Replay and Retrieval
par: Syed, Shahram Najam, et autres
Publié: (2025)
par: Syed, Shahram Najam, et autres
Publié: (2025)
LLM-Guided Task- and Affordance-Level Exploration in Reinforcement Learning
par: Luijkx, Jelle, et autres
Publié: (2025)
par: Luijkx, Jelle, et autres
Publié: (2025)
Vis-CoT: A Human-in-the-Loop Framework for Interactive Visualization and Intervention in LLM Chain-of-Thought Reasoning
par: Pather, Kaviraj, et autres
Publié: (2025)
par: Pather, Kaviraj, et autres
Publié: (2025)
Tricks and Plug-ins for Gradient Boosting in Image Classification
par: Fang, Biyi, et autres
Publié: (2025)
par: Fang, Biyi, et autres
Publié: (2025)
Cooperative Patrol Routing: Optimizing Urban Crime Surveillance through Multi-Agent Reinforcement Learning
par: Palma-Borda, Juan, et autres
Publié: (2025)
par: Palma-Borda, Juan, et autres
Publié: (2025)
Documents similaires
-
CulinaryCut-VLAP: A Vision-Language-Action-Physics Framework for Food Cutting via a Force-Aware Material Point Method
par: Koh, Hyunseo, et autres
Publié: (2026) -
Agentic Discovery of Neural Architectures: AIRA-Compose and AIRA-Design
par: Pepe, Alberto, et autres
Publié: (2026) -
SafeAnchor: Preventing Cumulative Safety Erosion in Continual Domain Adaptation of Large Language Models
par: Guo, Dongxin, et autres
Publié: (2026) -
Evaluating Model-Agnostic Meta-Learning on MetaWorld ML10 Benchmark: Fast Adaptation in Robotic Manipulation Tasks
par: Atamuradov, Sanjar
Publié: (2025) -
NeuroState-Bench: A Human-Calibrated Benchmark for Commitment Integrity in LLM Agent Profiles
par: Jia, Xiao
Publié: (2026)