Network of Theseus (like the ship)
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Subramaniam, Vighnesh, Conwell, Colin, Katz, Boris, Barbu, Andrei, Cheung, Brian |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Training the Untrainable: Introducing Inductive Bias via Representational Alignment
par: Subramaniam, Vighnesh, et autres
Publié: (2024)
par: Subramaniam, Vighnesh, et autres
Publié: (2024)
Revealing Vision-Language Integration in the Brain with Multimodal Networks
par: Subramaniam, Vighnesh, et autres
Publié: (2024)
par: Subramaniam, Vighnesh, et autres
Publié: (2024)
Multiagent Finetuning: Self Improvement with Diverse Reasoning Chains
par: Subramaniam, Vighnesh, et autres
Publié: (2025)
par: Subramaniam, Vighnesh, et autres
Publié: (2025)
Fine-Tuning a Time Series Foundation Model with Wasserstein Loss
par: Chernov, Andrei
Publié: (2024)
par: Chernov, Andrei
Publié: (2024)
Backward Lens: Projecting Language Model Gradients into the Vocabulary Space
par: Katz, Shahar, et autres
Publié: (2024)
par: Katz, Shahar, et autres
Publié: (2024)
Post-training makes large language models less human-like
par: Binz, Marcel, et autres
Publié: (2026)
par: Binz, Marcel, et autres
Publié: (2026)
Supernova: Achieving More with Less in Transformer Architectures
par: Tanase, Andrei-Valentin, et autres
Publié: (2025)
par: Tanase, Andrei-Valentin, et autres
Publié: (2025)
SupraTok: Cross-Boundary Tokenization for Enhanced Language Model Performance
par: Tănase, Andrei-Valentin, et autres
Publié: (2025)
par: Tănase, Andrei-Valentin, et autres
Publié: (2025)
Bridging the Semantic Gap for Categorical Data Clustering via Large Language Models
par: Yang, Zihua, et autres
Publié: (2026)
par: Yang, Zihua, et autres
Publié: (2026)
HAL: Inducing Human-likeness in LLMs with Alignment
par: Hasan, Masum, et autres
Publié: (2026)
par: Hasan, Masum, et autres
Publié: (2026)
Parameter Efficient Multimodal Instruction Tuning for Romanian Vision Language Models
par: Dima, George-Andrei, et autres
Publié: (2025)
par: Dima, George-Andrei, et autres
Publié: (2025)
Mechanistic Interpretability of GPT-like Models on Summarization Tasks
par: Mishra, Anurag
Publié: (2025)
par: Mishra, Anurag
Publié: (2025)
Fairness Aware Reward Optimization
par: Choi, Ching Lam, et autres
Publié: (2026)
par: Choi, Ching Lam, et autres
Publié: (2026)
Ensemble Distillation for Unsupervised Constituency Parsing
par: Shayegh, Behzad, et autres
Publié: (2023)
par: Shayegh, Behzad, et autres
Publié: (2023)
Language models show human-like content effects on reasoning tasks
par: Dasgupta, Ishita, et autres
Publié: (2022)
par: Dasgupta, Ishita, et autres
Publié: (2022)
Beyond Labels: Aligning Large Language Models with Human-like Reasoning
par: Kabir, Muhammad Rafsan, et autres
Publié: (2024)
par: Kabir, Muhammad Rafsan, et autres
Publié: (2024)
UniMaia: Steering Chess Policies with Language for Human-like Play
par: Siu, Sherman, et autres
Publié: (2026)
par: Siu, Sherman, et autres
Publié: (2026)
Task-Informed Anti-Curriculum by Masking Improves Downstream Performance on Text
par: Jarca, Andrei, et autres
Publié: (2025)
par: Jarca, Andrei, et autres
Publié: (2025)
Building Large-Scale English-Romanian Literary Translation Resources with Open Models
par: Nadas, Mihai, et autres
Publié: (2025)
par: Nadas, Mihai, et autres
Publié: (2025)
SciBench: Evaluating College-Level Scientific Problem-Solving Abilities of Large Language Models
par: Wang, Xiaoxuan, et autres
Publié: (2023)
par: Wang, Xiaoxuan, et autres
Publié: (2023)
Star Attention: Efficient LLM Inference over Long Sequences
par: Acharya, Shantanu, et autres
Publié: (2024)
par: Acharya, Shantanu, et autres
Publié: (2024)
ComPEFT: Compression for Communicating Parameter Efficient Updates via Sparsification and Quantization
par: Yadav, Prateek, et autres
Publié: (2023)
par: Yadav, Prateek, et autres
Publié: (2023)
Population Transformer: Learning Population-level Representations of Neural Activity
par: Chau, Geeling, et autres
Publié: (2024)
par: Chau, Geeling, et autres
Publié: (2024)
Position: The Most Expensive Part of an LLM should be its Training Data
par: Kandpal, Nikhil, et autres
Publié: (2025)
par: Kandpal, Nikhil, et autres
Publié: (2025)
Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training
par: Feng, Xidong, et autres
Publié: (2023)
par: Feng, Xidong, et autres
Publié: (2023)
Error Diversity Matters: An Error-Resistant Ensemble Method for Unsupervised Dependency Parsing
par: Shayegh, Behzad, et autres
Publié: (2024)
par: Shayegh, Behzad, et autres
Publié: (2024)
Online Speculative Decoding
par: Liu, Xiaoxuan, et autres
Publié: (2023)
par: Liu, Xiaoxuan, et autres
Publié: (2023)
MENLO: From Preferences to Proficiency -- Evaluating and Modeling Native-like Quality Across 47 Languages
par: Whitehouse, Chenxi, et autres
Publié: (2025)
par: Whitehouse, Chenxi, et autres
Publié: (2025)
Reduction of Supervision for Biomedical Knowledge Discovery
par: Theodoropoulos, Christos, et autres
Publié: (2025)
par: Theodoropoulos, Christos, et autres
Publié: (2025)
Blockwise Advantage Estimation for Multi-Objective RL with Verifiable Rewards
par: Pavlenko, Kirill, et autres
Publié: (2026)
par: Pavlenko, Kirill, et autres
Publié: (2026)
Contextually Entangled Gradient Mapping for Optimized LLM Comprehension
par: Sisate, Colin, et autres
Publié: (2025)
par: Sisate, Colin, et autres
Publié: (2025)
Do Robot Snakes Dream like Electric Sheep? Investigating the Effects of Architectural Inductive Biases on Hallucination
par: Huang, Jerry, et autres
Publié: (2024)
par: Huang, Jerry, et autres
Publié: (2024)
Exploring Major Transitions in the Evolution of Biological Cognition With Artificial Neural Networks
par: Voudouris, Konstantinos, et autres
Publié: (2025)
par: Voudouris, Konstantinos, et autres
Publié: (2025)
Evolutionary Contrastive Distillation for Language Model Alignment
par: Katz-Samuels, Julian, et autres
Publié: (2024)
par: Katz-Samuels, Julian, et autres
Publié: (2024)
C-3PO: Compact Plug-and-Play Proxy Optimization to Achieve Human-like Retrieval-Augmented Generation
par: Chen, Guoxin, et autres
Publié: (2025)
par: Chen, Guoxin, et autres
Publié: (2025)
Scalable Bayesian Low-Rank Adaptation of Large Language Models via Stochastic Variational Subspace Inference
par: Samplawski, Colin, et autres
Publié: (2025)
par: Samplawski, Colin, et autres
Publié: (2025)
Unlocking Continual Learning Abilities in Language Models
par: Du, Wenyu, et autres
Publié: (2024)
par: Du, Wenyu, et autres
Publié: (2024)
Revisiting the Test-Time Scaling of o1-like Models: Do they Truly Possess Test-Time Scaling Capabilities?
par: Zeng, Zhiyuan, et autres
Publié: (2025)
par: Zeng, Zhiyuan, et autres
Publié: (2025)
Merging LoRAs like Playing LEGO: Pushing the Modularity of LoRA to Extremes Through Rank-Wise Clustering
par: Zhao, Ziyu, et autres
Publié: (2024)
par: Zhao, Ziyu, et autres
Publié: (2024)
A Nurse is Blue and Elephant is Rugby: Cross Domain Alignment in Large Language Models Reveal Human-like Patterns
par: Yehudai, Asaf, et autres
Publié: (2024)
par: Yehudai, Asaf, et autres
Publié: (2024)
Documents similaires
-
Training the Untrainable: Introducing Inductive Bias via Representational Alignment
par: Subramaniam, Vighnesh, et autres
Publié: (2024) -
Revealing Vision-Language Integration in the Brain with Multimodal Networks
par: Subramaniam, Vighnesh, et autres
Publié: (2024) -
Multiagent Finetuning: Self Improvement with Diverse Reasoning Chains
par: Subramaniam, Vighnesh, et autres
Publié: (2025) -
Fine-Tuning a Time Series Foundation Model with Wasserstein Loss
par: Chernov, Andrei
Publié: (2024) -
Backward Lens: Projecting Language Model Gradients into the Vocabulary Space
par: Katz, Shahar, et autres
Publié: (2024)