Guardado en:
| Autores principales: | Jiang, Jingzhou, Tang, Yixuan, Yang, Yi, Tam, Kar Yan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2604.17344 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Layer-wise Representation Dynamics: An Empirical Investigation Across Embedders and Base LLMs
por: Jiang, Jingzhou, et al.
Publicado: (2026)
por: Jiang, Jingzhou, et al.
Publicado: (2026)
Evaluating and Aligning Human Economic Risk Preferences in LLMs
por: Liu, Jiaxin, et al.
Publicado: (2025)
por: Liu, Jiaxin, et al.
Publicado: (2025)
FLARE: Faithful Logic-Aided Reasoning and Exploration
por: Arakelyan, Erik, et al.
Publicado: (2024)
por: Arakelyan, Erik, et al.
Publicado: (2024)
Merging by Matching Models in Task Parameter Subspaces
por: Tam, Derek, et al.
Publicado: (2023)
por: Tam, Derek, et al.
Publicado: (2023)
TAGCOS: Task-agnostic Gradient Clustered Coreset Selection for Instruction Tuning Data
por: Zhang, Jipeng, et al.
Publicado: (2024)
por: Zhang, Jipeng, et al.
Publicado: (2024)
Task Vector Geometry Underlies Dual Modes of Task Inference in Transformers
por: Yan, Hao, et al.
Publicado: (2026)
por: Yan, Hao, et al.
Publicado: (2026)
Discovering Low-rank Subspaces for Language-agnostic Multilingual Representations
por: Xie, Zhihui, et al.
Publicado: (2024)
por: Xie, Zhihui, et al.
Publicado: (2024)
Obliviate: Neutralizing Task-agnostic Backdoors within the Parameter-efficient Fine-tuning Paradigm
por: Kim, Jaehan, et al.
Publicado: (2024)
por: Kim, Jaehan, et al.
Publicado: (2024)
Flexi-LoRA with Input-Adaptive Ranks: Efficient Finetuning for Speech and Reasoning Tasks
por: Li, Zongqian, et al.
Publicado: (2026)
por: Li, Zongqian, et al.
Publicado: (2026)
Layer-Aware Task Arithmetic: Disentangling Task-Specific and Instruction-Following Knowledge
por: Chen, Yan-Lun, et al.
Publicado: (2025)
por: Chen, Yan-Lun, et al.
Publicado: (2025)
GLaPE: Gold Label-agnostic Prompt Evaluation and Optimization for Large Language Model
por: Zhang, Xuanchang, et al.
Publicado: (2024)
por: Zhang, Xuanchang, et al.
Publicado: (2024)
Optimal synthesis embeddings
por: Santana, Roberto, et al.
Publicado: (2024)
por: Santana, Roberto, et al.
Publicado: (2024)
MAPX: An explainable model-agnostic framework for the detection of false information on social media networks
por: Condran, Sarah, et al.
Publicado: (2024)
por: Condran, Sarah, et al.
Publicado: (2024)
Dynamic Experts Search: Enhancing Reasoning in Mixture-of-Experts LLMs at Test Time
por: Han, Yixuan, et al.
Publicado: (2025)
por: Han, Yixuan, et al.
Publicado: (2025)
Do LLMs Know about Hallucination? An Empirical Investigation of LLM's Hidden States
por: Duan, Hanyu, et al.
Publicado: (2024)
por: Duan, Hanyu, et al.
Publicado: (2024)
Beyond Surface Similarity: Detecting Subtle Semantic Shifts in Financial Narratives
por: Liu, Jiaxin, et al.
Publicado: (2024)
por: Liu, Jiaxin, et al.
Publicado: (2024)
ROSD: Reflective On-Policy Self-Distillation for Language Model Reasoning across Domains
por: Zhao, Ziqi, et al.
Publicado: (2026)
por: Zhao, Ziqi, et al.
Publicado: (2026)
A comparative analysis of embedding models for patent similarity
por: Ascione, Grazia Sveva, et al.
Publicado: (2024)
por: Ascione, Grazia Sveva, et al.
Publicado: (2024)
Frustratingly Easy Task-aware Pruning for Large Language Models
por: Tian, Yuanhe, et al.
Publicado: (2025)
por: Tian, Yuanhe, et al.
Publicado: (2025)
Make Some Noise: Unlocking Language Model Parallel Inference Capability through Noisy Training
por: Wang, Yixuan, et al.
Publicado: (2024)
por: Wang, Yixuan, et al.
Publicado: (2024)
Machine-assisted writing evaluation: Exploring pre-trained language models in analyzing argumentative moves
por: Qin, Wenjuan, et al.
Publicado: (2025)
por: Qin, Wenjuan, et al.
Publicado: (2025)
Investigating the Pre-Training Dynamics of In-Context Learning: Task Recognition vs. Task Learning
por: Wang, Xiaolei, et al.
Publicado: (2024)
por: Wang, Xiaolei, et al.
Publicado: (2024)
Task Structure Reverses Layerwise State Encoding in Sequence Models
por: Jiang, Yuhang
Publicado: (2026)
por: Jiang, Yuhang
Publicado: (2026)
Exploring Task Performance with Interpretable Models via Sparse Auto-Encoders
por: Wang, Shun, et al.
Publicado: (2025)
por: Wang, Shun, et al.
Publicado: (2025)
DeepReview: Improving LLM-based Paper Review with Human-like Deep Thinking Process
por: Zhu, Minjun, et al.
Publicado: (2025)
por: Zhu, Minjun, et al.
Publicado: (2025)
Till the Layers Collapse: Compressing a Deep Neural Network through the Lenses of Batch Normalization Layers
por: Liao, Zhu, et al.
Publicado: (2024)
por: Liao, Zhu, et al.
Publicado: (2024)
EvasionBench: A Large-Scale Benchmark for Detecting Managerial Evasion in Earnings Call Q&A
por: Ma, Shijian, et al.
Publicado: (2026)
por: Ma, Shijian, et al.
Publicado: (2026)
ReAGent: A Model-agnostic Feature Attribution Method for Generative Language Models
por: Zhao, Zhixue, et al.
Publicado: (2024)
por: Zhao, Zhixue, et al.
Publicado: (2024)
†DAGGER: Distractor-Aware Graph Generation for Executable Reasoning in Math Problems
por: Nazi, Zabir Al, et al.
Publicado: (2026)
por: Nazi, Zabir Al, et al.
Publicado: (2026)
Isolating authorship from content with semantic embeddings and contrastive learning
por: Huertas-Tato, Javier, et al.
Publicado: (2024)
por: Huertas-Tato, Javier, et al.
Publicado: (2024)
ECG-LLM -- training and evaluation of domain-specific large language models for electrocardiography
por: Ahrens, Lara, et al.
Publicado: (2025)
por: Ahrens, Lara, et al.
Publicado: (2025)
HaloScope: Harnessing Unlabeled LLM Generations for Hallucination Detection
por: Du, Xuefeng, et al.
Publicado: (2024)
por: Du, Xuefeng, et al.
Publicado: (2024)
Propagation and Pitfalls: Reasoning-based Assessment of Knowledge Editing through Counterfactual Tasks
por: Hua, Wenyue, et al.
Publicado: (2024)
por: Hua, Wenyue, et al.
Publicado: (2024)
When 2D Tasks Meet 1D Serialization: On Serialization Friction in Structured Tasks
por: Lo, Chung-Hsiang, et al.
Publicado: (2026)
por: Lo, Chung-Hsiang, et al.
Publicado: (2026)
Dissecting embedding method: learning higher-order structures from data
por: Tupikina, Liubov, et al.
Publicado: (2024)
por: Tupikina, Liubov, et al.
Publicado: (2024)
Learning distributed representations with efficient SoftMax normalization
por: Dall'Amico, Lorenzo, et al.
Publicado: (2023)
por: Dall'Amico, Lorenzo, et al.
Publicado: (2023)
LLM-Measure: Generating Valid, Consistent, and Reproducible Text-Based Measures for Social Science Research
por: Yang, Yi, et al.
Publicado: (2024)
por: Yang, Yi, et al.
Publicado: (2024)
Empowering Federated Learning for Massive Models with NVIDIA FLARE
por: Roth, Holger R., et al.
Publicado: (2024)
por: Roth, Holger R., et al.
Publicado: (2024)
Byte-token Enhanced Language Models for Temporal Point Processes Analysis
por: Kong, Quyu, et al.
Publicado: (2025)
por: Kong, Quyu, et al.
Publicado: (2025)
Cropping outperforms dropout as an augmentation strategy for self-supervised training of text embeddings
por: González-Márquez, Rita, et al.
Publicado: (2025)
por: González-Márquez, Rita, et al.
Publicado: (2025)
Ejemplares similares
-
Layer-wise Representation Dynamics: An Empirical Investigation Across Embedders and Base LLMs
por: Jiang, Jingzhou, et al.
Publicado: (2026) -
Evaluating and Aligning Human Economic Risk Preferences in LLMs
por: Liu, Jiaxin, et al.
Publicado: (2025) -
FLARE: Faithful Logic-Aided Reasoning and Exploration
por: Arakelyan, Erik, et al.
Publicado: (2024) -
Merging by Matching Models in Task Parameter Subspaces
por: Tam, Derek, et al.
Publicado: (2023) -
TAGCOS: Task-agnostic Gradient Clustered Coreset Selection for Instruction Tuning Data
por: Zhang, Jipeng, et al.
Publicado: (2024)