DiLA: Enhancing LLM Tool Learning with Differential Logic Layer
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Yu, Zhen, Hui-Ling, Pei, Zehua, Lian, Yingzhao, Yin, Lihao, Yuan, Mingxuan, Yu, Bei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
BetterV: Controlled Verilog Generation with Discriminative Guidance
di: Pei, Zehua, et al.
Pubblicazione: (2024)
di: Pei, Zehua, et al.
Pubblicazione: (2024)
From Pruning to Grafting: Dynamic Knowledge Redistribution via Learnable Layer Fusion
di: Pei, Zehua, et al.
Pubblicazione: (2024)
di: Pei, Zehua, et al.
Pubblicazione: (2024)
Behavioral Fingerprinting of Large Language Models
di: Pei, Zehua, et al.
Pubblicazione: (2025)
di: Pei, Zehua, et al.
Pubblicazione: (2025)
What Matters For Safety Alignment?
di: Li, Xing, et al.
Pubblicazione: (2026)
di: Li, Xing, et al.
Pubblicazione: (2026)
Scaling Up, Speeding Up: A Benchmark of Speculative Decoding for Efficient LLM Test-Time Scaling
di: Sun, Shengyin, et al.
Pubblicazione: (2025)
di: Sun, Shengyin, et al.
Pubblicazione: (2025)
FocuSFT: Bilevel Optimization for Dilution-Aware Long-Context Fine-Tuning
di: Pei, Zehua, et al.
Pubblicazione: (2026)
di: Pei, Zehua, et al.
Pubblicazione: (2026)
Verilog-Evolve: Feedback-Driven and Skill-Evolving Verilog Generation
di: Pei, Zehua, et al.
Pubblicazione: (2026)
di: Pei, Zehua, et al.
Pubblicazione: (2026)
MemDLM: Memory-Enhanced DLM Training
di: Pei, Zehua, et al.
Pubblicazione: (2026)
di: Pei, Zehua, et al.
Pubblicazione: (2026)
SCOPE: Prompt Evolution for Enhancing Agent Effectiveness
di: Pei, Zehua, et al.
Pubblicazione: (2025)
di: Pei, Zehua, et al.
Pubblicazione: (2025)
MOSS: Efficient and Accurate FP8 LLM Training with Microscaling and Automatic Scaling
di: Zhang, Yu, et al.
Pubblicazione: (2025)
di: Zhang, Yu, et al.
Pubblicazione: (2025)
DiLA: Disentangled Latent Action World Models
di: Zhang, Tianqiu, et al.
Pubblicazione: (2026)
di: Zhang, Tianqiu, et al.
Pubblicazione: (2026)
SVDq: 1.25-bit and 410x Key Cache Compression for LLM Attention
di: Yankun, Hong, et al.
Pubblicazione: (2025)
di: Yankun, Hong, et al.
Pubblicazione: (2025)
Analytical FFN-to-MoE Restructuring via Activation Pattern Analysis
di: Pei, Zehua, et al.
Pubblicazione: (2025)
di: Pei, Zehua, et al.
Pubblicazione: (2025)
PASER: Post-Training Data Selection for Efficient Pruned Large Language Model Recovery
di: He, Bowei, et al.
Pubblicazione: (2025)
di: He, Bowei, et al.
Pubblicazione: (2025)
KVTuner: Sensitivity-Aware Layer-Wise Mixed-Precision KV Cache Quantization for Efficient and Nearly Lossless LLM Inference
di: Li, Xing, et al.
Pubblicazione: (2025)
di: Li, Xing, et al.
Pubblicazione: (2025)
MixPE: Quantization and Hardware Co-design for Efficient LLM Inference
di: Zhang, Yu, et al.
Pubblicazione: (2024)
di: Zhang, Yu, et al.
Pubblicazione: (2024)
SwiftMem: Fast Agentic Memory via Query-aware Indexing
di: Tian, Anxin, et al.
Pubblicazione: (2026)
di: Tian, Anxin, et al.
Pubblicazione: (2026)
Beyond Speedup -- Utilizing KV Cache for Sampling and Reasoning
di: Xing, Zeyu, et al.
Pubblicazione: (2026)
di: Xing, Zeyu, et al.
Pubblicazione: (2026)
Attention-Aware GNN-based Input Defense against Multi-Turn LLM Jailbreak
di: Huang, Zixuan, et al.
Pubblicazione: (2025)
di: Huang, Zixuan, et al.
Pubblicazione: (2025)
Logical Structure as Knowledge: Enhancing LLM Reasoning via Structured Logical Knowledge Density Estimation
di: Bi, Zhen, et al.
Pubblicazione: (2025)
di: Bi, Zhen, et al.
Pubblicazione: (2025)
Preserving LLM Capabilities through Calibration Data Curation: From Analysis to Optimization
di: He, Bowei, et al.
Pubblicazione: (2025)
di: He, Bowei, et al.
Pubblicazione: (2025)
RTLRewriter: Methodologies for Large Models aided RTL Code Optimization
di: Yao, Xufeng, et al.
Pubblicazione: (2024)
di: Yao, Xufeng, et al.
Pubblicazione: (2024)
Certifying Language Model Robustness with Fuzzed Randomized Smoothing: An Efficient Defense Against Backdoor Attacks
di: He, Bowei, et al.
Pubblicazione: (2025)
di: He, Bowei, et al.
Pubblicazione: (2025)
The Graph's Apprentice: Teaching an LLM Low Level Knowledge for Circuit Quality Estimation
di: Moravej, Reza, et al.
Pubblicazione: (2024)
di: Moravej, Reza, et al.
Pubblicazione: (2024)
SelfPrompt: Autonomously Evaluating LLM Robustness via Domain-Constrained Knowledge Guidelines and Refined Adversarial Prompts
di: Pei, Aihua, et al.
Pubblicazione: (2024)
di: Pei, Aihua, et al.
Pubblicazione: (2024)
Enigmata: Scaling Logical Reasoning in Large Language Models with Synthetic Verifiable Puzzles
di: Chen, Jiangjie, et al.
Pubblicazione: (2025)
di: Chen, Jiangjie, et al.
Pubblicazione: (2025)
LLM Lies: Hallucinations are not Bugs, but Features as Adversarial Examples
di: Yao, Jia-Yu, et al.
Pubblicazione: (2023)
di: Yao, Jia-Yu, et al.
Pubblicazione: (2023)
From Biased Chatbots to Biased Agents: Examining Role Assignment Effects on LLM Agent Robustness
di: Cao, Linbo, et al.
Pubblicazione: (2026)
di: Cao, Linbo, et al.
Pubblicazione: (2026)
LoRE-Merging: Exploring Low-Rank Estimation For Large Language Model Merging
di: Liu, Zehua, et al.
Pubblicazione: (2025)
di: Liu, Zehua, et al.
Pubblicazione: (2025)
UltraLogic: Enhancing LLM Reasoning through Large-Scale Data Synthesis and Bipolar Float Reward
di: Liu, Yile, et al.
Pubblicazione: (2026)
di: Liu, Yile, et al.
Pubblicazione: (2026)
Unlocking Efficient Long-to-Short LLM Reasoning with Model Merging
di: Wu, Han, et al.
Pubblicazione: (2025)
di: Wu, Han, et al.
Pubblicazione: (2025)
PermLLM: Learnable Channel Permutation for N:M Sparse Large Language Models
di: Zou, Lancheng, et al.
Pubblicazione: (2025)
di: Zou, Lancheng, et al.
Pubblicazione: (2025)
LoopTool: Closing the Data-Training Loop for Robust LLM Tool Calls
di: Zhang, Kangning, et al.
Pubblicazione: (2025)
di: Zhang, Kangning, et al.
Pubblicazione: (2025)
TrimR: Verifier-based Training-Free Thinking Compression for Efficient Test-Time Scaling
di: Lin, Weizhe, et al.
Pubblicazione: (2025)
di: Lin, Weizhe, et al.
Pubblicazione: (2025)
Stratified GRPO: Handling Structural Heterogeneity in Reinforcement Learning of LLM Search Agents
di: Zhu, Mingkang, et al.
Pubblicazione: (2025)
di: Zhu, Mingkang, et al.
Pubblicazione: (2025)
Label Distribution Learning-Enhanced Dual-KNN for Text Classification
di: Yuan, Bo, et al.
Pubblicazione: (2025)
di: Yuan, Bo, et al.
Pubblicazione: (2025)
Incentivizing Agentic Reasoning in LLM Judges via Tool-Integrated Reinforcement Learning
di: Xu, Ran, et al.
Pubblicazione: (2025)
di: Xu, Ran, et al.
Pubblicazione: (2025)
Enhancing LLM-Based Data Annotation with Error Decomposition
di: Xu, Zhen, et al.
Pubblicazione: (2026)
di: Xu, Zhen, et al.
Pubblicazione: (2026)
Logical Phase Transitions: Understanding Collapse in LLM Logical Reasoning
di: Zhang, Xinglang, et al.
Pubblicazione: (2026)
di: Zhang, Xinglang, et al.
Pubblicazione: (2026)
Explainable LLM Unlearning Through Reasoning
di: Liao, Junfeng, et al.
Pubblicazione: (2026)
di: Liao, Junfeng, et al.
Pubblicazione: (2026)
Documenti analoghi
-
BetterV: Controlled Verilog Generation with Discriminative Guidance
di: Pei, Zehua, et al.
Pubblicazione: (2024) -
From Pruning to Grafting: Dynamic Knowledge Redistribution via Learnable Layer Fusion
di: Pei, Zehua, et al.
Pubblicazione: (2024) -
Behavioral Fingerprinting of Large Language Models
di: Pei, Zehua, et al.
Pubblicazione: (2025) -
What Matters For Safety Alignment?
di: Li, Xing, et al.
Pubblicazione: (2026) -
Scaling Up, Speeding Up: A Benchmark of Speculative Decoding for Efficient LLM Test-Time Scaling
di: Sun, Shengyin, et al.
Pubblicazione: (2025)