Editing Arbitrary Propositions in LLMs without Subject Labels
Fuente:
arXiv
Salvato in:
| Autori principali: | Feigenbaum, Itai, Arpit, Devansh, Wang, Huan, Heinecke, Shelby, Niebles, Juan Carlos, Yao, Weiran, Xiong, Caiming, Savarese, Silvio |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Causal Layering via Conditional Entropy
di: Feigenbaum, Itai, et al.
Pubblicazione: (2024)
di: Feigenbaum, Itai, et al.
Pubblicazione: (2024)
Retroformer: Retrospective Large Language Agents with Policy Gradient Optimization
di: Yao, Weiran, et al.
Pubblicazione: (2023)
di: Yao, Weiran, et al.
Pubblicazione: (2023)
Entropy-Based Block Pruning for Efficient Large Language Models
di: Yang, Liangwei, et al.
Pubblicazione: (2025)
di: Yang, Liangwei, et al.
Pubblicazione: (2025)
xRouter: Training Cost-Aware LLMs Orchestration System via Reinforcement Learning
di: Qian, Cheng, et al.
Pubblicazione: (2025)
di: Qian, Cheng, et al.
Pubblicazione: (2025)
MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models
di: Liu, Zhiwei, et al.
Pubblicazione: (2025)
di: Liu, Zhiwei, et al.
Pubblicazione: (2025)
APIGen-MT: Agentic Pipeline for Multi-Turn Data Generation via Simulated Agent-Human Interplay
di: Prabhakar, Akshara, et al.
Pubblicazione: (2025)
di: Prabhakar, Akshara, et al.
Pubblicazione: (2025)
Promptomatix: An Automatic Prompt Optimization Framework for Large Language Models
di: Murthy, Rithesh, et al.
Pubblicazione: (2025)
di: Murthy, Rithesh, et al.
Pubblicazione: (2025)
ActionStudio: A Lightweight Framework for Data and Training of Large Action Models
di: Zhang, Jianguo, et al.
Pubblicazione: (2025)
di: Zhang, Jianguo, et al.
Pubblicazione: (2025)
REX: Rapid Exploration and eXploitation for AI Agents
di: Murthy, Rithesh, et al.
Pubblicazione: (2023)
di: Murthy, Rithesh, et al.
Pubblicazione: (2023)
Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding
di: Chen, Haolin, et al.
Pubblicazione: (2024)
di: Chen, Haolin, et al.
Pubblicazione: (2024)
UserBench: An Interactive Gym Environment for User-Centric Agents
di: Qian, Cheng, et al.
Pubblicazione: (2025)
di: Qian, Cheng, et al.
Pubblicazione: (2025)
DialogStudio: Towards Richest and Most Diverse Unified Dataset Collection for Conversational AI
di: Zhang, Jianguo, et al.
Pubblicazione: (2023)
di: Zhang, Jianguo, et al.
Pubblicazione: (2023)
ToolLibGen: Scalable Automatic Tool Creation and Aggregation for LLM Reasoning
di: Yue, Murong, et al.
Pubblicazione: (2025)
di: Yue, Murong, et al.
Pubblicazione: (2025)
Enterprise Deep Research: Steerable Multi-Agent Deep Research for Enterprise Analytics
di: Prabhakar, Akshara, et al.
Pubblicazione: (2025)
di: Prabhakar, Akshara, et al.
Pubblicazione: (2025)
UserRL: Training Interactive User-Centric Agent via Reinforcement Learning
di: Qian, Cheng, et al.
Pubblicazione: (2025)
di: Qian, Cheng, et al.
Pubblicazione: (2025)
APIGen: Automated Pipeline for Generating Verifiable and Diverse Function-Calling Datasets
di: Liu, Zuxin, et al.
Pubblicazione: (2024)
di: Liu, Zuxin, et al.
Pubblicazione: (2024)
AgentOhana: Design Unified Data and Training Pipeline for Effective Agent Learning
di: Zhang, Jianguo, et al.
Pubblicazione: (2024)
di: Zhang, Jianguo, et al.
Pubblicazione: (2024)
Prompt Optimization Via Diffusion Language Models
di: Wang, Shiyu, et al.
Pubblicazione: (2026)
di: Wang, Shiyu, et al.
Pubblicazione: (2026)
LAM SIMULATOR: Advancing Data Generation for Large Action Model Training via Online Exploration and Trajectory Feedback
di: Hoang, Thai, et al.
Pubblicazione: (2025)
di: Hoang, Thai, et al.
Pubblicazione: (2025)
Reasoning Curriculum: Bootstrapping Broad LLM Reasoning from Math
di: Pang, Bo, et al.
Pubblicazione: (2025)
di: Pang, Bo, et al.
Pubblicazione: (2025)
xLAM: A Family of Large Action Models to Empower AI Agent Systems
di: Zhang, Jianguo, et al.
Pubblicazione: (2024)
di: Zhang, Jianguo, et al.
Pubblicazione: (2024)
Webscale-RL: Automated Data Pipeline for Scaling RL Data to Pretraining Levels
di: Cen, Zhepeng, et al.
Pubblicazione: (2025)
di: Cen, Zhepeng, et al.
Pubblicazione: (2025)
Diversity Empowers Intelligence: Integrating Expertise of Software Engineering Agents
di: Zhang, Kexun, et al.
Pubblicazione: (2024)
di: Zhang, Kexun, et al.
Pubblicazione: (2024)
Active Video Perception: Iterative Evidence Seeking for Agentic Long Video Understanding
di: Wang, Ziyang, et al.
Pubblicazione: (2025)
di: Wang, Ziyang, et al.
Pubblicazione: (2025)
Shared Imagination: LLMs Hallucinate Alike
di: Zhou, Yilun, et al.
Pubblicazione: (2024)
di: Zhou, Yilun, et al.
Pubblicazione: (2024)
PRACT: Optimizing Principled Reasoning and Acting of LLM Agent
di: Liu, Zhiwei, et al.
Pubblicazione: (2024)
di: Liu, Zhiwei, et al.
Pubblicazione: (2024)
INDICT: Code Generation with Internal Dialogues of Critiques for Both Security and Helpfulness
di: Le, Hung, et al.
Pubblicazione: (2024)
di: Le, Hung, et al.
Pubblicazione: (2024)
Strefer: Empowering Video LLMs with Space-Time Referring and Reasoning via Synthetic Instruction Data
di: Zhou, Honglu, et al.
Pubblicazione: (2025)
di: Zhou, Honglu, et al.
Pubblicazione: (2025)
MobileAIBench: Benchmarking LLMs and LMMs for On-Device Use Cases
di: Murthy, Rithesh, et al.
Pubblicazione: (2024)
di: Murthy, Rithesh, et al.
Pubblicazione: (2024)
Enabling High Data Throughput Reinforcement Learning on GPUs: A Domain Agnostic Framework for Data-Driven Scientific Research
di: Lan, Tian, et al.
Pubblicazione: (2024)
di: Lan, Tian, et al.
Pubblicazione: (2024)
ToolScan: A Benchmark for Characterizing Errors in Tool-Use LLMs
di: Kokane, Shirley, et al.
Pubblicazione: (2024)
di: Kokane, Shirley, et al.
Pubblicazione: (2024)
PerfCodeGen: Improving Performance of LLM Generated Code with Execution Feedback
di: Peng, Yun, et al.
Pubblicazione: (2024)
di: Peng, Yun, et al.
Pubblicazione: (2024)
AgentLite: A Lightweight Library for Building and Advancing Task-Oriented LLM Agent System
di: Liu, Zhiwei, et al.
Pubblicazione: (2024)
di: Liu, Zhiwei, et al.
Pubblicazione: (2024)
BOLT: Bootstrap Long Chain-of-Thought in Language Models without Distillation
di: Pang, Bo, et al.
Pubblicazione: (2025)
di: Pang, Bo, et al.
Pubblicazione: (2025)
PersonaBench: Evaluating AI Models on Understanding Personal Information through Accessing (Synthetic) Private User Data
di: Tan, Juntao, et al.
Pubblicazione: (2025)
di: Tan, Juntao, et al.
Pubblicazione: (2025)
Text2Data: Low-Resource Data Generation with Textual Control
di: Wang, Shiyu, et al.
Pubblicazione: (2024)
di: Wang, Shiyu, et al.
Pubblicazione: (2024)
CRMArena: Understanding the Capacity of LLM Agents to Perform Professional CRM Tasks in Realistic Environments
di: Huang, Kung-Hsiang, et al.
Pubblicazione: (2024)
di: Huang, Kung-Hsiang, et al.
Pubblicazione: (2024)
X-InstructBLIP: A Framework for aligning X-Modal instruction-aware representations to LLMs and Emergent Cross-modal Reasoning
di: Panagopoulou, Artemis, et al.
Pubblicazione: (2023)
di: Panagopoulou, Artemis, et al.
Pubblicazione: (2023)
xGen-small Technical Report
di: Nijkamp, Erik, et al.
Pubblicazione: (2025)
di: Nijkamp, Erik, et al.
Pubblicazione: (2025)
SFR-DeepResearch: Towards Effective Reinforcement Learning for Autonomously Reasoning Single Agents
di: Nguyen, Xuan-Phi, et al.
Pubblicazione: (2025)
di: Nguyen, Xuan-Phi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Causal Layering via Conditional Entropy
di: Feigenbaum, Itai, et al.
Pubblicazione: (2024) -
Retroformer: Retrospective Large Language Agents with Policy Gradient Optimization
di: Yao, Weiran, et al.
Pubblicazione: (2023) -
Entropy-Based Block Pruning for Efficient Large Language Models
di: Yang, Liangwei, et al.
Pubblicazione: (2025) -
xRouter: Training Cost-Aware LLMs Orchestration System via Reinforcement Learning
di: Qian, Cheng, et al.
Pubblicazione: (2025) -
MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models
di: Liu, Zhiwei, et al.
Pubblicazione: (2025)