Enregistré dans:
| Auteurs principaux: | Fu, Jiayi, Zhao, Xuandong, Yang, Ruihan, Zhang, Yuansen, Chen, Jiangjie, Xiao, Yanghua |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2402.12948 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Gumbel Machine: Counterfactual Student Writing Generation via Gumbel Noise Steering
par: McNichols, Hunter, et autres
Publié: (2026)
par: McNichols, Hunter, et autres
Publié: (2026)
Gumbel Counterfactual Generation From Language Models
par: Ravfogel, Shauli, et autres
Publié: (2024)
par: Ravfogel, Shauli, et autres
Publié: (2024)
Gumbel Distillation for Parallel Text Generation
par: Zhang, Chi, et autres
Publié: (2026)
par: Zhang, Chi, et autres
Publié: (2026)
ARIA: Training Language Agents with Intention-Driven Reward Aggregation
par: Yang, Ruihan, et autres
Publié: (2025)
par: Yang, Ruihan, et autres
Publié: (2025)
SelfGoal: Your Language Agents Already Know How to Achieve High-level Goals
par: Yang, Ruihan, et autres
Publié: (2024)
par: Yang, Ruihan, et autres
Publié: (2024)
Gumbel Reranking: Differentiable End-to-End Reranker Optimization
par: Huang, Siyuan, et autres
Publié: (2025)
par: Huang, Siyuan, et autres
Publié: (2025)
Waste Not, Want Not; Recycled Gumbel Noise Improves Consistency in Natural Language Generation
par: de Mijolla, Damien, et autres
Publié: (2025)
par: de Mijolla, Damien, et autres
Publié: (2025)
Universal Adversarial Suffixes Using Calibrated Gumbel-Softmax Relaxation
par: Soor, Sampriti, et autres
Publié: (2025)
par: Soor, Sampriti, et autres
Publié: (2025)
Reward Shaping to Mitigate Reward Hacking in RLHF
par: Fu, Jiayi, et autres
Publié: (2025)
par: Fu, Jiayi, et autres
Publié: (2025)
Refined Detection for Gumbel Watermarking
par: Lattimore, Tor
Publié: (2026)
par: Lattimore, Tor
Publié: (2026)
Can LLM Infer Risk Information From MCP Server System Logs?
par: Fu, Jiayi, et autres
Publié: (2025)
par: Fu, Jiayi, et autres
Publié: (2025)
How Easily do Irrelevant Inputs Skew the Responses of Large Language Models?
par: Wu, Siye, et autres
Publié: (2024)
par: Wu, Siye, et autres
Publié: (2024)
In-Context Watermarks for Large Language Models
par: Liu, Yepeng, et autres
Publié: (2025)
par: Liu, Yepeng, et autres
Publié: (2025)
TravelAgent: An AI Assistant for Personalized Travel Planning
par: Chen, Aili, et autres
Publié: (2024)
par: Chen, Aili, et autres
Publié: (2024)
ANALOGYKB: Unlocking Analogical Reasoning of Language Models with A Million-scale Knowledge Base
par: Yuan, Siyu, et autres
Publié: (2023)
par: Yuan, Siyu, et autres
Publié: (2023)
GSQ: Highly-Accurate Low-Precision Scalar Quantization for LLMs via Gumbel-Softmax Sampling
par: Dadgarnia, Alireza, et autres
Publié: (2026)
par: Dadgarnia, Alireza, et autres
Publié: (2026)
Enhancing Language Agent Strategic Reasoning through Self-Play in Adversarial Games
par: Zhang, Yikai, et autres
Publié: (2025)
par: Zhang, Yikai, et autres
Publié: (2025)
TimeArena: Shaping Efficient Multitasking Language Agents in a Time-Aware Simulation
par: Zhang, Yikai, et autres
Publié: (2024)
par: Zhang, Yikai, et autres
Publié: (2024)
Gumbel-MPNN: Graph Rewiring with Gumbel-Softmax
par: Hoffmann, Marcel, et autres
Publié: (2025)
par: Hoffmann, Marcel, et autres
Publié: (2025)
Past Meets Present: Creating Historical Analogy with Large Language Models
par: Li, Nianqi, et autres
Publié: (2024)
par: Li, Nianqi, et autres
Publié: (2024)
Dataset Protection via Watermarked Canaries in Retrieval-Augmented LLMs
par: Liu, Yepeng, et autres
Publié: (2025)
par: Liu, Yepeng, et autres
Publié: (2025)
Revealing the Barriers of Language Agents in Planning
par: Xie, Jian, et autres
Publié: (2024)
par: Xie, Jian, et autres
Publié: (2024)
TravelPlanner: A Benchmark for Real-World Planning with Language Agents
par: Xie, Jian, et autres
Publié: (2024)
par: Xie, Jian, et autres
Publié: (2024)
Can LLMs Learn to Map the World from Local Descriptions?
par: Xia, Sirui, et autres
Publié: (2025)
par: Xia, Sirui, et autres
Publié: (2025)
Efficiently Identifying Watermarked Segments in Mixed-Source Texts
par: Zhao, Xuandong, et autres
Publié: (2024)
par: Zhao, Xuandong, et autres
Publié: (2024)
Recent Advancement of Emotion Cognition in Large Language Models
par: Chen, Yuyan, et autres
Publié: (2024)
par: Chen, Yuyan, et autres
Publié: (2024)
DEEPER Insight into Your User: Directed Persona Refinement for Dynamic Persona Modeling
par: Chen, Aili, et autres
Publié: (2025)
par: Chen, Aili, et autres
Publié: (2025)
DetectBench: Can Large Language Model Detect and Piece Together Implicit Evidence?
par: Gu, Zhouhong, et autres
Publié: (2024)
par: Gu, Zhouhong, et autres
Publié: (2024)
Piecing Together Clues: A Benchmark for Evaluating the Detective Skills of Large Language Models
par: Gu, Zhouhong, et autres
Publié: (2023)
par: Gu, Zhouhong, et autres
Publié: (2023)
Curse of Knowledge: When Complex Evaluation Context Benefits yet Biases LLM Judges
par: Li, Weiyuan, et autres
Publié: (2025)
par: Li, Weiyuan, et autres
Publié: (2025)
From Persona to Personalization: A Survey on Role-Playing Language Agents
par: Chen, Jiangjie, et autres
Publié: (2024)
par: Chen, Jiangjie, et autres
Publié: (2024)
SEGMENT+: Long Text Processing with Short-Context Language Models
par: Shi, Wei, et autres
Publié: (2024)
par: Shi, Wei, et autres
Publié: (2024)
Scalable Best-of-N Selection for Large Language Models via Self-Certainty
par: Kang, Zhewei, et autres
Publié: (2025)
par: Kang, Zhewei, et autres
Publié: (2025)
Position: LLM Watermarking Should Align Stakeholders' Incentives for Practical Adoption
par: Liu, Yepeng, et autres
Publié: (2025)
par: Liu, Yepeng, et autres
Publié: (2025)
RoCoIns: Enhancing Robustness of Large Language Models through Code-Style Instructions
par: Zhang, Yuansen, et autres
Publié: (2024)
par: Zhang, Yuansen, et autres
Publié: (2024)
A Practical Examination of AI-Generated Text Detectors for Large Language Models
par: Tufts, Brian, et autres
Publié: (2024)
par: Tufts, Brian, et autres
Publié: (2024)
SurveyAgent: A Conversational System for Personalized and Efficient Research Survey
par: Wang, Xintao, et autres
Publié: (2024)
par: Wang, Xintao, et autres
Publié: (2024)
The Exponentiated Generalized Gumbel Distribution
par: Thiago Andrade
Publié: (2015)
par: Thiago Andrade
Publié: (2015)
Questions of life / Nicky Gumbel
par: Gumbel, Nicky
par: Gumbel, Nicky
PLANNER: Generating Diversified Paragraph via Latent Language Diffusion Model
par: Zhang, Yizhe, et autres
Publié: (2023)
par: Zhang, Yizhe, et autres
Publié: (2023)
Documents similaires
-
Gumbel Machine: Counterfactual Student Writing Generation via Gumbel Noise Steering
par: McNichols, Hunter, et autres
Publié: (2026) -
Gumbel Counterfactual Generation From Language Models
par: Ravfogel, Shauli, et autres
Publié: (2024) -
Gumbel Distillation for Parallel Text Generation
par: Zhang, Chi, et autres
Publié: (2026) -
ARIA: Training Language Agents with Intention-Driven Reward Aggregation
par: Yang, Ruihan, et autres
Publié: (2025) -
SelfGoal: Your Language Agents Already Know How to Achieve High-level Goals
par: Yang, Ruihan, et autres
Publié: (2024)