Assisting humans in complex comparisons: automated information comparison at scale
Fuente:
arXiv
Salvato in:
| Autori principali: | Yuen, Truman, Watt, Graham A., Lawryshyn, Yuri |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reinforced Language Models for Sequential Decision Making
di: Dilkes, Jim, et al.
Pubblicazione: (2025)
di: Dilkes, Jim, et al.
Pubblicazione: (2025)
REVOLVE: Optimizing AI Systems by Tracking Response Evolution in Textual Optimization
di: Zhang, Peiyan, et al.
Pubblicazione: (2024)
di: Zhang, Peiyan, et al.
Pubblicazione: (2024)
When Words Change the Model: Sensitivity of LLMs for Constraint Programming Modelling
di: Pellegrino, Alessio, et al.
Pubblicazione: (2025)
di: Pellegrino, Alessio, et al.
Pubblicazione: (2025)
Resolving Action Bottleneck: Agentic Reinforcement Learning Informed by Token-Level Energy
di: He, Langzhou, et al.
Pubblicazione: (2026)
di: He, Langzhou, et al.
Pubblicazione: (2026)
Dynamic Policy Induction for Adaptive Prompt Optimization: Bridging the Efficiency-Accuracy Gap via Lightweight Reinforcement Learning
di: Xu, Jiexi
Pubblicazione: (2025)
di: Xu, Jiexi
Pubblicazione: (2025)
Aligning LLMs on a Budget: Inference-Time Alignment with Heuristic Reward Models
di: Nakamura, Mason, et al.
Pubblicazione: (2025)
di: Nakamura, Mason, et al.
Pubblicazione: (2025)
SCULPT: Constraint-Guided Pruned MCTS that Carves Efficient Paths for Mathematical Reasoning
di: Fang, Qitong, et al.
Pubblicazione: (2026)
di: Fang, Qitong, et al.
Pubblicazione: (2026)
On the Limits of Learned Importance Scoring for KV Cache Compression
di: Steele, Brady
Pubblicazione: (2026)
di: Steele, Brady
Pubblicazione: (2026)
Scaling Trends for Multi-Hop Contextual Reasoning in Mid-Scale Language Models
di: Steele, Brady, et al.
Pubblicazione: (2026)
di: Steele, Brady, et al.
Pubblicazione: (2026)
Language Models, Graph Searching, and Supervision Adulteration: When More Supervision is Less and How to Make More More
di: Frydenlund, Arvid
Pubblicazione: (2025)
di: Frydenlund, Arvid
Pubblicazione: (2025)
How Clued up are LLMs? Evaluating Multi-Step Deductive Reasoning in a Text-Based Game Environment
di: Ansell, Rebecca, et al.
Pubblicazione: (2026)
di: Ansell, Rebecca, et al.
Pubblicazione: (2026)
Critical Insights into Leading Conversational AI Models
di: Kohli, Urja, et al.
Pubblicazione: (2025)
di: Kohli, Urja, et al.
Pubblicazione: (2025)
ChatGPT4PCG Competition: Character-like Level Generation for Science Birds
di: Taveekitworachai, Pittawat, et al.
Pubblicazione: (2023)
di: Taveekitworachai, Pittawat, et al.
Pubblicazione: (2023)
Improving Existing Optimization Algorithms with LLMs
di: Sartori, Camilo Chacón, et al.
Pubblicazione: (2025)
di: Sartori, Camilo Chacón, et al.
Pubblicazione: (2025)
TrafficRAG: A Multimodal RAG Framework for Traffic Accident Liability Determination
di: Li, Xu, et al.
Pubblicazione: (2026)
di: Li, Xu, et al.
Pubblicazione: (2026)
ChatGPT4PCG 2 Competition: Prompt Engineering for Science Birds Level Generation
di: Taveekitworachai, Pittawat, et al.
Pubblicazione: (2024)
di: Taveekitworachai, Pittawat, et al.
Pubblicazione: (2024)
GraphEval36K: Benchmarking Coding and Reasoning Capabilities of Large Language Models on Graph Datasets
di: Wu, Qiming, et al.
Pubblicazione: (2024)
di: Wu, Qiming, et al.
Pubblicazione: (2024)
MESS+: Dynamically Learned Inference-Time LLM Routing in Model Zoos with Service Level Guarantees
di: Woisetschläger, Herbert, et al.
Pubblicazione: (2025)
di: Woisetschläger, Herbert, et al.
Pubblicazione: (2025)
Learning, Fast and Slow: Towards LLMs That Adapt Continually
di: Tiwari, Rishabh, et al.
Pubblicazione: (2026)
di: Tiwari, Rishabh, et al.
Pubblicazione: (2026)
Navigating WebAI: Training Agents to Complete Web Tasks with Large Language Models and Reinforcement Learning
di: Thil, Lucas-Andreï, et al.
Pubblicazione: (2024)
di: Thil, Lucas-Andreï, et al.
Pubblicazione: (2024)
Open-TI: Open Traffic Intelligence with Augmented Language Model
di: Da, Longchao, et al.
Pubblicazione: (2023)
di: Da, Longchao, et al.
Pubblicazione: (2023)
GEPA: Reflective Prompt Evolution Can Outperform Reinforcement Learning
di: Agrawal, Lakshya A, et al.
Pubblicazione: (2025)
di: Agrawal, Lakshya A, et al.
Pubblicazione: (2025)
REPOT: Recoverable Program-of-Thought via Checkpoint Repair
di: Mazaheri, Parsa
Pubblicazione: (2026)
di: Mazaheri, Parsa
Pubblicazione: (2026)
Knowledge Graphs as the Missing Data Layer for LLM-Based Industrial Asset Operations
di: Mandarapu, Madhulatha, et al.
Pubblicazione: (2026)
di: Mandarapu, Madhulatha, et al.
Pubblicazione: (2026)
FATHOMS-RAG: A Framework for the Assessment of Thinking and Observation in Multimodal Systems that use Retrieval Augmented Generation
di: Hildebrand, Samuel, et al.
Pubblicazione: (2025)
di: Hildebrand, Samuel, et al.
Pubblicazione: (2025)
Learning Natural Language Constraints for Safe Reinforcement Learning of Language Agents
di: Chua, Jaymari, et al.
Pubblicazione: (2025)
di: Chua, Jaymari, et al.
Pubblicazione: (2025)
GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing
di: Zhang, Peiyan, et al.
Pubblicazione: (2025)
di: Zhang, Peiyan, et al.
Pubblicazione: (2025)
Tiny QA Benchmark++: Ultra-Lightweight, Synthetic Multilingual Dataset Generation & Smoke-Tests for Continuous LLM Evaluation
di: Koc, Vincent
Pubblicazione: (2025)
di: Koc, Vincent
Pubblicazione: (2025)
ReaGeo: Reasoning-Enhanced End-to-End Geocoding with LLMs
di: Cui, Jian, et al.
Pubblicazione: (2026)
di: Cui, Jian, et al.
Pubblicazione: (2026)
Primary Care Diagnoses as a Reliable Predictor for Orthopedic Surgical Interventions
di: Verma, Khushboo, et al.
Pubblicazione: (2025)
di: Verma, Khushboo, et al.
Pubblicazione: (2025)
MOCHA: Multi-Objective Chebyshev Annealing for Agent Skill Optimization
di: Tanjim, Md Mehrab, et al.
Pubblicazione: (2026)
di: Tanjim, Md Mehrab, et al.
Pubblicazione: (2026)
Automated Theorem Provers Help Improve Large Language Model Reasoning
di: McGinness, Lachlan, et al.
Pubblicazione: (2024)
di: McGinness, Lachlan, et al.
Pubblicazione: (2024)
How Generation Architecture Shapes Code Complexity in Multi-Agent LLM Systems: A Paired Study on HumanEval
di: Ashrafi, Nazmus
Pubblicazione: (2026)
di: Ashrafi, Nazmus
Pubblicazione: (2026)
ConfProBench: A Confidence Evaluation Benchmark for MLLM-Based Process Judges
di: Zhou, Yue, et al.
Pubblicazione: (2025)
di: Zhou, Yue, et al.
Pubblicazione: (2025)
GraphWalk: Enabling Reasoning in Large Language Models through Tool-Based Graph Navigation
di: Ghandi, Taraneh, et al.
Pubblicazione: (2026)
di: Ghandi, Taraneh, et al.
Pubblicazione: (2026)
HiFi-RAG: Hierarchical Content Filtering and Two-Pass Generation for Open-Domain RAG
di: Nuengsigkapian, Cattalyya
Pubblicazione: (2025)
di: Nuengsigkapian, Cattalyya
Pubblicazione: (2025)
Unveiling Hidden Factors: Explainable AI for Feature Boosting in Speech Emotion Recognition
di: Nfissi, Alaa, et al.
Pubblicazione: (2024)
di: Nfissi, Alaa, et al.
Pubblicazione: (2024)
When Gradients Collide: Failure Modes of Multi-Objective Prompt Optimization for LLM Judges
di: Darshan, Parth, et al.
Pubblicazione: (2026)
di: Darshan, Parth, et al.
Pubblicazione: (2026)
Iterative Feature Boosting for Explainable Speech Emotion Recognition
di: Nfissi, Alaa, et al.
Pubblicazione: (2024)
di: Nfissi, Alaa, et al.
Pubblicazione: (2024)
Pioneer Agent: Continual Improvement of Small Language Models in Production
di: Atreja, Dhruv, et al.
Pubblicazione: (2026)
di: Atreja, Dhruv, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Reinforced Language Models for Sequential Decision Making
di: Dilkes, Jim, et al.
Pubblicazione: (2025) -
REVOLVE: Optimizing AI Systems by Tracking Response Evolution in Textual Optimization
di: Zhang, Peiyan, et al.
Pubblicazione: (2024) -
When Words Change the Model: Sensitivity of LLMs for Constraint Programming Modelling
di: Pellegrino, Alessio, et al.
Pubblicazione: (2025) -
Resolving Action Bottleneck: Agentic Reinforcement Learning Informed by Token-Level Energy
di: He, Langzhou, et al.
Pubblicazione: (2026) -
Dynamic Policy Induction for Adaptive Prompt Optimization: Bridging the Efficiency-Accuracy Gap via Lightweight Reinforcement Learning
di: Xu, Jiexi
Pubblicazione: (2025)