SocraSynth: Multi-LLM Reasoning with Conditional Statistics
Fuente:
arXiv
Salvato in:
| Autore principale: | Chang, Edward Y. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Uncovering Biases with Reflective Large Language Models
di: Chang, Edward Y.
Pubblicazione: (2024)
di: Chang, Edward Y.
Pubblicazione: (2024)
EVINCE: Optimizing Multi-LLM Dialogues Using Conditional Statistics and Information Theory
di: Chang, Edward Y.
Pubblicazione: (2024)
di: Chang, Edward Y.
Pubblicazione: (2024)
Internal Reasoning vs. External Control: A Thermodynamic Analysis of Sycophancy in Large Language Models
di: Chang, Edward Y.
Pubblicazione: (2025)
di: Chang, Edward Y.
Pubblicazione: (2025)
Large Language Model (LLM) Bias Index -- LLMBI
di: Oketunji, Abiodun Finbarrs, et al.
Pubblicazione: (2023)
di: Oketunji, Abiodun Finbarrs, et al.
Pubblicazione: (2023)
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2023)
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2023)
Self-Consistency from Only Two Samples: CoT-PoT Ensembling for Efficient LLM Reasoning
di: Saparkhan, Raman, et al.
Pubblicazione: (2026)
di: Saparkhan, Raman, et al.
Pubblicazione: (2026)
Does LLM Alignment Really Need Diversity? An Empirical Study of Adapting RLVR Methods for Moral Reasoning
di: Zhang, Zhaowei, et al.
Pubblicazione: (2026)
di: Zhang, Zhaowei, et al.
Pubblicazione: (2026)
Integrating Emotional and Linguistic Models for Ethical Compliance in Large Language Models
di: Chang, Edward Y.
Pubblicazione: (2024)
di: Chang, Edward Y.
Pubblicazione: (2024)
Harnessing Negative Signals: Reinforcement Distillation from Teacher Data for LLM Reasoning
di: Xu, Shuyao, et al.
Pubblicazione: (2025)
di: Xu, Shuyao, et al.
Pubblicazione: (2025)
Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding
di: Chen, Haolin, et al.
Pubblicazione: (2024)
di: Chen, Haolin, et al.
Pubblicazione: (2024)
Cognitive Load Limits in Large Language Models: Benchmarking Multi-Hop Reasoning
di: Adapala, Sai Teja Reddy
Pubblicazione: (2025)
di: Adapala, Sai Teja Reddy
Pubblicazione: (2025)
CodingTeachLLM: Empowering LLM's Coding Ability via AST Prior Knowledge
di: Chen, Zhangquan, et al.
Pubblicazione: (2024)
di: Chen, Zhangquan, et al.
Pubblicazione: (2024)
Beyond the Black Box: A Statistical Model for LLM Reasoning and Inference
di: Dalal, Siddhartha, et al.
Pubblicazione: (2024)
di: Dalal, Siddhartha, et al.
Pubblicazione: (2024)
MISR: Measuring Instrumental Self-Reasoning in Frontier Models
di: Fronsdal, Kai, et al.
Pubblicazione: (2024)
di: Fronsdal, Kai, et al.
Pubblicazione: (2024)
ObfusQAte: A Proposed Framework to Evaluate LLM Robustness on Obfuscated Factual Question Answering
di: Ghosh, Shubhra, et al.
Pubblicazione: (2025)
di: Ghosh, Shubhra, et al.
Pubblicazione: (2025)
A Llama walks into the 'Bar': Efficient Supervised Fine-Tuning for Legal Reasoning in the Multi-state Bar Exam
di: Fernandes, Rean, et al.
Pubblicazione: (2025)
di: Fernandes, Rean, et al.
Pubblicazione: (2025)
RAC: Efficient LLM Factuality Correction with Retrieval Augmentation
di: Li, Changmao, et al.
Pubblicazione: (2024)
di: Li, Changmao, et al.
Pubblicazione: (2024)
RAVR: Reference-Answer-guided Variational Reasoning for Large Language Models
di: Lin, Tianqianjin, et al.
Pubblicazione: (2025)
di: Lin, Tianqianjin, et al.
Pubblicazione: (2025)
Metaphors are a Source of Cross-Domain Misalignment of Large Reasoning Models
di: Hu, Zhibo, et al.
Pubblicazione: (2026)
di: Hu, Zhibo, et al.
Pubblicazione: (2026)
Every Sample Matters: Leveraging Mixture-of-Experts and High-Quality Data for Efficient and Accurate Code LLM
di: Codefuse, et al.
Pubblicazione: (2025)
di: Codefuse, et al.
Pubblicazione: (2025)
Sleepless Nights, Sugary Days: Creating Synthetic Users with Health Conditions for Realistic Coaching Agent Interactions
di: Yun, Taedong, et al.
Pubblicazione: (2025)
di: Yun, Taedong, et al.
Pubblicazione: (2025)
Mathador-LM: A Dynamic Benchmark for Mathematical Reasoning on Large Language Models
di: Kurtic, Eldar, et al.
Pubblicazione: (2024)
di: Kurtic, Eldar, et al.
Pubblicazione: (2024)
Positional Failures in Long-Context LLMs: A Blind Spot in Reasoning Benchmarks
di: Zhang, Chuyifei, et al.
Pubblicazione: (2026)
di: Zhang, Chuyifei, et al.
Pubblicazione: (2026)
External Hippocampus: Topological Cognitive Maps for Guiding Large Language Model Reasoning
di: Yan, Jian
Pubblicazione: (2025)
di: Yan, Jian
Pubblicazione: (2025)
AtManRL: Towards Faithful Reasoning via Differentiable Attention Saliency
di: Höth, Max Henning, et al.
Pubblicazione: (2026)
di: Höth, Max Henning, et al.
Pubblicazione: (2026)
Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers
di: Abramov, Roman, et al.
Pubblicazione: (2025)
di: Abramov, Roman, et al.
Pubblicazione: (2025)
Hista and Numca: Estimate State Value Effectively for LLM Reinforcement Learning
di: Chen, Zizhe, et al.
Pubblicazione: (2026)
di: Chen, Zizhe, et al.
Pubblicazione: (2026)
Harmful Intent as a Geometrically Recoverable Feature of LLM Residual Streams
di: Llorente-Saguer, Isaac
Pubblicazione: (2026)
di: Llorente-Saguer, Isaac
Pubblicazione: (2026)
Path-Lock Expert: Separating Reasoning Mode in Hybrid Thinking via Architecture-Level Separation
di: Wang, Shouren, et al.
Pubblicazione: (2026)
di: Wang, Shouren, et al.
Pubblicazione: (2026)
Mixture of Attention Spans: Optimizing LLM Inference Efficiency with Heterogeneous Sliding-Window Lengths
di: Fu, Tianyu, et al.
Pubblicazione: (2024)
di: Fu, Tianyu, et al.
Pubblicazione: (2024)
The Geometry of Harmful Intent: Training-Free Anomaly Detection via Angular Deviation in LLM Residual Streams
di: Llorente-Saguer, Isaac
Pubblicazione: (2026)
di: Llorente-Saguer, Isaac
Pubblicazione: (2026)
How Many Parameters Does Your Task Really Need? Task Specific Pruning with LLM-Sieve
di: Reda, Waleed, et al.
Pubblicazione: (2025)
di: Reda, Waleed, et al.
Pubblicazione: (2025)
Flash Multi-Head Feed-Forward Network
di: Zhang, Minshen, et al.
Pubblicazione: (2025)
di: Zhang, Minshen, et al.
Pubblicazione: (2025)
Contextual Integrity in LLMs via Reasoning and Reinforcement Learning
di: Lan, Guangchen, et al.
Pubblicazione: (2025)
di: Lan, Guangchen, et al.
Pubblicazione: (2025)
MultiMatch: Multihead Consistency Regularization Matching for Semi-Supervised Text Classification
di: Sirbu, Iustin, et al.
Pubblicazione: (2025)
di: Sirbu, Iustin, et al.
Pubblicazione: (2025)
AMEL: Accumulated Message Effects on LLM Judgments
di: Temkit, Sid-Ali
Pubblicazione: (2026)
di: Temkit, Sid-Ali
Pubblicazione: (2026)
Beyond Pass@k: Breadth-Depth Metrics for Reasoning Boundaries
di: Dragoi, Marius, et al.
Pubblicazione: (2025)
di: Dragoi, Marius, et al.
Pubblicazione: (2025)
Counterfactual Likelihood Tests for Indirect Influence in Private Reasoning Channels
di: Lorup, Alexander Boesgaard
Pubblicazione: (2026)
di: Lorup, Alexander Boesgaard
Pubblicazione: (2026)
ConciseRL: Conciseness-Guided Reinforcement Learning for Efficient Reasoning Models
di: Dumitru, Razvan-Gabriel, et al.
Pubblicazione: (2025)
di: Dumitru, Razvan-Gabriel, et al.
Pubblicazione: (2025)
The Deterministic Horizon: When Extended Reasoning Fails and Tool Delegation Becomes Necessary
di: Guo, Dongxin, et al.
Pubblicazione: (2026)
di: Guo, Dongxin, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Uncovering Biases with Reflective Large Language Models
di: Chang, Edward Y.
Pubblicazione: (2024) -
EVINCE: Optimizing Multi-LLM Dialogues Using Conditional Statistics and Information Theory
di: Chang, Edward Y.
Pubblicazione: (2024) -
Internal Reasoning vs. External Control: A Thermodynamic Analysis of Sycophancy in Large Language Models
di: Chang, Edward Y.
Pubblicazione: (2025) -
Large Language Model (LLM) Bias Index -- LLMBI
di: Oketunji, Abiodun Finbarrs, et al.
Pubblicazione: (2023) -
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2023)