Saved in:
| Main Authors: | Kislay, Kaustubh, Singh, Shlok, Joshi, Soham, Dutta, Rohan, Shim, Jay, Flint, George, Zhu, Kevin |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2410.21896 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Quantifying Phonosemantic Iconicity Distributionally in 6 Languages
by: Flint, George, et al.
Published: (2025)
by: Flint, George, et al.
Published: (2025)
Beyond Memorization: Testing LLM Reasoning on Unseen Theory of Computation Tasks
by: Shelat, Shlok, et al.
Published: (2026)
by: Shelat, Shlok, et al.
Published: (2026)
Evaluating Customized vs. Generalist Transformer-based Models for Legal Contract Classification
by: Singh, Amrita, et al.
Published: (2025)
by: Singh, Amrita, et al.
Published: (2025)
Taming the Hydra: Targeted Control-Flow Transformations for Dynamic Symbolic Execution
by: Saumya, Charitha, et al.
Published: (2023)
by: Saumya, Charitha, et al.
Published: (2023)
Chain-of-Thought Augmentation with Logit Contrast for Enhanced Reasoning in Language Models
by: Shim, Jay, et al.
Published: (2024)
by: Shim, Jay, et al.
Published: (2024)
Adversarial Lens: Exploiting Attention Layers to Generate Adversarial Examples for Evaluation
by: Dhole, Kaustubh
Published: (2025)
by: Dhole, Kaustubh
Published: (2025)
HITgram: A Platform for Experimenting with n-gram Language Models
by: Dasgupta, Shibaranjani, et al.
Published: (2024)
by: Dasgupta, Shibaranjani, et al.
Published: (2024)
Instruction Set and Language for Symbolic Regression
by: Lopez-Rubio, Ezequiel, et al.
Published: (2026)
by: Lopez-Rubio, Ezequiel, et al.
Published: (2026)
BabyReasoningBench: Generating Developmentally-Inspired Reasoning Tasks for Evaluating Baby Language Models
by: Dhole, Kaustubh D.
Published: (2026)
by: Dhole, Kaustubh D.
Published: (2026)
Adaptive Linguistic Prompting (ALP) Enhances Phishing Webpage Detection in Multimodal Large Language Models
by: Bhargude, Atharva, et al.
Published: (2025)
by: Bhargude, Atharva, et al.
Published: (2025)
In Context Learning and Reasoning for Symbolic Regression with Large Language Models
by: Sharlin, Samiha, et al.
Published: (2024)
by: Sharlin, Samiha, et al.
Published: (2024)
In-Context Symbolic Regression: Leveraging Large Language Models for Function Discovery
by: Merler, Matteo, et al.
Published: (2024)
by: Merler, Matteo, et al.
Published: (2024)
Robust K‐Fold Cross‐Validation Model Averaging Prediction
by: Yixi Dong, et al.
Published: (2025)
by: Yixi Dong, et al.
Published: (2025)
A Symbolic Framework for Evaluating Mathematical Reasoning and Generalisation with Transformers
by: Meadows, Jordan, et al.
Published: (2023)
by: Meadows, Jordan, et al.
Published: (2023)
Lost in Translation? A Comparative Study on the Cross-Lingual Transfer of Composite Harms
by: Shukla, Vaibhav, et al.
Published: (2026)
by: Shukla, Vaibhav, et al.
Published: (2026)
A Unified Model for Real-Time Systems: Symbolic Techniques and Implementation
by: Akshay, S, et al.
Published: (2023)
by: Akshay, S, et al.
Published: (2023)
Dissecting the Ledger: Locating and Suppressing "Liar Circuits" in Financial Large Language Models
by: Mirajkar, Soham
Published: (2025)
by: Mirajkar, Soham
Published: (2025)
Language Models can Infer Action Semantics for Symbolic Planners from Environment Feedback
by: Zhu, Wang, et al.
Published: (2024)
by: Zhu, Wang, et al.
Published: (2024)
PyTerrier-GenRank: The PyTerrier Plugin for Reranking with Large Language Models
by: Dhole, Kaustubh D.
Published: (2024)
by: Dhole, Kaustubh D.
Published: (2024)
An Optimal 14-Symbol Hybrid Basis for BCH-Algebras
by: Ramani, Mahesh, et al.
Published: (2026)
by: Ramani, Mahesh, et al.
Published: (2026)
On the Effects of Fine-tuning Language Models for Text-Based Reinforcement Learning
by: Gruppi, Mauricio, et al.
Published: (2024)
by: Gruppi, Mauricio, et al.
Published: (2024)
PSALM-V: Automating Symbolic Planning in Interactive Visual Environments with Large Language Models
by: Zhu, Wang Bill, et al.
Published: (2025)
by: Zhu, Wang Bill, et al.
Published: (2025)
Reward Modeling for Scientific Writing Evaluation
by: Şahinuç, Furkan, et al.
Published: (2026)
by: Şahinuç, Furkan, et al.
Published: (2026)
When Flores Bloomz Wrong: Cross-Direction Contamination in Machine Translation Evaluation
by: Tan, David, et al.
Published: (2026)
by: Tan, David, et al.
Published: (2026)
Mechanistic Behavior Editing of Language Models
by: Singh, Joykirat, et al.
Published: (2024)
by: Singh, Joykirat, et al.
Published: (2024)
HCAM -- Hierarchical Cross Attention Model for Multi-modal Emotion Recognition
by: Dutta, Soumya, et al.
Published: (2023)
by: Dutta, Soumya, et al.
Published: (2023)
TRUTH DECAY: Quantifying Multi-Turn Sycophancy in Language Models
by: Liu, Joshua, et al.
Published: (2025)
by: Liu, Joshua, et al.
Published: (2025)
Dialetto, ma Quanto Dialetto? Transcribing and Evaluating Dialects on a Continuum
by: Shim, Ryan Soh-Eun, et al.
Published: (2024)
by: Shim, Ryan Soh-Eun, et al.
Published: (2024)
Resolving Intent Ambiguities by Retrieving Discriminative Clarifying Questions
by: Dhole, Kaustubh D.
Published: (2020)
by: Dhole, Kaustubh D.
Published: (2020)
ProMoral-Bench: Evaluating Prompting Strategies for Moral Reasoning and Safety in LLMs
by: Thomas, Rohan Subramanian, et al.
Published: (2026)
by: Thomas, Rohan Subramanian, et al.
Published: (2026)
Curating Stopwords in Marathi: A TF-IDF Approach for Improved Text Analysis and Information Retrieval
by: Chavan, Rohan, et al.
Published: (2024)
by: Chavan, Rohan, et al.
Published: (2024)
Human-Calibrated Automated Testing and Validation of Generative Language Models
by: Sudjianto, Agus, et al.
Published: (2024)
by: Sudjianto, Agus, et al.
Published: (2024)
BrahmicTokenizer-131K: An Indic-Capable Drop-In Replacement for o200k_base
by: Shravan, Rohan
Published: (2026)
by: Shravan, Rohan
Published: (2026)
KAUCUS: Knowledge Augmented User Simulators for Training Language Model Assistants
by: Dhole, Kaustubh D.
Published: (2024)
by: Dhole, Kaustubh D.
Published: (2024)
An Exploration of Self-Supervised Mutual Information Alignment for Multi-Task Settings
by: Govande, Soham V.
Published: (2024)
by: Govande, Soham V.
Published: (2024)
Constraint-aware Path Planning from Natural Language Instructions Using Large Language Models
by: Shim, Dylan, et al.
Published: (2026)
by: Shim, Dylan, et al.
Published: (2026)
A Multi-Encoder Frozen-Decoder Approach for Fine-Tuning Large Language Models
by: Dhole, Kaustubh D.
Published: (2025)
by: Dhole, Kaustubh D.
Published: (2025)
Beyond Components: Singular Vector-Based Interpretability of Transformer Circuits
by: Ahmad, Areeb, et al.
Published: (2025)
by: Ahmad, Areeb, et al.
Published: (2025)
Medical Large Language Model Benchmarks Should Prioritize Construct Validity
by: Alaa, Ahmed, et al.
Published: (2025)
by: Alaa, Ahmed, et al.
Published: (2025)
Illusion or Algorithm? Investigating Memorization, Emergence, and Symbolic Processing in In-Context Learning
by: Niu, Jingcheng, et al.
Published: (2025)
by: Niu, Jingcheng, et al.
Published: (2025)
Similar Items
-
Quantifying Phonosemantic Iconicity Distributionally in 6 Languages
by: Flint, George, et al.
Published: (2025) -
Beyond Memorization: Testing LLM Reasoning on Unseen Theory of Computation Tasks
by: Shelat, Shlok, et al.
Published: (2026) -
Evaluating Customized vs. Generalist Transformer-based Models for Legal Contract Classification
by: Singh, Amrita, et al.
Published: (2025) -
Taming the Hydra: Targeted Control-Flow Transformations for Dynamic Symbolic Execution
by: Saumya, Charitha, et al.
Published: (2023) -
Chain-of-Thought Augmentation with Logit Contrast for Enhanced Reasoning in Language Models
by: Shim, Jay, et al.
Published: (2024)