Lightweight reranking for language model generations
Fuente:
arXiv
Guardado en:
| Autores principales: | Jain, Siddhartha, Ma, Xiaofei, Deoras, Anoop, Xiang, Bing |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Lossless Token Sequence Compression via Meta-Tokens
por: Harvill, John, et al.
Publicado: (2025)
por: Harvill, John, et al.
Publicado: (2025)
Fewer Truncations Improve Language Modeling
por: Ding, Hantian, et al.
Publicado: (2024)
por: Ding, Hantian, et al.
Publicado: (2024)
Empowering Multi-Turn Tool-Integrated Agentic Reasoning with Group Turn Policy Optimization
por: Ding, Yifeng, et al.
Publicado: (2025)
por: Ding, Yifeng, et al.
Publicado: (2025)
AI-AI Bias: large language models favor communications generated by large language models
por: Laurito, Walter, et al.
Publicado: (2024)
por: Laurito, Walter, et al.
Publicado: (2024)
The language of time: a language model perspective on time-series foundation models
por: Xie, Yi, et al.
Publicado: (2025)
por: Xie, Yi, et al.
Publicado: (2025)
Representation in large language models
por: Yetman, Cameron
Publicado: (2025)
por: Yetman, Cameron
Publicado: (2025)
Extracting effective solutions hidden in large language models via generated comprehensive specialists: case studies in developing electronic devices
por: Tomita, Hikari, et al.
Publicado: (2024)
por: Tomita, Hikari, et al.
Publicado: (2024)
Aleph-Alpha-GermanWeb: Improving German-language LLM pre-training with model-based data curation and synthetic data generation
por: Burns, Thomas F, et al.
Publicado: (2025)
por: Burns, Thomas F, et al.
Publicado: (2025)
Alignment faking in large language models
por: Greenblatt, Ryan, et al.
Publicado: (2024)
por: Greenblatt, Ryan, et al.
Publicado: (2024)
Auditing language models for hidden objectives
por: Marks, Samuel, et al.
Publicado: (2025)
por: Marks, Samuel, et al.
Publicado: (2025)
Long-form factuality in large language models
por: Wei, Jerry, et al.
Publicado: (2024)
por: Wei, Jerry, et al.
Publicado: (2024)
Can large language models explore in-context?
por: Krishnamurthy, Akshay, et al.
Publicado: (2024)
por: Krishnamurthy, Akshay, et al.
Publicado: (2024)
Extracting books from production language models
por: Ahmed, Ahmed, et al.
Publicado: (2026)
por: Ahmed, Ahmed, et al.
Publicado: (2026)
Approximately Aligned Decoding
por: Melcer, Daniel, et al.
Publicado: (2024)
por: Melcer, Daniel, et al.
Publicado: (2024)
Learning Generative Selection for Best-of-N
por: Toshniwal, Shubham, et al.
Publicado: (2026)
por: Toshniwal, Shubham, et al.
Publicado: (2026)
Scaling Test-Time Compute to Achieve IOI Gold Medal with Open-Weight Models
por: Samadi, Mehrzad, et al.
Publicado: (2025)
por: Samadi, Mehrzad, et al.
Publicado: (2025)
Hallucination Detection via Activations of Open-Weight Proxy Analyzers
por: Singh, Akshita, et al.
Publicado: (2026)
por: Singh, Akshita, et al.
Publicado: (2026)
Inducing anxiety in large language models can induce bias
por: Coda-Forno, Julian, et al.
Publicado: (2023)
por: Coda-Forno, Julian, et al.
Publicado: (2023)
Post-training makes large language models less human-like
por: Binz, Marcel, et al.
Publicado: (2026)
por: Binz, Marcel, et al.
Publicado: (2026)
Fresh in memory: Training-order recency is linearly encoded in language model activations
por: Krasheninnikov, Dmitrii, et al.
Publicado: (2025)
por: Krasheninnikov, Dmitrii, et al.
Publicado: (2025)
Safety and accuracy follow different scaling laws in clinical large language models
por: Wind, Sebastian, et al.
Publicado: (2026)
por: Wind, Sebastian, et al.
Publicado: (2026)
On the generalization of language models from in-context learning and finetuning: a controlled study
por: Lampinen, Andrew K., et al.
Publicado: (2025)
por: Lampinen, Andrew K., et al.
Publicado: (2025)
A dataset and benchmark for hospital course summarization with adapted large language models
por: Aali, Asad, et al.
Publicado: (2024)
por: Aali, Asad, et al.
Publicado: (2024)
Efficient semantic uncertainty quantification in language models via diversity-steered sampling
por: Park, Ji Won, et al.
Publicado: (2025)
por: Park, Ji Won, et al.
Publicado: (2025)
Vocabulary shapes cross-lingual variation of word-order learnability in language models
por: Martins, Jonas Mayer, et al.
Publicado: (2026)
por: Martins, Jonas Mayer, et al.
Publicado: (2026)
CogBench: a large language model walks into a psychology lab
por: Coda-Forno, Julian, et al.
Publicado: (2024)
por: Coda-Forno, Julian, et al.
Publicado: (2024)
Perturbation: A simple and efficient adversarial tracer for representation learning in language models
por: Rozner, Joshua, et al.
Publicado: (2026)
por: Rozner, Joshua, et al.
Publicado: (2026)
Lightweight Safety Guardrails via Synthetic Data and RL-guided Adversarial Training
por: Ilin, Aleksei, et al.
Publicado: (2025)
por: Ilin, Aleksei, et al.
Publicado: (2025)
MAP's not dead yet: Uncovering true language model modes by conditioning away degeneracy
por: Yoshida, Davis, et al.
Publicado: (2023)
por: Yoshida, Davis, et al.
Publicado: (2023)
Multi-step retrieval and reasoning improves radiology question answering with large language models
por: Wind, Sebastian, et al.
Publicado: (2025)
por: Wind, Sebastian, et al.
Publicado: (2025)
SteuerLLM: Local specialized large language model for German tax law analysis
por: Wind, Sebastian, et al.
Publicado: (2026)
por: Wind, Sebastian, et al.
Publicado: (2026)
Multimodal large language model for wheat breeding: a new exploration of smart breeding
por: Yang, Guofeng, et al.
Publicado: (2024)
por: Yang, Guofeng, et al.
Publicado: (2024)
Large language models can learn and generalize steganographic chain-of-thought under process supervision
por: Skaf, Joey, et al.
Publicado: (2025)
por: Skaf, Joey, et al.
Publicado: (2025)
MedicalBERT: enhancing biomedical natural language processing using pretrained BERT-based model
por: Reddy, K. Sahit, et al.
Publicado: (2025)
por: Reddy, K. Sahit, et al.
Publicado: (2025)
Linear probes rely on textual evidence: Results from leakage mitigation studies in language models
por: Boxo, Gerard, et al.
Publicado: (2025)
por: Boxo, Gerard, et al.
Publicado: (2025)
SmallToLarge (S2L): Scalable Data Selection for Fine-tuning Large Language Models by Summarizing Training Trajectories of Small Models
por: Yang, Yu, et al.
Publicado: (2024)
por: Yang, Yu, et al.
Publicado: (2024)
Can large language models replace humans in the systematic review process? Evaluating GPT-4's efficacy in screening and extracting data from peer-reviewed and grey literature in multiple languages
por: Khraisha, Qusai, et al.
Publicado: (2023)
por: Khraisha, Qusai, et al.
Publicado: (2023)
Zero-shot data citation function classification using transformer-based large language models (LLMs)
por: Byers, Neil, et al.
Publicado: (2025)
por: Byers, Neil, et al.
Publicado: (2025)
Open-sci-ref-0.01: open and reproducible reference baselines for language model and dataset comparison
por: Nezhurina, Marianna, et al.
Publicado: (2025)
por: Nezhurina, Marianna, et al.
Publicado: (2025)
Benchmarking large language models for biomedical natural language processing applications and recommendations
por: Chen, Qingyu, et al.
Publicado: (2023)
por: Chen, Qingyu, et al.
Publicado: (2023)
Ejemplares similares
-
Lossless Token Sequence Compression via Meta-Tokens
por: Harvill, John, et al.
Publicado: (2025) -
Fewer Truncations Improve Language Modeling
por: Ding, Hantian, et al.
Publicado: (2024) -
Empowering Multi-Turn Tool-Integrated Agentic Reasoning with Group Turn Policy Optimization
por: Ding, Yifeng, et al.
Publicado: (2025) -
AI-AI Bias: large language models favor communications generated by large language models
por: Laurito, Walter, et al.
Publicado: (2024) -
The language of time: a language model perspective on time-series foundation models
por: Xie, Yi, et al.
Publicado: (2025)