Risultati della ricerca - Devvrit
- Mostra 1 - 7 risultati su 7
-
1
Dual-Encoders for Extreme Multi-Label Classification di Gupta, Nilesh, Khatri, Devvrit, Rawat, Ankit S, Bhojanapalli, Srinadh, Jain, Prateek, Dhillon, Inderjit
Pubblicazione 2023Fuente: arXivPreprintAcceso al recurso -
2
The Art of Scaling Reinforcement Learning Compute for LLMs di Khatri, Devvrit, Madaan, Lovish, Tiwari, Rishabh, Bansal, Rachit, Duvvuri, Sai Surya, Zaheer, Manzil, Dhillon, Inderjit S., Brandfonbrener, David, Agarwal, Rishabh
Pubblicazione 2025Fuente: arXivPreprintAcceso al recurso -
3
Interleaved Head Attention di Duvvuri, Sai Surya, Ekbote, Chanakya, Bansal, Rachit, Tiwari, Rishabh, Khatri, Devvrit, Brandfonbrener, David, Liang, Paul, Dhillon, Inderjit, Zaheer, Manzil
Pubblicazione 2026Fuente: arXivPreprintAcceso al recurso -
4
Learning, Fast and Slow: Towards LLMs That Adapt Continually di Tiwari, Rishabh, Sareen, Kusha, Agrawal, Lakshya A, Gonzalez, Joseph E., Zaharia, Matei, Keutzer, Kurt, Dhillon, Inderjit S, Agarwal, Rishabh, Khatri, Devvrit
Pubblicazione 2026Fuente: arXivPreprintAcceso al recurso -
5
MatFormer: Nested Transformer for Elastic Inference di Devvrit, Kudugunta, Sneha, Kusupati, Aditya, Dettmers, Tim, Chen, Kaifeng, Dhillon, Inderjit, Tsvetkov, Yulia, Hajishirzi, Hannaneh, Kakade, Sham, Farhadi, Ali, Jain, Prateek
Pubblicazione 2023Fuente: arXivPreprintAcceso al recurso -
6
Compressing Many-Shots in In-Context Learning di Khatri, Devvrit, Kulkarni, Pranamya, Gupta, Nilesh, Varun, Yerram, Peng, Liqian, Yagnik, Jay, Netrapalli, Praneeth, Hsieh, Cho-Jui, Go, Alec, Dhillon, Inderjit S, Kusupati, Aditya, Jain, Prateek
Pubblicazione 2025Fuente: arXivPreprintAcceso al recurso -
7
Let's (not) just put things in Context: Test-Time Training for Long-Context LLMs di Bansal, Rachit, Zhang, Aston, Tiwari, Rishabh, Madaan, Lovish, Duvvuri, Sai Surya, Khatri, Devvrit, Brandfonbrener, David, Alvarez-Melis, David, Bhargava, Prajjwal, Kale, Mihir Sanjay, Jelassi, Samy
Pubblicazione 2025Fuente: arXivPreprintAcceso al recurso