Granite Code Models: A Family of Open Foundation Models for Code Intelligence
Fuente:
arXiv
Salvato in:
| Autori principali: | Mishra, Mayank, Stallone, Matt, Zhang, Gaoyuan, Shen, Yikang, Prasad, Aditya, Soria, Adriana Meza, Merler, Michele, Selvam, Parameswaran, Surendran, Saptha, Singh, Shivdeep, Sethi, Manish, Dang, Xuan-Hong, Li, Pengyuan, Wu, Kun-Lung, Zawad, Syed, Coleman, Andrew, White, Matthew, Lewis, Mark, Pavuluri, Raju, Koyfman, Yan, Lublinsky, Boris, de Bayser, Maximilien, Abdelaziz, Ibrahim, Basu, Kinjal, Agarwal, Mayank, Zhou, Yi, Johnson, Chris, Goyal, Aanchal, Patel, Hima, Shah, Yousaf, Zerfos, Petros, Ludwig, Heiko, Munawar, Asim, Crouse, Maxwell, Kapanipathi, Pavan, Salaria, Shweta, Calio, Bob, Wen, Sophia, Seelam, Seetharami, Belgodere, Brian, Fonseca, Carlos, Singhee, Amith, Desai, Nirmit, Cox, David D., Puri, Ruchir, Panda, Rameswar |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Scaling Granite Code Models to 128K Context
di: Stallone, Matt, et al.
Pubblicazione: (2024)
di: Stallone, Matt, et al.
Pubblicazione: (2024)
CRANE: Constrained Reasoning Injection for Code Agents via Nullspace Editing
di: Zhu, Mingzhi, et al.
Pubblicazione: (2026)
di: Zhu, Mingzhi, et al.
Pubblicazione: (2026)
Multi-task Code LLMs: Data Mix or Model Merge?
di: Zhu, Mingzhi, et al.
Pubblicazione: (2026)
di: Zhu, Mingzhi, et al.
Pubblicazione: (2026)
Usage, Effects and Requirements for AI Coding Assistants in the Enterprise: An Empirical Study
di: Vukovic, Maja, et al.
Pubblicazione: (2026)
di: Vukovic, Maja, et al.
Pubblicazione: (2026)
Data-Prep-Kit: getting your data ready for LLM application development
di: Wood, David, et al.
Pubblicazione: (2024)
di: Wood, David, et al.
Pubblicazione: (2024)
PythonSaga: Redefining the Benchmark to Evaluate Code Generating LLMs
di: Yadav, Ankit, et al.
Pubblicazione: (2024)
di: Yadav, Ankit, et al.
Pubblicazione: (2024)
Power Scheduler: A Batch Size and Token Number Agnostic Learning Rate Scheduler
di: Shen, Yikang, et al.
Pubblicazione: (2024)
di: Shen, Yikang, et al.
Pubblicazione: (2024)
Code-Driven Planning in Grid Worlds with Large Language Models
di: Aravindan, Ashwath Vaithinathan, et al.
Pubblicazione: (2025)
di: Aravindan, Ashwath Vaithinathan, et al.
Pubblicazione: (2025)
Structured Code Representations Enable Data-Efficient Adaptation of Code Language Models
di: Agarwal, Mayank, et al.
Pubblicazione: (2024)
di: Agarwal, Mayank, et al.
Pubblicazione: (2024)
COMI-LINGUA: Expert Annotated Large-Scale Dataset for Multitask NLP in Hindi-English Code-Mixing
di: Sheth, Rajvee, et al.
Pubblicazione: (2025)
di: Sheth, Rajvee, et al.
Pubblicazione: (2025)
Lost in Translation: A Study of Bugs Introduced by Large Language Models while Translating Code
di: Pan, Rangeet, et al.
Pubblicazione: (2023)
di: Pan, Rangeet, et al.
Pubblicazione: (2023)
Incremental Analysis of Legacy Applications Using Knowledge Graphs for Application Modernization
di: Krishnan, Saravanan, et al.
Pubblicazione: (2025)
di: Krishnan, Saravanan, et al.
Pubblicazione: (2025)
Reducing Transformer Key-Value Cache Size with Cross-Layer Attention
di: Brandon, William, et al.
Pubblicazione: (2024)
di: Brandon, William, et al.
Pubblicazione: (2024)
TFHE-Coder: Evaluating LLM-agentic Fully Homomorphic Encryption Code Generation
di: Kumar, Mayank, et al.
Pubblicazione: (2025)
di: Kumar, Mayank, et al.
Pubblicazione: (2025)
CliffSearch: Structured Agentic Co-Evolution over Theory and Code for Scientific Algorithm Discovery
di: Mroueh, Youssef, et al.
Pubblicazione: (2026)
di: Mroueh, Youssef, et al.
Pubblicazione: (2026)
LEO: Graph Attention Network based Hybrid Multi Sensor Extended Object Fusion and Tracking for Autonomous Driving Applications
di: Mayank, Mayank, et al.
Pubblicazione: (2026)
di: Mayank, Mayank, et al.
Pubblicazione: (2026)
ScarfBench: A Benchmark for Cross-Framework Application Migration in Enterprise Java
di: Pavuluri, Advait, et al.
Pubblicazione: (2026)
di: Pavuluri, Advait, et al.
Pubblicazione: (2026)
COMMENTATOR: A Code-mixed Multilingual Text Annotation Framework
di: Sheth, Rajvee, et al.
Pubblicazione: (2024)
di: Sheth, Rajvee, et al.
Pubblicazione: (2024)
Mitigating the Impact of Outlier Channels for Language Model Quantization with Activation Regularization
di: Nrusimha, Aniruddha, et al.
Pubblicazione: (2024)
di: Nrusimha, Aniruddha, et al.
Pubblicazione: (2024)
ONNX Models for CHASE
di: Arya, Mayank
Pubblicazione: (2026)
di: Arya, Mayank
Pubblicazione: (2026)
FVA-RAG: Falsification-Verification Alignment for Mitigating Sycophantic Hallucinations
di: Ravishankara, Mayank
Pubblicazione: (2025)
di: Ravishankara, Mayank
Pubblicazione: (2025)
CircuChain: Disentangling Competence and Compliance in LLM Circuit Analysis
di: Ravishankara, Mayank
Pubblicazione: (2026)
di: Ravishankara, Mayank
Pubblicazione: (2026)
A Review on Privacy in DAG-Based DLTs
di: Raikwar, Mayank
Pubblicazione: (2025)
di: Raikwar, Mayank
Pubblicazione: (2025)
On Spatial Matchings: The First-in-First-Match case
di: Manjrekar, Mayank
Pubblicazione: (2018)
di: Manjrekar, Mayank
Pubblicazione: (2018)
Self-calibrating Intelligent OCT-SLO System
di: Goswami, Mayank
Pubblicazione: (2024)
di: Goswami, Mayank
Pubblicazione: (2024)
PlotChain: Deterministic Checkpointed Evaluation of Multimodal LLMs on Engineering Plot Reading
di: Ravishankara, Mayank
Pubblicazione: (2026)
di: Ravishankara, Mayank
Pubblicazione: (2026)
On Automating Proofs of Multiplier Adder Trees using the RTL Books
di: Manjrekar, Mayank
Pubblicazione: (2025)
di: Manjrekar, Mayank
Pubblicazione: (2025)
Throughput Optimization as a Strategic Lever in Large-Scale AI Systems: Evidence from Dataloader and Memory Profiling Innovations
di: Jha, Mayank
Pubblicazione: (2026)
di: Jha, Mayank
Pubblicazione: (2026)
Squarefree numbers in short intervals
di: Pandey, Mayank
Pubblicazione: (2024)
di: Pandey, Mayank
Pubblicazione: (2024)
ToolRM: Outcome Reward Models for Tool-Calling Large Language Models
di: Agarwal, Mayank, et al.
Pubblicazione: (2025)
di: Agarwal, Mayank, et al.
Pubblicazione: (2025)
Generating Code World Models with Large Language Models Guided by Monte Carlo Tree Search
di: Dainese, Nicola, et al.
Pubblicazione: (2024)
di: Dainese, Nicola, et al.
Pubblicazione: (2024)
Aging in Nationhood: Everyday Nationalism and Belonging Among Seniors in Old‐Age Homes in Québec
di: Jessica Stallone
Pubblicazione: (2025)
di: Jessica Stallone
Pubblicazione: (2025)
NESTFUL: A Benchmark for Evaluating LLMs on Nested Sequences of API Calls
di: Basu, Kinjal, et al.
Pubblicazione: (2024)
di: Basu, Kinjal, et al.
Pubblicazione: (2024)
Multi-Modal Sensor Fusion using Hybrid Attention for Autonomous Driving
di: Mayank, Mayank, et al.
Pubblicazione: (2026)
di: Mayank, Mayank, et al.
Pubblicazione: (2026)
Granite-Function Calling Model: Introducing Function Calling Abilities via Multi-task Learning of Granular Tasks
di: Abdelaziz, Ibrahim, et al.
Pubblicazione: (2024)
di: Abdelaziz, Ibrahim, et al.
Pubblicazione: (2024)
Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage
di: Yuan, Ziqi, et al.
Pubblicazione: (2025)
di: Yuan, Ziqi, et al.
Pubblicazione: (2025)
RetailKLIP : Finetuning OpenCLIP backbone using metric learning on a single GPU for Zero-shot retail product image classification
di: Srivastava, Muktabh Mayank
Pubblicazione: (2023)
di: Srivastava, Muktabh Mayank
Pubblicazione: (2023)
Geodesic structure of spacetime near singularities
di: Mayank, et al.
Pubblicazione: (2025)
di: Mayank, et al.
Pubblicazione: (2025)
Distilling to Hybrid Attention Models via KL-Guided Layer Selection
di: Li, Yanhong, et al.
Pubblicazione: (2025)
di: Li, Yanhong, et al.
Pubblicazione: (2025)
Diversity Measurement and Subset Selection for Instruction Tuning Datasets
di: Wang, Peiqi, et al.
Pubblicazione: (2024)
di: Wang, Peiqi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Scaling Granite Code Models to 128K Context
di: Stallone, Matt, et al.
Pubblicazione: (2024) -
CRANE: Constrained Reasoning Injection for Code Agents via Nullspace Editing
di: Zhu, Mingzhi, et al.
Pubblicazione: (2026) -
Multi-task Code LLMs: Data Mix or Model Merge?
di: Zhu, Mingzhi, et al.
Pubblicazione: (2026) -
Usage, Effects and Requirements for AI Coding Assistants in the Enterprise: An Empirical Study
di: Vukovic, Maja, et al.
Pubblicazione: (2026) -
Data-Prep-Kit: getting your data ready for LLM application development
di: Wood, David, et al.
Pubblicazione: (2024)