C2LLM Technical Report: A New Frontier in Code Retrieval via Adaptive Cross-Attention Pooling
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Qin, Jin, Liao, Zihan, Zhang, Ziyin, Yu, Hang, Di, Peng, Wang, Rui |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
F2LLM Technical Report: Matching SOTA Embedding Performance with 6 Million Open-Source Data
par: Zhang, Ziyin, et autres
Publié: (2025)
par: Zhang, Ziyin, et autres
Publié: (2025)
F2LLM-v2: Inclusive, Performant, and Efficient Embeddings for a Multilingual World
par: Zhang, Ziyin, et autres
Publié: (2026)
par: Zhang, Ziyin, et autres
Publié: (2026)
ML-Embed: Inclusive and Efficient Embeddings for a Multilingual World
par: Zhang, Ziyin, et autres
Publié: (2026)
par: Zhang, Ziyin, et autres
Publié: (2026)
GALLa: Graph Aligned Large Language Models for Improved Source Code Understanding
par: Zhang, Ziyin, et autres
Publié: (2024)
par: Zhang, Ziyin, et autres
Publié: (2024)
Beyond Retrieval: A Multitask Benchmark and Model for Code Search
par: Xue, Siqiao, et autres
Publié: (2026)
par: Xue, Siqiao, et autres
Publié: (2026)
TingIS: Real-time Risk Event Discovery from Noisy Customer Incidents at Enterprise Scale
par: Wang, Jun, et autres
Publié: (2026)
par: Wang, Jun, et autres
Publié: (2026)
Unifying the Perspectives of NLP and Software Engineering: A Survey on Language Models for Code
par: Zhang, Ziyin, et autres
Publié: (2023)
par: Zhang, Ziyin, et autres
Publié: (2023)
QZhou-Embedding Technical Report
par: Yu, Peng, et autres
Publié: (2025)
par: Yu, Peng, et autres
Publié: (2025)
Kwai Summary Attention Technical Report
par: Chu, Chenglong, et autres
Publié: (2026)
par: Chu, Chenglong, et autres
Publié: (2026)
Tele-FLM Technical Report
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
LLM Alignment as Retriever Optimization: An Information Retrieval Perspective
par: Jin, Bowen, et autres
Publié: (2025)
par: Jin, Bowen, et autres
Publié: (2025)
dots.llm1 Technical Report
par: Huo, Bi, et autres
Publié: (2025)
par: Huo, Bi, et autres
Publié: (2025)
Qwen2 Technical Report
par: Yang, An, et autres
Publié: (2024)
par: Yang, An, et autres
Publié: (2024)
Tug-of-War within A Decade: Conflict Resolution in Vulnerability Analysis via Teacher-Guided Retrieval-Augmented Generations
par: Zhou, Ziyin, et autres
Publié: (2026)
par: Zhou, Ziyin, et autres
Publié: (2026)
EuroLLM-22B: Technical Report
par: Ramos, Miguel Moura, et autres
Publié: (2026)
par: Ramos, Miguel Moura, et autres
Publié: (2026)
EuroLLM-9B: Technical Report
par: Martins, Pedro Henrique, et autres
Publié: (2025)
par: Martins, Pedro Henrique, et autres
Publié: (2025)
Sigma-MoE-Tiny Technical Report
par: Hu, Qingguo, et autres
Publié: (2025)
par: Hu, Qingguo, et autres
Publié: (2025)
Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report
par: Lab, Shanghai AI, et autres
Publié: (2025)
par: Lab, Shanghai AI, et autres
Publié: (2025)
Xmodel-LM Technical Report
par: Wang, Yichuan, et autres
Publié: (2024)
par: Wang, Yichuan, et autres
Publié: (2024)
InternLM2 Technical Report
par: Cai, Zheng, et autres
Publié: (2024)
par: Cai, Zheng, et autres
Publié: (2024)
CATP: Cross-Attention Token Pruning for Accuracy Preserved Multimodal Model Inference
par: Liao, Ruqi, et autres
Publié: (2024)
par: Liao, Ruqi, et autres
Publié: (2024)
xGen-small Technical Report
par: Nijkamp, Erik, et autres
Publié: (2025)
par: Nijkamp, Erik, et autres
Publié: (2025)
Retrieval-Augmented Generation in Medicine: A Scoping Review of Technical Implementations, Clinical Applications, and Ethical Considerations
par: Yang, Rui, et autres
Publié: (2025)
par: Yang, Rui, et autres
Publié: (2025)
Distilling LLM Agent into Small Models with Retrieval and Code Tools
par: Kang, Minki, et autres
Publié: (2025)
par: Kang, Minki, et autres
Publié: (2025)
Reducing the Footprint of Multi-Vector Retrieval with Minimal Performance Impact via Token Pooling
par: Clavié, Benjamin, et autres
Publié: (2024)
par: Clavié, Benjamin, et autres
Publié: (2024)
Embedding-Informed Adaptive Retrieval-Augmented Generation of Large Language Models
par: Huang, Chengkai, et autres
Publié: (2024)
par: Huang, Chengkai, et autres
Publié: (2024)
From Black Box to Transparency: Enhancing Automated Interpreting Assessment with Explainable AI in College Classrooms
par: Jiang, Zhaokun, et autres
Publié: (2025)
par: Jiang, Zhaokun, et autres
Publié: (2025)
Fish Audio S2 Technical Report
par: Liao, Shijia, et autres
Publié: (2026)
par: Liao, Shijia, et autres
Publié: (2026)
MOSS-TTS Technical Report
par: Gong, Yitian, et autres
Publié: (2026)
par: Gong, Yitian, et autres
Publié: (2026)
Enhancing Essay Scoring with Adversarial Weights Perturbation and Metric-specific AttentionPooling
par: Huang, Jiaxin, et autres
Publié: (2024)
par: Huang, Jiaxin, et autres
Publié: (2024)
Phi-4 Technical Report
par: Abdin, Marah, et autres
Publié: (2024)
par: Abdin, Marah, et autres
Publié: (2024)
Enhancing Hyperspace Analogue to Language (HAL) Representations via Attention-Based Pooling for Text Classification
par: Sakour, Ali, et autres
Publié: (2026)
par: Sakour, Ali, et autres
Publié: (2026)
BioELX: Cross-lingual Biomedical Entity Linking via Alias-based Retrieval and LLM Ranking
par: Wang, Yi, et autres
Publié: (2026)
par: Wang, Yi, et autres
Publié: (2026)
TeleChat Technical Report
par: He, Zhongjiang, et autres
Publié: (2024)
par: He, Zhongjiang, et autres
Publié: (2024)
Attention Editing: A Versatile Framework for Cross-Architecture Attention Conversion
par: Cheng, Zhen, et autres
Publié: (2026)
par: Cheng, Zhen, et autres
Publié: (2026)
Pooling Attention: Evaluating Pretrained Transformer Embeddings for Deception Classification
par: Mamtani, Sumit, et autres
Publié: (2025)
par: Mamtani, Sumit, et autres
Publié: (2025)
A Comprehensive Survey on Relation Extraction: Recent Advances and New Frontiers
par: Zhao, Xiaoyan, et autres
Publié: (2023)
par: Zhao, Xiaoyan, et autres
Publié: (2023)
K-EXAONE Technical Report
par: Choi, Eunbi, et autres
Publié: (2026)
par: Choi, Eunbi, et autres
Publié: (2026)
GPT-4 Technical Report
par: OpenAI, et autres
Publié: (2023)
par: OpenAI, et autres
Publié: (2023)
CIRAG: Construction-Integration Retrieval and Adaptive Generation for Multi-hop Question Answering
par: Wei, Zili, et autres
Publié: (2026)
par: Wei, Zili, et autres
Publié: (2026)
Documents similaires
-
F2LLM Technical Report: Matching SOTA Embedding Performance with 6 Million Open-Source Data
par: Zhang, Ziyin, et autres
Publié: (2025) -
F2LLM-v2: Inclusive, Performant, and Efficient Embeddings for a Multilingual World
par: Zhang, Ziyin, et autres
Publié: (2026) -
ML-Embed: Inclusive and Efficient Embeddings for a Multilingual World
par: Zhang, Ziyin, et autres
Publié: (2026) -
GALLa: Graph Aligned Large Language Models for Improved Source Code Understanding
par: Zhang, Ziyin, et autres
Publié: (2024) -
Beyond Retrieval: A Multitask Benchmark and Model for Code Search
par: Xue, Siqiao, et autres
Publié: (2026)