Embedding Compression via Spherical Coordinates
Fuente:
arXiv
Salvato in:
| Autore principale: | Xiao, Han |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The MSR-Video to Text Dataset with Clean Annotations
di: Chen, Haoran, et al.
Pubblicazione: (2021)
di: Chen, Haoran, et al.
Pubblicazione: (2021)
Enhancing OCR for Sino-Vietnamese Language Processing via Fine-tuned PaddleOCRv5
di: Nguyen, Minh Hoang, et al.
Pubblicazione: (2025)
di: Nguyen, Minh Hoang, et al.
Pubblicazione: (2025)
SUGARCREPE++ Dataset: Vision-Language Model Sensitivity to Semantic and Lexical Alterations
di: Dumpala, Sri Harsha, et al.
Pubblicazione: (2024)
di: Dumpala, Sri Harsha, et al.
Pubblicazione: (2024)
STRICT: Stress Test of Rendering Images Containing Text
di: Zhang, Tianyu, et al.
Pubblicazione: (2025)
di: Zhang, Tianyu, et al.
Pubblicazione: (2025)
jina-clip-v2: Multilingual Multimodal Embeddings for Text and Images
di: Koukounas, Andreas, et al.
Pubblicazione: (2024)
di: Koukounas, Andreas, et al.
Pubblicazione: (2024)
A-VERT: Agnostic Verification with Embedding Ranking Targets
di: Aguirre, Nicolás, et al.
Pubblicazione: (2025)
di: Aguirre, Nicolás, et al.
Pubblicazione: (2025)
ReFACT: Updating Text-to-Image Models by Editing the Text Encoder
di: Arad, Dana, et al.
Pubblicazione: (2023)
di: Arad, Dana, et al.
Pubblicazione: (2023)
Explainable Image Captioning using CNN- CNN architecture and Hierarchical Attention
di: Mohan, Rishi Kesav, et al.
Pubblicazione: (2024)
di: Mohan, Rishi Kesav, et al.
Pubblicazione: (2024)
Evaluating MLLMs with Multimodal Multi-image Reasoning Benchmark
di: Cheng, Ziming, et al.
Pubblicazione: (2025)
di: Cheng, Ziming, et al.
Pubblicazione: (2025)
jina-vlm: Small Multilingual Vision Language Model
di: Koukounas, Andreas, et al.
Pubblicazione: (2025)
di: Koukounas, Andreas, et al.
Pubblicazione: (2025)
FrameFusion: Combining Similarity and Importance for Video Token Reduction on Large Vision Language Models
di: Fu, Tianyu, et al.
Pubblicazione: (2024)
di: Fu, Tianyu, et al.
Pubblicazione: (2024)
Jina Embeddings 2: 8192-Token General-Purpose Text Embeddings for Long Documents
di: Günther, Michael, et al.
Pubblicazione: (2023)
di: Günther, Michael, et al.
Pubblicazione: (2023)
DeepInterestGR: Mining Deep Multi-Interest Using Multi-Modal LLMs for Generative Recommendation
di: Zeng, Yangchen, et al.
Pubblicazione: (2026)
di: Zeng, Yangchen, et al.
Pubblicazione: (2026)
Automatic identification of diagnosis from hospital discharge letters via weakly-supervised Natural Language Processing
di: Torri, Vittorio, et al.
Pubblicazione: (2024)
di: Torri, Vittorio, et al.
Pubblicazione: (2024)
Clarification as Supervision: Reinforcement Learning for Vision-Language Interfaces
di: Gkountouras, John, et al.
Pubblicazione: (2025)
di: Gkountouras, John, et al.
Pubblicazione: (2025)
PairCFR: Enhancing Model Training on Paired Counterfactually Augmented Data through Contrastive Learning
di: Qiu, Xiaoqi, et al.
Pubblicazione: (2024)
di: Qiu, Xiaoqi, et al.
Pubblicazione: (2024)
Application of deep learning approaches for medieval historical documents transcription
di: Voloshchuk, Maksym, et al.
Pubblicazione: (2025)
di: Voloshchuk, Maksym, et al.
Pubblicazione: (2025)
Zero- and Few-Shot Prompting with LLMs: A Comparative Study with Fine-tuned Models for Bangla Sentiment Analysis
di: Hasan, Md. Arid, et al.
Pubblicazione: (2023)
di: Hasan, Md. Arid, et al.
Pubblicazione: (2023)
Position-aware Automatic Circuit Discovery
di: Haklay, Tal, et al.
Pubblicazione: (2025)
di: Haklay, Tal, et al.
Pubblicazione: (2025)
$FastDoc$: Domain-Specific Fast Continual Pre-training Technique using Document-Level Metadata and Taxonomy
di: Nandy, Abhilash, et al.
Pubblicazione: (2023)
di: Nandy, Abhilash, et al.
Pubblicazione: (2023)
FairLangProc: A Python package for fairness in NLP
di: Pérez-Peralta, Arturo, et al.
Pubblicazione: (2025)
di: Pérez-Peralta, Arturo, et al.
Pubblicazione: (2025)
LLM Questionnaire Completion for Automatic Psychiatric Assessment
di: Rosenman, Gony, et al.
Pubblicazione: (2024)
di: Rosenman, Gony, et al.
Pubblicazione: (2024)
Pivot Language for Low-Resource Machine Translation
di: Talwar, Abhimanyu, et al.
Pubblicazione: (2025)
di: Talwar, Abhimanyu, et al.
Pubblicazione: (2025)
Unilogit: Robust Machine Unlearning for LLMs Using Uniform-Target Self-Distillation
di: Vasilev, Stefan, et al.
Pubblicazione: (2025)
di: Vasilev, Stefan, et al.
Pubblicazione: (2025)
A Flexible Large Language Models Guardrail Development Methodology Applied to Off-Topic Prompt Detection
di: Chua, Gabriel, et al.
Pubblicazione: (2024)
di: Chua, Gabriel, et al.
Pubblicazione: (2024)
Preserving Empirical Probabilities in BERT for Small-sample Clinical Entity Recognition
di: Rehman, Abdul, et al.
Pubblicazione: (2024)
di: Rehman, Abdul, et al.
Pubblicazione: (2024)
Controlled Automatic Task-Specific Synthetic Data Generation for Hallucination Detection
di: Xie, Yong, et al.
Pubblicazione: (2024)
di: Xie, Yong, et al.
Pubblicazione: (2024)
MemeIntel: Explainable Detection of Propagandistic and Hateful Memes
di: Kmainasi, Mohamed Bayan, et al.
Pubblicazione: (2025)
di: Kmainasi, Mohamed Bayan, et al.
Pubblicazione: (2025)
ArMeme: Propagandistic Content in Arabic Memes
di: Alam, Firoj, et al.
Pubblicazione: (2024)
di: Alam, Firoj, et al.
Pubblicazione: (2024)
BitMar: Low-Bit Multimodal Fusion with Episodic Memory for Edge Devices
di: Aman, Euhid, et al.
Pubblicazione: (2025)
di: Aman, Euhid, et al.
Pubblicazione: (2025)
Compression Method Matters: Benchmark-Dependent Output Dynamics in LLM Prompt Compression
di: Johnson, Warren
Pubblicazione: (2026)
di: Johnson, Warren
Pubblicazione: (2026)
Hateful Meme Detection through Context-Sensitive Prompting and Fine-Grained Labeling
di: Ouyang, Rongxin, et al.
Pubblicazione: (2024)
di: Ouyang, Rongxin, et al.
Pubblicazione: (2024)
Mitigating Position-Shift Failures in Text-Based Modular Arithmetic via Position Curriculum and Template Diversity
di: Yudin, Nikolay
Pubblicazione: (2026)
di: Yudin, Nikolay
Pubblicazione: (2026)
Bonsai: Interpretable Tree-Adaptive Grounded Reasoning
di: Sanders, Kate, et al.
Pubblicazione: (2025)
di: Sanders, Kate, et al.
Pubblicazione: (2025)
Investigating Distributions of Telecom Adapted Sentence Embeddings for Document Retrieval
di: Roychowdhury, Sujoy, et al.
Pubblicazione: (2024)
di: Roychowdhury, Sujoy, et al.
Pubblicazione: (2024)
Beyond RNNs: Benchmarking Attention-Based Image Captioning Models
di: Yanambakkam, Hemanth Teja, et al.
Pubblicazione: (2025)
di: Yanambakkam, Hemanth Teja, et al.
Pubblicazione: (2025)
Continuous Latent Diffusion Language Model
di: Guo, Hongcan, et al.
Pubblicazione: (2026)
di: Guo, Hongcan, et al.
Pubblicazione: (2026)
Cache-to-Cache: Direct Semantic Communication Between Large Language Models
di: Fu, Tianyu, et al.
Pubblicazione: (2025)
di: Fu, Tianyu, et al.
Pubblicazione: (2025)
OmniFusion Technical Report
di: Goncharova, Elizaveta, et al.
Pubblicazione: (2024)
di: Goncharova, Elizaveta, et al.
Pubblicazione: (2024)
IRONIC: Coherence-Aware Reasoning Chains for Multi-Modal Sarcasm Detection
di: Ramakrishnan, Aashish Anantha, et al.
Pubblicazione: (2025)
di: Ramakrishnan, Aashish Anantha, et al.
Pubblicazione: (2025)
Documenti analoghi
-
The MSR-Video to Text Dataset with Clean Annotations
di: Chen, Haoran, et al.
Pubblicazione: (2021) -
Enhancing OCR for Sino-Vietnamese Language Processing via Fine-tuned PaddleOCRv5
di: Nguyen, Minh Hoang, et al.
Pubblicazione: (2025) -
SUGARCREPE++ Dataset: Vision-Language Model Sensitivity to Semantic and Lexical Alterations
di: Dumpala, Sri Harsha, et al.
Pubblicazione: (2024) -
STRICT: Stress Test of Rendering Images Containing Text
di: Zhang, Tianyu, et al.
Pubblicazione: (2025) -
jina-clip-v2: Multilingual Multimodal Embeddings for Text and Images
di: Koukounas, Andreas, et al.
Pubblicazione: (2024)