Measuring Vision-Language STEM Skills of Neural Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shen, Jianhao, Yuan, Ye, Mirzoyan, Srbuhi, Zhang, Ming, Wang, Chenguang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Measuring Social Norms of Large Language Models
par: Yuan, Ye, et autres
Publié: (2024)
par: Yuan, Ye, et autres
Publié: (2024)
SAC-KG: Exploiting Large Language Models as Skilled Automatic Constructors for Domain Knowledge Graphs
par: Chen, Hanzhu, et autres
Publié: (2024)
par: Chen, Hanzhu, et autres
Publié: (2024)
Agent Instructs Large Language Models to be General Zero-Shot Reasoners
par: Crispino, Nicholas, et autres
Publié: (2023)
par: Crispino, Nicholas, et autres
Publié: (2023)
Re-Tuning: Overcoming the Compositionality Limits of Large Language Models with Recursive Tuning
par: Pasewark, Eric, et autres
Publié: (2024)
par: Pasewark, Eric, et autres
Publié: (2024)
Knowledge Fusion of Large Language Models Via Modular SkillPacks
par: Du, Guodong, et autres
Publié: (2025)
par: Du, Guodong, et autres
Publié: (2025)
Preference Poisoning Attacks on Reward Model Learning
par: Wu, Junlin, et autres
Publié: (2024)
par: Wu, Junlin, et autres
Publié: (2024)
Data-Driven Calibration of Prediction Sets in Large Vision-Language Models Based on Inductive Conformal Prediction
par: Ye, Yuanchang, et autres
Publié: (2025)
par: Ye, Yuanchang, et autres
Publié: (2025)
Language-guided Skill Learning with Temporal Variational Inference
par: Fu, Haotian, et autres
Publié: (2024)
par: Fu, Haotian, et autres
Publié: (2024)
Self-Generated Critiques Boost Reward Modeling for Language Models
par: Yu, Yue, et autres
Publié: (2024)
par: Yu, Yue, et autres
Publié: (2024)
Directional Embedding Smoothing for Robust Vision Language Models
par: Wang, Ye, et autres
Publié: (2026)
par: Wang, Ye, et autres
Publié: (2026)
Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification
par: Liu, Chengwu, et autres
Publié: (2025)
par: Liu, Chengwu, et autres
Publié: (2025)
RuleR: Improving LLM Controllability by Rule-based Data Recycling
par: Li, Ming, et autres
Publié: (2024)
par: Li, Ming, et autres
Publié: (2024)
Missing Premise exacerbates Overthinking: Are Reasoning Models losing Critical Thinking Skill?
par: Fan, Chenrui, et autres
Publié: (2025)
par: Fan, Chenrui, et autres
Publié: (2025)
Graph Neural Prompting with Large Language Models
par: Tian, Yijun, et autres
Publié: (2023)
par: Tian, Yijun, et autres
Publié: (2023)
Small Language Models: Survey, Measurements, and Insights
par: Lu, Zhenyan, et autres
Publié: (2024)
par: Lu, Zhenyan, et autres
Publié: (2024)
MemSkill: Learning and Evolving Memory Skills for Self-Evolving Agents
par: Zhang, Haozhen, et autres
Publié: (2026)
par: Zhang, Haozhen, et autres
Publié: (2026)
VL-RouterBench: A Benchmark for Vision-Language Model Routing
par: Huang, Zhehao, et autres
Publié: (2025)
par: Huang, Zhehao, et autres
Publié: (2025)
Seeking Neural Nuggets: Knowledge Transfer in Large Language Models from a Parametric Perspective
par: Zhong, Ming, et autres
Publié: (2023)
par: Zhong, Ming, et autres
Publié: (2023)
Enhancing Quantitative Reasoning Skills of Large Language Models through Dimension Perception
par: Huang, Yuncheng, et autres
Publié: (2023)
par: Huang, Yuncheng, et autres
Publié: (2023)
MMG2Skill: Can Agents Distill In-the-Wild Guides into Self-Evolving Skills?
par: Che, Xinyu, et autres
Publié: (2026)
par: Che, Xinyu, et autres
Publié: (2026)
Interpretable by AI Mother Tongue: Native Symbolic Reasoning in Neural Models
par: Liu, Hung Ming
Publié: (2025)
par: Liu, Hung Ming
Publié: (2025)
VerAs: Verify then Assess STEM Lab Reports
par: Atil, Berk, et autres
Publié: (2024)
par: Atil, Berk, et autres
Publié: (2024)
Systematic Outliers in Large Language Models
par: An, Yongqi, et autres
Publié: (2025)
par: An, Yongqi, et autres
Publié: (2025)
Characterizing Model-Native Skills
par: Kang, Feiyang, et autres
Publié: (2026)
par: Kang, Feiyang, et autres
Publié: (2026)
AutoEnv: Automated Environments for Measuring Cross-Environment Agent Learning
par: Zhang, Jiayi, et autres
Publié: (2025)
par: Zhang, Jiayi, et autres
Publié: (2025)
The Limited Impact of Medical Adaptation of Large Language and Vision-Language Models
par: Jeong, Daniel P., et autres
Publié: (2024)
par: Jeong, Daniel P., et autres
Publié: (2024)
Towards Visual Text Grounding of Multimodal Large Language Model
par: Li, Ming, et autres
Publié: (2025)
par: Li, Ming, et autres
Publié: (2025)
STEM: Efficient Relative Capability Evaluation of LLMs through Structured Transition Samples
par: Hu, Haiquan, et autres
Publié: (2025)
par: Hu, Haiquan, et autres
Publié: (2025)
KwaiAgents: Generalized Information-seeking Agent System with Large Language Models
par: Pan, Haojie, et autres
Publié: (2023)
par: Pan, Haojie, et autres
Publié: (2023)
Large Visual-Language Models Are Also Good Classifiers: A Study of In-Context Multimodal Fake News Detection
par: Jiang, Ye, et autres
Publié: (2024)
par: Jiang, Ye, et autres
Publié: (2024)
Language Models as Hierarchy Encoders
par: He, Yuan, et autres
Publié: (2024)
par: He, Yuan, et autres
Publié: (2024)
Finding Culture-Sensitive Neurons in Vision-Language Models
par: Zhao, Xiutian, et autres
Publié: (2025)
par: Zhao, Xiutian, et autres
Publié: (2025)
Knowledge is Not Enough: Injecting RL Skills for Continual Adaptation
par: Tang, Pingzhi, et autres
Publié: (2026)
par: Tang, Pingzhi, et autres
Publié: (2026)
Language Guided Skill Discovery
par: Rho, Seungeun, et autres
Publié: (2024)
par: Rho, Seungeun, et autres
Publié: (2024)
Multimodal Generative Engine Optimization: Rank Manipulation for Vision-Language Model Rankers
par: Du, Yixuan, et autres
Publié: (2026)
par: Du, Yixuan, et autres
Publié: (2026)
Measuring and Controlling Instruction (In)Stability in Language Model Dialogs
par: Li, Kenneth, et autres
Publié: (2024)
par: Li, Kenneth, et autres
Publié: (2024)
NeuronTune: Fine-Grained Neuron Modulation for Balanced Safety-Utility Alignment in LLMs
par: Pan, Birong, et autres
Publié: (2025)
par: Pan, Birong, et autres
Publié: (2025)
Medical Adaptation of Large Language and Vision-Language Models: Are We Making Progress?
par: Jeong, Daniel P., et autres
Publié: (2024)
par: Jeong, Daniel P., et autres
Publié: (2024)
Skill-SD: Skill-Conditioned Self-Distillation for Multi-turn LLM Agents
par: Wang, Hao, et autres
Publié: (2026)
par: Wang, Hao, et autres
Publié: (2026)
RevOrder: A Novel Method for Enhanced Arithmetic in Language Models
par: Shen, Si, et autres
Publié: (2024)
par: Shen, Si, et autres
Publié: (2024)
Documents similaires
-
Measuring Social Norms of Large Language Models
par: Yuan, Ye, et autres
Publié: (2024) -
SAC-KG: Exploiting Large Language Models as Skilled Automatic Constructors for Domain Knowledge Graphs
par: Chen, Hanzhu, et autres
Publié: (2024) -
Agent Instructs Large Language Models to be General Zero-Shot Reasoners
par: Crispino, Nicholas, et autres
Publié: (2023) -
Re-Tuning: Overcoming the Compositionality Limits of Large Language Models with Recursive Tuning
par: Pasewark, Eric, et autres
Publié: (2024) -
Knowledge Fusion of Large Language Models Via Modular SkillPacks
par: Du, Guodong, et autres
Publié: (2025)