Measuring Vision-Language STEM Skills of Neural Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Shen, Jianhao, Yuan, Ye, Mirzoyan, Srbuhi, Zhang, Ming, Wang, Chenguang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Measuring Social Norms of Large Language Models
von: Yuan, Ye, et al.
Veröffentlicht: (2024)
von: Yuan, Ye, et al.
Veröffentlicht: (2024)
SAC-KG: Exploiting Large Language Models as Skilled Automatic Constructors for Domain Knowledge Graphs
von: Chen, Hanzhu, et al.
Veröffentlicht: (2024)
von: Chen, Hanzhu, et al.
Veröffentlicht: (2024)
Agent Instructs Large Language Models to be General Zero-Shot Reasoners
von: Crispino, Nicholas, et al.
Veröffentlicht: (2023)
von: Crispino, Nicholas, et al.
Veröffentlicht: (2023)
Re-Tuning: Overcoming the Compositionality Limits of Large Language Models with Recursive Tuning
von: Pasewark, Eric, et al.
Veröffentlicht: (2024)
von: Pasewark, Eric, et al.
Veröffentlicht: (2024)
Knowledge Fusion of Large Language Models Via Modular SkillPacks
von: Du, Guodong, et al.
Veröffentlicht: (2025)
von: Du, Guodong, et al.
Veröffentlicht: (2025)
Preference Poisoning Attacks on Reward Model Learning
von: Wu, Junlin, et al.
Veröffentlicht: (2024)
von: Wu, Junlin, et al.
Veröffentlicht: (2024)
Data-Driven Calibration of Prediction Sets in Large Vision-Language Models Based on Inductive Conformal Prediction
von: Ye, Yuanchang, et al.
Veröffentlicht: (2025)
von: Ye, Yuanchang, et al.
Veröffentlicht: (2025)
Language-guided Skill Learning with Temporal Variational Inference
von: Fu, Haotian, et al.
Veröffentlicht: (2024)
von: Fu, Haotian, et al.
Veröffentlicht: (2024)
Self-Generated Critiques Boost Reward Modeling for Language Models
von: Yu, Yue, et al.
Veröffentlicht: (2024)
von: Yu, Yue, et al.
Veröffentlicht: (2024)
Directional Embedding Smoothing for Robust Vision Language Models
von: Wang, Ye, et al.
Veröffentlicht: (2026)
von: Wang, Ye, et al.
Veröffentlicht: (2026)
Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification
von: Liu, Chengwu, et al.
Veröffentlicht: (2025)
von: Liu, Chengwu, et al.
Veröffentlicht: (2025)
RuleR: Improving LLM Controllability by Rule-based Data Recycling
von: Li, Ming, et al.
Veröffentlicht: (2024)
von: Li, Ming, et al.
Veröffentlicht: (2024)
Missing Premise exacerbates Overthinking: Are Reasoning Models losing Critical Thinking Skill?
von: Fan, Chenrui, et al.
Veröffentlicht: (2025)
von: Fan, Chenrui, et al.
Veröffentlicht: (2025)
Graph Neural Prompting with Large Language Models
von: Tian, Yijun, et al.
Veröffentlicht: (2023)
von: Tian, Yijun, et al.
Veröffentlicht: (2023)
Small Language Models: Survey, Measurements, and Insights
von: Lu, Zhenyan, et al.
Veröffentlicht: (2024)
von: Lu, Zhenyan, et al.
Veröffentlicht: (2024)
MemSkill: Learning and Evolving Memory Skills for Self-Evolving Agents
von: Zhang, Haozhen, et al.
Veröffentlicht: (2026)
von: Zhang, Haozhen, et al.
Veröffentlicht: (2026)
VL-RouterBench: A Benchmark for Vision-Language Model Routing
von: Huang, Zhehao, et al.
Veröffentlicht: (2025)
von: Huang, Zhehao, et al.
Veröffentlicht: (2025)
Seeking Neural Nuggets: Knowledge Transfer in Large Language Models from a Parametric Perspective
von: Zhong, Ming, et al.
Veröffentlicht: (2023)
von: Zhong, Ming, et al.
Veröffentlicht: (2023)
Enhancing Quantitative Reasoning Skills of Large Language Models through Dimension Perception
von: Huang, Yuncheng, et al.
Veröffentlicht: (2023)
von: Huang, Yuncheng, et al.
Veröffentlicht: (2023)
MMG2Skill: Can Agents Distill In-the-Wild Guides into Self-Evolving Skills?
von: Che, Xinyu, et al.
Veröffentlicht: (2026)
von: Che, Xinyu, et al.
Veröffentlicht: (2026)
Interpretable by AI Mother Tongue: Native Symbolic Reasoning in Neural Models
von: Liu, Hung Ming
Veröffentlicht: (2025)
von: Liu, Hung Ming
Veröffentlicht: (2025)
VerAs: Verify then Assess STEM Lab Reports
von: Atil, Berk, et al.
Veröffentlicht: (2024)
von: Atil, Berk, et al.
Veröffentlicht: (2024)
Systematic Outliers in Large Language Models
von: An, Yongqi, et al.
Veröffentlicht: (2025)
von: An, Yongqi, et al.
Veröffentlicht: (2025)
Characterizing Model-Native Skills
von: Kang, Feiyang, et al.
Veröffentlicht: (2026)
von: Kang, Feiyang, et al.
Veröffentlicht: (2026)
AutoEnv: Automated Environments for Measuring Cross-Environment Agent Learning
von: Zhang, Jiayi, et al.
Veröffentlicht: (2025)
von: Zhang, Jiayi, et al.
Veröffentlicht: (2025)
The Limited Impact of Medical Adaptation of Large Language and Vision-Language Models
von: Jeong, Daniel P., et al.
Veröffentlicht: (2024)
von: Jeong, Daniel P., et al.
Veröffentlicht: (2024)
Towards Visual Text Grounding of Multimodal Large Language Model
von: Li, Ming, et al.
Veröffentlicht: (2025)
von: Li, Ming, et al.
Veröffentlicht: (2025)
STEM: Efficient Relative Capability Evaluation of LLMs through Structured Transition Samples
von: Hu, Haiquan, et al.
Veröffentlicht: (2025)
von: Hu, Haiquan, et al.
Veröffentlicht: (2025)
KwaiAgents: Generalized Information-seeking Agent System with Large Language Models
von: Pan, Haojie, et al.
Veröffentlicht: (2023)
von: Pan, Haojie, et al.
Veröffentlicht: (2023)
Large Visual-Language Models Are Also Good Classifiers: A Study of In-Context Multimodal Fake News Detection
von: Jiang, Ye, et al.
Veröffentlicht: (2024)
von: Jiang, Ye, et al.
Veröffentlicht: (2024)
Language Models as Hierarchy Encoders
von: He, Yuan, et al.
Veröffentlicht: (2024)
von: He, Yuan, et al.
Veröffentlicht: (2024)
Finding Culture-Sensitive Neurons in Vision-Language Models
von: Zhao, Xiutian, et al.
Veröffentlicht: (2025)
von: Zhao, Xiutian, et al.
Veröffentlicht: (2025)
Knowledge is Not Enough: Injecting RL Skills for Continual Adaptation
von: Tang, Pingzhi, et al.
Veröffentlicht: (2026)
von: Tang, Pingzhi, et al.
Veröffentlicht: (2026)
Language Guided Skill Discovery
von: Rho, Seungeun, et al.
Veröffentlicht: (2024)
von: Rho, Seungeun, et al.
Veröffentlicht: (2024)
Multimodal Generative Engine Optimization: Rank Manipulation for Vision-Language Model Rankers
von: Du, Yixuan, et al.
Veröffentlicht: (2026)
von: Du, Yixuan, et al.
Veröffentlicht: (2026)
Measuring and Controlling Instruction (In)Stability in Language Model Dialogs
von: Li, Kenneth, et al.
Veröffentlicht: (2024)
von: Li, Kenneth, et al.
Veröffentlicht: (2024)
NeuronTune: Fine-Grained Neuron Modulation for Balanced Safety-Utility Alignment in LLMs
von: Pan, Birong, et al.
Veröffentlicht: (2025)
von: Pan, Birong, et al.
Veröffentlicht: (2025)
Medical Adaptation of Large Language and Vision-Language Models: Are We Making Progress?
von: Jeong, Daniel P., et al.
Veröffentlicht: (2024)
von: Jeong, Daniel P., et al.
Veröffentlicht: (2024)
Skill-SD: Skill-Conditioned Self-Distillation for Multi-turn LLM Agents
von: Wang, Hao, et al.
Veröffentlicht: (2026)
von: Wang, Hao, et al.
Veröffentlicht: (2026)
RevOrder: A Novel Method for Enhanced Arithmetic in Language Models
von: Shen, Si, et al.
Veröffentlicht: (2024)
von: Shen, Si, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Measuring Social Norms of Large Language Models
von: Yuan, Ye, et al.
Veröffentlicht: (2024) -
SAC-KG: Exploiting Large Language Models as Skilled Automatic Constructors for Domain Knowledge Graphs
von: Chen, Hanzhu, et al.
Veröffentlicht: (2024) -
Agent Instructs Large Language Models to be General Zero-Shot Reasoners
von: Crispino, Nicholas, et al.
Veröffentlicht: (2023) -
Re-Tuning: Overcoming the Compositionality Limits of Large Language Models with Recursive Tuning
von: Pasewark, Eric, et al.
Veröffentlicht: (2024) -
Knowledge Fusion of Large Language Models Via Modular SkillPacks
von: Du, Guodong, et al.
Veröffentlicht: (2025)