Harnessing GPT-4V(ision) for Insurance: A Preliminary Exploration
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lin, Chenwei, Lyu, Hanjia, Luo, Jiebo, Xu, Xian |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
INS-MMBench: A Comprehensive Benchmark for Evaluating LVLMs' Performance in Insurance
par: Lin, Chenwei, et autres
Publié: (2024)
par: Lin, Chenwei, et autres
Publié: (2024)
How Well Does GPT-4V(ision) Adapt to Distribution Shifts? A Preliminary Investigation
par: Han, Zhongyi, et autres
Publié: (2023)
par: Han, Zhongyi, et autres
Publié: (2023)
GPT-4V(ision) is a Generalist Web Agent, if Grounded
par: Zheng, Boyuan, et autres
Publié: (2024)
par: Zheng, Boyuan, et autres
Publié: (2024)
Learning to Evaluate the Artness of AI-generated Images
par: Chen, Junyu, et autres
Publié: (2023)
par: Chen, Junyu, et autres
Publié: (2023)
Irony in Emojis: A Comparative Study of Human and LLM Interpretation
par: Zheng, Yawen, et autres
Publié: (2025)
par: Zheng, Yawen, et autres
Publié: (2025)
DiagrammerGPT: Generating Open-Domain, Open-Platform Diagrams via LLM Planning
par: Zala, Abhay, et autres
Publié: (2023)
par: Zala, Abhay, et autres
Publié: (2023)
VideoDirectorGPT: Consistent Multi-scene Video Generation via LLM-Guided Planning
par: Lin, Han, et autres
Publié: (2023)
par: Lin, Han, et autres
Publié: (2023)
RewardHarness: Self-Evolving Agentic Post-Training
par: Zhang, Yuxuan, et autres
Publié: (2026)
par: Zhang, Yuxuan, et autres
Publié: (2026)
A Safety Report on GPT-5.2, Gemini 3 Pro, Qwen3-VL, Grok 4.1 Fast, Nano Banana Pro, and Seedream 4.5
par: Ma, Xingjun, et autres
Publié: (2026)
par: Ma, Xingjun, et autres
Publié: (2026)
Evolver: Chain-of-Evolution Prompting to Boost Large Multimodal Models for Hateful Meme Detection
par: Huang, Jinfa, et autres
Publié: (2024)
par: Huang, Jinfa, et autres
Publié: (2024)
VIST-GPT: Ushering in the Era of Visual Storytelling with LLMs?
par: Gado, Mohamed, et autres
Publié: (2025)
par: Gado, Mohamed, et autres
Publié: (2025)
AnyGPT: Unified Multimodal LLM with Discrete Sequence Modeling
par: Zhan, Jun, et autres
Publié: (2024)
par: Zhan, Jun, et autres
Publié: (2024)
GPT-4V(ision) for Robotics: Multimodal Task Planning from Human Demonstration
par: Wake, Naoki, et autres
Publié: (2023)
par: Wake, Naoki, et autres
Publié: (2023)
MiniGPT-3D: Efficiently Aligning 3D Point Clouds with Large Language Models using 2D Priors
par: Tang, Yuan, et autres
Publié: (2024)
par: Tang, Yuan, et autres
Publié: (2024)
HuatuoGPT-Vision, Towards Injecting Medical Visual Knowledge into Multimodal LLMs at Scale
par: Chen, Junying, et autres
Publié: (2024)
par: Chen, Junying, et autres
Publié: (2024)
AMFT: Aligning LLM Reasoners by Meta-Learning the Optimal Imitation-Exploration Balance
par: He, Lixuan, et autres
Publié: (2025)
par: He, Lixuan, et autres
Publié: (2025)
RetinalGPT: A Retinal Clinical Preference Conversational Assistant Powered by Large Vision-Language Models
par: Zhu, Wenhui, et autres
Publié: (2025)
par: Zhu, Wenhui, et autres
Publié: (2025)
GUI-Bee: Align GUI Action Grounding to Novel Environments via Autonomous Exploration
par: Fan, Yue, et autres
Publié: (2025)
par: Fan, Yue, et autres
Publié: (2025)
Echo-4o: Harnessing the Power of GPT-4o Synthetic Images for Improved Image Generation
par: Ye, Junyan, et autres
Publié: (2025)
par: Ye, Junyan, et autres
Publié: (2025)
Jr. AI Scientist and Its Risk Report: Autonomous Scientific Exploration from a Baseline Paper
par: Miyai, Atsuyuki, et autres
Publié: (2025)
par: Miyai, Atsuyuki, et autres
Publié: (2025)
A Survey of Automatic Evaluation Methods on Text, Visual and Speech Generations
par: Lan, Tian, et autres
Publié: (2025)
par: Lan, Tian, et autres
Publié: (2025)
Preliminary Investigations of a Multi-Faceted Robust and Synergistic Approach in Semiconductor Electron Micrograph Analysis: Integrating Vision Transformers with Large Language and Multimodal Models
par: Srinivas, Sakhinana Sagar, et autres
Publié: (2024)
par: Srinivas, Sakhinana Sagar, et autres
Publié: (2024)
HIVE: Harnessing Human Feedback for Instructional Visual Editing
par: Zhang, Shu, et autres
Publié: (2023)
par: Zhang, Shu, et autres
Publié: (2023)
ShizhenGPT: Towards Multimodal LLMs for Traditional Chinese Medicine
par: Chen, Junying, et autres
Publié: (2025)
par: Chen, Junying, et autres
Publié: (2025)
ExpVG: Investigating the Design Space of Visual Grounding in Multimodal Large Language Model
par: Kang, Weitai, et autres
Publié: (2025)
par: Kang, Weitai, et autres
Publié: (2025)
Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring
par: Chen, Guanxu, et autres
Publié: (2025)
par: Chen, Guanxu, et autres
Publié: (2025)
Enhancing Temporal Modeling of Video LLMs via Time Gating
par: Hu, Zi-Yuan, et autres
Publié: (2024)
par: Hu, Zi-Yuan, et autres
Publié: (2024)
Streaming-dLLM: Accelerating Diffusion LLMs via Suffix Pruning and Dynamic Decoding
par: Xiao, Zhongyu, et autres
Publié: (2026)
par: Xiao, Zhongyu, et autres
Publié: (2026)
Learn the Ropes, Then Trust the Wins: Self-imitation with Progressive Exploration for Agentic Reinforcement Learning
par: Qin, Yulei, et autres
Publié: (2025)
par: Qin, Yulei, et autres
Publié: (2025)
Fine-Grained Image-Text Alignment in Medical Imaging Enables Explainable Cyclic Image-Report Generation
par: Chen, Wenting, et autres
Publié: (2023)
par: Chen, Wenting, et autres
Publié: (2023)
Ovis: Structural Embedding Alignment for Multimodal Large Language Model
par: Lu, Shiyin, et autres
Publié: (2024)
par: Lu, Shiyin, et autres
Publié: (2024)
Cream of the Crop: Harvesting Rich, Scalable and Transferable Multi-Modal Data for Instruction Fine-Tuning
par: Lyu, Mengyao, et autres
Publié: (2025)
par: Lyu, Mengyao, et autres
Publié: (2025)
Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models
par: Huang, Wenxuan, et autres
Publié: (2025)
par: Huang, Wenxuan, et autres
Publié: (2025)
Rethinking Visual Prompting for Multimodal Large Language Models with External Knowledge
par: Lin, Yuanze, et autres
Publié: (2024)
par: Lin, Yuanze, et autres
Publié: (2024)
Vision-Language Model Based Handwriting Verification
par: Chauhan, Mihir, et autres
Publié: (2024)
par: Chauhan, Mihir, et autres
Publié: (2024)
Benchmarking the Thinking Mode of Multimodal Large Language Models in Clinical Tasks
par: Hong, Jindong, et autres
Publié: (2025)
par: Hong, Jindong, et autres
Publié: (2025)
Closed-Loop Open-Vocabulary Mobile Manipulation with GPT-4V
par: Zhi, Peiyuan, et autres
Publié: (2024)
par: Zhi, Peiyuan, et autres
Publié: (2024)
PH-Dreamer: A Physics-Driven World Model via Port-Hamiltonian Generative Dynamics
par: Luan, Xueyu, et autres
Publié: (2026)
par: Luan, Xueyu, et autres
Publié: (2026)
Dynamic-LLaVA: Efficient Multimodal Large Language Models via Dynamic Vision-language Context Sparsification
par: Huang, Wenxuan, et autres
Publié: (2024)
par: Huang, Wenxuan, et autres
Publié: (2024)
Incentivizing Reasoning for Advanced Instruction-Following of Large Language Models
par: Qin, Yulei, et autres
Publié: (2025)
par: Qin, Yulei, et autres
Publié: (2025)
Documents similaires
-
INS-MMBench: A Comprehensive Benchmark for Evaluating LVLMs' Performance in Insurance
par: Lin, Chenwei, et autres
Publié: (2024) -
How Well Does GPT-4V(ision) Adapt to Distribution Shifts? A Preliminary Investigation
par: Han, Zhongyi, et autres
Publié: (2023) -
GPT-4V(ision) is a Generalist Web Agent, if Grounded
par: Zheng, Boyuan, et autres
Publié: (2024) -
Learning to Evaluate the Artness of AI-generated Images
par: Chen, Junyu, et autres
Publié: (2023) -
Irony in Emojis: A Comparative Study of Human and LLM Interpretation
par: Zheng, Yawen, et autres
Publié: (2025)