# 多模态大模型 本框架支持两种自定义多模态评测方式: - **通用问答题格式(General-VQA)**:适用于问答类多模态评测任务。支持两种输入风格:**OpenAI 消息数据** 和 **MMMU 风格媒体占位符数据**。 - **通用选择题格式(General-VMCQ)**:适用于选择题类多模态评测任务。使用[媒体占位符机制][mp-feature]在问题和选项中嵌入图片、视频和音频,类似 MMMU 格式。 ## 通用问答题格式(General-VQA) General-VQA 支持**两种输入风格**: 1. **OpenAI 消息数据** — 完整的结构化内容,在 OpenAI 消息模式中显式包含媒体部分(图片、音频、视频)。支持多轮对话、系统提示以及对每个内容部分的精细控制。 2. **MMMU 风格媒体占位符数据** — 一种更简单的方式,用户消息为包含 ``、`