智迹闻AuraTracer
EN

EVENT DOSSIER

MMTClinic:用于临床领域的多模态、多语言时间序列问答与推理基准测试

2026-09-07 12:00 科学 🔥 42.2 事件热度
1家信源
1天持续发酵
42.2事件热度
1个提及
摘要由 AI 生成

研究人员发布了 MMTClinic 基准,旨在评估大语言模型在临床时间序列问答与推理任务上的表现。该基准整合了文本、医学图像及多变量生理信号等多模态数据,包含英语、印地语、孟加拉语、马拉地语和泰米尔语共五种语言的 30,000 对问答数据(含 15,000 道选择题和 15,000 道开放题)。基准覆盖死亡率预测、心率预测及 SOFA 评分估算三项核心临床任务。研究团队在零样本、少样本及思维链设置下评估了 13 种最先进的 LLM,发现模型在不同任务、语言和模态下的表现存在显著差异,揭示了当前临床推理能力的局限。数据集将在工作被接受后公开。

相关事件RELATED EVENTS
关键实体KEY ENTITIES
MMTClinic

信号强度SIGNALS

关键词热度
  • MMTClinic1

全部报道(1)SOURCES

A arXiv cs.AI en 2026-09-07 12:00

MMTClinic: Multimodal, Multilingual Time Series Question Answering and Reasoning Benchmark for Clinical Domain

研究人员发布 MMTClinic 基准,用于评估大语言模型在临床时间序列问答与推理任务上的表现。该基准整合文本、医学图像及多变量生理信号,包含涵盖英语、印地语、孟加拉语、马拉地语和泰米尔语共五种语言的 30,000 对问答数据(含 15,000 道选择题和 15,000 道开放题),覆盖死亡率预测、心率预测及 SOFA 评分估算三项临床任务。研究团队在零样本、少样本及思维链设置下评估了 13 种最先进的 LLM,发现模型在不同任务、语言和模态下的表现存在显著差异,揭示了当前临床推理能力的局限。数据集将在工作被接受后公开。