智迹闻AuraTracer
EN

EVENT DOSSIER

MM-IFEval-Pro:一种适用于视觉语言模型指令遵循的多语言且抗攻击的基准测试

2026-09-07 12:00 大模型 🔥 40.2 事件热度
1家信源
1天持续发酵
40.2事件热度
1个提及
摘要由 AI 生成

2026 年 9 月 7 日,arXiv cs.AI 预印本平台发布名为 MM-IFEval-Pro 的评估基准。该基准旨在为视觉 - 语言模型提供多语言及抗攻击能力的指令遵循测试标准。

相关事件RELATED EVENTS
关键实体KEY ENTITIES
MM-IFEval-Pro

信号强度SIGNALS

关键词热度
  • MM-IFEval-Pro1

全部报道(1)SOURCES

A arXiv cs.AI en 2026-09-07 12:00

MM-IFEval-Pro: A Multilingual and Attack-Resistant Benchmark for Instruction-Following in Vision-Language Models

arXiv:2609.04859v1 发布 MM-IFEval-Pro,这是一个覆盖中文和英文任务及多种指令劫持案例的多模态指令遵循基准。该基准包含 4 大类、24 个子类及 8 类共 52 个子类,每个样本平均包含 3.0 个约束以模拟复杂场景。研究团队构建了包含中文和对抗性指令的强化学习训练集,显著提升了模型在 MM-IFEval-Pro 上的表现,并有效迁移至其他主流多模态基准,展现出强大的跨任务和跨语言泛化能力。