摘要由 AI 生成
arXiv 于 2026 年 9 月 4 日及 7 日相继发布 LexFlip,一种用于诊断法律意义保留指标解离现象的工具。该工具基于对魁北克法语法规的 373 个最小扰动测试,发现这些扰动在仅改变 0.93 个词元的同时便逆转了法律效力。测试结果表明,七种嵌入模型和 BERTScore 等指标在此类编辑上的得分极低(0.022 至 0.039),远低于双向自然语言推断的得分(0.670)。在 FrJudge 基准测试中,仅长度特征的表现优于所有语义指标,且与人类测量上限(r=0.597)的差距最小。
相关事件RELATED EVENTS
- 2026-09-09 05:29OpenAI声称在著名的“千年难题”上取得了重大数学突破
- 2026-09-09 06:11OpenAI 宣称攻克纳维 - 斯托克斯方程难题遭学界质疑原创性
- 2026-09-08 22:00Google DeepMind Maps 9亿种可能的DNA变异
关键实体KEY ENTITIES
LexFlip
整合时间线UNIFIED TIMELINE
-
2026-09-04
LexFlip: A Dissociation Diagnostic for …
LexFlip: A Dissociation Diagnostic for Legal Meaning Preservation Metrics
-
2026-09-07
LexFlip: A Dissociation Diagnostic for …
arXiv:2609.05296v1 发布 LexFlip,一种用于法律意义保留指标的解离诊断工具。该工具包含 373 个对魁北克法语法规的最小扰动,这些扰动在保留 0.93 个词元的同时逆转了法律效力。测试显示,七种嵌入和 BERTSc…
信号强度SIGNALS
关键词热度
全部报道(2)SOURCES
LexFlip: A Dissociation Diagnostic for Legal Meaning Preservation Metrics
arXiv:2609.05296v1 发布 LexFlip,一种用于法律意义保留指标的解离诊断工具。该工具包含 373 个对魁北克法语法规的最小扰动,这些扰动在保留 0.93 个词元的同时逆转了法律效力。测试显示,七种嵌入和 BERTScore 指标在此类编辑上的得分仅占其相同 - 无关范围值的 0.022 至 0.039,远低于双向自然语言推断(0.670)。在 FrJudge 基准上,与人类测量上限 r=0.597 相比,仅长度特征的表现优于所有语义指标且差距最小。