軸: モデル / 出力 1st Workshop on Large Language Model Memorization (L2M2), pp. 106–126 | stub(原論文未読)

Memorization is language-sensitive

TL;DR

オランダ語・スロベニア語・ポーランド語・チェコ語での暗記を、 文字列の類似度メンバーシップ推論の両方で分析した。 モデルサイズ の知見が再現された上、低資源言語ほどメンバーシップ推論の性能が高まると報告。

位置づけ

モデル軸・出力軸。Ishihara 26 4·4 節と 7·2 節で引用される。 英語以外の言語を複数扱った数少ない研究。

手法・実験

オランダ語・スロベニア語・ポーランド語・チェコ語を対象に、 文字列の類似度とメンバーシップ推論の 2 系統で暗記を分析する。

主要な知見

限界・批判

Wiki 内の接点