Podcast · Episode 248
LLM多言語安全性の幻想:低リソース言語で脆弱性が露呈
8月20日(木) · 5分
大規模言語モデル(LLM)の安全対策は主に英語で開発されていますが、これが多言語環境、特に低リソース言語に普遍的に適用されるという前提に疑問が投げかけられています。アフリカの4言語を対象とした研究で、英語の安全対策がこれらの言語ではほとんど機能せず、有害なプロンプトに対する拒否信号が10%未満であることが判明。現在の多言語安全対策が表面的なものであり、真の安全性アライメント構築の必要性が浮き彫りになりました。