← ポッドキャスト一覧に戻る
Podcast · Episode 248

LLM多言語安全性の幻想:低リソース言語で脆弱性が露呈

8月20日(木) · 5分
大規模言語モデル(LLM)の安全対策は主に英語で開発されていますが、これが多言語環境、特に低リソース言語に普遍的に適用されるという前提に疑問が投げかけられています。アフリカの4言語を対象とした研究で、英語の安全対策がこれらの言語ではほとんど機能せず、有害なプロンプトに対する拒否信号が10%未満であることが判明。現在の多言語安全対策が表面的なものであり、真の安全性アライメント構築の必要性が浮き彫りになりました。
前のエピソード因果探索の統計エンジン:条件付き独立性テストの現状と課題 次のエピソードLLM自己再帰プローブの測定:モデル特性と構造的影響を区別する新手法