Podcast · Episode 356
LVLMの「幻覚」をトークンレベルで検出:UniProbeが画期的な解決策を提示
8月31日(月) · 5分
大規模視覚言語モデル(LVLM)は目覚ましい進歩を遂げる一方で、視覚入力に存在しない「幻覚」(ハルシネーション)を生成するという課題を抱えています。今回発表されたUniProbeは、LVLMの内部計算トレースを解析し、トークンレベルで幻覚を高精度に検出する軽量かつ統一された学習可能な検出器です。既存手法の限界を克服し、生成中の幻覚を最大55%削減する可能性を示しています。