柴亮太の
AI最前線
最新
基礎
タイムライン
ポッドキャスト
About
☰
×
最新
基礎
タイムライン
ポッドキャスト
About
← ポッドキャスト一覧に戻る
Podcast · Episode 180
LLM圧縮の精度向上:誤差伝播を抑える新手法を開発
8月17日(月) · 6分
LLMのトレーニング不要な低ランク圧縮は、パラメータ削減に有効ですが、キャリブレーションとトランケーションの誤差累積が課題でした。今回、これらの誤差伝播を軽減する新しいトレーニング不要な手法が提案されました。既存SOTAフレームワークに適用した結果、LlamaやQwen3モデルのゼロショットタスクで最大1〜2.5ポイントの精度向上を達成し、圧縮モデルの実用性を高めます。
元記事を読む →
前のエピソード
Anthropic「Claude」AIウォーターマークに“除去”ツール登場|“消せない証明”は可能なのか
次のエピソード
LLMの多言語推論、隠れた言語一貫性の課題