柴亮太の
AI最前線
最新
基礎
タイムライン
ポッドキャスト
About
☰
×
最新
基礎
タイムライン
ポッドキャスト
About
← ポッドキャスト一覧に戻る
Podcast · Episode 43
OpenAI、文字起こし新モデル「GPT-Transcribe」発表 ライブと収録で最適化へ
8月8日(土) · 4分
OpenAIが新たな文字起こしモデル「GPT-Transcribe」を公開しました。従来のWhisper-1と比較して誤り率が半減し、ライブ音声と収録音声で異なる設計思想を採用。これにより、各ユースケースに特化した高精度な文字起こしが可能となり、ビジネス現場での活用が加速すると私は見ています。
元記事を読む →
前のエピソード
Google Docs、Geminiがコメント対応を支援|要約・返信・本文修正まで対応
次のエピソード
SpaceXAI「Grok Voice Think Fast 2.0」|音声AIは「話す」から「仕事を進める」へ