OpenAIの新音声モデルが同時聴話を実現、リアルタイム翻訳がより自然に
OpenAIは2026年7月9日、「同時に話しながら聴く」能力を初めて実現した新世代音声モデルを正式発表した。この技術革新により、同時通訳や多言語通話などのシナリオでリアルタイム対話の遅延と中断感が大幅に軽減される。
OpenAIは2026年7月9日、「同時に話しながら聴く」能力を初めて実現した新世代音声モデルを正式発表した。この技術革新により、同時通訳や多言語通話などのシナリオでリアルタイム対話の遅延と中断感が大幅に軽減される。
AI翻訳大手のDeepLが、ライブ音声ストリーミング・翻訳スタートアップのMixhaloを買収した。この買収により、サンフランシスコに新オフィスを開設し、文書翻訳からリアルタイム音声翻訳へと製品ラインナップを拡充する。
Googleは2026年Google I/Oで、原音声の語調・速度・音高を保ったまま翻訳するリアルタイム音声相互翻訳機能「Gemini 3.5 Live Translate」を発表した。SynthID電子透かしを搭載し、ディープフェイクの悪
DeepLは、リアルタイム音声翻訳に先進的な翻訳技術を適用し、ZoomやMicrosoft Teamsと統合する計画を発表した。これにより、DeepLは競争の激しい言語サービス市場でのシェア拡大を目指している。
AI搭載の物理的なノート取りデバイスが登場し、会議の録音・文字起こし・要約・アクションアイテムの生成、さらにリアルタイム翻訳機能を提供することで、現代の職場における生産性向上に貢献している。
AIノートデバイスは会議の生産性を向上させる新しいツールです。これらのデバイスは音声を自動的に転写し、要約とアクション項目を生成することで、ビジネス環境での負担を軽減します。