OpenAIが音声インターフェース革命を準備:新デバイスとChatGPTのボイスモード

OpenAIOpenAI
OpenAIはサム・アルトマンとジョニー・アイブと協力して、新しい音声中心のデバイス(おそらくスマートスピーカー)を開発しています。一方、同社はChatGPTにボイスモードをリリースし、最小限の遅延でリアルタイムの自然な会話を可能にし、キーボードやマウスといった従来の入力方法に取って代わる可能性があります。
最近の報告によると、サム・アルトマンとジョニー・アイヴは、新しいハードウェアデバイスを含む共同プロジェクトに取り組んでおり、そのデバイスは音声対話に特化したスマートスピーカーであることが明らかになった。スマートスピーカー市場はすでに飽和状態だが、大きな差別化要因はOpenAIの新しいChatGPTのボイスモードである。単なる音声入力とは異なり、ボイスモードは継続的に聞き取り、ほぼ瞬時に応答し、ユーザーの発言に割り込むことさえできるため、自然な会話の流れを実現する。ユーザーからは言語学習のチューターや翻訳ツールとして有用だと評価されている。このデバイスとボイスモードの組み合わせは、OpenAIが音声をコンピュータの主要な入力方式にしようとしていることを示唆しており、キーボードやマウスに取って代わる可能性がある。この移行には、AIが人間の話し方に適応することが必要であり、人間が入力デバイスの使い方を学ぶ必要はない。最終的に、音声はカメラやジェスチャー、文脈認識を含む、より自然でマルチモーダルなヒューマン・コンピュータ・インターフェースへの第一歩となるだろう。Siriは音声対話の先駆者として評価されているが、現代の大規模言語モデル(LLMs、Large Language Models)は大きく進歩している。この傾向が続けば、キーボードはプロフェッショナル向けの専門ツールとなり、音声インターフェースがスタートアップにとって次の大きな波となるだろう。
出典: Habr — хаб ИИ — 原文
関連記事 ↓
新着ニュース