OpenAI bereidt een steminterface-revolutie voor: nieuw apparaat en spraakmodus in ChatGPT
OpenAI
OpenAI werkt samen met Sam Altman en Jony Ive aan een nieuw, op spraak gericht apparaat, vermoedelijk een slimme luidspreker. Tegelijkertijd heeft het bedrijf de spraakmodus in ChatGPT uitgebracht, die realtime, natuurlijke conversatie met minimale latentie mogelijk maakt en traditionele invoermethoden zoals toetsenborden en muizen zou kunnen vervangen.
Recente berichten wijzen erop dat Sam Altman en Jony Ive al enige tijd samenwerken aan een gezamenlijk project rond een nieuw hardwareapparaat, dat nu een slimme luidspreker blijkt te zijn die gericht is op spraakinteractie. Hoewel de markt voor slimme luidsprekers al overvol is, is het belangrijkste onderscheidende element de nieuwe spraakmodus van OpenAI in ChatGPT. In tegenstelling tot eenvoudige dicteerfuncties luistert de spraakmodus continu, reageert bijna onmiddellijk en kan zelfs over de gebruiker heen praten, waardoor een natuurlijke gespreksstroom ontstaat. Gebruikers hebben het nuttig gevonden als taaltrainer en vertaler. De combinatie van dit apparaat en de spraakmodus suggereert dat OpenAI erop mikt om spraak de primaire invoermethode voor computers te maken, mogelijk ter vervanging van toetsenborden en muizen. Deze verschuiving vereist dat AI zich aanpast aan menselijke spraak in plaats van dat mensen leren invoerapparaten te gebruiken. Uiteindelijk zou spraak de eerste stap kunnen zijn naar een meer natuurlijke, multimodale mens-computerinteractie met camera's, gebaren en contextbewustzijn. Siri wordt geprezen als een pionier op het gebied van spraakinteractie, maar moderne grote taalmodellen zijn aanzienlijk verbeterd. Als deze trend doorzet, zouden toetsenborden gespecialiseerde gereedschappen voor professionals kunnen worden en zouden spraakinterfaces de volgende grote golf voor startups worden.
Bron: Habr — хаб ИИ —
origineel
