OpenAI phát hành chế độ Voice ChatGPT trên máy tính với kỹ năng điều khiển máy tính
OpenAI
Anthropic
OpenAI đã cập nhật ứng dụng ChatGPT trên máy tính với chế độ Voice mới sử dụng dòng mô hình ChatGPT-Live. Tính năng giọng nói này có thể điều khiển các tác nhân AI, thực hiện tác vụ, truy cập trang web và ứng dụng, và trên macOS sử dụng Appshots để xem nội dung màn hình. Nó hỗ trợ các lệnh phức tạp nhiều bước.
OpenAI vào thứ Năm vừa cập nhật ứng dụng ChatGPT dành cho máy tính để bàn, hỗ trợ ChatGPT Voice, cho phép người dùng ra lệnh bằng giọng nói để điều khiển các tác nhân AI và thực hiện tác vụ. Tính năng này sử dụng các mô hình giọng nói ChatGPT-Live mới của OpenAI được ra mắt đầu tháng này. ChatGPT Voice hoạt động với cả ChatGPT Work lẫn Codex, và có thể tận dụng kỹ năng sử dụng máy tính để tra cứu trang web và ứng dụng. Trên macOS, với Appshots, người dùng có thể cho phép ứng dụng truy cập nội dung màn hình, bao gồm cả văn bản thay thế. Không giống như phiên bản điện thoại thông minh vốn có các cuộc hội thoại mượt mà hơn nhưng không thể thực hiện hành động, bản cập nhật máy tính để bàn cho phép đọc chính tả các lệnh phức tạp nhiều bước và phản hồi khi cần nhập liệu. Trong một buổi demo, một nhà phát triển đã dùng một lệnh thoại để tạo luồng (thread), tạo yêu cầu kéo (pull request) và tìm nguyên nhân gốc rễ của lỗi. Người dùng cũng có thể truy cập ChatGPT Voice trong Codex từ ứng dụng iOS thông qua truy cập từ xa. Riêng biệt, Anthropic đã cập nhật chế độ giọng nói cho Claude, sử dụng các mô hình Opus, Sonnet và Haiku để hoàn thành tác vụ trong Gmail, Lịch (Calendar), Slack, Notion và Canva.
Nguồn: TechCrunch AI —
bản gốc
