HeadlinesBriefing HeadlinesBriefing.com

Visi dan Suara di ChatGPT

OpenAI Blog •
×

OpenAI telah menerbitkan postingan yang menjelaskan bagaimana kemampuan visi dan suara di ChatGPT membantu tim bekerja dengan input multimodal dan berkomunikasi lebih alami.

Postingan ini berfokus pada sisi praktis dari fitur-fitur tersebut. Visi memungkinkan pengguna membagikan gambar dan meminta ChatGPT menafsirkannya, sementara suara memungkinkan percakapan lisan sebagai pengganti teks yang diketik. Bersama-sama, kedua mode ini memungkinkan orang berpindah antara input tertulis, visual, dan lisan dalam satu sesi.

Bagi tim, daya tariknya terletak pada penggabungan berbagai jenis informasi. Pengguna dapat memotret diagram, papan tulis, atau dokumen dan mengajukan pertanyaan tentangnya, lalu melanjutkan diskusi dengan berbicara. Hal ini mengurangi kerepotan mengubah materi visual menjadi teks sebelum mendapatkan bantuan.

Pengumuman ini memposisikan fitur-fitur tersebut sebagai cara untuk membuat kolaborasi dengan AI terasa lebih alami. Dengan mendukung bentuk komunikasi yang sudah digunakan orang dalam pekerjaan, ChatGPT bertujuan untuk menyatu lebih lancar dengan alur kerja sehari-hari.

Sumber: OpenAI Blog · Diringkas oleh HeadlinesBriefing