HeadlinesBriefing HeadlinesBriefing.com

ChatGPT视觉与语音功能

OpenAI Blog •
×

OpenAI发布了一篇文章,解释ChatGPT中的视觉与语音功能如何帮助团队处理多模态输入,并实现更自然的沟通。

这篇文章重点介绍了这些功能的实际应用。视觉功能允许用户分享图片,并让ChatGPT对其进行解读;语音功能则让用户可以用口语对话代替文字输入。两种模式结合在一起,使人们能够在同一次会话中自由切换书面、视觉和口语输入。

对团队而言,吸引力在于能够整合不同类型的信息。用户可以拍下图表、白板或文件并就其提问,然后再通过语音继续讨论。这减少了在获得帮助之前,将视觉材料转换为文字的麻烦。

这一公告将这些功能定位为让与AI的协作感觉更加自然的一种方式。通过支持人们在工作中已经习惯使用的沟通形式,ChatGPT希望更顺畅地融入日常工作流程。

来源: OpenAI Blog · 由HeadlinesBriefing整理摘要