HeadlinesBriefing HeadlinesBriefing.com

Vision et voix dans ChatGPT

OpenAI Blog •
×

OpenAI a publié un article expliquant comment les capacités de vision et de voix de ChatGPT aident les équipes à travailler avec des entrées multimodales et à communiquer plus naturellement.

L'article se concentre sur l'aspect pratique de ces fonctions. La vision permet aux utilisateurs de partager des images et de demander à ChatGPT de les interpréter, tandis que la voix permet une conversation orale à la place du texte saisi. Ensemble, ces deux modes permettent de passer de l'entrée écrite à l'entrée visuelle et orale au sein d'une même session.

Pour les équipes, l'intérêt réside dans la combinaison de différents types d'informations. Un utilisateur peut photographier un schéma, un tableau blanc ou un document, poser des questions à ce sujet, puis poursuivre la discussion à l'oral. Cela réduit la difficulté de transformer des supports visuels en texte avant d'obtenir de l'aide.

L'annonce présente ces fonctions comme un moyen de rendre la collaboration avec l'IA plus naturelle. En prenant en charge les formes de communication que les gens utilisent déjà au travail, ChatGPT vise à s'intégrer plus facilement dans les flux de travail quotidiens.

Source: OpenAI Blog · Résumé par HeadlinesBriefing