OpenAI hat einen Beitrag veröffentlicht, der erklärt, wie die Fähigkeiten für Bild und Sprache in ChatGPT Teams dabei helfen, mit multimodalen Eingaben zu arbeiten und natürlicher zu kommunizieren.
Der Beitrag konzentriert sich auf die praktische Seite dieser Funktionen. Mit der Bildfunktion können Nutzer Bilder teilen und ChatGPT bitten, sie zu interpretieren, während die Sprachfunktion ein gesprochenes Gespräch anstelle von getipptem Text ermöglicht. Gemeinsam erlauben beide Modi, innerhalb einer einzigen Sitzung zwischen schriftlicher, visueller und gesprochener Eingabe zu wechseln.
Für Teams liegt der Reiz darin, verschiedene Arten von Informationen zu kombinieren. Ein Nutzer kann ein Diagramm, ein Whiteboard oder ein Dokument fotografieren, Fragen dazu stellen und die Diskussion anschließend sprechend fortsetzen. Dadurch entfällt der Aufwand, visuelles Material erst in Text umzuwandeln, bevor man Hilfe erhält.
Die Ankündigung stellt diese Funktionen als Weg dar, die Zusammenarbeit mit KI natürlicher wirken zu lassen. Indem ChatGPT die Kommunikationsformen unterstützt, die Menschen bei der Arbeit ohnehin nutzen, soll es sich reibungsloser in den Arbeitsalltag einfügen.
Quelle: OpenAI Blog · Zusammengefasst von HeadlinesBriefing