OpenAI ने एक पोस्ट प्रकाशित की है, जो बताती है कि ChatGPT में विज़न और वॉइस क्षमताएँ टीमों को मल्टीमॉडल इनपुट के साथ काम करने और अधिक स्वाभाविक रूप से संवाद करने में कैसे मदद करती हैं।
यह पोस्ट इन सुविधाओं के व्यावहारिक पहलू पर केंद्रित है। विज़न उपयोगकर्ताओं को छवियाँ साझा करने और ChatGPT से उनकी व्याख्या कराने की सुविधा देता है, जबकि वॉइस टाइप किए गए पाठ के स्थान पर बोलकर बातचीत करने को संभव बनाता है। दोनों मोड मिलकर लोगों को एक ही सत्र में लिखित, दृश्य और बोले गए इनपुट के बीच आसानी से स्विच करने देते हैं।
टीमों के लिए इसका आकर्षण अलग-अलग प्रकार की जानकारी को एक साथ जोड़ने में है। उपयोगकर्ता किसी आरेख, व्हाइटबोर्ड या दस्तावेज़ की तस्वीर ले सकता है और उसके बारे में प्रश्न पूछ सकता है, फिर बोलकर चर्चा जारी रख सकता है। इससे मदद लेने से पहले दृश्य सामग्री को पाठ में बदलने की परेशानी कम हो जाती है।
इस घोषणा में इन सुविधाओं को AI के साथ सहयोग को अधिक स्वाभाविक बनाने के तरीके के रूप में प्रस्तुत किया गया है। वे संवाद के वे रूप समर्थित करके, जिन्हें लोग पहले से ही कार्यस्थल पर उपयोग करते हैं, ChatGPT का लक्ष्य रोज़मर्रा के कार्यप्रवाह में अधिक सहजता से फिट होना है।
स्रोत: OpenAI Blog · HeadlinesBriefing द्वारा सारांशित