نشرت OpenAI مقالًا يشرح كيف تساعد إمكانيات الرؤية والصوت في ChatGPT الفرق على العمل مع المدخلات متعددة الوسائط والتواصل بشكل أكثر طبيعية.
يركز المقال على الجانب العملي لهذه الميزات. تتيح الرؤية للمستخدمين مشاركة الصور وتكليف ChatGPT بتفسيرها، بينما يتيح الصوت إجراء محادثة منطوقة بدلًا من النص المكتوب. ومعًا، يتيح الوضعان للأشخاص الانتقال بين المدخلات المكتوبة والمرئية والمنطوقة ضمن جلسة واحدة.
بالنسبة للفرق، تكمن الجاذبية في الجمع بين أنواع مختلفة من المعلومات. يمكن للمستخدم تصوير مخطط أو لوحة بيضاء أو مستند وطرح أسئلة حوله، ثم متابعة النقاش بالتحدث. وهذا يقلل من عناء تحويل المادة المرئية إلى نص قبل الحصول على المساعدة.
يضع الإعلان هذه الميزات كوسيلة لجعل التعاون مع الذكاء الاصطناعي يبدو أكثر طبيعية. ومن خلال دعم أشكال التواصل التي يستخدمها الناس بالفعل في العمل، تسعى ChatGPT إلى الاندماج بسلاسة أكبر في سير العمل اليومي.
المصدر: OpenAI Blog · لخّصه HeadlinesBriefing