HeadlinesBriefing HeadlinesBriefing.com

ChatGPT-তে ভিশন ও ভয়েস

OpenAI Blog •
×

OpenAI একটি পোস্ট প্রকাশ করেছে, যেখানে ব্যাখ্যা করা হয়েছে কীভাবে ChatGPT-এর ভিশন ও ভয়েস সক্ষমতা দলগুলোকে মাল্টিমোডাল ইনপুট নিয়ে কাজ করতে এবং আরও স্বাভাবিকভাবে যোগাযোগ করতে সাহায্য করে।

এই পোস্টটি এই বৈশিষ্ট্যগুলোর ব্যবহারিক দিকের ওপর আলোকপাত করে। ভিশন ব্যবহারকারীদের ছবি শেয়ার করতে এবং ChatGPT-কে সেগুলোর ব্যাখ্যা দিতে দেয়, আর ভয়েস লেখা টেক্সটের পরিবর্তে কথোপকথনের সুযোগ তৈরি করে। এই দুই মোড একসঙ্গে মানুষকে একই সেশনের মধ্যে লিখিত, দৃশ্যমান ও কথ্য ইনপুটের মধ্যে যাতায়াত করতে সাহায্য করে।

দলগুলোর জন্য আকর্ষণ রয়েছে বিভিন্ন ধরনের তথ্য একত্র করার মধ্যে। একজন ব্যবহারকারী একটি ডায়াগ্রাম, হোয়াইটবোর্ড বা নথির ছবি তুলে সে সম্পর্কে প্রশ্ন করতে পারেন, তারপর কথা বলে আলোচনা চালিয়ে যেতে পারেন। এতে সাহায্য পাওয়ার আগে দৃশ্যমান উপাদানকে টেক্সটে রূপান্তর করার ঝামেলা কমে।

এই ঘোষণায় এই বৈশিষ্ট্যগুলোকে AI-এর সঙ্গে সহযোগিতাকে আরও স্বাভাবিক করে তোলার উপায় হিসেবে উপস্থাপন করা হয়েছে। মানুষ কাজে ইতিমধ্যে যে ধরনের যোগাযোগ ব্যবহার করে, তা সমর্থন করে ChatGPT দৈনন্দিন কর্মপ্রবাহে আরও সহজে মিশে যেতে চায়।

উৎস: OpenAI Blog · সারাংশ: HeadlinesBriefing