HeadlinesBriefing favicon HeadlinesBriefing.com

DeepSeek-V4.1-Flash: ছোট এবং দ্রুত AI মডেল

Hacker News •
×

DeepSeek DeepSeek-V4.1-Flash-কে প্রস্তुत করেছে, যা এর নতুন আর্কিটেকচার পরিবারের সবচেয়ে ছোট মডেল, যেটিতে নেটিভ ভিজুয়াল বোঝার সুবিধা আছে এবং এটি বেশি ক্ষমতা, দ্রুত ইনফারেন্স এবং উচ্চ থ্রুপুটের জন্য ডিজাইন করা হয়েছে। মডেলটি অসামমিত আর্কিটেকচার ব্যবহার করে, jossa 552B-প্যারামিটার MoE এবং একটি নতুন ক্যাজুয়াল এনকোডার–ডিকোডার ডিজাইন আছে, যা ইনপুটের জন্য শুধুমাত্র 8B সক্রিয় প্যারামিটার এবং আউটপুটের জন্য 16B প্রয়োজন করে। পুর্ব প্রজন্মের তুলনায়, V4.1-Flash KV ক্যাশের প্রয়োজন হবি HBM-এর 1/4 এবং SSD স্টোরেজের 1/8-এ কমিয়ে দিয়েছে, ক্যাশ-হিট চার্জকে সঙ্কুচিত করে এজেন্ট খরচকে উল্লেখযোগ্যভাবে কমিয়ে দিয়েছে। মডেল এখন DeepSeek API-এ লাইভ আছে, jossa নেটিভ মাল্টিমোডাল সমর্থন আছে; ব্যবহারকারীদের তাদের মডেলকে deepseek-flash-এ সেট করা উচিত। V4-Flash এবং V4-Flash-Vision-Exp অবসন্ন হয়েছে, সামঞ্জস্যতার জন্য V4.1-Flash-এ অস্থায়ী রাউটিং করা হয়েছে। DeepSeek گزارش করে যে উন্নত দক্ষতার কারণে API দাম কমেছে, এবং সেই Bangladesh টাকাকে ব্যবহারকারীদের কাছে পৌঁছে দেওয়া হয়েছে, এবং শীর্ষ/অশীর্ষ মূল্য নির্ধারণ বজায় রাখেছে, যেখানে অশীর্ষ দর শীর্ষ দরের 50%। কোম্পানি ওপেন-সোর্স কমিউনিটির সাথে ইনফারেন্স সমর্থনে সহযোগিতা করছে এবং বিনিয়োগের বিকল্পগুলি খোঁজছে, 2,000 GPU এবং স্টোরেজ ক্লাস্টার সহ বড় পরিমাণের সেটআপের জন্য জিজ্ঞাসা আমন্ত্রণ दे रही है। মডেল Hugging Face-এ deepseek-ai/DeepSeek-V4.1-Flash হিসেবে উপলব্ধ।