AI-জেনারেটেড প্রুফসকে সাধারণত formalisation প্রক্রিয়াটি ব্যবহার করে পরীক্ষা করা হয়। OpenAI apparently committed a subtle error while publishing its proofs of the Navier-Stokes problem, a team of mathematicians has claimed. The error does not mean that the proofs are incorrect or that OpenAI has not correctly solved the problem, but it does call into question whether mathematical results generated by AI models can always be relied on.
"যে সব এই বড় ভাষা মডেল দ্বারা জেনারেটেড প্রুফসকে মানবদের পড়া হবে, এবং এটি গণিতজেদের enormous অতিরিক্ত担负" বলে Anders Hansen University of Cambridge-তে। 8 সেপ্টেম্বর তারিখে, OpenAI ঘোষণা করল যে সে Navier-Stokes সমস্যার সমাধান খুঁজে পেয়েছে, যা গাণিতের সবচেয়ে বিখ্যাত খোলা সমস্যা之一। এটি দুই সংস্করণে প্রকাশিত করেছে – একটি "natural language" ভাষায় এবং অন্যটি কম্পিউটার কোড Lean ভাষায়।
সমস্যা হল, হানসন এবং তার দল বলছেন, দুটি প্রুফ মিল না করে। "এই formalisation প্রক্রিয়া peer review প্রতিস্থাপন করার চেষ্টা করছে" বলছেন দলের সদস্য Fabian Circelli,ও Cambridge University-তে। "Peer review অর্থায় মানব চোখ প্রুফস দেখবে। কিন্তু আমরা এই পেপারে যা দেখালে, যে ধরনের AI auto-formalisation একই উদ্দেশ্য সেবা করতে পারে না।"
দলের নির্দিষ্ট দাবি প্রুফs বলা অংশে টिका আছে, যা Lemma 8.6 নামে পরিচিত। প্রাকৃতিক ভাষার প্রুফে, একটি সমীকরণে একটি মানকে m + 4 এর নিচ হতে হবে, Mientras que Lean প্রুফে সমকক্ষ মান m + 5 এর নিচে হয়, যা গাণিতিকভাবে কমজোর। OpenAI New Scientist-কে জানালে যে সে এই মিসম্যাচের vě aware আছে এবং এর মানে যে কোনো প্রুফ অবৈধ নয়।
উৎস: Hacker News · সারাংশ: HeadlinesBriefing