Show HN: Lathoa, a math app for kids where the AI is wrong on purpose
🇬🇧 English
I made Lathoa for kids aged 10 to 14. A robot named Errol solves math problems step by step, but one step is intentionally wrong. The child must find the error and explain why it's wrong to earn XP.
Sometimes nothing is wrong, so guessing 'there's a mistake' doesn't work—explanations are required. Speed also affects scoring. There's no direct LLM chat; Lathoa uses stable harnessing with evaluation steps to catch inconsistencies and prompt injections.
You can play a case on the homepage without signing up. Getting an LLM to be wrong on purpose is hard: half the time it gives the right answer and calls it wrong, or flags a correct step as a mistake. So every case is pre-checked.
Where possible, a plain arithmetic check redoes the math exactly. A second model solves the problem without seeing Errol's work. If they disagree, the case is discarded.
The weakness is that the second model might make the same mistake as the first. The arithmetic check helps, but only works for English cases so far—German and Greek use commas for decimals, and parsing isn't fixed yet. I wonder: does finding someone else's mistake teach more than solving the problem yourself? I'm not sure, and I'd like input from educators.
🇸🇦 العربية
Lathoa: تطبيق رياضيات حيث تكون الذكاء الاصطناعي خاطئة على النحو المقصود
صنعت Lathoa للأطفال الذين يبلغون من 10 إلى 14 سنة. يحل روبوت يُدعى Errol مسائل الرياضيات خطوة بخطوة، لكن خطوة واحدة خاطئة على النحو المقصود. يجب على الطفل إيجاد الخطأ وشرح السبب لكي يكسب نقاط الخبرة. أحيانًا لا يكون هناك شيء خاطئ، لذا لا ينجح التخمين العشوائي بـ 'هناك خطأ'—يتطلب التوضيحات. كما أن السرعة تؤثر على التصحيح. لا يوجد دردشة LLM مباشرة؛ يستخدم Lathoa تحفيزًا ثابتًا مع خطوات تقييم لالتقاط التعارضات والحقن التوجيهية. يمكنك اللعب بحالة على الصفحة الرئيسية دون التسجيل. من الصعب أن يكون LLM خاطئًا على النحو المقصود: نصف الوقت يقدّم الإجابة الصحيحة ويُسميها خاطئة، أو يُشير إلى خطوة صحيحة كخطأ. لذا، يتم التحقق من كل حالة مسبقًا. حيثما أمكن، يجرى التحقق الرياضي البسيط لإعادة حساب الرياضيات بدقة. يحل نموذج ثانٍ المشكلة دون أن يرى عمل Errol. إذا اختلفا، يُتجرف الحال. الضعف هو أن النموذج الثاني قد يرتكب الخطأ نفسه مثل الأول. يساعد التحقق الرياضي، لكنه يعمل فقط على حالات اللغة الإنجليزية حتى الآن—يستخدم الألمان واليونان فواصل للعدد العشري، ولم يتم تصحيح التحليل بعد. أتساءل: هل العثور على خطأ في غيره يعلّم أكثر من حل المشكلة بنفسك؟ لست متأكدًا، وأود أن أستمع إلى آراء المعلّمين.
هل العثور على خطأ في غيره يعلّم أكثر من حل المشكلة بنفسك؟
لست متأكدًا، وأود أن أستمع إلى من يقدّمون التعليم.
🇧🇩 বাংলা
Lathoa: এমন একটি গণিত অ্যাপ যেখানে AI ইচ্ছাকৃতভাবে ভুল হয়
আমি Lathoa-কে 10 থেকে 14 বছর বয়সের শিশুদের জন্য তৈরি করেছি। একটি নাম Errol রোবট ধাপে ধাপে গণিত সমস্যার সমাধান করে, কিন্তু একটি ধাপ ইচ্ছাকৃতভাবে ভুল হয়। শিশুটি ভুলটি খুঁজে বের করতে এবং সেটি কেন ভুল ব্যাখ্যা করতে হয় যাতে তারা XP পায়। কখনও কখনও কিছু ভুল হয় না, তাই অনুমান করা 'একটি ভুল আছে' কাজ করে না—ব্যাখ্যা প্রয়োজন। গতি একটি স্কোরে প্রভাব ফেলে। কোনও সরাসরি LLM চ্যাট নেই; Lathoa স্থিতিশীলতা ব্যবহার করে মূল্যায়ন ধাপগুলি ক্যাপচার করতে অসঙ্গতি এবং প্রম্পট ইনজেকশনগুলি। আপনি হোমপেজে সাইন-আপ করা ছাড়া একটি কেস খেলতে পারেন। LLM-কে ইচ্ছাকৃতভাবে ভুল করা কতটা কঠিন: আপেলারা আধার মধ্যে এটি সঠিক উত্তর দেয় এবং সেটি ভুল বলে ডাকে, বা সঠিক ধাপকে ভুল হিসাবে চিহ্নিত করে। তাই, প্রতিটি কেস প্রথমে যাচাই করা হয়। সম্ভব হলে, একটি সাধারণ অংকগণিত চেক সঠিকভাবে গণিত পুনরায় করে। দ্বিতীয় মডেল Errol-এর কাজ দেখা ছাড়া সমস্যার সমাধান করে। যদি তারা মত মিলে না, কেস ফেলে যায়। দুর্বলতা হল যে দ্বিতীয় মডেলটি প্রথমের সাথে একই ভুল করতে পারে। অংকগণিত চেক মানে কিছু হয়, কিন্তু এটি পর্যন্ত শুধুমম ইংরেজি কেসে কাজ করে—জার্মান ও গ্রিকের দশমিক সংখ্যা জন্য কমা ব্যবহার করে, এবং পার্সিং এখনও ঠিক করা হয়নি। আমি শিগগিরি করি: কাকে ধরা ভুল খুঁজে বের করা নিজে নিজে সমস্যা সমাধান করার চেয়ে বেশি শিখে? আমি নিশ্চিত নই, এবং আমি শিক্ষকদের থেকে মতামত চাই।
কি কাকে ধরা ভুল খুঁজে বের করা নিজে নিজে সমস্যা সমাধান করার চেয়ে বেশি শিখে?
আমি নিশ্চিত নই, এবং আমি শিক্ষকদের থেকে মতামত চাই।
🇩🇪 Deutsch
Lathoa: Mathematik-App, bei der KI Absichtlich Fehler macht
Ich habe Lathoa für Kinder im Alter von 10 bis 14 Jahren entwickelt. Ein Roboter namens Errol löst mathematische Probleme schritt für Schritt, aber ein Schritt ist absichtlich falsch. Das Kind muss den Fehler finden und erklären, warum er falsch ist, um XP zu erhalten.
Manchmal ist nichts falsch, also funktioniert das Rateen 'es gibt einen Fehler' nicht—Erklärungen werden benötigt. Geschwindigkeit beeinflusst auch die Punktzahl. Es gibt keinen direkten LLM-Chat; Lathoa verwendet Stabilität mit Bewertungsschritten, um Inkonsistenzen und Prompt-Injektionen zu erfassen.
Sie können einen Fall auf der Startseite ohne Registrierung spielen. Es ist schwer, eine LLM absichtlich falsch zu machen: Die Hälfte der Zeit gibt sie die richtige Antwort und nennt sie falsch, oder markiert einen korrekten Schritt als Fehler. Daher wird jeder Fall vorab geprüft.
Wo möglich, führt eine einfache arithmetische Überprüfung die Mathematik exakt erneut durch. Ein zweites Modell löst das Problem, ohne die Arbeit von Errol zu sehen. Wenn sie nicht übereinstimmen, wird der Fall verworfen.
Die Schwäche ist, dass das zweite Modell dieselbe Fehler machen könnte wie das erste. Die arithmetische Überprüfung hilft, aber funktioniert bisher nur für englische Fälle—Deutsch und Griechisch verwenden Kommas als Dezimaltrennzeichen, und das Parsen ist noch nicht behoben. Ich frage mich: Lernt man mehr, indem man einen anderen Fehler findet, als indem man das Problem selbst löst? Ich bin mir nicht sicher und hätte gerne Feedback von Lehrern.
Lernt man mehr, indem man einen anderen Fehler findet, als indem man das Problem selbst löst?
Ich bin mir nicht sicher und hätte gerne Feedback von Lehrern.
🇪🇸 Español
Lathoa: App de matemáticas donde la IA se equivoca a propósito
Creé Lathoa para niños de 10 a 14 años. Un robot llamado Errol resuelve problemas matemáticos paso a paso, pero un paso está intencionalmente mal. El niño debe encontrar el error y explicar por qué está mal para ganar XP.
A veces no hay nada malo, por lo que adivinar 'hay un error' no funciona—se requieren explicaciones. La velocidad también afecta la puntuación. No hay chat directo de LLM; Lathoa usa estabilización con pasos de evaluación para capturar inconsistencias e inyecciones de indicaciones.
Puedes jugar un caso en la página principal sin registrarte. Es difícil que un LLM esté equivocado a propósito: la mitad de las veces da la respuesta correcta y la llama incorrecta, o marca un paso correcto como error. Por eso, cada caso se verifica previamente.
Donde sea posible, una verificación aritmética básica vuelve a realizar los cálculos exactos. Un segundo modelo resuelve el problema sin ver el trabajo de Errol. Si no coinciden, el caso se descarta.
La debilidad es que el segundo modelo podría cometer la misma equivocación que el primero. La verificación aritmética ayuda, pero solo funciona para casos en inglés hasta ahora—el alemán y el griego usan comas para decimales, y el análisis aún no está arreglado. Me pregunto: ¿encontrar el error de otra persona enseña más que resolver el problema tú mismo? No tengo certeza, y me gustaría opiniones de educadores.
¿Encontrar el error de otra persona enseña más que resolver el problema tú mismo?
No tengo certeza, y me gustaría escuchar a las personas que enseñan.
🇫🇷 Français
Lathoa : Une appli maths où l'IA est faussement erronée
J'ai créé Lathoa pour les enfants âgés de 10 à 14 ans. Un robot nommé Errol résout les problèmes de mathématiques étape par étape, mais une étape est intentionnellement fausse. L'enfant doit trouver l'erreur et expliquer pourquoi elle est fausse pour gagner des points d'expérience.
Parfois, rien n'est faux, donc deviner qu'il y a une erreur ne fonctionne pas—des explications sont nécessaires. La vitesse affecte également le score. Il n'y a pas de chat LLM direct ; Lathoa utilise une stabilisation avec des étapes d'évaluation pour capturer les incohérences et les injections de prompt.
Vous pouvez jouer à un cas sur la page d'accueil sans vous inscrire. Il est difficile de faire en sorte qu'une LLM soit erronée intentionnellement : la moitié du temps, elle donne la bonne réponse et l'appelle incorrecte, ou marque une étape correcte comme une erreur. Par conséquent, chaque cas est vérifié à l'avance.
Lorsque possible, une vérification arithmétique basique refait exactement les calculs. Un deuxième modèle résout le problème sans voir le travail d'Errol. S'ils ne sont pas d'accord, le cas est rejeté.
La faiblesse est que le deuxième modèle pourrait commettre la même erreur que le premier. La vérification arithmétique aide, mais ne fonctionne pour l'instant que pour les cas en anglais—l'allemand et le grec utilisent des virgules pour les décimaux, et le parsing n'est pas encore corrigé. Je me demande : trouver l'erreur d'une autre personne apprend-il plus en résolvant le problème soi-même ? Je ne suis pas sûr, et j'aimerais des retours d'enseignants.
Trouver l'erreur d'une autre personne apprend-il plus en résolvant le problème soi-même ?
Je ne suis pas sûr, et j'aimerais entendre des personnes qui enseignent.
🇮🇳 हिन्दी
Lathoa: वह मैथ ऐप जहाँ AI इच्छांतः गलत होती है
मैंने Lathoa को 10 से 14 वर्षों के बच्चों के लिए बनाया है। एक रोबोट जिसका नाम Errol है, चरण दर चरण गणितीय समस्याओं का समाधान करता है, लेकिन एक चरण इच्छांतः गलत होता है। बच्चा को गलती ढूंढना और यह समझना पड़ता है कि वह क्यों गलत है, ताकि वह XP पा सके। कभी-कभी कुछ भी गलत नहीं होता है, इसलिए 'गलती है' कहना से ठीक नहीं चलता—असर की आवश्यकता होती है। गति भी स्कोरिंग में प्रभाव डालती है। कोई सीधा LLM चैट नहीं है; Lathoa स्थिरता के साथ मूल्यांकन चरणों का उपयोग करता है ताकि असंगतियों और प्रॉम्प्ट इंजेक्शन को पकड़ा जा सके। आप होमपेज पर साइन-अप किए बिना एक केस खेल सकते हैं। LLM को इच्छांतः गलत होना कितना मुश्किल है: आधा हिस्से में वह सही उत्तर देता है और उसे गलत कह देता है, या सही चरण को गलती के रूप में चिह्नित करता है। इसलिए, हर केस पहले से जाँचा जाता है। जहां संभव होता है, एक साधारण अंकगणितीय जाँच सटीक रूप से गणित को दोबारा करती है। दूसरा मॉडल Errol के काम को देखिए बिना समस्या का समाधान करता है। अगर वे सही नहीं होते, तो केस छोड़ दिया जाता है। कमजोरी यह है कि दूसरा मॉडल पहले के साथ समान त्रुटि कर सकता है। अंकगणितीय जाँच मदद करती है, लेकिन अभी तक केवल अंग्रेज़ी केस में ही काम करती है—जर्मन और यूनानी दशांश के लिए कॉमा का उपयोग करते हैं, और पार्सिंग अभी तक ठीक नहीं हुआ है। मैं सोचता हूँ: क्या किसी की गलती ढूंढना तुम्हें खुद समस्या हल करने से अधिक सीखता है? मैं निश्चित नहीं हूँ, और मुझे शिक्षकों से प्रतिक्रिया चाहिए।
क्या किसी की गलती ढूंढना तुम्हें खुद समस्या हल करने से अधिक सीखता है?
मैं निश्चित नहीं हूँ, और मुझे शिक्षकों से सुनना चाहिए।
🇮🇩 Bahasa Indonesia
Lathoa: Aplikasi Matematika Di Mana AI Salah Secara Sengaja
Saya membuat Lathoa untuk anak berusia 10 hingga 14 tahun. Sebuah robot bernama Errol memecahkan masalah matematika langkah demi langkah, tetapi satu langkah secara sengaja salah. Anak harus menemukan kesalahan dan menjelaskan mengapa salah untuk memperoleh XP.
Kadang tidak ada yang salah, jadi menebak 'ada kesalahan' tidak akan berhasil—penjelasan diperlukan. Kecepatan juga memengaruhi skor. Tidak ada obrolan LLM langsung; Lathoa menggunakan stabilisasi dengan langkah evaluasi untuk menangkap inkonsistensi dan injeksi prompt.
Anda dapat bermain satu kasus di beranda tanpa mendaftar. Membuat LLM salah secara sengaja sulit: setengah waktunya memberikan jawaban yang benar dan memanggilnya salah, atau menandai langkah yang benar sebagai kesalahan. Jadi setiap kasus sudah dipastikan telah diperiksa.
Di mana memungkinkan, pemeriksaan aritmetika dasar mengulangi matematika dengan tepat. Model kedua memecahkan masalah tanpa melihat pekerjaan Errol. Jika mereka tidak setuju, kasus akan dibuang.
Kelemahannya adalah model kedua bisa membuat kesalahan yang sama seperti model pertama. Pemeriksaan aritmetika membantu, tetapi hanya berfungsi untuk kasus bahasa Inggris hingga saat ini—Jerman dan Yunani menggunakan koma untuk desimal, dan pemparaan belum perbaiki. Saya bertanya-tanya: apakah menemukan kesalahan orang lain lebih belajar daripada memecahkan masalah sendiri? Saya tidak yakin, dan saya ingin mendengar masukan dari pendidik.
🇯🇵 日本語
Lathoa:AIが意図的に間違える数学アプリ
私はLathoaを10から14歳の子どものために作りました。名前がErrolのロボットが数学の問題をステップごとに解きますが、その中で1つのステップだけ意図的に間違っています。子どもはその間違いを見つけて、なぜ間違っているのかを説明して、XPを獲得します。時々、間違いは何もないので、'間違いがある'と当てずらしにしても効果がありません—説明が必要です。速度もスコアに影響します。直接的なLLMチャットはありません;Lathoaは安定化を使用し、一貫性とプロンプトインジェクションをキャッチするための評価ステップを使用します。ホームページで会員登録なしでケースをプレイできます。LLMを意図的に間違らせるのは難しい:半分の時間は正しい答えを出してそれを間違いだと呼び、または正しいステップを間違いとしてフラグ付けします。そのため、各ケースは事前にチェックされています。可能な限り、単純な算術チェックが正確に数学を再計算します。2番目のモデルはErrolの作業を見ることなしに問題を解きます。それらが一致しなければ、そのケースは廃棄されます。弱点は、2番目のモデルが最初と同じ間違いを犯す可能性があるということです。算術チェックは役立ちますが、これはこれまで英語のケースでしか機能しません—ドイツ語とギリシャ語は小数点にカンマを使用し、解析はまだ修正されていません。私は思います:他の人の間違いを見つけることが、自分で問題を解くことより多く学ぶのでしょうか?私は確信がありません、そして教育者の意見を聞きたいです。
他の人の間違いを見つけることが、自分で問題を解くことより多く学ぶのでしょうか?
私は確信がありません、そして教育者の意見を聞きたいです。
🇧🇷 Português
Lathoa: App de matemática onde a IA erra intencionalmente
Criei o Lathoa para crianças de 10 a 14 anos. Um robô chamado Errol resolve problemas matemáticos passo a passo, mas um passo está intencionalmente errado. A criança deve encontrar o erro e explicar por que está errado para ganhar XP. Às vezes nada está errado, então adivinhar 'há um erro' não funciona—explicações são necessárias.
A velocidade também afeta a pontuação. Não há chat direto de LLM; o Lathoa usa estabilização com passos de avaliação para capturar inconsistências e injecções de prompt. Você pode jogar um caso na página inicial sem se cadastrar. É difícil fazer uma LLM errar intencionalmente: metade do tempo ela dá a resposta correta e a chama errada, ou marca um passo correto como erro.
Por isso, cada caso é pré-verificado. Sempre que possível, uma verificação aritmética básica refaz os cálculos exatamente. Um segundo modelo resolve o problema sem ver o trabalho do Errol.
Se eles discordarem, o caso é descartado. A fraqueza é que o segundo modelo pode cometer a mesma falha que o primeiro. A verificação aritmética ajuda, mas até agora só funciona para casos em inglês—alemão e grego usam vírgulas para decimais, e a análise ainda não foi corrigida.
Me pergunto: encontrar o erro de outra pessoa ensina mais do que resolver o problema você mesmo? Não tenho certeza, e gostaria de opiniões de educadores.
Encontrar o erro de outra pessoa ensina mais do que resolver o problema você mesmo?
Não tenho certeza, e gostaria de ouvir pessoas que ensinam.
🇷🇺 Русский
Lathoa: приложение для математики, где ИИ ошибается намеренно
Я создал Lathoa для детей от 10 до 14 лет. Робот по имени Errol решает задачи по математике по шагам, но один шаг преднамеренно неправильный. Ребенок должен найти ошибку и объяснить, почему она неправильна, чтобы получить XP. Иногда ничего не ошибается, поэтому угадывать «ошибка есть» не работает—требуются объяснения. Скорость также влияет на оценку. Нет прямого чата с LLM; Lathoa использует стабилизацию с этапами оценки для захвата несоответствий и инъекций подсказок. Вы можете играть в случай на главной странице без регистрации. Сделать ИИ ошибшейся намеренно сложно: половина времени она дает правильный ответ и называет его ошибочным, или помечает правильный шаг как ошибку. Поэтому каждый случай заранее проверяется. Где возможно, простая арифметическая проверка точно повторяет вычисления. Вторая модель решает задачу, не видя работы Errol. Если они не согласны, случай отбрасывается. Слабость в том, что вторая модель может сделать ту же ошибку, что и первая. Арифметическая проверка помогает, но пока работает только для английских случаев—немецкие и греческие используют запятые для десятичных чисел, и разбор пока не исправлен. Я интересуюсь: учиться ли больше, находя чужую ошибку, чем решая задачу самому? Я не уверен, и мне бы хотелось услышать мнения преподавателей.
Учиться ли больше, находя чужую ошибку, чем решая задачу самому?
Я не уверен, и мне бы хотелось услышать мнения тех, кто воспитывает.
🇨🇳 简体中文
Lathoa:人为让AI出错的数学应用
我制作了Lathoa,专为10到14岁的孩子设计。一个名为Errol的机器人会逐步解答数学问题,但有一个步骤是故意错误的。孩子必须找到错误并解释为什么是错误的才能获得XP。有时没有错误,所以随意猜测“有错误”不会有效——需要解释。速度也会影响评分。没有直接的LLM聊天;Lathoa使用稳定的方法,通过评估步骤来捕捉不一致和提示注入。您可以在首页无需注册的情况下玩一个案例。让LLM故意出错很难:通常一半时间它给出正确的答案并称其为错误,或将正确的步骤标记为错误。因此,每个案例都经过预先检查。可能的情况下,一个纯粹的算术检查会完全重新计算数学。第二个模型在不看到Errol工作的情况下解题。如果它们不一致,案例就会被丢弃。 weakness is that the second model might make the same mistake as the first. The arithmetic check helps, but only works for English cases so far—German and Greek use commas for decimals, and parsing isn't fixed yet. I wonder: does finding someone else's mistake teach more than solving the problem yourself? I'm not sure, and I'd like input from educators.
找别人的错误比自己解题更有教育作用吗?
我不确定,我想来自教育者的反馈。