HeadlinesBriefing HeadlinesBriefing 8 languages

What Would a Serious AI Product Look Like?

Hacker News ·

🇬🇧 English

The author criticizes current AI products like ChatGPT, Gemini, and Claude for not treating their limitations seriously. They argue that these tools present themselves as problem-solving assistants while ignoring their core flaw: hallucinations. The text highlights how error-checking is dismissed as legalese rather than integrated into the workflow. The author proposes a 2-column worksheet interface where users must verify each claim with notes and a checkbox. They also suggest coding assistants should include pre-test diff checks to avoid wasting compute. The piece concludes by demanding more citations and details instead of unsupported answers, calling the current approach a grift.

The author specifically mentions Ollama as another offender due to its lower model quality. They argue that serious tools must provide affordances for verification, not just warnings. The post is inspired by the universal admission that AIs make mistakes, yet no product builds a workflow around this reality.

View original article →


🇸🇦 العربية

ماذا لو كان منتج الذكاء الاصطناعي جديًا؟

ينتقد المؤلف منتجات الذكاء الحالية مثل ChatGPT وGemini وClaude لعدم جدية معالجتها للقيود. يرى أن هذه الأدوات تعرض نفسها كمساعدين لحل المشاكل بينما تتجاهل عيبها الأساسي: الوهميات. يسلط النص الضوء على كيفية تجاهل فحص الأخطاء كنصوص قانونية بدلاً من دمجها في سير العمل. يقترح المؤلف واجهة جدول عمل عمودين يجب على المستخدمين التحقق من كلادعية مع ملاحظات ومربع اختيار. كما يقترح يجب أن تشمل مساعدات البرمجة فحوصات فرق قبل الاختبار لتجنب إهدار الموارد الحوسبية. يختتم القطع بطلب المزيد من الاقتباسات والتفاصيل بدلاً من أجوبة غير مدعومة، موصفًا النهج الحالي كمنفاق. يذكر المؤلف Ollama على نطبق كمخطئ آخر بسبب جودة النموذج المنخفضة. يرون أن الأدوات الجادة يجب أن توفر وسائل للتحقق، وليس فقط تحذيرات. مستمد من الاعتراف الشامع بأن الذكاء الاصطناعي يرتكب أخطاء، على الرغم من عدم بناء أي منتج لتدفق العمل حول هذه الواقعية.،

ما الخصائص التي تجعل منتج الذكاء الاصطناعي جديًا؟

أدوات فحص الأخطاء المدمجة، مثل جدول عمل بعمودين للتحقق من الادعاءات، وفحوصات فرق الشيفرة قبل الاختبار، والاقتباسات الإلزامية مع التفاصيل بدلاً من أجوبة غير مدعومة.

العربية version →


🇧🇩 বাংলা

একটি সূক্ষ্ম AI পণ্য কী হবে?

লেখক বর্তমান AI পণ্যগুলি যেমন ChatGPT, Gemini এবং Claude এর বিরুদ্ধে লিখে দেন কারণ তারা তাদের সীমাবদ্ধতাকে সূক্ষ্মভাবে প্রতিফলন করেন না। তারা যুক্তি দেন যে এই মহোযোগগুলি সমস্যার সমাধানের সহায়কদের হিসেবে নিজেকে প্রদর্শন করেন জবরপুর্ণভাবে তাদের মূল সমস্যা অবহেলা করে: হ্যালুসিনেশন। পাঠ্য হালিফেশন এর বিরুদ্ধে ত্রুটি পরীক্ষা কে আইনি দস্তা঵েজের রূপে প্রতিকূল করা হয় বলে হাইলাইট করে। লেখক 2-কলাম ওয়ার্কশিট ইন্টারফেস প্রস্তাব করেন যেখানে ব্যবহারকারীরা প্রতিটি দাবীকে নোটের সাথে এবং একটি চেকবক্সের সাথে যাচাই করতে হবে। তারা একটি কোডিং সহায়ক ব্যবহার করা উচিত পূর্ব-পরীক্ষায় diff চেক অন্তর্ভুক্ত করে যাতে কম্পিউটেশন ব্যয় না করা পড়ে। এই রকমের একটি কাগজপত্র শেষ হয়েছে যা ব্যবহারকারীরা বেশি উদ্ধৃতি এবং বিবরণ দেখাতে চায় বদলে সমর্থিত না হয়ে আছে উত্তরগুলি, বর্তমান পদ্ধতিটিকে একটি ধোখা বলে উল্লেখ করে। লেখক বিশেষভাবে Ollama কে একটি অন্য অপরাধী হিসেবে উল্লেখ করেন কারণ তার মডেল গুণমান কম। তারা মনে করেন যে সূক্ষ্ম সরঞ্জামগুলি কেবল চেতাবনি প্রদান করবে না, বরণ করতে হবে নয় যাচাইর জন্য সুবিধা। এই পোস্টটি স্বজ্ঞানের উপর ভিত্তি করে তৈরি হয়েছে যে AI সম্পূরকভাবে ভুল করে, তবু কোন পণ্য স্থানের চারপাশে কোনও কর্মপ্রবাহ না তৈরি করে।

কোন বৈশিষ্ট্যগুলি AI পণ্যকে সূক্ষ্ম করে তুলে?

একীকৃত ত্রুটি যাচাই টুলগুলি, যেমন দাবী যাচাইর জন্য 2-কলাম পত্রিকা, পূর্ব-পরীক্ষা কোড ডিফ চেক, এবং সমর্থিত না হয়ে আছে উত্তরগুলির বদলে বাধ্যতামূলক উদ্ধৃতি এবং বিবরণ।

বাংলা version →


🇪🇸 Español

¿Qué sería un producto de IA serio?

El autor critica los productos de IA actuales como ChatGPT, Gemini y Claude por no tomar en serio sus limitaciones. Argumentan que estas herramientas se presentan como asistentes para resolver problemas mientras ignoran su falla principal: las alucinaciones. El texto destaca cómo la verificación de errores se descarta como lenguaje legal en lugar de integrarse en el flujo de trabajo.

El autor propone una interfaz de hoja de cálculo de 2 columnas donde los usuarios deben verificar cada afirmación con notas y una casilla de verificación. También sugieren que los asistentes de codificación deben incluir verificaciones de diferencias antes de las pruebas para evitar desperdiciar cómputo. La pieza concluye exigiendo más citaciones y detalles en lugar de respuestas no respaldadas, llamando al enfoque actual un estafa.

El autor menciona específicamente a Ollama como otro culpable debido a su menor calidad de modelo. Argumentan que las herramientas serias deben proporcionar facilidades para la verificación, no solo advertencias. La publicación está inspirada en la admisión universal de que las IAs cometen errores, aunque ningún producto construye un flujo de trabajo alrededor de esta realidad.

¿Qué características harían que un producto de IA parezca serio?

Herramientas integradas de verificación de errores, como una hoja de cálculo de 2 columnas para verificar afirmaciones, verificaciones de diferencias de código antes de las pruebas, y citas obligatorias con detalles en lugar de respuestas no respaldadas.

Español version →


🇫🇷 Français

À quoi ressemblerait un produit IA sérieux ?

L'auteur critique les produits d'IA actuels comme ChatGPT, Gemini et Claude pour ne pas prendre leurs limites au sérieux. Ils argumentent que ces outils se présentent comme des assistants résolvant les problèmes tout en ignorant leur défaut principal : les hallucinations. Le texte souligne comment la vérification des erreurs est rejetée comme un langage juridique au lieu d'être intégrée au workflow.

L'auteur propose une interface de feuille de travail à 2 colonnes où les utilisateurs doivent vérifier chaque affirmation avec des notes et une case à cocher. Ils suggèrent également que les assistants de codage doivent inclure des vérifications de diff avant les tests pour éviter de gaspiller des ressources de calcul. L'article conclut par exiger plus de citations et de détails au lieu de réponses non soutenues, qualifiant l'approche actuelle d'escroquerie.

L'auteur mentionne spécifiquement Ollama comme un autre coupable en raison de sa qualité de modèle inférieure. Ils soutiennent que les outils sérieux doivent fournir des moyens de vérification, pas seulement des avertissements. Le post est inspiré de l'admission universelle que les IA commettent des erreurs, mais aucun produit ne construit un workflow autour de cette réalité. à 2 colonnes** où les utilisateurs doivent vérifier chaque affirmation avec des notes et une case à cocher.

Ils suggèrent également que les assistants de codage doivent inclure des vérifications de diff avant les tests pour éviter de gaspiller des ressources de calcul. L'article conclut par exiger plus de citations et de détails au lieu de réponses non soutenues, qualifiant l'approche actuelle d'escroquerie. L'auteur mentionne spécifiquement Ollama comme un autre coupable en raison de sa qualité de modèle inférieure.

Ils soutiennent que les outils sérieux doivent fournir des moyens de vérification, pas seulement des avertissements. Le post est inspiré de l'admission universelle que les IA commettent des erreurs, mais aucun produit ne construit un workflow autour de cette réalité.

Quelles caractéristiques rendraient qu'un produit IA paraisse sérieux ?

Des outils de vérification d'erreurs intégrés, comme une feuille de travail à 2 colonnes pour vérifier les affirmations, des vérifications de diff de code avant les tests, et des citations obligatoires avec des détails au lieu de réponses non soutenues.

Français version →


🇮🇳 हिन्दी

एक गंभीर AI उत्पाद क्या होगा?

लेखक वर्तमान AI उत्पादों जैसे ChatGPT, Gemini और Claude की आलोचना करते हैं कि वे अपनी सीमाओं को गंभीरता से ले रहे नहीं हैं। उन्होंने तर्क दिया है कि ये औरभर कर समस्या के समाधान के सहायक के रूप में ख़ुद को प्रस्तुत करते हैं जबकि अपनी मूल बाधा को नज़रअंदाज़ करते हैं: भ्राकृतियाँ। लेख में उजागर किया गया है कि त्रुटि जाँच को कानूनी दस्तावेज़ के रूप में ठीक नहीं समझा गया है बल्कि कार्यप्रवाह में एकीकृत किया जाना चाहिए। लेखक 2-कॉलम वर्कशीट इंटरफ़ेस का प्रस्ताव रखते हैं जहाँ उपयोगकर्ता हर दावे की जाँच करने के साथ नोट्स और चेकबॉक्स के साथ पुष्टि करें। उन्होंने कोडिंग सहायकों को पूर्व-परीक्षा में diff जाँच शामिल करने का सुझाव दिया है ताकि कम्प्यूट को बर्बाद न किया जाए। यह लेख अपने आप को असमर्थित उत्तरों के बजाय अधिक प्रमाणों और विवरणों की मांग करता है, वर्तमान दृष्टिकोण को एक धोखा कहता है। लेखक विशेष रूप से Ollama को एक अन्य अपराधी के रूप में उल्लेख करते हैं क्योंकि इसकी मॉडल गुणवत्ता कम है। उन्होंने कहा है कि गंभीर औरकों को केवल चेतावनियों के साथ नहीं, बल्कि सत्यापन के लिए उपलब्धता प्रदान करनी होगी। यह पोस्ट उस प्रकार की प्रेरणा से बना है जहाँ AI संभवतः गलती करते हैं, फिर भी कोई भी उत्पाद इस वास्तविकता के आधार पर एक कार्यप्रवाह नहीं बनाता।

किन उपादानों के साथ AI उत्पाद गंभीर दिखेगा?

एकीकृत त्रुटि जाँच औरकों, जैसे कि दावा सत्यापन के लिए 2-कॉलम कागज़ी तालिका, पूर्व-परीक्षा कोड डिफ़ जाँच, और असमर्थित उत्तरों के बजाय अनिवार्य प्रमाण और विवरण।

हिन्दी version →


🇧🇷 Português

O que seria um produto de IA sério?

O autor critica os produtos de IA atuais como ChatGPT, Gemini e Claude por não levarem a sério suas limitações. Eles argumentam que essas ferramentas se apresentam como assistentes para resolver problemas enquanto ignoram sua falha principal: alucinações. O texto destaca como a verificação de erros é descartada como linguagem jurídica em vez de ser integrada ao fluxo de trabalho.

O autor propõe uma interface de planilha de 2 colunas onde os usuários devem verificar cada afirmação com notas e uma caixa de seleção. Eles também sugerem que assistentes de codificação devem incluir verificações de diferença antes dos testes para evitar desperdício de computação. O texto conclui exigindo mais citações e detalhes em vez de respostas não suportadas, chamando a abordagem atual de golpe.

O autor menciona especificamente Ollama como outro culpado devido à sua menor qualidade de modelo. Eles argumentam que ferramentas sérias devem fornecer meios de verificação, não apenas avisos. O post é inspirado na admissão universal de que IAs cometem erros, mas nenhum produto constrói um fluxo de trabalho em torno dessa realidade. ao fluxo de trabalho.

O autor propõe uma interface de planilha de 2 colunas onde os usuários devem verificar cada afirmação com notas e uma caixa de seleção. Eles também sugerem que assistentes de codificação devem incluir verificações de diferença antes dos testes para evitar desperdício de computação. O texto conclui exigindo mais citações e detalhes em vez de respostas não suportadas, chamando a abordagem atual de golpe.

O autor menciona especificamente Ollama como outro culpado devido à sua menor qualidade de modelo. Eles argumentam que ferramentas sérias devem fornecer meios de verificação, não apenas avisos. O post é inspirado na admissão universal de que IAs cometem erros, mas nenhum produto constrói um fluxo de trabalho em torno dessa realidade.

Quais recursos tornariam um produto de IA sério?

Ferramentas integradas

Português version →


🇨🇳 简体中文

严肃的AI产品会是什么样子?

作者批评当前AI产品如ChatGPT、Gemini和Claude不严肃对待它们的局限性。他们认为这些工具呈现自己作为问题解决助手的同时,忽略了核心缺陷:幻觉。文本强调,错误检查被视为法律文件,而不是集成到工作流程中。作者提议采用2列工作表界面,用户必须对每个声明进行验证并添加注释和复选框。他们还建议编码助手应包括预测试diff检查,以避免浪费计算资源。该篇文章 concludes by demanding more citations and details instead of unsupported answers, calling the current approach a grift。作者特别提到Ollama作为另一个有问题的产品 due to its lower model quality。他们认为严肃工具必须提供验证的便利性,而不仅仅是警告。该帖子受到AI普遍承认会犯错的事实启发,却没有任何产品围绕这一现实构建工作流程。

哪些功能会让AI产品显得严肃?

集成错误检查工具,如用于声明验证的2列工作表、预测试代码diff检查以及对引用和细节的强制要求,而不是不受支持的答案。

简体中文 version →