HeadlinesBriefing favicon HeadlinesBriefing.com

Quelles caractéristiques rendent un produit IA sérieux ?

Hacker News •
×

L'auteur critique les produits d'IA actuels comme ChatGPT, Gemini et Claude pour ne pas prendre leurs limites au sérieux. Ils argumentent que ces outils se présentent comme des assistants résolvant les problèmes tout en ignorant leur défaut principal : les hallucinations. Le texte souligne comment la vérification des erreurs est rejetée comme un langage juridique au lieu d'être intégrée au workflow.

L'auteur propose une interface de feuille de travail à 2 colonnes où les utilisateurs doivent vérifier chaque affirmation avec des notes et une case à cocher. Ils suggèrent également que les assistants de codage doivent inclure des vérifications de diff avant les tests pour éviter de gaspiller des ressources de calcul. L'article conclut par exiger plus de citations et de détails au lieu de réponses non soutenues, qualifiant l'approche actuelle d'escroquerie.

L'auteur mentionne spécifiquement Ollama comme un autre coupable en raison de sa qualité de modèle inférieure. Ils soutiennent que les outils sérieux doivent fournir des moyens de vérification, pas seulement des avertissements. Le post est inspiré de l'admission universelle que les IA commettent des erreurs, mais aucun produit ne construit un workflow autour de cette réalité. à 2 colonnes** où les utilisateurs doivent vérifier chaque affirmation avec des notes et une case à cocher.

Ils suggèrent également que les assistants de codage doivent inclure des vérifications de diff avant les tests pour éviter de gaspiller des ressources de calcul. L'article conclut par exiger plus de citations et de détails au lieu de réponses non soutenues, qualifiant l'approche actuelle d'escroquerie. L'auteur mentionne spécifiquement Ollama comme un autre coupable en raison de sa qualité de modèle inférieure.

Ils soutiennent que les outils sérieux doivent fournir des moyens de vérification, pas seulement des avertissements. Le post est inspiré de l'admission universelle que les IA commettent des erreurs, mais aucun produit ne construit un workflow autour de cette réalité.