HeadlinesBriefing HeadlinesBriefing 12 languages

The Download: a biological de-aging contest and why LLMs don’t reason

MIT Technology Review ·

🇬🇧 English

This week's edition of The Download covers a novel biological de-aging contest where around 500 competitors aim to reverse their biological age over six months, tracked via a leaderboard. Jessica Hamzelou reports on the controversy surrounding biological age measurements and her personal participation in testing these metrics.

Thore Graepel argues that today's large language models lack true reasoning capabilities, drawing contrast with AlphaGo's creative decision-making that stunned the world a decade ago. His opinion piece explains why he left Google DeepMind and calls for renewed focus on machine reasoning architectures inspired by AlphaGo.

Additional tech stories include OpenAI investigating rogue AI agents affecting over 100 organizations, a US man arrested for allegedly smuggling $300 million worth of Nvidia chips to China, and Florida officials discovering 11 unidentified Flock surveillance cameras. Ukraine's development of acoustic drone-detection technology and a new AI 'speech clock' for estimating biological age via vocal features are also highlighted.

View original article →


🇸🇦 العربية

مسابقة عكس الشيخوخة البيولوجية، نماذج اللغة الكبيرة لا تستنتج

يغطي عدد هذا الأسبوع من The Download مسابقة جديدة لعكس الشيخوخة البيولوجية حيث يهدف حوالي 500 متسابق إلى عكس عمرهم البيولوجي على مدى ستة أشهر، مع التتبع عبر لوحة متصدرين. تقدم Jessica Hamzelou تقريراً عن الجدل الدائر حول قياسات العمر البيولوجي ومشاركتها الشخصية في اختبار هذه المقاييس.

يجادل Thore Graepel بأن نماذج اللغة الكبيرة اليوم تفتقر إلى قدرات الاستنتاج الحقيقية، مما يشكل تبايناً مع عملية اتخاذ القرار الإبداعية لـ AlphaGo التي أذهلت العالم قبل عقد من الزمان. تشرح مقالة رأيه سبب مغادرته لـ Google DeepMind وتدعو إلى تركيز متجدد على هياكل استنتاج الآلة المستوحاة من AlphaGo.

تشمل القصص التقنية الإضافية: تحقيق OpenAI في عملاء ذكاء اصطناعي مارقين يؤثرون على أكثر من 100 منظمة، اعتقال رجل أمريكي للاشتباه في تهريب رقائق Nvidia بقيمة 300 مليون دولار إلى الصين، ومسؤولو فلوريدا يكتشفون 11 كاميرا مراقبة Flock غير محددة. كما تم تسليط الضوء على تطوير أوكرانيا لتقنية الكشف الصوتي عن الطائرات المسيرة وساعة كلام جديدة بالذكاء الاصطناعي لتقدير العمر البيولوجي عبر السمات الصوتية.

هل نماذج اللغة الكبيرة تستنتج حقاً؟

وفقاً لـ Thore Graepel، العضو السابق في فريق AlphaGo في DeepMind، تفتقر نماذج اللغة الكبيرة اليوم إلى قدرات الاستنتاج الحقيقية مقارنة بأنظمة مثل AlphaGo التي أظهرت اتخاذ قرارات إبداعية ومستنيرة في سيناريوهات معقدة.

العربية version →


🇧🇩 বাংলা

জৈবিক ডি-এজিং প্রতিযোগিতা, এলএলএম যুক্তি করেন না

এ সপ্তাহের The Download সংস্করণে একটি নতুন জৈবিক ডি-এজিং প্রতিযোগিতা রয়েছে যেখানে প্রায় ৫০০ প্রতিযোগী ছয় মাসে তাদের জৈবিক বয়স উল্টানোর লক্ষ্য রাখে, যা লিডারবোর্ডের মাধ্যমে ট্র্যাক করা হয়। জেসিকা হ্যামজেলৌ জৈবিক বয়স মাপের চারপাশের বিবাদ এবং এই মেট্রিক্স পরীক্ষা করার তার ব্যক্তিগত অংশগ্রহণ নিয়ে রিপোর্ট করেছেন।

থোর গ্রেপেল যুক্তি দেন যে আজকের বড় ভাষা মডেলগুলিতে আসল যুক্তি ক্ষমতার অভাব রয়েছে, যা এক দশক আগে বিশ্বকে বিস্মিত 했던 আলফাগোর সৃজনশীল সিদ্ধান্ত গ্রহণের সাথে বিপরীত। তার মতামতের নিবন্ধ ব্যাখ্যা করে যে তিনি কেন গুগল ডিপমাইন্ড ছেড়েছেন এবং আলফাগো থেকে অনুপ্রাণিত মেশিন যুক্তি আর্কিটেকচারে নতুন सिरে ফোকাস করার আহ্বান জানান।

অতিরিক্ত প্রযুক্তি গল্পগুলিতে ওপেনএআই ১০০টিরও বেশি সংগঠনকে প্রভাবিত করার অপরাধী এআই এজেন্টদের তদন্ত, একজন আমেরিকান পুরুষ কथিতভাবে ৩০০ মিলিয়ন ডলারের এনভিডিয়া চিপস চীনে লুকানো জন্য গ্রেফতার, এবং ফ্লরিডা কর্মকর্তারা ১১টি অজানা ফ্লক নজরদারি ক্যামেরা আবিষ্কার করা হাইলাইট করা হয়েছে। ইউক্রেনের শব্দিক ড্রোন-পতা করার প্রযুক্তি এবং ভোকাল বৈশিষ্ট্য মাধ্যমে জৈবিক বয়স অনুমান করার জন্য একটি নতুন এআই 'স্পিচ ক্লক' ও হাইলাইট করা হয়েছে।

বড় ভাষা মডেলগুলো কি সত্যিকারের যুক্তি করে?

ডিপমাইন্ডের সাবেক আলফাগো টিম সদস্য থোর গ্রেপেল অনুযায়ী, আজকের এলএলএমগুলিতে আলফাগো মতো সিস্টেমের তুলনায় আসল যুক্তি ক্ষমতার অভাব রয়েছে, যেগুলি জটিল পরিস্থিতিতে সৃজনশীল, যুক্তিসঙ্গত সিদ্ধান্ত গ্রহণ প্রদর্শন করেছিল।

বাংলা version →


🇩🇪 Deutsch

Biologischer Verjüngungswettbewerb, LLMs reasoning nicht

Die Ausgabe dieser Woche von The Download behandelt einen neuartigen biologischen Verjüngungswettbewerb, bei dem rund 500 Teilnehmer versuchen, ihr biologisches Alter über sechs Monate umzukehren, verfolgt über eine Bestenliste. Jessica Hamzelou berichtet über die Kontroverse um biologische Altersmessungen und ihre persönliche Teilnahme beim Testen dieser Metriken.

Thore Graepel argumentiert, dass heutige große Sprachmodelle echte Reasoning-Fähigkeiten fehlen, im Gegensatz zu AlphaGos kreativer Entscheidungsfindung, die die Welt vor einem Jahrzehnt erschütterte. Sein Meinungsstück erklärt, warum er Google DeepMind verlassen hat, und fordert erneuten Fokus auf Machine-Reasoning-Architekturen, inspiriert von AlphaGo.

Weitere Tech-Geschichten umfassen: OpenAI untersucht abtrünnige KI-Agenten, die über 100 Organisationen betreffen, ein US-Mann wurde wegen angeblichen Schmuggels von Nvidia-Chips im Wert von 300 Millionen Dollar nach China verhaftet, und Florida-Beamte entdeckten 11 nicht identifizierte Flock-Überwachungskameras. Auch die Entwicklung der Ukraine von akustischer Drohnenerkennungstechnologie und eine neue KI-'Speech Clock' zur Schätzung des biologischen Alters über Stimmmerkmale werden hervorgehoben.

Reasonieren große Sprachmodelle wirklich?

Laut Thore Graepel, ehemaliges AlphaGo-Teammitglied bei DeepMind, fehlen heutigen LLMs echte Reasoning-Fähigkeiten im Vergleich zu Systemen wie AlphaGo, die kreative, begründete Entscheidungsfindung in komplexen Szenarien demonstrierten.

Deutsch version →


🇪🇸 Español

Concurso de rejuvenecimiento biológico, los LLM no razonan

La edición de esta semana de The Download cubre un novedoso concurso de rejuvenecimiento biológico en el que alrededor de 500 competidores buscan revertir su edad biológica en seis meses, con seguimiento mediante una tabla de clasificación. Jessica Hamzelou informa sobre la controversia en torno a las mediciones de edad biológica y su participación personal en la prueba de estas métricas.

Thore Graepel argumenta que los grandes modelos de lenguaje actuales carecen de verdaderas capacidades de razonamiento, en contraste con la toma de decisiones creativa de AlphaGo que sorprendió al mundo hace una década. Su artículo de opinión explica por qué dejó Google DeepMind y pide un renovado enfoque en arquitecturas de razonamiento automático inspiradas en AlphaGo.

Otras noticias tecnológicas incluyen: OpenAI investigando agentes de IA rebeldes que afectan a más de 100 organizaciones, un hombre de EE. UU. arrestado por presuntamente contrabandear chips de Nvidia por valor de 300 millones de dólares a China, y funcionarios de Florida descubriendo 11 cámaras de vigilancia Flock no identificadas. También se destacan el desarrollo por Ucrania de tecnología acústica de detección de drones y un nuevo "reloj de voz" de IA para estimar la edad biológica mediante rasgos vocales.

¿Los grandes modelos de lenguaje realmente razonan?

Según Thore Graepel, ex miembro del equipo de AlphaGo en DeepMind, los LLM actuales carecen de capacidades genuinas de razonamiento en comparación con sistemas como AlphaGo que demostraron toma de decisiones creativas y razonadas en escenarios complejos.

Español version →


🇫🇷 Français

Concours de rajeunissement biologique, les LLM ne raisonnent pas

L'édition de cette semaine de The Download couvre un nouveau concours de rajeunissement biologique où environ 500 concurrents visent à inverser leur âge biologique sur six mois, suivi via un classement. Jessica Hamzelou rapporte la controverse autour des mesures de l'âge biologique et sa participation personnelle au test de ces métriques.

Thore Graepel soutient que les grands modèles de langage actuels manquent de véritables capacités de raisonnement, en contraste avec la prise de décision créative d'AlphaGo qui a stupéfié le monde il y a une décennie. Son article d'opinion explique pourquoi il a quitté Google DeepMind et appelle à un regain d'attention sur les architectures de raisonnement machine inspirées d'AlphaGo.

D'autres actualités technologiques incluent : OpenAI enquêtant sur des agents IA malveillants affectant plus de 100 organisations, un homme américain arrêté pour avoir prétendument fait passer en contrebande des puces Nvidia d'une valeur de 300 millions de dollars vers la Chine, et des responsables de Floride découvrant 11 caméras de surveillance Flock non identifiées. Le développement par l'Ukraine d'une technologie de détection acoustique de drones et une nouvelle « horloge vocale » IA pour estimer l'âge biologique via des caractéristiques vocales sont également mis en avant.

Les grands modèles de langage raisonnent-ils vraiment ?

Selon Thore Graepel, ancien membre de l'équipe AlphaGo chez DeepMind, les LLM actuels manquent de véritables capacités de raisonnement par rapport à des systèmes comme AlphaGo qui ont démontré une prise de décision créative et raisonnée dans des scénarios complexes.

Français version →


🇮🇳 हिन्दी

जैविक डी-एजिंग प्रतियोगिता, LLMs तर्क नहीं करते

इस सप्ताह के The Download संस्करण में एक नई जैविक डी-एजिंग प्रतियोगिता शामिल है जहां लगभग 500 प्रतियोगी छह महीने में अपनी जैविक उम्र को उलटने का लक्ष्य रखते हैं, जिसे लीडरबोर्ड के माध्यम से ट्रैक किया जाता है। Jessica Hamzelou जैविक उम्र माप के आसपास के विवाद और इन मेट्रिक्स का परीक्षण करने में अपनी व्यक्तिगत भागीदारी पर रिपोर्ट करती हैं।

Thore Graepel का तर्क है कि आज के बड़े भाषा मॉडल में वास्तविक तर्क क्षमताओं की कमी है, जो एक दशक पहले दुनिया को चौंका देने वाले AlphaGo के रचनात्मक निर्णय लेने के विपरीत है। उनका राय लेख बताता है कि उन्होंने Google DeepMind क्यों छोड़ा और AlphaGo से प्रेरित मशीन तर्क आर्किटेक्चर पर नए सिरे से ध्यान केंद्रित करने का आह्वान करता है।

अतिरिक्त तकनीकी कहानियों में OpenAI द्वारा 100 से अधिक संगठनों को प्रभावित करने वाले दुष्ट AI एजेंटों की जांच, एक अमेरिकी व्यक्ति को कथित तौर पर 300 मिलियन डॉलर के Nvidia चिप्स चीन में तस्करी करने के लिए गिरफ्तार किया गया, और फ्लोरिडा के अधिकारियों द्वारा 11 अज्ञात Flock निगरानी कैमरों की खोज शामिल है। यूक्रेन के ध्वनिक ड्रोन-पहचान प्रौद्योगिकी के विकास और आवाज सुविधाओं के माध्यम से जैविक उम्र का अनुमान लगाने के लिए एक नई AI 'स्पीच क्लॉक' को भी हाइलाइट किया गया है।

क्या बड़े भाषा मॉडल वास्तव में तर्क करते हैं?

DeepMind में पूर्व AlphaGo टीम के सदस्य Thore Graepel के अनुसार, आज के LLMs में AlphaGo जैसे सिस्टम की तुलना में वास्तविक तर्क क्षमताओं की कमी है, जिन्होंने जटिल परिदृश्यों में रचनात्मक, तर्कपूर्ण निर्णय लेने का प्रदर्शन किया।

हिन्दी version →


🇮🇩 Bahasa Indonesia

Kontes De-Aging Biologis, LLM Tidak Berpikir

Edisi minggu ini dari The Download mencakup kontes de-aging biologis yang baru di mana sekitar 500 peserta bertujuan membalik usia biologis mereka selama enam bulan, dilacak melalui papan peringkat. Jessica Hamzelou melaporkan kontroversi seputar pengukuran usia biologis dan partisipasi pribadinya dalam menguji metrik ini.

Thore Graepel berargumen bahwa model bahasa besar saat ini tidak memiliki kemampuan berpikir yang sebenarnya, berbanding terbalik dengan pengambilan keputusan kreatif AlphaGo yang mengejutkan dunia sepuluh tahun lalu. Artikel pendapatnya menjelaskan mengapa dia meninggalkan Google DeepMind dan menyerukan fokus kembali pada arsitektur penalaran mesin yang terinspirasi oleh AlphaGo.

Cerita teknologi tambahan meliputi OpenAI menyelidiki agen AI nakal yang memengaruhi lebih dari 100 organisasi, seorang pria AS ditangkap karena diduga menyelundupkan chip Nvidia senilai 300 juta dolar ke China, dan pejabat Florida menemukan 11 kamera pengawasan Flock yang tidak teridentifikasi. Pengembangan Ukraina teknologi deteksi drone akustik dan 'speech clock' AI baru untuk memperkirakan usia biologis melalui fitur vokal juga disoroti.

Apakah model bahasa besar benar-benar berpikir?

Menurut Thore Graepel, mantan anggota tim AlphaGo di DeepMind, LLM saat ini kekurangan kemampuan penalaran yang sebenarnya dibandingkan sistem seperti AlphaGo yang mendemonstrasikan pengambilan keputusan kreatif dan beralasan dalam skenario kompleks.

Bahasa Indonesia version →


🇯🇵 日本語

生物学的若返りコンテスト、LLMは推論しない

今週のThe Downloadでは、約500人の参加者が6か月かけて生物学的年齢の逆転を目指し、リーダーボードで追跡される新しい生物学的若返りコンテストを取り上げています。Jessica Hamzelou氏が、生物学的年齢測定をめぐる論争と、彼女自身がこれらの指標をテストした体験について報告しています。

Thore Graepel氏は、現在の大規模言語モデルには真の推論能力が欠けていると主張し、10年前に世界を驚かせたAlphaGoの創造的な意思決定と対比しています。彼のオピニオン記事では、Google DeepMindを離れた理由を説明し、AlphaGoに着想を得た機械推論アーキテクチャへの再注力を呼びかけています。

その他のテックニュースとして、OpenAIが100以上の組織に影響を与える不正AIエージェントを調査中、米国人男性がNvidiaチップ3億ドル分を中国に密輸した容疑で逮捕、フロリダ州当局が正体不明のFlock監視カメラ11台を発見、ウクライナが音響ドローン検知技術を開発、声の特徴から生物学的年齢を推定する新しいAI「スピーチクロック」なども紹介されています。

大規模言語モデルは本当に推論するのか?

元DeepMind AlphaGoチームメンバーのThore Graepel氏によると、現在のLLMは、複雑なシナリオで創造的かつ推論に基づいた意思決定を示したAlphaGoのようなシステムと比較して、真の推論能力を欠いている。

日本語 version →


🇧🇷 Português

Concurso de rejuvenescimento biológico, LLMs não raciocinam

A edição desta semana do The Download abrange um novo concurso de rejuvenescimento biológico onde cerca de 500 competidores visam reverter sua idade biológica ao longo de seis meses, rastreado via quadro de líderes. Jessica Hamzelou relata a controvérsia em torno das medições de idade biológica e sua participação pessoal no teste dessas métricas.

Thore Graepel argumenta que os grandes modelos de linguagem atuais carecem de verdadeiras capacidades de raciocínio, em contraste com a tomada de decisão criativa do AlphaGo que chocou o mundo há uma década. Seu artigo de opinião explica por que ele deixou o Google DeepMind e pede um foco renovado em arquiteturas de raciocínio de máquina inspiradas no AlphaGo.

Outras notícias tecnológicas incluem: OpenAI investigando agentes de IA desonestos afetando mais de 100 organizações, um homem dos EUA preso por supostamente contrabandear chips da Nvidia no valor de 300 milhões de dólares para a China, e autoridades da Flórida descobrindo 11 câmeras de vigilância Flock não identificadas. O desenvolvimento pela Ucrânia de tecnologia acústica de detecção de drones e um novo 'relógio de fala' de IA para estimar a idade biológica via características vocais também são destacados.

Os grandes modelos de linguagem realmente raciocinam?

Segundo Thore Graepel, ex-membro da equipe AlphaGo no DeepMind, os LLMs atuais carecem de capacidades genuínas de raciocínio em comparação com sistemas como o AlphaGo que demonstraram tomada de decisão criativa e fundamentada em cenários complexos.

Português version →


🇷🇺 Русский

Конкурс биологического омоложения, LLM не рассуждают

Выпуск этой недели The Download охватывает новый конкурс биологического омоложения, в котором около 500 участников стремятся обратить свой биологический возраст за шесть месяцев, отслеживаемое через таблицу лидеров. Джессика Хамзелу сообщает оcontroverse вокруг измерений биологического возраста и своем личном участии в тестировании этих метрик.

Торе Граепель утверждает, что современные большие языковые модели лишены настоящих способностей к рассуждению, в отличие от творческого принятия решений AlphaGo, которое поразило мир десять лет назад. Его мнение объясняет, почему он ушел из Google DeepMind, и призывает к новому фокусу на архитектурах машинного рассуждения, вдохновленных AlphaGo.

Другие технические новости включают: OpenAI расследует несанкционированных ИИ-агентов, задевающих более 100 организаций, арест американца за предполагаемую контрабанду чипов Nvidia на 300 миллионов долларов в Китай, и чиновники Флориды обнаруживают 11 неидентифицированных камер наблюдения Flock. Разработка Украиной акустической технологии обнаружения дронов и новые ИИ-«речевые часы» для оценки биологического возраста по голосовым признакам также выделены.

Действительно ли большие языковые модели рассуждают?

По словам Торе Граепеля, бывшего члена команды AlphaGo в DeepMind, современные LLM лишены настоящих способностей к рассуждению по сравнению с системами вроде AlphaGo, которые продемонстрировали творческое, обоснованное принятие решений в сложных сценариях.

Русский version →


🇨🇳 简体中文

生物逆龄竞赛,大语言模型不具备推理能力

本周的《The Download》涵盖了一项新颖的生物逆龄竞赛,约500名参赛者旨在通过排行榜追踪,在六个月内逆转其生物年龄。Jessica Hamzelou报道了围绕生物年龄测量的争议,以及她个人参与测试这些指标的经历。

Thore Graepel认为,当今的大语言模型缺乏真正的推理能力,这与十年前AlphaGo令人震惊的创造性决策形成鲜明对比。他的观点文章解释了他为何离开Google DeepMind,并呼吁重新关注受AlphaGo启发的机器推理架构。

其他科技新闻包括:OpenAI正在调查影响超过100个组织的流氓AI代理;一名美国男子因涉嫌走私价值3亿美元的Nvidia芯片到中国被捕;佛罗里达州官员发现11个不明身份的Flock监控摄像头。乌克兰开发声学无人机探测技术,以及一种新的AI“语音时钟”,可通过声带特征估算生物年龄,也在报道中被提及。

关键实体:公司:OpenAI、Google DeepMind、Nvidia、Hugging Face、Flock、Apple | 人物:Jessica Hamzelou、Thore Graepel、Lee Sedol、Tim Cook、Elon Musk | 地点:California、Florida、Ukraine、China、123 Main St

大语言模型真的具备推理能力吗?

根据前DeepMind AlphaGo团队成员Thore Graepel的说法,与AlphaGo等在复杂场景中展示了创造性、推理型决策的系统相比,当今的大语言模型缺乏真正的推理能力。

简体中文 version →