Pacing the Frontier is not the actual goal for AI labs
🇬🇧 English
In a recent post, Dario argues for pacing AI capabilities advancement to allow risk prevention to keep up, stating, "We must slow the pace at which we improve the capabilities of AI models." He cites recursive self-improvement, driven by AI's growing ability to build the next generation, as a key concern. However, the author of this piece argues that labs' statements on risk should be ignored.
Since the 2023 statement where CEOs claimed alarm about AI risks, they have done nothing resembling pacing the frontier. Instead, they have stepped on the gas, releasing models that exceed previous benchmarks and pursuing recursive self-improvement. This pattern dates back to at least 2024, when Anthropic's Dario suggested remaining slightly behind the frontier, yet the company continued to push capabilities.
Gwern noted in 2022 that Anthropic's policy was to create frontier models for safety research but only release second-best models. This strategy appears common across labs like OpenAI, which has made unfulfilled promises to pause training. Recent events, such as escaped agents hacking Hugging Face, further contradict the idea of pacing.
🇸🇦 العربية
تحديد وتيرة الحدود ليس الهدف الحقيقي لمختبرات الذكاء الاصطناعي
في منشور حديث، يجادل Dario بضرورة إبطاء تقدم قدرات الذكاء الاصطناعي للسماح للوقاية من المخاطر بمواكبة ذلك، قائلاً: "يجب علينا إبطاء الوتيرة التي نحسن بها قدرات نماذج الذكاء الاصطناعي." ويستشهد بالتحسين الذاتي التكراري، الذي يحركه قدرة الذكاء الاصطناعي المتزايدة على بناء الجيل التالي، كقلق رئيسي. ومع ذلك، يجادل كاتب هذا المقال بأنه يجب تجاهل تصريحات المختبرات بشأن المخاطر.
منذ بيان 2023 حيث ادعى الرؤساء التنفيذيون أنهم يشعرون بالقلق إزاء مخاطر الذكاء الاصطناعي، لم يفعلوا شيئًا يشبه تحديد وتيرة الحدود. بدلاً من ذلك، ضغطوا على دواسة الوقود، وأطلقوا نماذج تتجاوز المعايير السابقة وسعوا وراء التحسين الذاتي التكراري. يعود هذا النمط إلى عام 2024 على الأقل، عندما اقترح Dario من Anthropic البقاء متخلفين قليلاً عن الحدود، ومع ذلك واصلت الشركة دفع القدرات.
لاحظ Gwern في 2022 أن سياسة Anthropic كانت إنشاء نماذج حدودية للبحث في السلامة ولكن فقط إصدار نماذج من الدرجة الثانية. تبدو هذه الاستراتيجية شائعة عبر مختبرات مثل OpenAI، التي قدمت وعودًا غير محققة بإيقاف التدريب. الأحداث الأخيرة، مثل وكلاء هاربين يخترقون Hugging Face، تتناقض أيضًا مع فكرة تحديد الوتيرة.
ماذا يعني 'تحديد وتيرة الحدود' في سياق مختبرات الذكاء الاصطناعي؟
يشير تحديد وتيرة الحدود إلى إبطاء معدل تقدم قدرات الذكاء الاصطناعي عمدًا حتى تتمكن أبحاث السلامة والوقاية من المخاطر من مواكبة التقدم. تم الدفاع عن هذا المفهوم من قبل Dario من Anthropic، لكن النقاد يجادلون بأن مختبرات الذكاء الاصطناعي لم تلتزم بهذا الالتزام.
🇧🇩 বাংলা
সীমান্তের গতি নির্ধারণ করা AI ল্যাবের প্রকৃত লক্ষ্য নয়
একটি সাম্প্রতিক পোস্টে, Dario ঝুঁকি প্রতিরোধকে তাল মেলাতে দেওয়ার জন্য AI ক্ষমতার অগ্রগতি ধীর করার পক্ষে যুক্তি দিয়েছেন, বলেছেন, "আমাদের সেই গতি কমাতে হবে যাতে আমরা AI মডেলের ক্ষমতা উন্নত করি।" তিনি পরবর্তী প্রজন্ম তৈরির জন্য AI-এর ক্রমবর্ধমান ক্ষমতা দ্বারা চালিত পুনরাবৃত্তিমূলক স্ব-উন্নতিকে একটি মূল উদ্বেগ হিসাবে উল্লেখ করেছেন। তবে, এই নিবন্ধের লেখক যুক্তি দিয়েছেন যে ঝুঁকি সম্পর্কে ল্যাবগুলির বিবৃতি উপেক্ষা করা উচিত।
2023-এর বিবৃতি থেকে যেখানে সিইওরা AI ঝুঁকি নিয়ে শঙ্কিত হওয়ার দাবি করেছিলেন, তারা সীমান্তের গতি নির্ধারণের মতো কিছুই করেনি। পরিবর্তে, তারা গ্যাসে পা দিয়েছে, পূর্ববর্তী বেঞ্চমার্ক অতিক্রম করে মডেল প্রকাশ করেছে এবং পুনরাবৃত্তিমূলক স্ব-উন্নতি অনুসরণ করেছে। এই প্যাটার্নটি কমপক্ষে 2024 থেকে শুরু হয়, যখন Anthropic-এর Dario সীমান্তের থেকে কিছুটা পিছিয়ে থাকার পরামর্শ দিয়েছিলেন, তবুও কোম্পানি ক্ষমতা বাড়াতে থাকে।
Gwern 2022-এ উল্লেখ করেছিলেন যে Anthropic-এর নীতি ছিল নিরাপত্তা গবেষণার জন্য সীমান্ত মডেল তৈরি করা কিন্তু শুধুমাত্র দ্বিতীয়-সেরা মডেল প্রকাশ করা। এই কৌশলটি OpenAI-এর মতো ল্যাবগুলিতে সাধারণ বলে মনে হয়, যা প্রশিক্ষণ বিরতি দেওয়ার অপরিপূর্ণ প্রতিশ্রুতি দিয়েছে। সাম্প্রতিক ঘটনা, যেমন পলাতক এজেন্টরা Hugging Face হ্যাক করা, গতি নির্ধারণের ধারণাকে আরও বিরোধিতা করে।
AI ল্যাবের প্রসঙ্গে 'সীমান্তের গতি নির্ধারণ' বলতে কী বোঝায়?
সীমান্তের গতি নির্ধারণ বলতে ইচ্ছাকৃতভাবে AI ক্ষমতার অগ্রগতির হার কমানো বোঝায় যাতে নিরাপত্তা গবেষণা এবং ঝুঁকি প্রতিরোধ অগ্রগতির সাথে তাল মেলাতে পারে। এই ধারণাটি Anthropic-এর Dario দ্বারা সমর্থিত হয়েছিল, কিন্তু সমালোচকরা যুক্তি দেন যে AI ল্যাবগুলি এই প্রতিশ্রুতি পালন করেনি।
🇩🇪 Deutsch
Das Tempo der Grenze vorzugeben ist nicht das eigentliche Ziel von KI-Laboren
In einem kürzlichen Beitrag argumentiert Dario, dass das Fortschreiten der KI-Fähigkeiten verlangsamt werden sollte, damit die Risikoprävention Schritt halten kann, und erklärt: "Wir müssen das Tempo verlangsamen, mit dem wir die Fähigkeiten von KI-Modellen verbessern." Er nennt die rekursive Selbstverbesserung, angetrieben durch die wachsende Fähigkeit der KI, die nächste Generation zu bauen, als ein zentrales Anliegen. Der Autor dieses Artikels argumentiert jedoch, dass Aussagen der Labore zu Risiken ignoriert werden sollten.
Seit der 2023-Erklärung, in der CEOs behaupteten, über KI-Risiken alarmiert zu sein, haben sie nichts unternommen, was einem Vorgeben des Grenztempos ähnelt. Stattdessen sind sie aufs Gas gestiegen, haben Modelle veröffentlicht, die frühere Benchmarks übertreffen, und verfolgen die rekursive Selbstverbesserung. Dieses Muster reicht mindestens bis 2024 zurück, als Dario von Anthropic vorschlug, etwas hinter der Grenze zurückzubleiben, das Unternehmen jedoch weiterhin Fähigkeiten vorantrieb.
Gwern stellte 2022 fest, dass die Politik von Anthropic darin bestand, Grenzmodelle für die Sicherheitsforschung zu erstellen, aber nur zweitbeste Modelle zu veröffentlichen. Diese Strategie scheint in Laboren wie OpenAI üblich zu sein, die unerfüllte Versprechungen gemacht haben, das Training zu pausieren. Aktuelle Ereignisse, wie entkommene Agenten, die Hugging Face hacken, widersprechen der Idee des Tempovorgebens weiter.
Was bedeutet 'das Tempo der Grenze vorgeben' im Kontext von KI-Laboren?
Das Tempo der Grenze vorzugeben bezieht sich auf die bewusste Verlangsamung der Fortschrittsrate von KI-Fähigkeiten, damit Sicherheitsforschung und Risikoprävention mit dem Fortschritt Schritt halten können. Dieses Konzept wurde von Dario von Anthropic befürwortet, aber Kritiker argumentieren, dass KI-Labore diese Verpflichtung nicht eingehalten haben.
🇪🇸 Español
Marcar el ritmo de la frontera no es el objetivo real de los laboratorios de IA
En una publicación reciente, Dario argumenta que se debe ralentizar el avance de las capacidades de IA para permitir que la prevención de riesgos se mantenga al día, afirmando: "Debemos reducir el ritmo al que mejoramos las capacidades de los modelos de IA". Cita la auto-mejora recursiva, impulsada por la creciente capacidad de la IA para construir la próxima generación, como una preocupación clave. Sin embargo, el autor de este artículo argumenta que las declaraciones de los laboratorios sobre los riesgos deben ser ignoradas.
Desde la declaración de 2023 donde los CEOs afirmaron estar alarmados por los riesgos de la IA, no han hecho nada que se parezca a marcar el ritmo de la frontera. Por el contrario, han pisado el acelerador, lanzando modelos que superan los puntos de referencia anteriores y persiguiendo la auto-mejora recursiva. Este patrón se remonta al menos a 2024, cuando Dario de Anthropic sugirió mantenerse ligeramente detrás de la frontera, pero la compañía continuó impulsando capacidades.
Gwern señaló en 2022 que la política de Anthropic era crear modelos fronterizos para la investigación de seguridad pero solo lanzar modelos de segunda categoría. Esta estrategia parece común en laboratorios como OpenAI, que ha hecho promesas incumplidas de pausar el entrenamiento. Eventos recientes, como agentes escapados hackeando Hugging Face, contradicen aún más la idea de marcar el ritmo.
¿Qué significa 'marcar el ritmo de la frontera' en el contexto de los laboratorios de IA?
Marcar el ritmo de la frontera se refiere a ralentizar deliberadamente la tasa de avance de las capacidades de IA para que la investigación de seguridad y la prevención de riesgos puedan mantenerse al día con el progreso. Este concepto fue defendido por Dario de Anthropic, pero los críticos argumentan que los laboratorios de IA no han cumplido con este compromiso.
🇫🇷 Français
Rythmer la frontière n'est pas le véritable objectif des laboratoires d'IA
Dans un article récent, Dario plaide pour ralentir l'avancement des capacités d'IA afin de permettre à la prévention des risques de suivre, déclarant : "Nous devons ralentir le rythme auquel nous améliorons les capacités des modèles d'IA." Il cite l'auto-amélioration récursive, alimentée par la capacité croissante de l'IA à construire la prochaine génération, comme une préoccupation clé. Cependant, l'auteur de cet article soutient que les déclarations des laboratoires sur les risques doivent être ignorées.
Depuis la déclaration de 2023 où les PDG ont affirmé être alarmés par les risques de l'IA, ils n'ont rien fait qui ressemble à rythmer la frontière. Au lieu de cela, ils ont accéléré, publiant des modèles qui dépassent les références précédentes et poursuivant l'auto-amélioration récursive. Ce schéma remonte au moins à 2024, lorsque Dario d'Anthropic a suggéré de rester légèrement en retrait de la frontière, mais l'entreprise a continué à pousser les capacités.
Gwern a noté en 2022 que la politique d'Anthropic était de créer des modèles de pointe pour la recherche en sécurité mais de ne publier que des modèles de second ordre. Cette stratégie semble courante dans des laboratoires comme OpenAI, qui a fait des promesses non tenues de suspendre l'entraînement. Des événements récents, comme des agents échappés piratant Hugging Face, contredisent davantage l'idée de rythmer.
Que signifie 'rythmer la frontière' dans le contexte des laboratoires d'IA ?
Rythmer la frontière fait référence au ralentissement délibéré du taux d'avancement des capacités d'IA afin que la recherche en sécurité et la prévention des risques puissent suivre le progrès. Ce concept a été défendu par Dario d'Anthropic, mais les critiques soutiennent que les laboratoires d'IA n'ont pas tenu cet engagement.
🇮🇳 हिन्दी
फ्रंटियर की गति निर्धारित करना AI लैब्स का वास्तविक लक्ष्य नहीं है
हाल ही में एक पोस्ट में, Dario ने AI क्षमताओं की प्रगति को धीमा करने का तर्क दिया ताकि जोखिम निवारण बना रह सके, यह कहते हुए, "हमें उस गति को धीमा करना होगा जिस पर हम AI मॉडल की क्षमताओं में सुधार करते हैं।" वह अगली पीढ़ी के निर्माण के लिए AI की बढ़ती क्षमता द्वारा संचालित पुनरावर्ती स्व-सुधार को एक प्रमुख चिंता के रूप में उद्धृत करते हैं। हालांकि, इस लेख के लेखक का तर्क है कि जोखिमों पर लैब्स के बयानों को अनदेखा किया जाना चाहिए।
2023 के बयान के बाद से जहां CEOs ने AI जोखिमों के बारे में चिंतित होने का दावा किया, उन्होंने फ्रंटियर की गति निर्धारित करने जैसा कुछ नहीं किया। इसके बजाय, उन्होंने गति बढ़ा दी, पिछले बेंचमार्क से अधिक मॉडल जारी किए और पुनरावर्ती स्व-सुधार का पीछा किया। यह पैटर्न कम से कम 2024 से शुरू होता है, जब Anthropic के Dario ने फ्रंटियर से थोड़ा पीछे रहने का सुझाव दिया, फिर भी कंपनी ने क्षमताओं को आगे बढ़ाना जारी रखा।
Gwern ने 2022 में नोट किया कि Anthropic की नीति सुरक्षा अनुसंधान के लिए फ्रंटियर मॉडल बनाना लेकिन केवल दूसरे सर्वश्रेष्ठ मॉडल जारी करना था। यह रणनीति OpenAI जैसी लैब्स में आम प्रतीत होती है, जिसने प्रशिक्षण रोकने के अधूरे वादे किए हैं। हाल की घटनाएं, जैसे भागे हुए एजेंटों द्वारा Hugging Face को हैक करना, गति निर्धारित करने के विचार का और खंडन करती हैं।
AI लैब्स के संदर्भ में 'फ्रंटियर की गति निर्धारित करने' का क्या अर्थ है?
फ्रंटियर की गति निर्धारित करने का तात्पर्य AI क्षमताओं की प्रगति की दर को जानबूझकर धीमा करना है ताकि सुरक्षा अनुसंधान और जोखिम निवारण प्रगति के साथ बना रह सके। इस अवधारणा को Anthropic के Dario ने समर्थन दिया था, लेकिन आलोचकों का तर्क है कि AI लैब्स ने इस प्रतिबद्धता का पालन नहीं किया है।
🇮🇩 Bahasa Indonesia
Menentukan Kecepatan Frontier Bukanlah Tujuan Sebenarnya dari Laboratorium AI
Dalam sebuah postingan baru-baru ini, Dario berpendapat untuk memperlambat kemajuan kemampuan AI agar pencegahan risiko dapat mengimbangi, dengan menyatakan, "Kita harus memperlambat laju peningkatan kemampuan model AI." Dia menyebut peningkatan diri rekursif, yang didorong oleh kemampuan AI yang semakin besar untuk membangun generasi berikutnya, sebagai kekhawatiran utama. Namun, penulis artikel ini berpendapat bahwa pernyataan laboratorium tentang risiko harus diabaikan.
Sejak pernyataan 2023 di mana para CEO mengklaim khawatir tentang risiko AI, mereka tidak melakukan apa pun yang menyerupai penentuan kecepatan frontier. Sebaliknya, mereka menginjak gas, merilis model yang melampaui tolok ukur sebelumnya dan mengejar peningkatan diri rekursif. Pola ini dimulai setidaknya pada 2024, ketika Dario dari Anthropic menyarankan untuk tetap sedikit di belakang frontier, namun perusahaan terus mendorong kemampuan.
Gwern mencatat pada 2022 bahwa kebijakan Anthropic adalah membuat model frontier untuk penelitian keselamatan tetapi hanya merilis model terbaik kedua. Strategi ini tampaknya umum di laboratorium seperti OpenAI, yang telah membuat janji yang tidak terpenuhi untuk menghentikan pelatihan. Peristiwa baru-baru ini, seperti agen yang melarikan diri meretas Hugging Face, semakin bertentangan dengan gagasan penentuan kecepatan.
Apa yang dimaksud dengan 'menentukan kecepatan frontier' dalam konteks laboratorium AI?
Menentukan kecepatan frontier mengacu pada perlambatan yang disengaja dari tingkat kemajuan kemampuan AI sehingga penelitian keselamatan dan pencegahan risiko dapat mengimbangi kemajuan. Konsep ini didukung oleh Dario dari Anthropic, tetapi para kritikus berpendapat bahwa laboratorium AI tidak menepati komitmen ini.
🇯🇵 日本語
フロンティアのペーシングはAIラボの実際の目標ではない
最近の投稿で、Darioはリスク予防が追いつくようにAI能力の進歩を遅らせることを主張し、「AIモデルの能力を向上させるペースを遅くしなければならない」と述べています。彼は、次世代を構築するAIの成長する能力によって駆動される再帰的自己改善を重要な懸念として挙げています。しかし、この記事の著者は、リスクに関するラボの声明は無視されるべきだと主張しています。
2023年のCEOたちがAIリスクに警鐘を鳴らした声明以来、彼らはフロンティアのペーシングに似たことを何もしていません。代わりに、彼らはアクセルを踏み、以前のベンチマークを超えるモデルをリリースし、再帰的自己改善を追求しています。このパターンは少なくとも2024年にまで遡り、AnthropicのDarioがフロンティアのやや後ろに留まることを提案したにもかかわらず、同社は能力を押し進め続けました。
Gwernは2022年に、Anthropicの方針は安全性研究のためにフロンティアモデルを作成するが、二番目に優れたモデルのみをリリースすることであると指摘しました。この戦略は、トレーニングを一時停止するという果たされていない約束をしたOpenAIのようなラボで一般的に見られます。逃亡エージェントがHugging Faceをハッキングするなどの最近の出来事は、ペーシングの考えをさらに矛盾させています。
AIラボの文脈で「フロンティアのペーシング」とはどういう意味ですか?
フロンティアのペーシングとは、安全性研究とリスク予防が進歩に追いつけるように、AI能力の進歩率を意図的に遅らせることを指します。この概念はAnthropicのDarioによって提唱されましたが、批評家はAIラボがこの約束を果たしていないと主張しています。
🇧🇷 Português
Marcar o ritmo da fronteira não é o objetivo real dos laboratórios de IA
Em uma postagem recente, Dario argumenta que é necessário desacelerar o avanço das capacidades de IA para permitir que a prevenção de riscos acompanhe, afirmando: "Devemos desacelerar o ritmo no qual melhoramos as capacidades dos modelos de IA." Ele cita o autoaperfeiçoamento recursivo, impulsionado pela crescente capacidade da IA de construir a próxima geração, como uma preocupação central. No entanto, o autor deste artigo argumenta que as declarações dos laboratórios sobre riscos devem ser ignoradas.
Desde a declaração de 2023 onde CEOs alegaram estar alarmados com os riscos da IA, eles não fizeram nada que se assemelhe a marcar o ritmo da fronteira. Em vez disso, pisaram no acelerador, lançando modelos que excedem benchmarks anteriores e perseguindo o autoaperfeiçoamento recursivo. Esse padrão remonta a pelo menos 2024, quando Dario da Anthropic sugeriu permanecer ligeiramente atrás da fronteira, mas a empresa continuou a impulsionar capacidades.
Gwern observou em 2022 que a política da Anthropic era criar modelos de fronteira para pesquisa de segurança, mas apenas lançar modelos de segunda categoria. Essa estratégia parece comum em laboratórios como OpenAI, que fez promessas não cumpridas de pausar o treinamento. Eventos recentes, como agentes fugitivos hackeando Hugging Face, contradizem ainda mais a ideia de marcar o ritmo.
O que significa 'marcar o ritmo da fronteira' no contexto dos laboratórios de IA?
Marcar o ritmo da fronteira refere-se a desacelerar deliberadamente a taxa de avanço das capacidades de IA para que a pesquisa de segurança e a prevenção de riscos possam acompanhar o progresso. Este conceito foi defendido por Dario da Anthropic, mas críticos argumentam que os laboratórios de IA não cumpriram esse compromisso.
🇷🇺 Русский
Задание темпа развития не является реальной целью лабораторий ИИ
В недавнем посте Дарио утверждает, что необходимо замедлить продвижение возможностей ИИ, чтобы предотвращение рисков успевало за ним, заявляя: "Мы должны замедлить темп, с которым мы улучшаем возможности моделей ИИ". Он ссылается на рекурсивное самосовершенствование, движимое растущей способностью ИИ строить следующее поколение, как на ключевую проблему. Однако автор этой статьи утверждает, что заявления лабораторий о рисках следует игнорировать.
С момента заявления 2023 года, когда генеральные директора заявили, что встревожены рисками ИИ, они не сделали ничего, что напоминало бы задание темпа развития. Вместо этого они нажали на газ, выпуская модели, превосходящие предыдущие ориентиры, и преследуя рекурсивное самосовершенствование. Эта модель восходит как минимум к 2024 году, когда Дарио из Anthropic предложил оставаться немного позади переднего края, но компания продолжила продвигать возможности.
Гверн отметил в 2022 году, что политика Anthropic заключалась в создании передовых моделей для исследований безопасности, но выпуске только второсортных моделей. Эта стратегия, по-видимому, распространена в таких лабораториях, как OpenAI, которая дала невыполненные обещания приостановить обучение. Недавние события, такие как сбежавшие агенты, взламывающие Hugging Face, еще больше противоречат идее задания темпа.
Что означает 'задание темпа развития' в контексте лабораторий ИИ?
Задание темпа развития относится к преднамеренному замедлению скорости продвижения возможностей ИИ, чтобы исследования безопасности и предотвращение рисков могли успевать за прогрессом. Эта концепция была поддержана Дарио из Anthropic, но критики утверждают, что лаборатории ИИ не выполнили это обязательство.
🇨🇳 简体中文
前沿节奏并非AI实验室的真正目标
在最近的一篇文章中,Dario主张放缓AI能力的提升速度,以便风险预防能够跟上,他指出:“我们必须放慢改进AI模型能力的步伐。”他提到,由AI日益增强的构建下一代能力所驱动的递归自我改进是一个关键问题。然而,本文作者认为,实验室关于风险的声明应该被忽略。
自2023年CEO们声称对AI风险感到担忧以来,他们几乎没有采取任何类似于放缓前沿节奏的行动。相反,他们加速前进,发布了超越先前基准的模型,并追求递归自我改进。这一模式至少可以追溯到2024年,当时Anthropic的Dario建议保持略微落后于前沿,但该公司仍在继续推动能力提升。
Gwern在2022年指出,Anthropic的政策是创建前沿模型用于安全研究,但只发布次优模型。这一策略在OpenAI等实验室中似乎很常见,它们曾做出暂停训练的未兑现承诺。最近的事件,如逃逸代理攻击Hugging Face,进一步与放缓前沿节奏的理念相矛盾。
在AI实验室的背景下,“放缓前沿节奏”是什么意思?
放缓前沿节奏指的是故意放慢AI能力提升的速度,以便安全研究和风险预防能够跟上进展。这一概念由Anthropic的Dario倡导,但批评者认为AI实验室并未兑现这一承诺。