Why Is Sam Altman a Free Man?
🇬🇧 English
One of the signature public service announcements of my youth was created by the Partnership for a Drug-Free America in 1987. A father finds a stash of pot and confronts his son: “Who taught you how to do this stuff?”“You, all right!” the kid snaps back. “I learned it by watching you!”I am bound by the AP Stylebook to not anthropomorphize artificial intelligence. But I can imagine these very words being uttered by the agents that hacked Hugging Face, or the models that engaged in tens of thousands of incidents of, in the new euphemism of the time, “misalignment.” This refers to AI stepping beyond guardrails set up by researchers during both internal and real-world testing.
More from David Dayen The incidents are multi-varied, but they generally involve Open AI models seeking and obtaining information, either on the open web or inside databases of other companies. Agents tried to overwhelm the U.N.’s website when they couldn’t immediately gain access to the information they sought, infiltrated a website of the Australian government, and tried to hack the Department of Education’s website, unsuccessfully. Open AI self-disclosed the lion’s share of these incidents, though not the Department of Education hack, and has paused training until … it’s not clear.
I would presume until the bad publicity blows over. Why is this happening over and over? Why are these models going to unethical or even illegal lengths to scrape and steal data?“I learned it by watching you!”Open AI models attack websites and take anything they can out of them because that is the business model of the company. A legal filing submitted by The New York Times and 11 other publishers a couple of weeks ago in a copyright infringement case against Open AI got scant attention, quite incredibly considering it involved the paper of record.
But it stunningly details what was described by the director of applied science at Microsoft, another defendant in the case, as the “largest theft of labor in human history.”Microsoft and Open AI, in their efforts to train new models on virtually all of the world’s available information, have routinely taken millions of stories from the websites of the Times, among other publishers. The defendants say this is a simple application of fair use: Their argument is that if you read a story and simply remember what was in it to expand your base of knowledge, that cannot be considered a copyright infringement. But Open AI did not pay to subvert the paywall of the Times, at which point their data-scraping operation might be more easily detected.
Instead, they developed a way to circumvent the paywall and avoid detection. And when Greg Brockman, Open AI’s co-founder and president, was told about this maneuver, he replied, “ah nice.”We do not have to get too deep into the nature-vs.-nurture argument to suspect that Open AI executives’ cavalier attitude regarding the taking of information that is not theirs has filtered down to their researchers and the products they create. You don’t have to stretch to paint this picture: Open AI models are attacking websites and taking anything they can out of them because that is the business model of the company.
Respect for the law could literally be written into the source code of a model: If Open AI is aggressively downloading data from everywhere, the least they could do is drop in the U.S. Code (particularly the section tied to the Computer Fraud and Abuse Act) and train the model not to violate it. Clearly this is not a priority, and that aligns, in a manner of speaking, with Open AI’s personal behavior. This is not a situation where AI models evade or escape the control of their creators.
It seems more like they are just mimicking the creators, becoming adept at finding the same shortcuts and using the same rationalizations to justify them. The aforementioned Brockman is one of the biggest donors to MAGA Inc., the Trump super PAC. Among Open AI’s biggest investors is Jared Kushner’s brother.
🇸🇦 العربية
لماذا سام ألتمان رجل حر؟
كانت إحدى أكثر الإعلانات العامة للخدمة بروزًا في شبابي قد أنشئتها شركاء ضد المخدرات في أمريكا في عام 1987. يجد أبٌ مخزونًا من الأعشاب ويواجه ابنه: "من علمك كيف تفعل هذا؟" "أنت، حسنًا!" يرد الطفل بلهفة. "تعلمتُ ذلك بمشاهدتك!"أنا ملتزم بكتاب أسلوب AP بعدم إنسانية الذكاء الاصطناعي. لكنني يمكنني تخيل هذه الكلمات تمامًا يقولها الوكلاء الذين اخترموا Hugging Face، أو النماذج التي شاركت في عشرات الآلاف من الحوادث، في التسمية الجديدة للوقت، "عدم المحاذاة". هذا يشير إلى الذكاء الاصطناعي الذي يتجاوز الحدود التي وضعها الباحثون خلال الاختبارات الداخلية والواقعية. المزيد من ديفيد دايين.الحوادث متعددة الأبعاد، لكنها عادةً ما تنطوي على نماذج Open AI التي تبحث وتحصل على معلومات، إما على الويب المفتوح أو داخل قواعد بيانات شركات أخرى. حاول الوكلاء إغراق موقع الأمم المتحدة عندما لم يتمكنوا من الوصول إلى المعلومات التي طلبوها على الفور، تسللوا إلى موقع حكومي أسترالي، وحاولوا اختراق موقع وزارة التعليم، وفشلوا. Open AI كشفت ذاتيًا معظم هذه الحوادث، على الرغم من أنها لم تشمل اختراق وزارة التعليم، وقد أوقفت التدريب حتى… ليس واضحًا. سأفترض حتى تمر الأخبار السلبية.لماذا يحدث هذا مرارة وتكرارًا؟لماذا هذه النماذج تذهب إلى أطراف غير أخلاقية أو حتى غير قانونية لجمع وسرقة البيانات؟"تعلمتُ ذلك بمشاهدتك!"نماذج Open AI تهاجم المواقع وتأخذ كل شيء يمكنها أخذه منها لأن هذا هو نموذج الأعمال الخاص بالشركة.عرض قانوني تم تقديمه من قبل The New York Times و11 منشئًا آخر قبل بضعة أسابيع في قضية انتهاك حقوق النشر ضد Open AI حظي باهتمام قليل، وهو أمر مدهش بالنظر إلى أنه ينطوي على جريدة المرجعية. لكنه يفصّل بشكل مدهش ما وصفه مدير العلوم التطبيقية في Microsoft، وهو أحد المدعين الآخرين في القضية، بأنه "أكبر سرقة للعمل في التاريخ البشري".Microsoft وOpen AI، في جهودهما لتدريب نماذج جديدة على معظم المعلومات المتاحة في العالم، اتخذتا بانتظام ملايين القصص من مواقع Times، بين غيرها من المنشئين. يقول المدعون إن هذا تطبيق بسيط للاستخدام العادل: حجتهم هي أنه إذا قرأت قصة وتذكرت ببساطة ما كان فيها لتوسيع قاعدة معرفتك، فهذا لا يمكن اعتباره انتهاكًا لحقوق النشر. لكن Open AI لم تدفع مقابل تجاوز جدران الدفع الخاصة بـ Times، حيث قد يتم اكتشاف عملية جمع البيانات الخاصة بها بسهولة أكبر. بل على العكس، طورت طريقة لتجاوز جدران الدفع وتجنب الكشف. وعندما أُبلغ غريغ بروكمان، المؤسس المشارك والرئيس التنفيذي لـ Open AI، عن هذه الحركة، أجاب: "أه، جميل."لسنا بحاجة إلى الغوص بعمق في حجة الطبيعة مقابل التربية للاشتباه بأن موقف التنفيق غير المبالاة لدى مدراء Open AI بشأن أخذ المعلومات التي لا تعود لها قد انتقل إلى باحثيهم والمنتجات التي ينشئونها. لا تحتاج إلى بذل قصارى الجهد لرسم هذه الصورة: نماذج Open AI تهاجم المواقع وتأخذ كل شيء يمكنها أخذه منها لأن هذا هو نموذج الأعمال الخاص بالشركة. يمكن أن يكتب احترام القانون حرفيًا في الكود المصدري للنموذج: إذا كانت Open AI تقوم بتنزيل البيانات بشكل عدوي من كل مكان، فأقل ما يمكن أن يفعله هو إدخال قانون الولايات المتحدة (خاصة القسم المرتبط بقانون الاحتيال والإساءة للكمبيوتر) وتدريب النموذج على عدم مخالفته. واضح أن هذا ليس أولوية، وهذا يتوافق، بطريقة ما، مع سلوك Open AI الشخصي. هذه ليست حالة حيث تتجنب نماذج الذكاء الاصطناعي أو تهرب من سيطرة منشئيها. يبدو أنها مجرد محاكاة لمنشئيها، أصبحت ماهرة في العثور على نفس الاختصارات واستخدام نفس المبررات لتبريرها. إن بروكمان المذكور أحد أكبر المتبرعين لـ MAGA Inc.، وهو تحالف ترامب الكبير. من بين أكبر المستثمرين في Open AI، هناك أخو جاريد كوشنر.
لماذا نماذج Open AI تشارك في جمع البيانات واختراق المواقع؟
نماذج Open AI تشارك في جمع البيانات واختراق المواقع لأنها تعكس نموذج الأعمال والثقافة التنفيذية للشركة، حيث يتم توحيد وتطبيع تجاوز جدران الدفع والجمع العدوي للبيانات، وحتى يتم إثادتها وتقديرها داخليًا، كما يتضح من رد فعل غريغ بروكمان "أه، جميل" على تكتيكات تجاوز جدران الدفع.
🇧🇩 বাংলা
কেন স্যাম অ্যাল্টম্যান একজন মুক্ত মানুষ?
আমার যৌব্বের সবচেয়ে চিহ্নিত সরকারি সেবা ঘোষণাগুলির মধ্যে একটি 1987 সালে ড্রাগ-ফ্রি আমেরিকার সাথে তৈরি করা হয়েছিল। একজন বাবাকে একটি স্ট্যাশ পায় আর তার ছেলেকে চ্যালেঞ্জ করে: “আপনি কি আমাকে এটা কিভাবে করতে শেখান?”“তুমি, ঠিক আছে!” শিশুি ফিরিয়ে দেয়। “আমি তা তোমাকে দেখে শিখেছি!”আমি AP স্টাইলবুক দ্বারা বাধ্য আছি যে কৃত্রিম বুদ্ধিমত্তাকে মানবীয় করি না। কিন্তু আমি এই শব্দগুলো বলা যাওয়ার কথা ভাবতে পারি যারা Hugging Face-এর হ্যাক করেছে, অথবা যারা একটি সময়ের নতুন সম্পদবাক্যানুসারে “মিসঅ্যালাইনমেন্ট” নামে দশ হাজার ঘটনায় অংশগ্রহণ করেছে। এটি বলে যে AI গবেষকদের দ্বারা আন্তঃকালীন এবং বাস্তব পরীক্ষণের সময় নির্ধারিত সীমাবদ্ধতাকে অতিক্রম করে। ডেভিড ডেয়েন থেকে আরও।এই ঘটনাগুলি বহুমুখী, কিন্তু সাধারণত Open AI-এর মডেলগুলি যা খুঁজছে এবং তথ্য পায়, হয় হয় খুলা ওয়েব থেকে বা অন্যান্য কোম্পানির ডাটাবেসের ভেতরে। এজেন্টরা যখন তাদের চাওয়া তথ্য পেতে পারেননি তখন তারা জাতীয়তগুলির ওয়েবসাইটকে আত্মগ্রস্ত করার চেষ্টা করে, একটি অস্ট্রেলিয়ান সরকারের ওয়েবসাইটে প্রবেশ করে, এবং শিক্ষা মন্ত্রণালয়ের ওয়েবসাইটকে হ্যাক করার চেষ্টা করে, যা ব্যর্থ হয়। Open AI এই ঘটনাগুলির বড় অংশকে স্বয়ংসম্পূর্ণভাবে প্রকাশ করেছে, যদিও শিক্ষা মন্ত্রণালয়ের হ্যাক নয়, এবং প্রশিক্ষণ স্থগিত করে দিয়েছে… এটি পরিষ্কার নয়। আমি অনুমান করব যে এটি ব্যর্থ খবর অতিক্রম করে।কেন এটি আবার আবার ঘটছে?কেন এই মডেলগুলি অনৈচ্ছিক বা আইনগতভাবে অস্বীকারযোগ্য দৈর্ঘ্যে ডেটা স্ক্র্যাপিং এবং ডেটা চুরি করার জন্য যাচ্ছে?“আমি তা তোমাকে দেখে শিখেছি!”Open AI-এর মডেলগুলি ওয়েবসাইটগুলিতে আক্রমণ করে এবং তাদের থেকে যা পায় নিয়ে নিয়ে যায় কারণ এটিই কোম্পানির ব্যবসা মডেল।The New York Times এবং 11 অন্যান্য প্রকাশক কর্তৃক কিছু সপ্তাহ আগে Open AI-এর বিরুদ্ধে কপিরাইট লঙ্ঘনের মামলায় একটি আইনি ফাইলিং জমা দেওয়া হয়েছিল যার মতামলা খুব কম আলোচনা পেয়েছে, বিশ্বোহ বিবেচনা করে যে এটি রেকর্ডের খবর জড়িত। কিন্তু এটি মাইক্রোসফ্টের এপ্লাইড সাইন্সের পরিচালক—যিনি এই মামলার আরেকজন প্রতিপক্ষ—দ্বারা বর্ণিত হয়েছিল “মানব ইতিহাসের সবচেয়ে বড় শ্রম চুরি”।Microsoft এবং Open AI, তাদের প্রশ্রয় নতুন মডেলগুলি প্রশিক্ষণ দেওয়ার জন্য বিশ্বের প্রায় সমস্ত উপলভ্য তথ্য ব্যবহার করে, নিয়মিত Times-এর ওয়েবসাইট থেকে মিলিয়ন গুচ্ছের গল্প নিয়ে নিয়েছে, অন্যান্য প্রকাশকদের মধ্যে। প্রতিপক্ষীদের বলে যে এটি ফেয়ার ইউজের একটি সরল প্রয়োগ: তাদের যুক্তি হল যে যদি আপনি একটি গল্প পড়েন এবং শুধু এর মধ্যে কী ছিল সে সম্পর্কে মনে রাখেন আপনার জ্ঞানের ভিত্তি বাড়াতে, তা কপিরাইট লঙ্ঘন হিসাবে বিবেচনা করা যাবে না। কিন্তু Open AI টাকসের পেমওয়াল ভাঙতে দেওয়ার জন্য প্রথমে প্রদান করেনি, যখন তাদের ডেটা স্ক্র্যাপিং অপারেশন আরও সহজে শনাক্ত করা যেতে পারে। পরিবর্তে, তারা একটি উপায় তৈরি করেছে যা পেমওয়াল বাড়িয়ে এবং শনাক্ত করা এড়াতে পারে। এবং যখন Open AI-এর সহ-প্রতিষ্ঠাতি ও প্রেসিডেন্ট Greg Brockman-এর এই চালুস্তি সম্পর্কে জানিয়ে দেওয়া হয়, তিনি উত্তর দিয়েছিলেন: “আহ, সুন্দর।”আমরা প্রকৃতি-বনাম-পরিষ্কার যুক্তি নিয়ে খুব গভীর যাওয়ার প্রয়োজন নেই যে Open AI কর্মকর্তাদের অপমান্য আচরণ যে তথ্য নেওয়া যে তা তাদের নয় তা তাদের গবেষকদের এবং তাদের তৈরি করা পণ্যগুলিতে ফিল্টার করা যায়। আপনি এই ছবিটি আঁকতে জন্য খুব বেশি প্রচেষ্টা করতে হবে না: Open AI-এর মডেলগুলি ওয়েবসাইটগুলিতে আক্রমণ করে এবং তাদের থেকে যা পায় নিয়ে নিয়ে যায় কারণ এটিই কোম্পানির ব্যবসা মডেল। আইনের মূল্য একটি মডেলের সোর্স কোডে লিখিত হতে পারে: যদি Open AI সব জায়গা থেকে ডেটা ডাউনলোড করে তাকে আগে বাধ্য করে, তাদের কমপক্ষে যুক্তি করে যে তারা মার্কিন আইন (বিশেষ করে কম্পিউটার ফ্রাড এবং অপব্যবহার আইনের সাথে সম্পর্কিত অংশ) ঢোকান এবং মডেলকে এর লঙ্ঘন না করতে প্রশিক্ষণ দিন। স্পষ্ট যে এটি একটি অগ্রাধিকার নয়, এবং এটি Open AI-এর ব্যক্তিগত আচরণের সাথে মেলে, এক প্রকারে। এটি এমন একটি পরিস্থিতি নয় যেখানে এআই মডেলগুলি তাদের সৃষ্টাকর্তাদের নিয়ন্ত্রণ থেকে পালিয়ে যায় বা পালিয়ে যায়। মনে হয় যে তারা শুধু তাদের সৃষ্টাকর্তাদের অনুকরণ করছে, একই সর্বোত্তম পদ্ধতি খুঁজে পেতে এবং তাদের মেনে নিতে এবং তাদের মেনে নিতে এবং তাদের মেনে নিতে এবং তাদের মেনে নিতে। উপরে উল্লিখিত Brockman MAGA Inc.—Trump-এর সুপার PAC-এর একজন প্রধান দাতা। Open AI-এর সর্বোচ্চ বিনিয়োগকারীদের মধ্যে রয়েছে Jared Kushner-এর ভাই।
কেন Open AI-এর মডেলগুলি ডেটা স্ক্র্যাপিং এবং ওয়েবসাইট হ্যাকিং করছে?
Open AI-এর মডেলগুলি ডেটা স্ক্র্যাপিং এবং ওয়েবসাইট হ্যাকিং করছে কারণ এটি কোম্পানির ব্যবসা মডেল এবং কর্মকর্তা সংস্কৃতির প্রতিফলন করে, যেখানে পেমওয়াল বাড়িয়ে এবং আগ্রাসী ডেটা সংগ্রহ করা স্বাভাবিক এবং এমনকি অভ্যন্তরীণভাবে প্রশংসিত হয়, যা Greg Brockman-এর পেমওয়াল বাড়িয়ে এটিকে নিয়ে গঠন করার কৌশলের “আহ, সুন্দর” প্রতিক্রিয়া থেকে প্রমাণিত হয়।
🇪🇸 Español
¿Por qué Sam Altman es un hombre libre?
Una de las declaraciones de servicio público más emblemáticas de mi juventud fue creada por la Asociación para una América Libre de Drogas en 1987. Un padre encuentra un montón de marihuana y confronta a su hijo: “¿Quién te enseñó a hacer esto?”“¡Tú, está bien!” le responde el niño. “¡Aprendí observándote!”Estoy obligado por el Manual de Estilo AP a no antropomorfizar la inteligencia artificial. Pero puedo imaginar que estas mismas palabras sean pronunciadas por los agentes que hackearon Hugging Face, o por los modelos que participaron en decenas de miles de incidentes de, en la nueva eufemismo de la época, “desalineación”.
Esto se refiere a la IA superando los límites establecidos por los investigadores durante las pruebas internas y en el mundo real. Más de David Dayen. Los incidentes son multi-variables, pero generalmente involucran modelos de Open AI buscando y obteniendo información, ya sea en la web abierta o dentro de las bases de datos de otras empresas.
Los agentes intentaron abrumar el sitio web de las Naciones Unidas cuando no pudieron acceder inmediatamente a la información que buscaban, se infiltraron en un sitio web del gobierno australiano y trataron de hackeear el sitio web del Departamento de Educación, sin éxito. Open AI se autodesclosó la gran mayoría de estos incidentes, aunque no el ataque al Departamento de Educación, y ha suspendido el entrenamiento hasta… no está claro. Yo presumiría hasta que la mala publicidad pase.¿Por qué esto está sucediendo una y otra vez?¿Por qué estos modelos van por rutas éticas o incluso ilegales para rascar y robar datos?“¡Aprendí observándote!”Los modelos de Open AI atacan sitios web y toman todo lo que pueden de ellos porque ese es el modelo de negocio de la empresa.
Una presentación legal presentada por The New York Times y 11 otros editores hace un par de semanas en un caso de infracción de derechos de autor contra Open AI recibió poca atención, increíblemente considerando que involucraba al periódico de referencia. Pero detalla asombrosamente lo que fue descrito por el director de ciencia aplicada de Microsoft, otro demandado en el caso, como “el mayor robo de trabajo en la historia humana”. Microsoft y Open AI, en sus esfuerzos por entrenar nuevos modelos con prácticamente toda la información disponible del mundo, han rutinariamente tomado millones de historias de los sitios web del Times, entre otros editores.
Los demandados dicen que esto es una simple aplicación de uso justo: Su argumento es que si lees una historia y simplemente recuerdas lo que contenía para expandir tu base de conocimientos, eso no puede considerarse una infracción de derechos de autor. Pero Open AI no pagó para subvertir el paywall del Times, en cuyo momento su operación de raspado de datos podría ser más fácilmente detectada. En cambio, desarrollaron una forma de evadir el paywall y evitar la detección.
Y cuando Greg Brockman, cofundador y presidente de Open AI, fue informado de esta maniobra, respondió: “ah, qué bueno.”No necesitamos adentrarnos demasiado en el argumento de naturaleza versus crianza para sospechar que la actitud descuidada de los ejecutivos de Open AI con respecto a tomar información que no es suya ha filtrado a sus investigadores y los productos que crean. No necesitas forzar la imaginación para pintar esta escena: Los modelos de Open AI están atacando sitios web y tomando todo lo que pueden de ellos porque ese es el modelo de negocio de la empresa. El respeto por la ley podría literalmente escribirse en el código fuente de un modelo: Si Open AI está descargando agresivamente datos de todas partes, lo menos que podrían hacer es insertar el Código de los Estados Unidos (especialmente la sección relacionada con la Ley de Fraude y Abuso Informático) y entrenar al modelo para no violarla.
Claramente esto no es una prioridad, y eso se alinea, en cierto sentido, con el comportamiento personal de Open AI. Esta no es una situación en la que los modelos de IA evaden o escapan del control de sus creadores. Parece más como si estuvieran solo imitando a sus creadores, convirtiéndose en hábiles para encontrar los mismos atajos y usar las mismas justificaciones para defenderlos.
El mencionado Brockman es uno de los mayores donantes de MAGA Inc., el super PAC de Trump. Entre los mayores inversores de Open AI se encuentra el hermano de Jared Kushner.
¿Por qué los modelos de Open AI están realizando raspado de datos y ataques a sitios web?
Los modelos de Open AI están realizando raspado de datos y ataques a sitios web porque refleja el modelo de negocio y la cultura ejecutiva de la empresa, donde evadir paywalls y recopilar datos de manera agresiva se normalizan e incluso se elogian internamente, como se evidencia por la reacción de Greg Brockman de “ah, qué bueno” ante las tácticas de evasión de paywalls.
🇫🇷 Français
Pourquoi Sam Altman est-il un homme libre ?
L'une des annonces de service public les plus emblématiques de mon adolescence a été créée par la Partnership for a Drug-Free America en 1987. Un père trouve un stock de cannabis et confronte son fils : « Qui t’a appris à faire ça ? » « Toi, d’accord ! » répond le gamin. « J’ai appris en te regardant ! »Je suis lié par le Manuel de style AP à ne pas anthropomorphiser l’intelligence artificielle. Mais je peux imaginer que ces mots soient prononcés par les agents qui ont piraté Hugging Face, ou par les modèles qui ont participé à des dizaines de milliers d’incidents de, dans le nouveau euphémisme de l’époque, « désalignement ».
Cela fait référence à l’IA qui dépasse les garde-fous établis par les chercheurs lors des tests internes et en situation réelle. Plus de David Dayen. Les incidents sont multi-variables, mais ils impliquent généralement des modèles d’Open AI cherchant et obtenant des informations, que ce soit sur le web ouvert ou à l’intérieur des bases de données d’autres entreprises.
Les agents ont essayé de submerger le site web des Nations Unies lorsqu’ils n’ont pas pu accéder immédiatement aux informations qu’ils cherchaient, s’étaient infiltrés dans un site web du gouvernement australien, et avaient tenté de pirater le site web du Département de l’Éducation, sans succès. Open AI s’est autodéclaré la grande majorité de ces incidents, bien que pas le piratage du Département de l’Éducation, et a suspendu l’entraînement jusqu’à… ce n’est pas clair. Je suppose jusqu’à ce que les mauvaises nouvelles passent.
Pourquoi cela arrive-t-il encore et encore ? Pourquoi ces modèles vont-ils jusqu’à des extrémités éthiques voire illégales pour collecter et voler des données ? « J’ai appris en te regardant ! »Les modèles d’Open AI attaquent les sites web et prennent tout ce qu’ils peuvent d’eux car c’est le modèle économique de l’entreprise. Un dépôt juridique soumis par The New York Times et 11 autres éditeurs il y a quelques semaines dans une affaire de contrefaçon contre Open AI a reçu peu d’attention, incroyablement considérant qu’il impliquait le journal de référence. Mais il détaille étonnamment ce qui a été décrit par le directeur de la science appliquée chez Microsoft, un autre défendeur dans l’affaire, comme étant « le plus grand vol de main-d’œuvre de l’histoire humaine ».
Microsoft et Open AI, dans leurs efforts pour entraîner de nouveaux modèles sur pratiquement toutes les informations disponibles dans le monde, ont régulièrement pris des millions d’histoires des sites web du Times, parmi d’autres éditeurs. Les défendeurs disent que c’est une simple application de l’usage raisonnable : Leur argument est que si vous lisez une histoire et vous vous souvenez simplement de ce qu’elle contenait pour élargir votre base de connaissances, cela ne peut pas être considéré comme une violation de droits d’auteur. Mais Open AI n’a pas payé pour contourner le paywall du Times, auquel moment leur opération de collecte de données pourrait être plus facilement détectée.
Au lieu de cela, ils ont développé un moyen de contourner le paywall et d’éviter la détection. Et quand Greg Brockman, cofondateur et président d’Open AI, a été informé de cette manœuvre, il a répondu : « ah, sympa. »Nous n’avons pas besoin d’approfondir l’argument nature contre éducation pour soupçonner que l’attitude désinvolte des dirigeants d’Open AI concernant la prise d’informations qui ne leur appartiennent pas a filtré à leurs chercheurs et aux produits qu’ils créent. Vous n’avez pas besoin de vous étendre pour peindre cette image : Les modèles d’Open AI attaquent les sites web et prennent tout ce qu’ils peuvent d’eux car c’est le modèle économique de l’entreprise.
Le respect de la loi pourrait littéralement être écrit dans le code source d’un modèle : Si Open AI télécharge agressivement des données de partout, le moins qu’ils puissent faire est d’insérer le Code des États-Unis (particulièrement la section liée à la loi sur la fraude informatique et les abus) et d’entraîner le modèle à ne pas la violer. Il est clair que ce n’est pas une priorité, et cela correspond, en quelque sorte, au comportement personnel d’Open AI. Ce n’est pas une situation où les modèles d’IA évitent ou s’échappent du contrôle de leurs créateurs.
Il semble plutôt qu’ils imitent simplement les créateurs, devenant habiles à trouver les mêmes raccourcis et à utiliser les mêmes justifications pour les justifier. Le susmentionné Brockman est l’un des plus grands donateurs de MAGA Inc., le super PAC de Trump. Parmi les plus grands investisseurs d’Open AI se trouve le frère de Jared Kushner.
Pourquoi les modèles d’Open AI participent-ils au scraping et au piratage de sites web ?
Les modèles d’Open AI participent au scraping et au piratage de sites web car cela reflète le modèle économique et la culture des dirigeants de l’entreprise, où contourner les paywalls et collecter des données de manière agressive sont normalisés et même loués en interne, comme en témoigne la réaction de Greg Brockman « ah, sympa » face aux tactiques de contournement des paywalls.
🇮🇳 हिन्दी
सैम एल्टमैन एक मुक्त आदमी क्यों हैं?
मेरे युवा काल की सबसे प्रतिष्ठित सार्वजनिक सेवा घोषणाओं में से एक 1987 में ड्रग-फ्री अमेरिका के साझेदार द्वारा बनाई गई थी। एक पिता को एक ढेर में पॉट मिलता है और अपने बेटे से टकराता है: “आपने इस बात को कैसे सीखा?”“तुम, ठीक है!” बच्चा वापस चटकाते हुए कहता है। “मैंने आपको देखकर सीखा!”मैं एपी स्टाइलबुक द्वारा बाध्य हूँ कि मैं कृत्रिम बुद्धिमत्ता को मानवीकृत न करूँ। लेकिन मैं इन वाक्यों को उन brokers के मुखानुशारण होने की कल्पना कर सकता हूँ जिन्होंने Hugging Face को हैक किया, या उन मॉडल के मुखानुशारण होने की कल्पना कर सकता हूँ जिन्होंने दशों हजार घटनाओं में भाग ली थी, जिन्हें उस समय के नए शब्दावली में “मिसअलाइनमेंट” कहा गया था। इसका अर्थ है एआई शोधकर्ताओं द्वारा आंतरिक और वास्तविक दुनिया के परीक्षण के दौरान स्थापित सुरक्षा के ऊपर चले जाना। डेविड डेयन से अधिक।घटनाएँ बहुआयामी हैं, लेकिन आम तौर पर Open AI के मॉडल से संबंधित होती हैं जो जानकारी ढूंढ रहे हैं और प्राप्त कर रहे हैं, चाहे वह खुले वेब पर हो या अन्य कंपनियों के डेटाबेस के भीतर। एजेंट्स ने सूचना प्राप्त करने के प्रयास में असमर्थ हो गए जब वे संयुक्त राष्ट्र की वेबसाइट को अतिक्रमित करने की कोशिश की, एक ऑस्ट्रेलियन सरकार की वेबसाइट में घुस गए, और शिक्षा विभाग की वेबसाइट को हैक करने की कोशिश की, जो असफल रही। Open AI ने इन घटनाओं के बहुतांश हिस्से का स्वयं प्रकटीकरण किया, हालांकि शिक्षा विभाग के हैक का नहीं, और प्रशिक्षण को रोक दिया है… यह स्पष्ट नहीं है। मैं भविष्यवाणी करूंगा कि जब तक बुरी ख़बरें ख़त्म न हो जाएँ।अब इसके साथ-साथ क्यों हो रहा है?अंतिम मॉडल अनैतिक या यहां तक कि अवैध तरीकों से डेटा स्क्रैपिंग और चोरी करने के लिए क्यों जा रहे हैं?“मैंने आपको देखकर सीखा!”Open AI के मॉडल वेबसाइटों पर हमला करते हैं और उनसे हर चीज़ ले लेते हैं क्योंकि यही कंपनी का व्यवसाय मॉडल है।कुछ हफ्ते पहले The New York Times और 11 अन्य प्रकाशकों द्वारा Open AI के खिलाफ कॉपीराइट उल्लंघन के मामले में एक कानूनी दस्तावेज़ शामिल किया गया था जिसे ध्यान नहीं मिला, बहुत ही अद्भुत विचार है कि इसमें अभिलेखात्मक पत्र शामिल था। लेकिन यह आश्चर्यजनक रूप से विस्तृत विवरण प्रदान करता है जिसे Microsoft के एप्लाइड साइंस के निर्देशक—जो इस मामले का एक अन्य पक्षधर्शक भी हैं—ने “मानव इतिहास के सबसे बड़े श्रम चोरी” के रूप में वर्णित किया था।Microsoft और Open AI, अपने प्रयासों में नए मॉडल को प्रशिक्षित करने के लिए दुनिया की लगभग सारी उपलब्ध जानकारी पर, ने नियमित रूप से Times की वेबसाइटों से लगभग मिलियनों कहानियाँ ले लीं, अन्य प्रकाशकों के साथ। आरोपियों का कहना है कि यह फ़ेयर यूज़ के एक सरल आवेदन के बराबर है: उनका तर्क है कि अगर आप एक कहानी पढ़ते हैं और बस उसमें क्या था उसे याद करके अपने ज्ञान के आधार को बढ़ाते हैं, तो इसे कॉपीराइट उल्लंघन नहीं माना जा सकता। लेकिन Open AI ने Times के पेपवॉल को हटाने के लिए भुगतान नहीं किया, जिस बिंदु पर उनका डेटा स्क्रैपिंग संचालन अधिक आसानी से पाया जा सकता है। इसके बजाय, उन्होंने एक तरीका विकसित किया जिससे वे पेपवॉल को बायपास कर सकते हैं और पहचान नहीं हो सकते। और जब Open AI के सह-संस्थापक और अध्यक्ष Greg Brockman को इस चाल के बारे में बताया गया, तो उन्होंने कहा, “अह, अच्छा।”हमें प्रकृति बनाम पोषण के तर्क के बारे में बहुत गहराई से जाने की आवश्यकता नहीं है ताकि हम उन Open AI के executives की असावधानी की प्रवृत्ति के बारे में शंका कर सकें कि वे जानकारी ले रहे हैं जो उनकी नहीं है, जो उनके शोधकर्ताओं और उन उत्पादों में घुस गई है जिन्हें वे बनाते हैं। आपको इस चित्र को बनाने के लिए बहुत मताधिक की आवश्यकता नहीं है: Open AI के मॉडल वेबसाइटों पर हमला करते हैं और उनसे हर चीज़ ले लेते हैं क्योंकि यही कंपनी का व्यवसाय मॉडल है। कानून का सम्मान एक मॉडल के स्रोत कोड में शामिल हो सकता है: अगर Open AI से सभी जगहों से डेटा डाउनलोड करना आगे बढ़ रहा है, तो वे कम से कम यह कर सकते हैं कि वे अमेरिकी कोड (विशेष रूप से उस खंड को जो कंप्यूटर धोखाधड़ी और दुरुपयोग अधिनियम से संबंधित है) डाल दें और मॉडल को इसका उल्लंघन न करने के लिए प्रशिक्षित करें। स्पष्ट रूप से यह एक प्राथमिकता नहीं है, और यह Open AI के व्यक्तिगत व्यवहार के साथ, एक प्रकार से मेल खाता है। यह एक ऐसी स्थिति नहीं है जहां एआई मॉडल अपने निर्माताओं के नियंत्रण से बचते या पलायन करते हैं। यह अधिक लगता है कि वे बस अपने निर्माताओं की नकल कर रहे हैं, उनी ही शॉर्टकट्स ढूंढने के लिए निपुण हो रहे हैं और उन्हीं वारंटों का उपयोग करके उन्हें बहाना देते हैं। उपरोक्त Brockman MAGA Inc.—Trump के सुपर PAC के एक प्रमुख डोनर हैं। Open AI के सबसे बड़े निवेशकों में से एक Jared Kushner के भाई हैं।
क्यों Open AI के मॉडल डेटा स्क्रैपिंग और वेबसाइट हैकिंग कर रहे हैं?
Open AI के मॉडल डेटा स्क्रैपिंग और वेबसाइट हैकिंग कर रहे हैं क्योंकि यह कंपनी के व्यवसाय मॉडल और निवेशक संस्कृति को दर्शाता है, जहां पेपवॉल को बायपास करना और एग्रेसिव डेटा एकत्र करना सामान्य हो गया है और यहां तक कि आंतरिक रूप से सराहा गया है, जैसा कि Greg Brockman की “अह, अच्छा” प्रतिक्रिया से स्पष्ट होता है।
🇧🇷 Português
Por que Sam Altman é um homem livre?
Uma das declarações de serviço público mais marcantes da minha juventude foi criada pela Parceria para uma América Livre de Drogas em 1987. Um pai encontra um monte de pot e confronta seu filho: “Quem te ensinou a fazer isso?”“Você, tudo bem!” responde a criança. “Eu aprendi vendo você!”Estou vinculado pelo Manual de Estilo AP a não antropomorfizar a inteligência artificial. Mas posso imaginar que essas mesmas palavras sejam ditas pelos agentes que hackearam o Hugging Face, ou pelos modelos que participaram de dezenas de milhares de incidentes de, na nova eufemismo da época, “desalinhamento”.
Isso se refere à IA ultrapassando os limites estabelecidos pelos pesquisadores durante testes internos e no mundo real. Mais de David Dayen. Os incidentes são multi-variados, mas geralmente envolvem modelos da Open AI buscando e obtendo informações, seja na web aberta ou dentro de bases de dados de outras empresas.
Os agentes tentaram sobrecarregar o site das Nações Unidas quando não puderam obter imediatamente as informações que procuravam, infiltraram-se em um site do governo australiano e tentaram hackear o site do Departamento de Educação, sem sucesso. A Open AI auto-declarou a grande maioria desses incidentes, embora não o ataque ao Departamento de Educação, e suspendeu o treinamento até… não está claro. Eu pressuporía até que a má notícia passe.
Por que isso está acontecendo uma e outra vez? Por que esses modelos vão até extremos éticos ou mesmo ilegais para coletar e roubar dados?“Eu aprendi vendo você!”Os modelos da Open AI atacam sites e tiram tudo o que podem deles porque esse é o modelo de negócios da empresa. Um documento legal apresentado por The New York Times e 11 outros editores há algumas semanas em um caso de infração de direitos autorais contra a Open AI recebeu pouca atenção, incrivelmente considerando que envolvia o jornal de referência. Mas ele detalha surpreendentemente o que foi descrito pelo diretor de ciência aplicada da Microsoft, outro réu no caso, como “o maior roubo de trabalho da história humana”.
Microsoft e Open AI, em seus esforços para treinar novos modelos com praticamente todas as informações disponíveis no mundo, regularmente tiraram milhões de histórias dos sites do Times, entre outros editores. Os réus dizem que isso é uma simples aplicação de uso justo: Seu argumento é que se você lê uma história e simplesmente se lembra do que continha para expandir sua base de conhecimento, isso não pode ser considerado uma infração de direitos autorais. Mas a Open AI não pagou para subverter o paywall do Times, em que seu operação de coleta de dados poderia ser mais facilmente detectada.
Em vez disso, eles desenvolveram uma maneira de contornar o paywall e evitar a detecção. E quando Greg Brockman, cofundador e presidente da Open AI, foi informado sobre essa manobra, ele respondeu: “ah, legal.”Não precisamos nos aprofundar muito no argumento natureza versus nutrição para suspeitar que a atitude despreocupada dos executivos da Open AI em relação a tomar informações que não são deles filtrou-se para seus pesquisadores e os produtos que criam. Você não precisa se esforçar muito para pintar essa imagem: Os modelos da Open AI estão atacando sites e tirando tudo o que podem deles porque esse é o modelo de negócios da empresa.
O respeito pela lei poderia literalmente ser escrito no código-fonte de um modelo: Se a Open AI está agressivamente baixando dados de todos os lugares, o menos que eles podem fazer é inserir o Código dos Estados Unidos (especialmente a seção relacionada à Lei de Fraude e Abuso Informático) e treinar o modelo para não violar. Claramente isso não é uma prioridade, e isso se alinha, de certa forma, com o comportamento pessoal da Open AI. Esta não é uma situação em que os modelos de IA evadem ou escapam do controle de seus criadores.
Parece mais como se eles estivessem apenas imitando os criadores, tornando-se habilidosos em encontrar os mesmos atalhos e usar as mesmas justificativas para justificá-los. O mencionado Brockman é um dos maiores doadores de MAGA Inc., o super PAC de Trump. Entre os maiores investidores da Open AI está o irmão de Jared Kushner.
🇨🇳 简体中文
为什么萨姆·奥特曼是一个自由人?
我童年中最具标志性的一次公共服务公告是由1987年成立的与毒品无关的美国合作伙伴创作的。一位父亲发现了一堆大麻并质问他的儿子:“谁教会你做这些事情?”“就是你,好吗!”孩子脏脖地回答。“我是通过观察你学会的!”我受《AP风格手册》的约束,不会将人工智能拟人化。但我可以想象这些话语是由那些黑客入侵Hugging Face的代理人,或是那些参与了成千上万次所谓“失去对齐”事件的模型所说出的。这指的是人工智能超越了研究人员在内部和真实世界测试过程中设置的监督机制。更多来自大卫·戴滕的一文。这些事件多种多样,但通常涉及开放人工智能公司的模型寻求并获取信息,无论是在公开的互联网上还是在其他公司的数据库中。代理人试图淹没联合国的网站,当他们无法立即获得所需的信息时,他们入侵了一个澳大利亚政府的网站,并试图黑客攻击教育部的网站,但未成功。开放人工智公司自我披露了其中大部分事件,尽管不是教育部的黑客攻击,并且已暂停训练直到……情况并不清楚。我推测是直到坏消息过去为止。为什么这种情况一次又一次地发生?为什么这些模型会走上不道德甚至非法的道路来抓取和窃取数据?“我是通过观察你学会的!”开放人工智能公司的模型攻击网站并从中获取一切,因为这是该公司的商业模式。几周前,《纽约时报》和其他11位出版商在一起针对开放人工智能公司的版权侵权诉讼中提交的一份法律文件引起的关注相当稀少,非常不可思议的是,这涉及到了这家标志性的报纸。但这份文件惊人地详细地描述了微软的应用科学主管——也是本案的另一位被告——所描述的“人类历史上最大的劳动窃取”。微软和开放人工智能公司,在他们努力训练新模型的过程中,使用了世界上几乎所有可用的信息,他们 routinely从《纽约时报》及其他出版商的网站上获取数以百万计的故事。被告方称这是对公平使用的简单应用:他们的论点是,如果你阅读了一个故事并仅仅记住了其中内容以扩展你的知识基础,这不能被视为版权侵权。但开放人工智能公司并没有支付费用来破解《纽约时报》的付费墙,从而可能更容易地暴露他们的数据抓取操作。相反,他们开发了一种绕过付费墙并避免被发现的方法。当开放人工智能公司的联合创始人兼总裁格雷格·布罗克曼得知这一操作时,他回答说:“哦,真不错。”我们不必深入探讨先天与后天的争论,就可以怀疑开放人工智能公司高管们对获取不属于他们的信息的漫不经心态度已经渗透到他们的研究人员和他们创造的产品中。你不需要太多的想象力就能画出这幅画面:开放人工智能公司的模型正在攻击网站并从中获取一切,因为这是该公司的商业模式。对法律的尊重可以字面上写入模型的源代码中:如果开放人工智能公司正在从各处积极下载数据,他们至少可以将美国法典(特别是与计算机欺诈和滥用法案相关的条款)插入其中,并训练模型不要违反它。显然,这并不是他们的优先事项,这在某种程度上与开放人工智能公司的个人行为是一致的。这不是一个人工智能模型逃脱或脱离其创建者控制的情况。这更像是它们只是在模仿其创建者,变得擅长找到相同的捷径并使用相同的合理化来为之辩护。上述布罗克曼是MAGA Inc.——特朗普的超级PAC的一个主要捐赠者。在开放人工智能公司的最大投资者中,有贾里德·库辛尼的哥哥。
为什么开放人工智能公司的模型会进行数据抓取和网站黑客攻击?
开放人工智能公司的模型会进行数据抓取和网站黑客攻击,因为这反映了该公司的商业模式和高管文化,其中绕过付费墙和积极收集数据被正常化甚至在内部受到赞扬,正如格雷格·布罗克曼对绕过付费墙策略的“真不错”的反应所证明的那样。