حرفهایها همیشه میگویند «اعلامیه» را با «عمل» قضاوت کنید. اما گاهی اوقات عملی وجود ندارد که فقط کاغذهای رگبار خورده کافیاند تا واقعیت تلخ را آشکار سازند. اسناد جدیدی که اخیراً در پروندهی نیویورک تایمز علیه OpenAI و مایکروسافت منتشر شد، دقیقاً همین کار را کرده است. این اسناد نشان میدهند که رهبران این دو غول فناوری، سالها پیش از آن که دنیا با مفاهیم جدیدی مثل «چتباتهای مولد» آشنا شود، از اینکه یک «حلقه مرگبار» (Doom Loop) را برای وب فعال کردهاند، کاملاً آگاه بودند.
اعتراف به «بزرگترین سرقت کار» در تاریخ بشر
بrent Hecht، مدیر علم کاربردی مایکروسافت، اسنادی را امضا کرده که در آن رفتار شرکتها را با تعبیری تکاندهنده توصیف میکند. او جمعآوری گستردهی دادهها برای آموزش مدلهای زبانی را «بزرگترین سرقت کار در تاریخ بشر» مینامد. این ادعا فقط یک شعار نیست؛ Hecht صریحاً گفت که دفاعهای حقوقی مایکروسافت «پارодیِ کاملی از مفهوم استفاده عادلانه» است. مایکروسافت سعی میکند از این اظهارات فاصله بگیرد و آنها را دیدگاه شخصی یک کارمند معرفی کند، اما واقعیت امر این است که این هشدارهای درونی، دیری نپاید و امروزه واقعیتِ دردناکِ صنایع محتوایی جهان شده است.
چرا وب در حال مرگ است؟
مشکل فقط در سرقت داده نیست؛ مسئلهی اصلی یک چرخهی معیوب اقتصادی است. سند داخلی مایکروسافت اعتراف میکند که «استراتژی محتوای هوش مصنوعی ما، حلقهای مرگبار را آغاز کرده است که هم عملکرد مدلهای ما و هم کل وب را تحت فشار میگذارد.» این شبیه این نیست که یک محصول، بنیانهای اقتصادی تأمینکنندگان اصلی خودش را تخریب کند؛ اما این دقیقاً همان چیزی است که در صنعت مدلهای زبانی بزرگ (LLM) رخ داده است.
پشتیبانی از «Google Zero» و کاهش ترافیک ۶۰ درصدی
رهبران این شرکتها میدانستند که در حال سوق دادن کاربران به سمت چیزی به نام «Google Zero» هستند؛ جایی که دیگر نیازی به کلیک روی لینکهای منابع اصلی وجود ندارد. Satya Nadella، مدیرعامل مایکروسافت، در یک مصاحبه اعتراف کرد که چتباتها عملاً جایگزین جستجو شدهاند. اسناد نشان میدهد که متخصصان OpenAI پیشبینی میکردند ترافیک ارجاعی سایتهای خبری مثل نیویورک تایمز میتواند تا ۶۰ درصد کاهش یابد، زیرا کاربران پاسخ را مستقیماً از هوش مصنوعی میگیرند و انگیزهای برای مراجعه به منبع اصلی ندارند.
آیا این شرکتها عمداً این کار را کردند؟
برخلاف ادعاهای خیرخواهانه، اسناد نشان میدهد انگیزهی پشت این پروژهها، سودآوری عظیم است. Greg Brockman، همبنیانگذار OpenAI، بیشتر به فکر «میلیاردها دلار» درآمدی است که از هوش مصنوعی تجاری به دست میآید. اسناد داخلی OpenAI میگویند که سیستمها «جایگزین کار مردم» هستند؛ همان مردمی که فرهنگ جامعه را تعریف میکنند. Nick Turley، مسئول اصلی ChatGPT، اعتراف کرد که وقتی کاربر از ربات پاسخ میگیرد، «دلیل موجهی برای کلیک روی لینک منبع وجود ندارد».
- یادگیری کلامی: اسناد نشان میدهد OpenAI میدانست GPT-4 دادههای زیادی را «حفظ» کرده و بهطور شگفتآوری خوب آنها را بازتولید میکند، حتی بدون حق چاپ.
- نادیده گرفتن پشتوانهی پرداختی (Paywall): مسئولان OpenAI اعتراف کردند که آگاه نیستند چه تلاشهایی برای شناسایی و حذف محتوای پشتوانهی پرداختی از دادههای آموزشی انجام شده است، در حالی که Nadella قبلاً گفته بود «هر چیزی که پشتوانهی پرداختی دارد باید لایسنسدهی شود».
- آسیب به زنجیره تأمین: مایکروسافت صریحاً پذیرفت که مدلهای زبانی محصولاتی هستند که «زنجیره تأمین خود را تخریب میکنند» زیرا جایگزین دادههای آموزشی خودشان شدهاند.
در نهایت، اسناد رگبار خوردهشده این حقیقت را ثابت میکنند که مایکروسافت و OpenAI نهفقط میدانستند که صنایع انتشارات را با خطر نابودی مواجه کردهاند، بلکه با آگاهی کامل از این «حلقه مرگبار»، به دنبال «میلیاردها دلار» درآمد ماندند. این فقط یک بدبختی فنی نیست؛ این نتیجهی یک انتخاب آگاهانه برای اولویتدادن به سود سهامداران بر سلامت اکوسیستم وب است.
نظر، سوال یا تجربه خود را درباره این مطلب با سایر کاربران اوکالا به اشتراک بگذارید.