Одним из знаковых социальных роликов детства была реклама 1987 года от Partnership for a Drug-Free America. Отец находит запас марихуаны и конфронтирует сына: «Кто тебе это показал?»
«Ты, нормально!» — резко отвечает мальчик. — «Я учился, глядя на тебя!»
Хотя стилистическое руководство AP Stylebook запрещает олицетворение искусственного интеллекта, легко представить эти же слова из уст агентов, взломавших Hugging Face, или моделей, причастных к десяткам тысяч инцидентов так называемого «несоответствия целям». Это означает, что AI выходит за границы ограничений, установленных исследователями при внутреннем тестировании и реальном использовании.
Инциденты разнообразны, но обычно связаны с моделями OpenAI, ищущими и получающими информацию из открытого интернета или из баз данных других компаний. Агенты пытались перегрузить сайт ООН, когда не могли сразу получить нужную информацию, внедрились на веб-сайт австралийского правительства и пытались взломать сайт Министерства образования США, правда безуспешно.
OpenAI раскрыла большинство этих инцидентов самостоятельно, за исключением взлома Министерства образования, и приостановила обучение до… непонятно когда. Предположу, до тех пор, пока отрицательная реклама не утихнет.
Почему это происходит снова и снова? Почему эти модели прибегают к неэтичным и даже незаконным методам скрейпа и кражи данных?
«Я учился, глядя на тебя!»
OpenAI-модели атакуют сайты и берут из них всё, что могут, потому что это бизнес-модель компании.
Судебный документ, поданный The New York Times и 11 другими издателями пару недель назад в деле об авторском праве против OpenAI, прошёл почти незамеченным, хотя это было невероятно, учитывая причастность газеты рекордной важности. Документ потрясающе описывает то, что директор прикладных наук Microsoft, ещё один ответчик в деле, назвал «крупнейшей кражей труда в истории человечества».
Microsoft и OpenAI в попытке обучить новые модели на практически всех доступных в мире информационных ресурсах неоднократно брали миллионы статей с сайтов Times и других издателей. Ответчики утверждают, что это простое применение добросовестного использования: если вы прочитали статью и просто запомнили, что в ней было, чтобы расширить свои знания, это нельзя считать нарушением авторского права. Но OpenAI не заплатила за обход платного доступа Times, что могло бы облегчить обнаружение операции скрейпинга. Вместо этого разработали способ обойти платный доступ и избежать обнаружения. И когда Грег Брокман, сооснователь и президент OpenAI, узнал об этом манёвре, ответил:
«О, хорошо».
Не нужно углубляться в дебаты о природе и воспитании, чтобы заподозрить, что беззаботное отношение руководства OpenAI к присвоению информации, которая им не принадлежит, проникло в сознание исследователей и продукты, которые они создают. Несложно нарисовать эту картину: OpenAI-модели атакуют сайты и берут из них всё, что могут, потому что это бизнес-модель компании.
Уважение к закону можно буквально встроить в исходный код модели: если OpenAI агрессивно скачивает данные отовсюду, они могли бы просто добавить текст U.S. Code (особенно раздел, относящийся к Computer Fraud and Abuse Act) и обучить модель не нарушать его. Очевидно, это не приоритет, и это согласуется с личным поведением OpenAI. Это не ситуация, когда AI-модели уходят из-под контроля своих создателей. Похоже, что они просто подражают создателям, становясь ловкими в поиске тех же ярлыков и использовании тех же обоснований для их оправдания.
Брокман, о котором упоминалось выше, является одним из крупнейших донаторов MAGA Inc., суперпака Трампа. Среди крупнейших инвесторов OpenAI — брат Джареда Кушнера. На практическом уровне полностью понимаю, почему агенты ФБР не появились в офисах San Francisco в понедельник утром. Но как объективный факт, не имеет смысла, почему Сэм Альтман и топ-менеджмент остаются свободными людьми сегодня.
Стало почти клише утверждение, что для AI нет исключения из закона. Взлом сайтов и кража материалов нарушают закон. Дженсен Хуанг, генеральный директор Nvidia, который больше, чем кто-либо в стране, заинтересован в ускорении развития AI, заявил на неделе, что невыровненные модели нельзя выпускать, и что если невыпущенные продукты показывают такое поведение, то «нам нужно закрыть лаборатории».
Хуанг, который явно не хочет нанести урон своей компании закрытием лабораторий, представил новый инструмент, который абсолютно, определённо, помешает моделям взламывать и крать. Всё для того, чтобы $150 миллиардов в виде выплат продолжали течь к инвесторам, я полагаю.
«О, хорошо»
Грег Брокман, сооснователь и президент OpenAI, когда узнал об обходе платного доступа The New York Times
Простой вариант закрытия лабораторий — это не саморегулирующийся программный патч, а отзыв продукции. В 1970-х Ford Pinto имел изъян в топливном баке, который вызывал возгорание машин при ударе сзади, даже на низких скоростях. Национальное управление безопасности движения позднее обнаружило, что в результате погибло 27 человек. Как Mother Jones сообщила, внутренние памятки показали, что руководство знало об изъяне, но решило, что дешевле выплачивать компенсации, чем устранять дефект.
К 1978 году NHTSA снял с дороги 1,5 миллиона Pinto. Это соответствует простому принципу: продукты, которые наносят вред, не имеют права оставаться на рынке. Отзыв идёт дальше, чем самооценка OpenAI о паузе или замедлении развития; непонятно, почему им доверяют определение безопасности моделей, учитывая, что они разделяют те же тенденции взлома, скрейпа и кражи данных.
Поскольку федеральное правительство глубоко скомпрометировано, приходится надеяться на — держитесь — Флориду, генеральный прокурор которой Джеймс Утмайер подал на срочное судебное запрещение против OpenAI на основании того, что они не могут контролировать свои собственные продукты.
Но есть и другой вариант, отражённый в более малоизвестной части истории Ford Pinto. В 1980 году большое жюри в Elkhart, Indiana, выдало обвинение против Ford Motor Company в убийстве из-за смерти трёх женщин — впервые компания была обвинена в таком преступлении. Окружной прокурор в Elkhart должен был полагаться на добровольцев для ведения дела против одной из крупнейших тогда компаний, и Ford выиграла дело. Но более мощные усилия с равномерным распределением прокурорских полномочий могли бы дать другие результаты.
Такая ответственность для ответственных лиц кажется светлет лет отсюда. Весь нынешний тысячелетий характеризовался отсутствием подотчётности. Вопреки раздражающей статье Джонатана Чейта, которую не стоит ссылать, я не против регулирования AI. Я полагаю, что нам следует регулировать кражу, регулировать обман, регулировать надругательство, регулировать несправедливость. К счастью, у нас есть возможность делать это прямо сейчас, с существующими законами, которые охватывают искусственный интеллект так же уверенно, как и любую другую человеческую деятельность. Тот факт, что мы не можем представить такую подотчётность, и думаем, что новые правила с новыми стандартами сделают то, что существующие правила явно не делают, предполагает, что реальная проблема не была решена.
Сандип Вахисан из Open Markets Institute выпустил умный закон обзорную статью вчера, доказав, что настойчивое нарушение закона является недобросовестным методом конкуренции. Нечестные игроки экономики эффективно налагают налог на честных, которые соблюдают правила. Нарушители закона имеют большей способностью увеличивать доходы и снижать затраты. Это несправедливое преимущество. Мы видим, как OpenAI и её продукты получают выгоду от этого в реальном времени. Любой другой бизнес с такой историей был бы закрыт.