Правовой хаос вокруг создания и развития искусственного интеллекта перерос в масштабную судебную войну. Корпорация Google столкнулась с сокрушительным коллективным иском (Class Action) в федеральном суде Калифорнии. Группа известных авторов и правообладателей обвинила технологического гиганта в массовом нарушении авторских прав. Согласно материалам дела, Google незаконно использовал миллионы защищённых копирайтом книг, включая пиратские базы данных, чтобы провести обучение нейросетей своего флагманского семейства Gemini.
Этот судебный процесс обещает стать историческим. Его исход напрямую определит, смогут ли технологические компании и дальше бесплатно скачивать весь мировой контент или им придётся платить авторам за каждую строчку текста.
Суть обвинения: откуда Google брал книги для Gemini
Разработчики больших языковых моделей (LLM) всегда тщательно скрывают точные списки датасетов, на которых обучаются их алгоритмы. Однако истцам удалось найти доказательства того, что при создании Gemini (ранее Bard) инженеры Google использовали массив данных под названием Books3.
Набор данных Books3 давно имеет дурную славу в ИТ-индустрии — это гигантская цифровая библиотека, содержащая около 200 000 структурированных книг, целиком выкачанных с пиратских трекеров и теневых сайтов. Авторы иска утверждают, что Google сознательно проигнорировал пиратское происхождение этих материалов, так как компании критически не хватало качественных, длинных и грамматически правильных текстов для обучения сложной языковой логике Gemini.
Позиция авторов непоколебима: Google взял их интеллектуальную собственность без разрешения, не выплатил ни цента компенсации, а теперь продаёт платную подписку Gemini Advanced, которая генерирует тексты, фактически паразитируя на чужом писательском таланте.
Почему этот суд изменит правила игры для всех создателей контента
Многие вебмастера и копирайтеры ошибочно думают, что суды из-за художественных книг их не касаются. На самом деле этот прецедент создаёт правила, по которым будет жить всё интернет-пространство в ближайшие десятилетия:
- Конец эпохи Fair Use (Добросовестного использования): Технологические гиганты долго защищались в судах термином «добросовестное использование», заявляя, что они не копируют книги, а лишь «изучают» их. Если суд признает эту практику незаконной, под запрет попадёт и бесплатный парсинг обычных коммерческих сайтов, блогов и СМИ.
- Переход на лицензионную модель: Google, OpenAI и Microsoft будут вынуждены заключать официальные многомиллионные контракты с издательствами, фотостоками и крупными сайтами ради легального доступа к контенту. Рынок генеративного ИИ станет невероятно дорогим.
- Защита авторов в Рунете: Отечественные нейросети (Яндекс GPT, Шедеврум, GigaChat) обучаются по точно таким же принципам на базе русскоязычных текстов, книг и статей из Рунета. Решения американских судов неизбежно запустят волну аналогичных правовых реформ и судебных исков в российском
Что требует группа авторов от Google в суде?
Истцы требуют от суда признать действия Google незаконными, полностью заблокировать использование их произведений в датасетах и выплатить многомиллионные компенсации за каждый факт несанкционированного использования книги для обучения ИИ.
Как Google комментирует этот коллективный иск?
Официальные юристы Google заявляют, что обучение моделей не нарушает закон, так как нейросеть создает полностью новый, трансформационный продукт, а не копирует исходные тексты напрямую.
Могут ли обычные сайты защитить тексты от обучения нейросетей?
Да, на текущий момент единственный рабочий способ — внедрение жестких систем авторизации пользователей (Paywall) и использование Cloudflare для точечной блокировки ИИ-краулеров поисковых систем на уровне сервера.












