Коаліція медіаорганізацій, серед яких The Guardian і Financial Times, опублікувала стандарт для відстеження використання контенту видавців інструментами штучного інтелекту. Ініціатива Standards for Publisher Usage Rights, або SPUR, випустила content telemetry standard і запросила OpenAI, Anthropic, Google, Meta та Microsoft долучитися до формування правил його впровадження. Про це повідомив технічний керівник SPUR Алекс Спрінгер.
Якщо ШІ-компанії погодяться, вони увійдуть до нової AI Licensing Advisory Board — консультативної ради, створеної за запрошеннями. Її мета — зробити так, щоб стандарт відображав потреби всього ШІ-екосистеми, а не лише видавців. Наразі жодних підтверджень від OpenAI, Google чи інших компаній про приєднання немає.
Проблема, яку вирішує SPUR, лежить у площині прозорості. Видавці десятиліттями могли вимірювати, як пошукові системи індексують їхній контент, але з появою генеративних моделей цей зв'язок став непрозорим. Ніхто до пуття не знає, які саме матеріали потрапили в навчальні вибірки, як часто ШІ-відповіді цитують конкретні статті та чи отримує медіа хоч якусь компенсацію за це. Content telemetry standard покликаний дати технічну відповідь: він описує, які саме сигнали мають передавати ШІ-системи, щоб видавці могли відстежувати використання своїх матеріалів.
Контекст ініціативи — судові позови та регуляторний тиск. The New York Times ще у грудні 2023 року подала позов проти OpenAI і Microsoft, і в оприлюднених внутрішніх документах обох компаній є визнання, що моделі «згрібають» чужу роботу. Зокрема, директор із прикладної науки Microsoft Брент Хехт у службовій записці на початку 2023 року назвав це «найбільшою крадіжкою праці в історії людства». А президент OpenAI Грег Брокман, реагуючи на опис обходу пейволу NYT, відповів: «ah nice». Голова ChatGPT Нік Терлі назвав чатботів «екзистенційною загрозою» для видавців.
Міністерство юстиції США також втрутилося в суперечку, подавши заяву про те, чи є навчання моделей на контенті видавців добросовісним використанням. Відомство визнало, що «вихідні дані, які реконструюють і поширюють оригінальний захищений авторським правом твір, можуть не бути трансформативними». Це формулювання близьке до опису ШІ-пошуку, який фактично переказує актуальну журналістику.
Паралельно на ринку з'явилися посередники — компанії на кшталт Exa, Parallel і Tavily, які масово збирають дані з відкритого вебу й перепродують їх ШІ-компаніям та підприємствам. Вони вже заробляють на цьому, тоді як видавці здебільшого залишаються без компенсації. Саме цю асиметрію SPUR і намагається виправити через технічний стандарт, а не через чергові позови.
Для українських медіа та digital-команд це сигнал, який варто тримати в полі зору. По-перше, якщо SPUR стане галузевим стандартом, він може з'явитися в контрактах із ШІ-вендорами як обов'язкова умова — і тоді українським видавцям доведеться або адаптувати свої технічні системи, або втратити переговорну позицію. По-друге, локальні медіа, які публікують унікальний контент — розслідування, аналітику, дані, — мають шанс монетизувати його через ліцензування, але лише за умови, що зможуть технічно довести факт використання. По-третє, агентствам і продуктовим командам, які будують ШІ-продукти на відкритих даних, варто заздалегідь готуватися до прозорішої звітності: стандарти на кшталт SPUR рано чи пізно доїдуть і до українського ринку через глобальних вендорів.
Поки що SPUR — це лише опублікований стандарт і запрошення до діалогу. Чи приєднаються OpenAI, Google, Meta, Microsoft та Anthropic, стане зрозуміло найближчим часом. Якщо ні — коаліція видавців отримає ще один аргумент у судах і переговорах: вони запропонували технічне рішення, а індустрія ШІ від нього відмовилася.
2




