Ажіотаж навколо штучного інтелекту розпалюється ідеєю, що всі дані є загальнодоступними, потенційною сировиною для навчання нових моделей. Не дивно, що питання власності та крадіжки інтелектуальної власності стали такими гарячими в індустрії технологій.
У четвер китайський стартап з робототехніки JoyIn, розробник моделі Aether, звинуватив OpenAI у “дистиляції” своїх систем ШІ та крадіжці космічної естетики дизайну свого вебсайту для запуску та брендингу GPT-6 Astra. У відкритому листі китайською мовою генеральний директор JoyIn Ґуо Ренцзе заявив, що його компанія розпочала процес подання позову, згідно з перекладом CNBC. (Gizmodo не мав можливості незалежно перевірити це повідомлення).
“Дистиляція” — це поширена практика в індустрії, коли розробники використовують більшу, більш досконалу модель як своєрідного “вчителя” для тренування меншої “студентської” моделі. Але це стало суперечливим питанням останніми місяцями, оскільки великі американські компанії зі штучного інтелекту, включно з OpenAI та Anthropic, неодноразово заявляли, що конкуренти в Китаї використовують їхні пропрієтарні моделі для масштабного, незаконного “дистиляції” з метою отримання конкурентної переваги.
У заяві, опублікованій у вівторок, Агентство з кібербезпеки та захисту інфраструктури США (CISA) повідомило, що деякі з найбільших китайських компаній у сфері ШІ — DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun та Z.ai — “здійснюють систематичне вилучення пропрієтарних функціональних можливостей та потенціалу моделей американських компаній у сфері ШІ через великомасштабні кампанії “дистиляції” знань, які становлять основу, а не просто доповнення, їхньої стратегії розробки ШІ”. За даними CISA, усе це, ймовірно, здійснювалося зі згоди та схвалення китайського уряду. Anthropic також заявив у четвер, що Moonshot, розробник моделі ШІ Kimi, використовував трюк у стилі “механічного курника”, щоб переконати своїх клієнтів, що вони отримують відповіді від Kimi, хоча насправді вони були згенеровані Claude.
Лист Ґуо до OpenAI є першим відомим випадком, коли китайський розробник звинуватив американську компанію в “дистиляції”. Проте це далеко не перший випадок, коли OpenAI звинувачують у крадіжці. Компанія мусила відбиватися від безлічі позовів з моменту запуску ChatGPT менш ніж чотири роки тому, поданих художниками та видавцями новин, які стверджували, що їхні авторські роботи були незаконно використані для навчання нових моделей ШІ. (OpenAI неодноразово захищалася, посилаючись на так звану норму “добросовісного використання” закону США про авторське право.) У липні Apple подала позов проти компанії, стверджуючи, що та викрала комерційну таємницю, щоб розпочати свій новий бізнес у сфері обладнання. (Знову ж таки, OpenAI заперечувала будь-які порушення.) Раніше цього тижня професор математики з Нью-Йоркського університету поставив під сумнів, чи була його робота над Codex таємно використана для тренування моделі, яку OpenAI використала для розв’язання “проблеми тисячоліття” Нав’є-Стокса. (OpenAI заявила Австралійській радіомовній корпорації, що “категорично неможливо, щоб команди доктора Бакмастера з Codex за останні два місяці будь-яким чином вплинули на систему, зокрема на тренування”).
Іронія полягає в тому, що компанії ШІ звинувачують у “незаконній” дистиляції, тоді як значна частина їхньої бізнес-моделі залежить від непогодженого збору веб-контенту. Здається, OpenAI та Anthropic, які готуються до рекордних IPO, не помічають цього. Принаймні наразі межа між “добросовісним використанням” і крадіжкою в нерегульованій індустрії ШІ така ж розмита, як і внутрішня робота самих моделей.

