Маск намагається отримати дані померлих стартапів для тренування ШІ

Дані з X виявилися недостатніми для досягнення “загального штучного інтелекту” Grok. Ілон Маск шукає нові джерела інформації.

© Photo by Anna Barclay / Getty Images

Штучному інтелекту потрібні дані для навчання, а ці дані коштують чималих грошей. Здається, що всіх користувацьких даних з платформи X (раніше Twitter) та всієї інформації, яку коли-небудь створювала SpaceX, виявилося недостатньо для Grok Ілона Маска. Тому він шукає нове рішення — купувати дані клієнтів збанкрутілих компаній задешево.

За даними джерел Bloomberg, SpaceX, яка відчуває брак даних, розглядає можливість придбання даних клієнтів та операційних даних з компаній-стартапів, що зазнають труднощів або вже збанкрутували.

SpaceX терміново потрібні дешевші джерела даних. У своєму першому звіті минулого місяця компанія оголосила про значні інвестиції у розмірі 15,8 мільярдів доларів на свої AI-розробки, хоча підрозділ xAI, що займається штучним інтелектом, завершив квартал з чистим операційним збитком у 1,3 мільярда доларів. Маск має амбітні плани щодо свого чат-бота Grok, щоб він міг конкурувати з моделями від інших AI-лабораторій, таких як OpenAI та Anthropic. Компанія планує представити Grok 5 до кінця року — модель, яка, за словами Маска, досягне рівня загального штучного інтелекту (AGI). Звичайно, для досягнення AGI потрібна величезна кількість навчальних даних.

Наразі ці переговори є неформальними і можуть не призвести до угоди. Однак, якщо це станеться, це матиме серйозні наслідки для конфіденційності. Будь-яка компанія, якій ви довірили свої дані і яка зараз має фінансові труднощі, може продати ці дані Маску.

SpaceX — не єдиний технологічний гігант, який прагне отримати дані, незважаючи на етичні суперечності та занепокоєння щодо конфіденційності. З поширенням агентного ШІ на робочих місцях, AI-лабораторії все більше цінують галузеві знання у різних секторах. Продаж даних компаній, що зазнали невдачі, AI-лабораторіям став нішевим ринком.

На аукціоні з банкрутства минулого місяця Google зробив ставку у 10 мільйонів доларів за дані авіакомпанії Spirit Airlines, яка вже не існує, щоб навчати свої моделі Gemini. Хоча дані Spirit не включали інформацію про пасажирів, вони містили 100 мільйонів електронних листів компанії та 500 мільйонів чатів Microsoft Teams від колишніх співробітників. Також були включені дані про операції літаків та продуктивність співробітників, 1 мільйон записів обліку робочого часу, 17 мільйонів індивідуальних файлів Microsoft OneDrive та сотні тисяч записів про співробітників, включаючи податкові форми, трудові договори та судові документи.

Google запевнила, що дані будуть очищені від особистої інформації, але цього було недостатньо для деяких сторін. Профспілка колишніх співробітників Spirit, Асоціація бортпровідників, подала заперечення до Суду з банкрутства США. Позивачі стверджували, що правові стандарти процесу “знеособлення” застосовуються лише до споживачів, залишаючи приватні дані співробітників, включаючи записи про подорожі та податкові форми, вразливими.

“Псевдонімізований набір даних все ще може розкрити, які бази екіпажу генерували скарги, як невелика частина бортпровідників проходила повторне навчання, які співробітники були під слідством, які коригування компенсації слідували за певними подіями, і що співробітники говорили один одному про керівництво, штат або їхню профспілку”, — йдеться в запереченні.

Суд з банкрутства згодом відклав затвердження угоди про купівлю.

No votes yet.
Please wait...

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *