Украдены 4 терабайта голосовых данных у 40 тысяч контрактных разработчиков ИИ в Mercor

hackernews · оригинал

Компания Mercor столкнулась с крупной кибератакой: хакеры похитили 4 терабайта аудиозаписей, собранных у 40 тысяч контрактных разработчиков искусственного интеллекта. Данные включают речевые образцы, использовавшиеся для обучения моделей распознавания речи и синтеза голоса.

Ценность: Эта утечка представляет серьезную угрозу для приватности и безопасности. Голосовые данные могут быть использованы для имитации личных разговоров, фишинга или создания поддельных аудиосообщений. Кроме того, пострадавшие разработчики теряют контроль над своими творческими материалами, что может повлиять на доверие к платформам контрактной работы в сфере ИИ.

В долгосрочной перспективе утечка может замедлить развитие ИИ-технологий, так как разработчики и компании станут более осторожны при использовании внешних данных. Также растет вероятность создания «голосовых подделок», которые могут быть использованы для мошенничества, например, для имитации руководства компании в целях мошеннических звонков. Поскольку данные включают в себя широкий спектр языков и эмоций, их применение в злонамеренных целях будет особенно эффективным.