Россияне с трудом распознают голоса, созданные нейросетями
:format(webp)/YXJ0aWNsZXMvaW1hZ2UvMjAyNi84L2xvcmktMDA0NjIyOTY2My1iaWd3d3dfZTVDUWxIbS5qcGc.webp)
Фото - © Валерий Лукин / Фотобанк Лори
Только 54% россиян отличают сгенерированные нейросетью голосовые сообщения от настоящих. Аудиозаписи стали самым уязвимым форматом для распознавания ИИ, сообщает «Вечерняя Москва».
Опрос частной маркетинговой компании показал, что признаки ИИ в видеороликах распознают 77% участников, а в сообщениях от лица человека — 82%. С информационными статьями не справились 40% респондентов.
Эксперт по программированию и нейросетям Никита Войтов пояснил, что модели обучаются на записях человеческой речи и воспроизводят произношение, интонации, темп и эмоции. Злоумышленники могут скопировать голос конкретного человека, используя несколько минут его записей. Универсальных способов определить подделку на слух почти нет.
Синтез голоса применяют в рекламе, подкастах, аудиокнигах, обучающих курсах и корпоративном контенте. Маркетолог Василий Михайлов отметил, что технология ускоряет и удешевляет производство, но не заменяет актеров там, где важны эмоции и харизма. Он призвал критически оценивать голосовые сообщения с нетипичными просьбами.
Подписывайтесь на канал РИАМО в МАКС.