ИИ научился создавать изображение по звукам

ИИ достаточно 10-секундного аудио контента, чтобы сгенерировать изображение.

Ученые из Техасского университета в Остине создали технологию, которая с высокой точностью преобразует звук городской среды в визуальные образы.

ИИ теперь способен способна генерировать изображения, соответствующие звуковому ландшафту, - объявили специалисты.

Отмечается, что модель диффузии звукового ландшафта в изображение прошла "обучение" на 10-секундных роликах. Они состояли из неподвижной картинки и звуков, сопровождающих визуальный ряд. Картинки были взяты с изображением ландшафтов Азии, Европы, Северной и Южной Америки, Африки.

Генерируя картинки при помощи звуков, ИИ преображал изначальные изображения в режим дня или ночи, зависимо от уровня шумов. А также моделировал количество людей на улицах.

После "обучения" систему попросили создать определенные картинки, которые соответствовали бы звуковому ряду. Затем группе людей показали эти изображения, а также еще два дополнительно. В это же время вопроизводили звуковую дорожку, на основе которой ИИ создал картинку. Люди угадывали какую картинку на основе данных звуков создал ИИ в 80 случаев из ста.

Ученые считают, что их разработка может быть полезна криминалистам, которые на основе звукового ряда смогут воссоздать место преступления, например.

Полученные результаты могут расширить знания о влиянии зрительного и слухового восприятия на психическое здоровье, стать основой для разработки новых подходов к городскому планированию и способствовать повышению общего качества жизни в сообществах, - утверждают ученые.

Напомним, самая ранняя успешная программа искусственного интеллекта была создана Кристофером Стрейчи в 1951 году. А уже в 1952 году она играла в шашки с человеком.