сен

2024

Красота в деталях: ученые Вышки и AIRI разработали метод высококачественного редактирования изображений

Энди Уорхол. Диптих Мэрилин, 1962г.

crossarea.ru/art

Исследователи Центра ИИ НИУ ВШЭ, AIRI и Бременского университета разработали новый метод редактирования изображений на основе глубинного обучения — StyleFeatureEditor. Он позволяет точно воссоздавать мельчайшие детали изображения и сохранять их при редактировании. С его помощью пользователи смогут изменять цвет волос или выражение лица без потери качества изображения. Результаты работы опубликованы на самой цитируемой конференции по компьютерному зрению CVPR 2024.

Искусственный интеллект уже научился генерировать изображения и редактировать их. Это стало возможным благодаря генеративно-состязательным нейросетям (GANs — generative adversarial networks). Архитектура предполагает две независимые сети: генератор производит изображения, дискриминатор различает реальные и сгенерированные образцы, и они соревнуются друг с другом. Новым этапом в развитии генеративно-состязательных сетей стала модель StyleGAN. Она может генерировать изображения и изменять их отдельные части по запросу пользователя, но не умеет работать с реальными фото или картинками.

Исследователи Центра ИИ НИУ ВШЭ, AIRI и Бременского университета предложили способ быстро и качественно редактировать реальные изображения. Ученые создали метод (StyleFeatureEditor) с двумя модулями: первый воссоздает (реконструирует) исходное изображение, а второй редактирует эту реконструкцию. Результат работы модулей передается в StyleGAN в понятном для нейросети наборе внутренних представлений, из которых и создается редактированное изображение. При этом разработчикам удалось решить проблемы, которые возникали в предыдущих исследованиях: при небольшом наборе представлений нейросеть хорошо редактировала изображение, но теряла детали исходного изображения, а при большом наборе все детали сохранялись, но нейросеть не понимала, как их правильно преобразовать с учетом поставленной задачи.

Для решения этой проблемы исследователи предложили следующее: первый модуль ищет и большие, и маленькие представления, а второй учится редактировать большие на примере редактуры маленьких представлений.

Однако, чтобы обучить эти модули правильно редактировать представления, нейросети нужны настоящие изображения и их отредактированные версии.

Денис Бобков

«Нам нужны были образцы, например одно и то же лицо с разной мимикой, прической, деталями. К сожалению, таких пар изображений не существует на данный момент. И мы придумали хитрость: с помощью метода, работающего с малыми представлениями, мы создали реконструкцию настоящего изображения и пример редактирования этой реконструкции. Несмотря на то что получились довольно простые примеры без деталей, модель четко поняла, как правильно совершать редактирования», — рассказывает один из авторов статьи, стажер-исследователь Центра глубинного обучения и байесовских методов Института искусственного интеллекта и цифровых наук ФКН, младший научный сотрудник лаборатории Fusion Brain AIRI Денис Бобков.

Однако обучение только на сгенерированных (простых) примерах ведет к потере деталей при работе с реальными (сложными) изображениями. Чтобы этого не происходило, ученые добавили реальные изображения в обучающую выборку. И нейросеть училась воссоздавать их в деталях.

Таким образом, показав модели и как редактировать простые, и как воссоздавать сложные изображения, ученым удалось создать условия, при которых нейросеть научилась редактировать сложные изображения. В частности, разработанный подход справляется с добавлением новых элементов стиля, а также лучше сохраняет детали исходных изображений по сравнению с другими существующими методами.

В случае простой реконструкции (первый ряд) StyleFeatureEditor аккуратно воспроизвел шляпку, в то время как большинство других методов ее практически потеряло. Лучшее качество разработанный метод показал в случае добавления аксессуаров (третий ряд): большинство методов справились с добавлением очков, но только StyleFeatureEditor сохранил исходный цвет глаз.

Айбек Аланов

«Благодаря технике обучения на сгенерированных данных, мы получили модель с хорошим качеством редактирования, а также быструю скорость работы за счет использования подхода с достаточно легковесными нейросетями. Фреймворку StyleFeatureEditor требуется всего 0,07 секунды на редактирование одного изображения», — говорит Айбек Аланов, заведующий Центром глубинного обучения и байесовских методов Института искусственного интеллекта и цифровых наук ФКН, руководитель научной группы «Контролируемый генеративный ИИ» лаборатории Fusion Brain AIRI.

Исследование поддержано грантом для исследовательских центров в области искусственного интеллекта, предоставленным Аналитическим центром при Правительстве РФ.

Результаты исследования будут представлены в докладе на ежегодной конференция по искусственному интеллекту и машинному обучению Fall into ML 2024, которая пройдет в НИУ ВШЭ 25-26 октября. На площадке Высшей школы экономики ведущие ученые в области искусственного интеллекта обсудят лучшие работы, опубликованные на конференциях А* в 2024 году — флагманских событиях этой области. Демо разработанного метода можно опробовать на HuggingFace, код — в Github репозитории.

Дата

5 сентября 2024

Рубрики

Наука

Темы

исследования и аналитика искусственный интеллект нейросети

В статье упомянуты

Институт искусственного интеллекта и цифровых наук, Центр глубинного обучения и байесовских методов, Центр искусственного интеллекта

Персоны

Аланов Айбек

Бобков Денис Николаевич

Вам также может быть интересно:

мар

2025

«Идею всегда задает человек»: что дает ИИ образованию и медиа

ИИ-технологии меняют принципы работы образования и медиаиндустрии. Большинство студентов уже в той или иной мере используют ИИ, а нейросети уже массово производят все виды контента. Возможности и вызовы эксперты обсудили на конференции «Образование и медиа в эпоху цифровых перемен», организованной Дирекцией по маркетинговым коммуникациям НИУ ВШЭ и «Яндекс Образованием».

31 марта

мар

2025

В Вышке стартовали открытые семинары «ИИ в индустрии»

Институт искусственного интеллекта и цифровых наук факультета компьютерных наук НИУ ВШЭ запустил цикл открытых семинаров. Встречи посвящены актуальным вопросам внедрения искусственного интеллекта в различные отрасли экономики. Семинары проводятся еженедельно в 18:00 в кампусе на Покровском бульваре. Для участников также предусмотрена онлайн-трансляция.

17 марта

мар

2025

Ученые представили новый метод для работы с несбалансированными данными

Специалисты факультета компьютерных наук НИУ ВШЭ и Лаборатории искусственного интеллекта Сбера разработали геометрический метод расширения данных — Simplicial SMOTE. Тесты на разных наборах данных показали, что он значительно улучшает качество работы AI. Метод особенно полезен в ситуациях, когда редкие случаи очень важны, например в борьбе с мошенничеством или при диагностике редких болезней. Результаты исследования доступны в открытом архиве Arxiv.org и будут представлены на Международной конференции по обнаружению знаний и анализу данных (KDD) летом 2025 года в Торонто.

14 марта

мар

2025

В Вышке рассчитали экономический эффект от внедрения технологий ИИ в России

Институт статистических исследований и экономики знаний НИУ ВШЭ оценил потенциальный экономический эффект от внедрения и использования технологий искусственного интеллекта в отраслях российской экономики до 2035 года. Эксперты также предположили, каким должен быть объем ресурсов, которые потребуются организациям для освоения данного класса технологий.

6 марта

мар

2025

Мегасайенс, ИИ и суперкомпьютеры: Вышка расширяет сотрудничество с ОИЯИ

Специалисты по компьютерным технологиям НИУ ВШЭ и Объединенного института ядерных исследований (ОИЯИ) обсудили сотрудничество и совместные проекты на встрече в Лаборатории информационных технологий им. М.Г. Мещерякова (ЛИТ). Со стороны ВШЭ в дискуссии участвовали заведующий Лабораторией вычислительной физики МИЭМ Лев Щур и сотрудники Научно-учебной лаборатории методов анализа больших данных факультета компьютерных наук Денис Деркач и Федор Ратников.

3 марта

фев

2025

Искусственный интеллект предсказал поведение квантовых систем

Ученые ВШЭ совместно с коллегами из Университета Южной Калифорнии разработали алгоритм, который быстро и точно предсказывает поведение квантовых систем — от квантовых компьютеров до солнечных батарей. С его помощью удалось смоделировать процессы в полупроводнике MoS₂ и выяснить, что на движение заряженных частиц влияет не только количество дефектов, но и их расположение. Эти дефекты могут замедлять или ускорять перенос заряда, создавая эффекты, которые раньше было сложно учесть при применении стандартных методов. Исследование опубликовано в журнале The Proceedings of the National Academy of Sciences (PNAS).

25 февраля

фев

2025

Вышка запускает курс повышения квалификации по ИИ в образовании

Факультет компьютерных наук НИУ ВШЭ запускает курс повышения квалификации по искусственному интеллекту в образовании. Программа предназначена для педагогов, преподавателей, методистов, планирующих интегрировать технологии ИИ в учебный процесс, а также для управленческих команд образовательных учреждений, заинтересованных в улучшении образовательных процессов через внедрение ИИ.

10 февраля

янв

2025

«Многие хотят создавать продукты на базе ИИ и стать конкурентоспособнее»

В 2024 году на магистерскую онлайн-программу «Искусственный интеллект», реализуемую факультетом компьютерных наук ВШЭ, поступило рекордное количество первокурсников — более 300. Откуда такой высокий интерес к ИИ, как строится обучение и какими новыми компетенциями будут обладать выпускники программы, рассказала ее академический руководитель Елена Кантонистова.

22 января

дек

2024

Динамику ESG в мире обсудили на международной конференции по вопросам устойчивого развития в Вышке

Участники форума «ESG Corporate Dynamics: the Challenges for Emerging Capital Markets» обсудили использование ИИ в сфере устойчивого развития, влияние климатической уязвимости на привлечение институциональных инвесторов, тренды ESG-политики в Южной Корее и Китае, разработку интегральной ESG-модели для оценки вероятности дефолта компаний и многие другие вопросы. В работе конференции, организованной факультетом экономических наук ВШЭ, приняли участие более 20 ученых из ведущих университетов Китая, Египта, Малайзии и других стран.

24 декабря 2024

дек

2024

Исследователи из ВШЭ разработали Python-библиотеку для анализа данных движений глаз

Исследовательская группа из Высшей школы экономики разработала Python-библиотеку EyeFeatures, предназначенную для анализа и моделирования данных движений глаз. Инструмент призван облегчить работу ученых и разработчиков, предоставляя им возможность эффективно обрабатывать сложные данные и строить предсказательные модели.

20 декабря 2024