Содержание статьи
Как сделать нейросеть барби
ThisPersonDoesNotExist
Avatarro — нейросеть, способная сделать аватар по фото. Приложение отличается огромным количеством стилей (киберпанк, пилот, невеста, рок-звезда, супергерои, праздники, деловые и много других), возможностью некоторых улучшений и быстрой скоростью генерации. Нейросеть доступна в виде мобильного приложения для iOS и Android.
Для того, чтобы воспользоваться нейросетью, нужно загрузить файл с ней в соответствующее окно. Под каждым ообработанным фото будет две иконки: первая — разукрашенное изображение в оригинальном размере, вторая — сравнительная картинка, на которой одна половина снимка чёрно-белая, а другая — цветная. Бесплатно на аккаунт можно загрузить до 50 фото, причем на каждом будет отображаться текст «Создано с помощью Colorize.cc».
«Я считаю, что стремление к красоте — это неотъемлемая потребность каждого человека», — говорила Чан. В 2015 году она основала Perfect Corp, которая разрабатывает приложения для «примерки» макияжа. Ее основные клиенты — бьюти-гиганты вроде Estée Lauder, Shiseido, Chanel и Revlon. Сомневающимся потребителям проще решиться на покупку, особенно в интернет-магазине, если они могут посмотреть, как тот или иной косметический продукт будет смотреться на лице.
Работу DeepCake критиковали — и за недостаточно качественный постпродакшнн, и за этическую неоднозначность самой технологии, которая, только появившись, сразу стала инструментом «черного пиара». На сайте Brask — компании, сооснователем которого Чмир стала в 2020 году, — говорится о приверженности этическим стандартам и «ответственному ИИ». Компания специализируется на создании цифровых масок, полноценных цифровых дублей (как в случае с Брюсом Уиллисом и Жоржем Милославским) и других продуктов, связанных с модификацией видео и аудио (например, потоковый переводчик Rask распознает речь, переводит сказанное с одного языка на другой и озвучивает тем же голосом, каким текст был произнесен изначально).
Конечно, топ открывает нашумевшая новинка — эта нейросеть создана независимыми разработчиками после выхода в свет фильма про Барби с Марго Робби в главной роли. Автор идеи — выпускница Массачусетского технологического института Ширли Мао, по совместительству она является соучредителем компании Rvnway, которая занимается разработкой биотехнологических стартапов. На сайте написано, что это «веселый пародийный проект».
С развитием генеративного искусственного интеллекта эту технологию стали брать на вооружение многие создатели дизайнерского ПО, и в 2023-м свою версию представила Canva. Во-первых, благодаря ИИ становится проще обработка изображений (результаты фотомонтажа становятся более реалистичными). Во-вторых, появился встроенный генератор изображений по текстовому описанию.
В 2021 году в развитии и распространении генеративного ИИ произошел скачок. Компания OpenAI представила нейросеть DALL-E, которая создавала изображения по текстовым запросам, и выложила в открытый доступ математическую модель CLIP — она в работе DALL-E занимается проверкой того, насколько получившееся изображение соответствует текстовому запросу. Сам генератор DALL-E опубликован не был, зато широкой аудитории оказался доступен другой, под названием VQGAN. Совместно с CLIP он стал общедоступным инструментом для генерации картинок. Его опубликовала его соавтор, программистка Кэтрин Кроусон.
Еще в школьные годы Ширли Мао открыла локальное отделение организации «Women In Tech» — глобального движения, которое поддерживает девушек в STEM. Затем поступила в Массачусетский технологический институт (MIT), где изучала биомеханику и биомедицинские устройства, робототехнику и приборостроение, а также компьютерные науки и искусственный интеллект. Будучи студенткой, Мао вошла в коллектив авторов нескольких статей, посвященных адресной доставке молекул прямиком в клетку (это повышает эффективность и снижает побочные эффекты от применения некоторых лекарств, в том числе использующихся в терапии ВИЧ), и прошла стажировку в Google и Facebook (теперь — Meta, признана в России экстремистской и запрещена).
Мария Чмир: цифровые двойники
Сколько Мао и ее компании удалось заработать таким образом, неизвестно, но за несколько дней после запуска многочисленные «кукольные» фото заполонили интернет. Популярности сервиса способствовала и маркетинговая кампания фильма (создатели которого никак не связаны с проектом Мао), и внимание знаменитостей: свои фото в виде Барби выложили в соцсетях Тейлор Свифт, Селена Гомес, Кайли Дженнер и другие.
«Результаты настолько шокируют, что многие, кажется, просто не могут в это поверить, — сказала Кроусон в интервью Vice. — CLIP обучается на 400 млн пар изображение/текст. На таком масштабе мы начинаем видеть способности, которые раньше видели только у людей-художников, например, способность к абстракции или к проведению аналогий».
Это проект на базе искуственного интеллекта, который разработала группа ученых из Японии в 2018 году. Он позволяет превращать изображения в соответствующий звуковой пейзаж, определенный нейронной сетью. Пользователи могут передвигаться по Google Street View и погружаться в воображаемые звуковые ландшафты — они созданы с помощью моделей глубокого обучения. Нейросеть умеет озвучивать случайное место на земле на Google Map, а также озвучивать другие изображения.
Для того, чтобы сгенерировать новое лицо, нужно просто обновить страницу. Такой сервис полезен для дизайнеров, разработчиков и исследователей. Также это пример использования нейросетей для выполнения задач без необходимости нанимать моделей и фотографов. Этот проект демонстрирует возможности современных технологий машинного обучения и нейронных сетей в области компьютерного зрения.
Сайт, который с помощью нейросети генерирует реалистичное изображение лица человека, которого в реальности не существует. Там нет кнопок, разделов и тому подобного — по умолчанию, когда пользователь открывает сервис, он видит только сгенерированное человеческое лицо. Используются две нейросети: генератор, который создает изображения, и дискриминатор, который определяет, насколько они реалистичны.
Известность она получила в 2023 году, когда удачно воспользовалась хайпом вокруг фильма «Барби». Мао запустила сайт Bairbie.me с простым аттракционом на основе ИИ: пользователь загружает свое фото, выбирает цвет кожи и волос и получает свой портрет в образе куклы Барби или Кена. Бесплатное фото содержит водяной знак; чтобы получить изображение без него, нужно заплатить $1,99.
Интересное
Photify AI — нейросеть для создания аватара с помощью нейросети. Инструмент представлен в виде приложения для Android и телеграмм-бота. В вашем распоряжении множество стилей для создания аватарок и возможность настройки собственного стиля с помощью текстовых инструкций. Сервис выделяется высоким качеством полученных аватарок и простым интерфейсом.
BaiRBIE.me — это увлекательный проект, использующий нейросеть для превращения вас в любимую куклу всех девочек. Высококачественные снимки, на которых лицо направлено прямо в камеру без очков или других аксессуаров, наилучшим образом подходят для обработки. Вы можете представить себя в образе Барби или Кена, а также выбрать их цвет волос, цвет кожи и расу (опционально). После обработки вам будет отправлен результат на указанный адрес электронной почты.
Одновременно с выходом фильма «Барби» завирусилось веб-приложение Bairbie.me: его пользователи выкладывали в сеть свои фото в образе знаменитой куклы. Создательница приложения — выпускница Массачусетского технологического института Ширли Мао. Рассказываем о ней и о других создательницах проектов, где искусственный интеллект рисует популярные картинки
ImagetoCartoon — нейросеть для создания аватарок в стиле мультика из вашего фото. Инструмент поставляется в виде веб-сервиса, программы для Mac, мобильного приложения для iOS и Android. Также нейросеть создаст персонажа из фото в стиле полицейского, футболиста, атлета, доктора, супергероя, маркетолога и многих других.
Чтобы начать использовать VQGAN+CLIP, нужно уметь хотя бы немного программировать, но все же этот инструмент гораздо доступнее широкой аудитории, чем математические модели той же OpenAI. После публикации VQGAN+CLIP соцсети и форумы наводнили сгенерированные с его помощью изображения. А затем начали появляться программные оболочки для тех, кто программировать не умеет. Например, веб-приложение NightCafe, созданное изначально для переноса стиля (это когда вы даете нейросети запрос вроде «нарисуй героев сериала «Симпсоны» в стиле Ван Гога»), подключило VQGAN+CLIP, чтобы начать генерировать изображения по более сложным запросам.
Canva — не первый графический редактор, в котором используется ИИ. Но у него ниже порог входа, он ориентирован не на профессиональных дизайнеров, а на всех, кому приходится так или иначе работать с изображениями — создавать презентации, подбирать картинки для публикаций в соцсетях, верстать несложные сайты. По состоянию на 2023 год у Canva более 6 млн командных подписчиков и около 125 млн пользователей совокупно.