👉 ruDALL-E

ruDALL-E – перша нейромережа, яка може генерувати картинки за запитом російською мовою.

Нейромережа навчається одночасно на картинках і текстах і може створювати необмежену кількість нових зображень по заданому опису.

Модель ruDALL – E XL з 1,3 млрд параметрів лежить у відкритому доступі на GitHub. Є друга версія – ruDALL-E 12B з 12 млрд параметрів. Обидві найближчим часом будуть доступні на платформі ml Space в хабі переднавчених моделей і датасетов DataHub від Sbercoud.

ruDALL-E складається з трьох нейромереж, перша приймає текст і генерує задане число картинок, друга вибирає більш вдалі, третя — збільшує їх у розмірі без втрати якості.

Нейромережа DALL-E для генерації картинок за описами англійською мовою представила OpenAI в січні 2021 року. Команди SberDevices, Sber AI і SberCloud відтворили її код і запустили навчання моделі на платформі ML Space на базі суперкомп’ютера «Крістофарі».

Навчання зайняло 23 тисячі GPU-годин на масиві даних зі 120 млн зображень.

Для початку переходимо за посиланням – ruDALL-E (rudalle.ru/demo) і вводимо запит. Далі тиснемо відправити і чекаємо аж цілих 15-30 хвилин. Напевно, сервіс відправляє запит індусам, бо інакше не можу пояснити нащо потрібно стільки часу.

Додати коментар