Подписаться
Мобильные технологии

Google запускает собственное редактирование изображений

239

После тестирования разработчиками в прошлом месяце Google начинает внедрять встроенную функцию редактирования изображений на основе искусственного интеллекта в приложение Gemini.

Это позволяет вам редактировать изображения, которые вы загружаете вручную, а также те, которые генерирует приложение Gemini, с текстовыми подсказками на естественном языке. Вы можете продолжать просить Google вносить изменения, пока не будете удовлетворены, с сохранением контекста на протяжении всего процесса. Это включает в себя изменение фона, замену объектов и добавление элементов.

Вы также должны иметь возможность менять стили. В примере ниже вы видите, как к собаке добавляется шляпа, а затем фон травы меняется на пляж. Еще один пример — как «вы можете загрузить личную фотографию и попросить Gemini сгенерировать изображение того, как бы вы выглядели с разными цветами волос».

Как только базовая возможность будет активирована (появится встроенная подсказка), вы сможете использовать любую из текущих моделей для начала редактирования изображений.

Еще одним преимуществом того, что Google называет «интуитивным, многошаговым редактированием», являются «более содержательные, более контекстные ответы на ваши подсказки с интегрированным текстом и изображениями». Одним из примеров является запрос пошаговых инструкций, включающих изображения.

Например, вы можете попросить Близнецов написать черновик сказки на ночь о драконах и предоставить иллюстрации, которые будут сопровождать эту историю.

Что касается безопасности, «изображения, созданные или отредактированные с помощью собственной генерации изображений, будут содержать невидимый цифровой водяной знак SynthID». Google также «экспериментирует с добавлением видимого водяного знака на все изображения, созданные Gemini». В приведенном выше примере это «ai» в контейнере в форме таблетки в правом нижнем углу.

В прошлом месяце в AI Studio компания Google рекламировала, как Flash 2.0 превосходно справляется с визуализацией изображений с текстом независимо от длины и как он «использует мировые знания и расширенные возможности логического мышления для создания правильного изображения».

Нативная функция редактирования изображений постепенно внедряется в приложение Gemini, начиная с сегодняшнего дня. Она «будет расширяться для большего числа людей на более чем 45 языках и в большинстве стран в ближайшие недели».

Источник