HiTechVision
Свежие новости ИИ: инвестиционные раунды, IPO AI-стартапов, финансовые отчеты Google, Microsoft и OpenAI.
  • Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов
Автор

admin

admin

    Генерация изображений

    Google выпустила Nano Banana 2 Lite и Gemini Omni Flash

    admin 18.07.2026


    30 июня Google открыла доступ к двум новым моделям генеративной графики и видео — Nano Banana 2 Lite и Gemini Omni Flash. Первая делает упор на скорость и низкую цену генерации картинок, вторая создаёт и редактирует видео обычными текстовыми командами. Обе доступны разработчикам через Google AI Studio, Gemini API и Gemini Enterprise Agent Platform.

    Содержание

    1. Картинка за 4 секунды и три цента
    2. Место Lite в линейке Nano Banana
    3. Видео и правки на словах
    4. Что Omni Flash пока не умеет
    5. Связка картинка → видео в один конвейер
    6. Зачем Google дешёвый этаж генмедиа

    Google делает ставку на нижний ценовой этаж генеративных медиа. Сразу две модели вышли в один день: лёгкая версия генератора картинок Nano Banana и видеомодель Gemini Omni Flash, которую раньше показывали только на конференции. Обе оптимизированы под одно — много, быстро, дёшево.

    Картинка за 4 секунды и три цента

    Nano Banana 2 Lite (системное имя gemini-3.1-flash-lite-image) — самая быстрая и дешёвая модель в семействе Nano Banana. Генерация изображения по тексту занимает 4 секунды, цена — $0,034 за картинку разрешением 1K. Google прямо называет её заменой первой версии Nano Banana (gemini-2.5-flash-image): код можно переключить уже сейчас и получить выше качество, выше скорость и ниже цену на том же месте.

    Несмотря на упор на скорость, Lite держит точность следования промпту, узнаваемость персонажей от кадра к кадру и читаемый текст внутри картинки — то, на чём обычно сыплются быстрые модели. Модель доступна разработчикам в AI Studio, через Gemini API и на корпоративной платформе агентов. Параллельно её включают в потребительские продукты: режим AI в Поиске, приложение Gemini, NotebookLM, Google Photos, Stitch, Google Flow и Google Ads.

    Место Lite в линейке Nano Banana

    Семейство теперь делится по задачам. Nano Banana 2 Lite — про скорость и объём, когда нужны тысячи картинок и минимальная задержка. Nano Banana 2 (Gemini 3.1 Flash Image) — универсальная рабочая лошадка, баланс качества и цены. Nano Banana Pro (Gemini 3 Pro Image) — для сложных профессиональных сцен, где важнее точность, чем скорость. Первая Nano Banana ушла в статус устаревшей, и Google советует с неё съезжать.

    Видео и правки на словах

    Вторая модель, Gemini Omni Flash (gemini-omni-flash-preview), впервые доступна разработчикам — через Gemini API и AI Studio, а также в приложении Gemini и в Google Flow. Её показывали ещё на Google I/O, теперь это открытый предварительный доступ. Omni Flash генерирует и редактирует видео из комбинации текста, картинок и видео на входе.

    Сильная сторона — правки разговором: видео можно дорабатывать обычными командами, без таймлайна и ручного монтажа. Модель опирается на общие знания Gemini (история, биология, логика повествования) и умеет привязывать текст и графику к действиям в кадре. Цена — $0,10 за секунду готового видео, столько же стоит Veo 3.1 Fast.

    Что Omni Flash пока не умеет

    Здесь нужно оговориться: это превью, и ограничений хватает. Длина ролика — пока 10 секунд, больше обещают позже. Загрузка аудио-референсов и продление сцены через API не поддерживаются. Видео-референсы до 3 секунд формально принимаются схемой API, но корректно моделью не обрабатываются. Сохранение персонажа при смене сцены и панорамировании работает с оговорками — в Google говорят, что дорабатывают.

    Набор честный, но он же показывает зрелость: Omni Flash годится для коротких эффектных вставок, а не для связных сцен с одним героем.

    Связка картинка → видео в один конвейер

    Главный смысл двойного релиза — не две отдельные модели, а конвейер. Nano Banana 2 Lite быстро генерирует изображение, оно уходит референсом в Omni Flash и оживает в видео. Через Interactions API такие многошаговые сессии сохраняют историю и контекст: пользователь может сложить до трёх последовательных правок подряд. Google уже выложила демо-приложения (Anywhere, Space Lift, Omni product studio), где обе модели работают в одном потоке.

    Зачем Google дешёвый этаж генмедиа

    Подача всего релиза — про стоимость и объём, а не про рекорды качества. $0,034 за картинку и $0,10 за секунду видео — заявка на сегмент, где генерят пачками: прототипы, товарные карточки, рекламные креативы, интерфейсные ассеты. Там, где раньше дорогая модель съедала бюджет, Google предлагает прижать расходы и держать скорость.

    Watermark SynthID встроен в обе модели — сгенерированный контент можно проверить через приложение Gemini, Gemini в Chrome и Поиск. Для рекламы и медиа это снимает часть вопросов о происхождении картинок.

    Проверочной точкой станет видео. Картиночная часть выглядит готовой к продакшену уже сейчас, а вот Omni Flash с её 10 секундами и нестабильным персонажем — пока инструмент для коротких эффектов. Дозреет ли она до связных сцен — увидим, когда снимут ограничения превью.



    Источник

    18.07.2026 0 комментариев
    0 VKOdnoklassnikiEmail
  • Новости

    Google выпустила DiffusionGemma: текст блоками и до 4x ускорение генерации

    admin 18.07.2026
    18.07.2026

    Google представила DiffusionGemma — экспериментальную открытую модель, которая собирает текст крупными блоками вместо привычной генерации по одному токену. За счёт …

    0 VKOdnoklassnikiEmail
  • Генерация изображений

    Промт для Nano Banana: Новогодний 3D-персонаж в стиле Pixar

    admin 18.07.2026
    18.07.2026

    Этот промт для Nano Banana позволяет создавать очаровательных новогодних персонажей в мультяшном 3D-стиле. Он идеален для генерации праздничных иллюстраций с …

    0 VKOdnoklassnikiEmail
  • Генерация изображений

    В Gemini появились цифровые аватары для Nano Banana

    admin 17.07.2026
    17.07.2026

    Google добавила в Gemini персональные аватары. Теперь можно один раз записать лицо и голос, после чего создавать изображения с собой …

    0 VKOdnoklassnikiEmail
  • Генерация изображений

    ByteDance выпустила Seedream 5.0 Pro для инфографики и точного редактирования изображений

    admin 17.07.2026
    17.07.2026

    ByteDance Seed 8 июля 2026 года представила Seedream 5.0 Pro — мультимодальную модель для генерации и редактирования изображений. Релиз делает …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Microsoft запускает бесплатный Bing Video Creator на базе Sora от OpenAI

    admin 17.07.2026
    17.07.2026

    Microsoft представила Bing Video Creator — бесплатный инструмент для создания коротких видеороликов по текстовым описаниям, использующий технологию Sora от OpenAI. …

    0 VKOdnoklassnikiEmail
  • Новости

    Агенты Claude заработали по расписанию и с ключами, скрытыми от модели

    admin 17.07.2026
    17.07.2026

    10 июня 2026 года на конференции Code with Claude Tokyo компания Anthropic объявила сразу о трёх обновлениях для работы с …

    0 VKOdnoklassnikiEmail
  • Генерация изображений

    Промт для нейросети: Кинематографичный экшн-портрет в динамике

    admin 17.07.2026
    17.07.2026

    Этот промт для [название нейросети] создаёт сочетание фотореалистичного портрета с абстрактной графикой, идеально подходящее для визуального сторителлинга в спортивном маркетинге …

    0 VKOdnoklassnikiEmail
  • Генерация текста

    OpenAI выпустила Codex Micro — контроллер для управления ИИ-агентами за $230

    admin 16.07.2026
    16.07.2026

    OpenAI представила Codex Micro — компактный программируемый контроллер для работы с агентами Codex. Компания разработала устройство вместе с производителем клавиатур …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Midjourney представляет первую видео-модель: доступность AI для всех

    admin 16.07.2026
    16.07.2026

    Midjourney теперь предлагает пользователям возможность создавать видео-контент с помощью искусственного интеллекта. Новая видео-модель, доступная за 10 долларов в месяц, делает …

    0 VKOdnoklassnikiEmail
Новые
Старые

Свежие записи

  • Google представила нативное приложение Gemini для macOS
  • Alibaba запретит своим сотрудникам использовать ИИ-инструмент Claude Code
  • Midjourney хочет доказать, что Disney и Universal сами обучают ИИ на чужом контенте
  • ИИ-помощник Roblox получил новые агентные инструменты для разработки и тестирования игр
  • 20 промтов для осенней ИИ-фотосессии в нейросетях

Свежие комментарии

Нет комментариев для просмотра.

Новые статьи

  • Google представила нативное приложение Gemini для macOS

    19.09.2026
  • Alibaba запретит своим сотрудникам использовать ИИ-инструмент Claude Code

    18.09.2026
  • Midjourney хочет доказать, что Disney и Universal сами обучают ИИ на чужом контенте

    18.09.2026
  • ИИ-помощник Roblox получил новые агентные инструменты для разработки и тестирования игр

    18.09.2026
  • 20 промтов для осенней ИИ-фотосессии в нейросетях

    18.09.2026
  • Microsoft сократила около 4 800 сотрудников на фоне масштабной реструктуризации Xbox

    17.09.2026

Рубрики

  • Генерация видео (108)
  • Генерация звука (23)
  • Генерация изображений (89)
  • Генерация текста (68)
  • Новости (75)
  • Обзор сервисов (51)

Google представила нативное приложение Gemini для macOS

19.09.2026

Alibaba запретит своим сотрудникам использовать ИИ-инструмент Claude Code

18.09.2026

Midjourney хочет доказать, что Disney и Universal сами...

18.09.2026

ИИ-помощник Roblox получил новые агентные инструменты для разработки...

18.09.2026

20 промтов для осенней ИИ-фотосессии в нейросетях

18.09.2026
  • Email
  • Vk
  • Rss
  • Yandex

@2026- hitechvision.ru


Наверх
HiTechVision
  • Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов