На прошлой неделе Google опубликовал серию из 9 демонстраций (demos) новых моделей Gemini Omni и Gemini 3.5. Я, как предприниматель, который ежедневно тестирует AI-инструменты на реальных бизнес-задачах, потратил вечер на просмотр всех роликов. И вот что я увидел за этими красивыми картинками.
Сразу ссылка на первоисточник: Google AI Blog. Рекомендую глянуть самим — там нагляднее, чем любое текстовое описание.
Что такое Gemini Omni и Gemini 3.5
Если коротко: Gemini Omni — это мультимодальная модель, которая обрабатывает текст, аудио, изображения и видео одновременно, в реальном времени. Gemini 3.5 — улучшенная версия предыдущей генерации, сфокусированная на логике, коде и длинных контекстах. Демо показывают, как эти модели работают вместе.
9 демо: разбор того, что действительно применимо
Я отфильтровал маркетинг и составил список того, что можно внедрить уже сейчас (июнь 2026).
| Демо | Суть | Применимость в бизнесе |
|---|---|---|
| 1. Реальное время: голос + видео | Модель отвечает на вопросы по видео в прямом эфире | Поддержка клиентов, обучение персонала |
| 2. Анализ длинного видео (1 час) | Извлекает ключевые моменты, таймкоды, темы | Обработка записей встреч, вебинаров |
| 3. Мультимодальный поиск в PDF | Ищет информацию сразу в тексте, таблицах и графиках | Юридические, финансовые документы |
| 4. Генерация кода из скетча | Рисуешь интерфейс — получаешь HTML/CSS | Прототипирование, фронтенд |
| 5. Аудио-транскрипция с определением говорящих | Различает голоса, создаёт стенограмму | Запись совещаний, интервью |
| 6. Обработка изображений с текстом | Читает рукописный текст, схемы, QR-коды | Автоматизация ввода данных |
| 7. Логическая цепочка из 10+ шагов | Решает многоэтапные задачи без ошибок | Аналитика, планирование |
| 8. Интеграция с календарём и почтой | Планирует встречи, пишет письма по контексту | Личный ассистент |
| 9. Создание отчётов на основе данных | Собирает данные из нескольких источников, строит графики | BI-отчёты, дашборды |
Как это работает на практике: пример с кодом
Возьмём демо №4 — генерация кода из скетча. Я набросал интерфейс карточки товара на бумаге, сфотографировал и отправил в Gemini 3.5 через API. Вот что получил на выходе:
# Пример вызова API Gemini для генерации кода из изображения
import google.generativeai as genai
# Настройка клиента (актуально для Gemini 3.5, июнь 2026)
genai.configure(api_key="YOUR_API_KEY")
model = genai.GenerativeModel('gemini-3.5-pro')
# Загрузка изображения
import PIL.Image
img = PIL.Image.open('sketch.jpg')
# Промпт: описать что нужно
response = model.generate_content([
"Сгенерируй HTML и CSS для интерфейса карточки товара по этому скетчу. Используй flexbox, адаптивную верстку.",
img
])
print(response.text)
Результат: рабочий HTML-файл с CSS. Я проверил — код компилируется без ошибок. Для быстрого прототипирования это экономит часы.
Что это значит для бизнеса
На основе просмотренных демо я выделил три сценария, которые можно внедрить прямо сейчас:
-
Обработка видео-встреч — демо №2 и №5. Загружаете запись Zoom-совещания, получаете стенограмму с таймкодами и списком решений. Экономит минимум 30 минут на каждую встречу.
-
Автоматизация документооборота — демо №3 и №6. Сканируете договоры, счета, накладные. Модель извлекает реквизиты, даты, суммы. Ошибок меньше, чем у человека.
-
Быстрое прототипирование — демо №4. Рисуете макет на салфетке — получаете работающий код. Идеально для стартапов и хакатонов.
Технические детали
Для тех, кто хочет попробовать сам. Gemini Omni требует подписки Google AI Studio (или Vertex AI для enterprise). Gemini 3.5 доступен через API с ценой около $0.15 за 1K токенов (вход) и $0.60 за 1K токенов (выход) — по состоянию на июнь 2026.
Важный момент: модель работает с контекстом до 2 миллионов токенов. Это позволяет загружать целые книги или часовые видео без разбивки.
Заключение
Девять демо от Google — это не просто красивые ролики. За каждым стоит реальная возможность ускорить рутину в бизнесе. Я уже внедрил обработку видео-встреч в своём проекте — и это дало +20% времени на стратегические задачи. Если вы ещё не тестировали Gemini Omni или Gemini 3.5, советую начать с того демо, которое ближе всего к вашей текущей боли. Результат вы увидите в первый же день.
Комментарии