New-ZZZ
RU / EN

Июньские AI-обновления Google продвигают Gemini на устройства и в приложения

Р
Редакция New-ZZZ
Google AI Blog · 1 месяц назад

Июньский обзор AI от Google за 2026 год показывает масштабное стремление сделать AI не отдельным инструментом, а слоем, встроенным в повседневные устройства, приложения и рабочие процессы. Компания выстраивает объявления месяца вокруг более единой вычислительной среды, где AI может помогать на телефонах, ноутбуках, в браузерах, финансовых инструментах, продуктах для умного дома, сервисах перевода и платформах для разработчиков. Главная идея в том, что AI должен брать на себя рутинную координацию, интерпретацию и автоматизацию, чтобы люди могли больше времени уделять работе, обучению, общению или творческой деятельности, которые им действительно важны.

Крупное техническое обновление — Gemma 4 12B, новейшая открытая модель Google. Она рассчитана на локальный запуск на ноутбуке с 16 ГБ памяти, что важно, потому что локальный AI может обеспечивать более быстрые ответы и более приватные рабочие процессы без отправки каждой задачи на облачные серверы. Google говорит, что модель объединяет единую архитектуру с обработкой изображений и нативной обработкой голоса, то есть может работать с изображениями и речью как часть одной системы, а не воспринимать их как отдельные дополнения. Практический смысл в том, что более способные AI-агенты переходят на обычное потребительское железо, а не только на крупную облачную инфраструктуру.

Google также расширила возможности создания агентов через computer use в Gemini 3.5 Flash. Проще говоря, “computer use” означает, что AI-система может смотреть на программные среды, рассуждать о том, что видит, и выполнять действия в десктопных, мобильных и браузерных контекстах. Google позиционирует это как полезное для длительной автоматизации, корпоративных рабочих процессов, непрерывного тестирования ПО и интеллектуальной работы. Это говорит о том, что компания пытается сделать Gemini полезнее не только для ответов на вопросы, но и для работы внутри реальных интерфейсов, где задачи включают множество шагов во времени.

Для создателей контента и разработчиков Google выделила Nano Banana 2 Lite и Gemini Omni Flash. Nano Banana 2 Lite описывается как самая быстрая и экономичная модель Gemini Image на данный момент, нацеленная на то, чтобы сделать эксперименты с изображениями и их производство дешевле и быстрее. Gemini Omni Flash выходит в публичное превью через API и описывается как нативно мультимодальная модель для пользовательских видеопроцессов. “Мультимодальная” здесь означает, что модель создана для работы с разными типами входных или выходных данных, такими как текст, изображения, аудио или видео, более интегрированным образом. Вместе эти запуски показывают, как Google расширяет Gemini от помощи в формате чата к творческим производственным конвейерам для изображений и динамического видео.

На потребительской стороне Android 17 представлен как крупное обновление платформы, смежное с AI. В него входят плавающие окна приложений для более удобной многозадачности, Screen Reactions для записи в режиме «картинка в картинке», улучшения компоновки для игр на складных устройствах и обновления безопасности, например использование биометрии для блокировки пропавшего телефона. Эти функции сначала выходят на устройствах Pixel, а затем на других подходящих Android-устройствах в течение 2026 года. Июньский Pixel Drop добавляет больше функций на уровне устройства, включая реакции при записи экрана, создание видео и музыки на базе AI, плавающие пузырьки приложений, расширенный голосовой перевод в реальном времени, пользовательские приветствия голосовой почты и автоматические экстренные уведомления.

Google Finance также обновляется AI-функциями по мере выхода из беты. Новая версия должна помогать пользователям отслеживать портфели, следить за рыночной информацией и понимать движения инвестиций через Android-приложение. AI-инструмент для исследований и AI-функция “key moments” предназначены для объяснения, почему изменилась цена акции, что может сделать финансовую информацию проще для понимания пользователями, которые не являются профессиональными аналитиками. В объявлении не утверждается, что AI будет принимать инвестиционные решения за пользователей; вместо этого акцент сделан на кратком изложении рыночного контекста и помощи людям в более быстром понимании сигналов.

Одно из самых очевидных объявлений для повседневного использования — Gemini 3.5 Live Translate. Новая аудиомодель поддерживает живой перевод речи в речь, автоматически определяет более 70 языков, лучше сохраняет естественный тон говорящего и сокращает неловкие паузы. Google говорит, что это может поддерживать почти синхронные многоязычные разговоры в звонках, встречах и поездках. Функция выходит через Gemini Live API, Google AI Studio и приложение Google Translate, то есть она ориентирована как на конечных пользователей, так и на разработчиков, которые могут захотеть встроить перевод в собственные продукты.

В обзоре также представлен новый Google Home Speaker, созданный для Gemini. Google говорит, что колонка разработана так, чтобы разговоры с домашним ассистентом ощущались более естественными и меньше требовали жестких голосовых команд. Она может обрабатывать несколько запросов одновременно, отвечать на более сложные вопросы и лучше помнить контекст, чем старые ассистенты на основе команд. Это указывает на более широкий сдвиг в продуктах для умного дома: голосовые ассистенты переосмысляются вокруг разговорного AI, а не фиксированных меню команд.

В целом июньские объявления меньше похожи на один отдельный прорыв и больше на размещение AI Google сразу на множестве поверхностей. Открытые локальные модели, агентное управление компьютером, API для изображений и видео, функции Android, обновления Pixel, финансовые инструменты, живой перевод и умные колонки поддерживают одну и ту же стратегию: сделать AI доступным везде, где пользователи уже работают, общаются, создают или управляют повседневными задачами. Источник описывает это как результат долгосрочных инвестиций Google в машинное обучение и AI-инфраструктуру, с применениями от личной продуктивности до образования, здравоохранения, реагирования на кризисы и климатических исследований.

Почему это важно

  • Google переносит AI из отдельных чат-инструментов в телефоны, ноутбуки, умные колонки, финансовые приложения, сервисы перевода и API для разработчиков.
  • Локальные модели вроде Gemma 4 12B показывают, что более сложные AI-задачи могут выполняться на повседневном оборудовании с лучшей приватностью и меньшей задержкой.
  • Обновления показывают, как потребительские продукты, корпоративная автоматизация и креативные AI-инструменты сходятся вокруг мультимодальных систем Gemini.

Ключевые факты

  • Июньский обзор Google включает Gemma 4 12B, Gemini 3.5 Flash computer use, Nano Banana 2 Lite, Gemini Omni Flash, Android 17, обновления Pixel Drop, Google Finance, Live Translate и Google Home Speaker на базе Gemini.
  • Gemma 4 12B — открытая модель, рассчитанная на локальный запуск на ноутбуках с 16 ГБ памяти; она поддерживает обработку изображений и нативную обработку голоса.
  • Gemini 3.5 Live Translate распознает более 70 языков и поддерживает почти синхронный перевод речи в речь, сохраняя естественную интонацию.
  • Android 17 добавляет многозадачность, улучшения игровых раскладок для складных устройств и функции безопасности; сначала обновление выходит на устройства Pixel, а позже в 2026 году — на совместимые Android-устройства.
  • Новый Google Home Speaker создан для более естественных разговоров с Gemini, включая несколько запросов подряд и более сложные вопросы.
Читать первоисточник

Полный текст — в первоисточнике. Здесь — краткое изложение и ключевые факты.

/ похожие материалы