ИИ

Забудьте о номерах версий — новый ИИ от Google ставит эффективность превыше всего

Google запускает Gemini 3.6 Flash и 3.5 Flash Lite, отдавая приоритет эффективности и скорости, откладывая флагман 3.5 Pro и анонсируя Gemini 4.
Забудьте о номерах версий — новый ИИ от Google ставит эффективность превыше всего

Пока технологический мир обычно ждет следующего гигантского скачка в развитии интеллекта, последний шаг Google говорит о том, что индустрия сейчас находится в цикле доработки. Недавно компания анонсировала Gemini 3.6 Flash и специализированную модель для кибербезопасности, одновременно признав, что ее широко разрекламированная модель 3.5 Pro все еще застряла в лаборатории. Эта закономерность выявляет сдвиг в гонке вооружений ИИ. В течение нескольких месяцев повествование было сосредоточено на том, какая машина может мыслить больше всего как человек. Теперь приоритет отдается тому, какая машина может мыслить больше всего как дешевый и неутомимый стажер.

Решение Google прекратить поддержку Gemini 3.5 Flash всего через несколько месяцев после ее дебюта является необычным. Обычно версии программного обеспечения живут не менее года, прежде чем их заменят. Однако 3.5 Flash не оправдала ожиданий, заявленных Google на конференции I/O в мае, особенно в области программирования. Внезапный переход к Gemini 3.6 Flash — это корректирующая мера. Она отвечает реальности: разработчикам нужны инструменты, которые надежно работают сегодня, а не обещания того, что может заработать в следующем году.

Невидимая математика облака

Чтобы понять, почему изменение версии на 0.1 имеет значение, посмотрите на стоимость эксплуатации этих систем. Модели ИИ обрабатывают информацию частями, называемыми токенами. Каждый раз, когда вы просите чат-бота написать электронное письмо или разработчик просит его исправить ошибку, он потребляет эти токены. Для крупной корпорации эти расходы складываются в миллионы долларов в месяц. Именно здесь брендинг «Flash» оправдывает свое название.

Gemini 3.6 Flash примерно на 17 процентов эффективнее своей предшественницы. На практике это означает, что она использует меньше вычислительных ресурсов для выдачи того же ответа. Для обычного пользователя это выражается в ускорении времени отклика в приложении Gemini. Для бизнеса это означает меньший счет. Цена за выходные токены упала с 9 до 7,50 долларов за миллион. Хотя это звучит как небольшое изменение, это значительное улучшение маржи для компаний, которые запускают тысячи автоматизированных задач каждый час.

Взглянув на общую картину, можно увидеть, что такая эффективность позволяет реализовать то, что инженеры называют агентными рабочими процессами (agentic workflows). Это системы, в которых ИИ не просто отвечает на вопрос, а выполняет ряд шагов для завершения работы, например, бронирует авиабилет или организует электронную таблицу. Каждый шаг стоит денег. Снижая количество токенов на один шаг, Google делает этих автоматизированных помощников более жизнеспособными для массового рынка.

Успехи в программировании и использовании компьютера

Google утверждает, что Gemini 3.6 Flash лучше справляется с кодом. Компания использует бенчмарк под названием DeepSWE для измерения того, насколько хорошо ИИ может решать реальные проблемы программного обеспечения. Предыдущая модель набрала 37 процентов, в то время как новая версия 3.6 достигла 49 процентов. Это заметный скачок для минорного обновления версии. Это говорит о том, что Google тонко настраивает то, как модель понимает логику и синтаксис, не обязательно делая саму модель больше или медленнее.

Еще одним дополнением является стандартное включение функций «использования компьютера» (computer use) в API. Это позволяет ИИ взаимодействовать с интерфейсом компьютера почти так же, как это делал бы человек, перемещая курсоры и нажимая кнопки для навигации по приложениям. Тест OSWorld, который измеряет эту способность, показал рост с 78,4 процента до 83 процентов. Хотя это еще не идеальная замена оператору-человеку, это признак того, что ИИ все лучше ориентируется в запутанном, неоптимизированном программном обеспечении, которое мы используем каждый день.

Почему результаты поиска могут казаться другими

Наряду с выпуском 3.6, Google представила Gemini 3.5 Flash Lite. Это самая маленькая и быстрая модель в их текущей линейке. Она обрабатывает 350 токенов в секунду, что является почти мгновенным для большинства текстовых задач. Google уже интегрирует эту модель в AI Overviews (обзоры ИИ) внутри Google Search.

Для обычного человека это самое ощутимое изменение. Когда вы ищете «как починить протекающий кран» и видите в верхней части страницы резюме, сгенерированное ИИ, скорость является самым важным фактором. Если резюме загружается пять секунд, вы, скорее всего, прокрутите его мимо. Используя модель Flash Lite, Google гарантирует, что эти сводки появляются почти так же быстро, как традиционные синие ссылки. Эта модель примерно эквивалентна по мощности топовым моделям ИИ годичной давности, но она достаточно дешева, чтобы обслуживать миллиарды людей одновременно.

Хранилище кибербезопасности

Одним из более специализированных релизов является Gemini 3.5 Flash Cyber. Эта модель настроена специально для поиска уязвимостей в программном коде и предложения исправлений. Согласно внутренним тестам, она работает почти так же хорошо, как гораздо более крупные модели, такие как Claude Mythos, но сохраняет скорость меньшей системы. Однако вы не можете скачать ее или использовать в стандартном приложении Gemini.

Google рассматривает эту модель как технологию «двойного назначения». В чужих руках ИИ, который отлично находит дыры в безопасности, является мощным инструментом для хакеров. Из-за этого риска Google держит модель за закрытой дверью. В настоящее время она доступна только доверенным партнерам и правительствам через инструмент под названием CodeMender. Этот осторожный подход отражает растущую тенденцию в индустрии, когда наиболее мощные специализированные инструменты ограничиваются для предотвращения широкомасштабных цифровых сбоев.

Отсутствующий флагман и дорога к Gemini 4

Самым заметным упущением в этом анонсе является Gemini 3.5 Pro. Google изначально обещала, что эта модель появится в июне, чтобы конкурировать с такими тяжеловесами, как GPT 5.6 и Claude Fable. Этот срок прошел без релиза. Теперь компания заявляет, что 3.5 Pro находится на стадии тестирования с избранными партнерами и появится, «когда будет готова». Отчеты из индустрии предполагают, что задержка вызвана неспособностью модели превзойти конкурентов в сложных задачах программирования.

Даже пока Google изо всех сил пытается завершить поколение 3.5, она уже начала предварительное обучение Gemini 4. Предварительное обучение — самая дорогая и трудоемкая часть создания ИИ. Оно включает в себя подачу в систему триллионов точек данных со всего интернета для формирования ее фундаментальных знаний. Анонсируя Gemini 4 сейчас, Google сигнализирует инвесторам, что она не отстает, даже если ее текущий график релизов несколько запутан.

Сравнение новой линейки Gemini

Модель Основной сценарий использования Ключевой показатель Цена API (Вход/Выход за 1 млн)
Gemini 3.6 Flash Общие задачи, код, приложения на 17% эффективнее, чем 3.5 $1.50 / $7.50
Gemini 3.5 Flash Lite Поиск, простой чат, скорость 350 токенов в секунду $0.30 / $2.50
Gemini 3.5 Flash Cyber Аудит безопасности Ограниченный пилотный выпуск Не публично
Gemini 3.1 Flash Lite Устаревшие высокоскоростные задачи Старая архитектура $0.25 / $1.50

Что это значит для вас

С точки зрения потребителя, эти обновления означают, что ИИ становится невидимой частью инфраструктуры, а не яркой новой игрушкой. Вы будете чаще видеть сводки ИИ в результатах поиска, потому что теперь их предоставление обходится Google дешевле и быстрее. Если вы разработчик, ваши расходы только что снизились, а ваши автоматизированные инструменты должны совершать меньше ошибок при написании кода.

В конечном счете, задержка модели «Pro» и спешка с выпуском версии «3.6» говорят о том, что эра массовых мгновенных прорывов замедлилась. Мы вступили в эру оптимизации. Технологические компании больше не пытаются просто создать самый умный мозг в мире. Они пытаются создать самый эффективный. Как пользователь, вы должны меньше обращать внимания на номера версий и больше на то, как эти инструменты интегрируются в ваш ежедневный рабочий процесс. Самый революционный ИИ — это не тот, который проходит тест Тьюринга, а тот, который достаточно быстр и дешев, чтобы использовать его для каждого поиска и электронного письма.

Источники: Google DeepMind Technical Blog, OSWorld Benchmark Reports, DeepSWE Coding Performance Data.

bg
bg
bg

До встречи на другой стороне.

Наше решение для электронной почты и облачного хранения данных со сквозным шифрованием обеспечивает наиболее мощные средства безопасного обмена данными, гарантируя их сохранность и конфиденциальность.

/ Создать бесплатный аккаунт