В связи с ростом затрат на ИИ сотрудники Google переходят на Gemini 3.8 Flash


По сообщениям, сотрудники Google начали тестирование предварительной версии Gemini 3.8 Flash на собственной платформе для программирования, что является еще одним подтверждением того, что ведущие компании в области искусственного интеллекта работают над инновационными и экономически эффективными моделями с поразительной скоростью.
Скорость имеет важное значение для компаний, наблюдающих за ростом стоимости ИИ. По данным Gartner, глобальные расходы на платформы и модели ИИ, по прогнозам, достигнут 64,25 миллиарда долларов в 2026 году, что представляет собой ежегодный рост на 63,4% по сравнению с 2025 годом, поскольку компании становятся все более избирательными в отношении эффективности своих расходов.
Как стало известно Business Insider из опубликованных изображений, модель «Gemini 3.8 Flash Preview» была размещена на внутренней платформе Google Jetski. Один из сотрудников сообщил, что она, по-видимому, лучше, чем версия 3.7 Flash, но предупредил, что это может быть неверная оценка. Google отказался от комментариев. Таким образом, номер версии и дата окончательного публичного релиза остаются неизвестными.
Практически ежемесячное обновление, ориентированное на бюджетный сегмент
Компания Google неустанно работала. Версия Gemini 3.6 Flash была представлена 21 июля, а версия 3.7 Flash стала доступна 13 августа, на все это ушло чуть более трех недель.
Это сделано намеренно. Во время телефонной конференции по итогам второго квартала генеральный директор AlphabetСундар Пичаи заявил, что Google рассчитывает выпускать модели «почти ежемесячно» в процессе работы над Gemini 4.
Flash также представляет собой область, где Google прилагает наибольшие усилия по ценообразованию. Google называет эту серию «рабочей лошадкой» для программирования и агентов — приложений, где многократное использование языковой модели приводит к значительным затратам на токены.
Запуск Gemini 3.7 Flash начался с начальной цены в 0,75 доллара за миллион входных токенов и 3,75 доллара за миллион выходных токенов до конца 2026 года. Это ровно половина от стартовой цены Gemini 3.6 Flash в 1,50 доллара за вход и 7,50 доллара за выход.
Гонка цен, потому что неизведанные территории недоступны
Подход Google очевиденdent том, что в портфеле публичных продуктов компании есть пробелы на самом высоком уровне. 19 мая компания объявила, что Gemini 3.5 Pro используется внутри компании и выйдет в июне. Однако к 21 июля модель все еще тестировалась с партнерами, и Google объявила, что она будет выпущена для широкой публики, как только будет готова.
На данный момент Google вынуждена агрессивно конкурировать по цене и скорости выпуска, в то время как разработка её флагманского продукта ещё не завершена.
Анализ с помощью искусственного интеллекта дает Gemini 3.7 Flash при высоких усилиях к рассуждению индекс интеллекта 56, по сравнению с 61 у GPT-5.6 Sol при максимальных усилиях и 62 у Claude Fable 5.

Тарифный план Luna от OpenAI остается значительно дешевле, чем предложение Flash от Google, составляя 0,20 доллара за миллион входных токенов и 1,20 доллара за миллион выходных токенов. В более широком смысле, сравнение показывает, насколько сильно разбросаны цены на ИИ — от центов до десятков долларов за миллион токенов в зависимости от возможностей.
Почему именно покупатели устанавливают условия?
Рыночная ситуация помогает объяснить подход Google. Gartner ожидает резкого роста расходов на модели и платформы ИИ в этом году, но аналитик Арунасри Чепарти отметила, что корпоративные бюджеты подвергаются «более тщательному анализу», с большим вниманием к эффективности, контролю затрат и измеримым результатам.
Данные Ramp о расходах показывают, как это давление может повлиять даже на самые эффективные модели. В первый месяц работы Claude Fable 5 получил всего 6% токенов, купленных компаниями у Anthropic, и 11,4% от всех расходов моделей Anthropic, несмотря на то, что был запущен на вершине рейтинга интеллекта в Artificial Analysis. Anthropic взимает 10 долларов за миллион входных токенов и 50 долларов за миллион выходных токенов за модель.
Экономист Ramp Ара Харазиан заявил, что наблюдаемая тенденция указывает на существование верхнего предела того, сколько предприятия готовы платить за базовые производственные мощности. Это благоприятствует моделям, которые являются дешевыми, быстрыми и достаточно качественными для выполнения задачи — именно ту часть рынка, которую пытается захватить Google.
Информация о публичном выпуске Gemini 3.8 Flash пока остается неопределенной. В настоящее время данные о его демонстрации поступают из заявлений Business Insider, а это значит, что Google еще не подтвердил этот факт официально, что крайне важно, учитывая часто меняющиеся названия моделей и даты выпуска на рынке.
