Первые впечатления от Google Gemini 3.1 Pro: «Deep Think Mini» с настраиваемыми рассуждениями по требованию

В течение последних трех месяцев Gemini 3 Pro от Google удерживал позиции одной из самых мощных доступных моделей. Но в быстро меняющемся мире искусственного интеллекта три месяца — это целая жизнь, и конкуренты не стоят на месте.

Ранее сегодня Google выпустила Близнецы 3.1 Прообновление, которое привносит ключевое нововведение в модель мощности рабочей лошадки компании: три уровня регулируемого мышления, которые эффективно превращают ее в облегченную версию специализированной системы рассуждения Google Deep Think.

Этот релиз знаменует собой первый раз, когда Google выпустил «первое» обновление для модели Gemini, сигнализируя об изменении стратегии выпуска компании от периодических выпусков полных версий к более частым дополнительным обновлениям. Что еще более важно для корпоративных групп ИИ, оценивающих свой набор моделей, новая трехуровневая система мышления 3.1 Pro — низкий, средний и высокий — дает разработчикам и ИТ-руководителям единую модель, которая может динамически масштабировать свои усилия по рассуждению: от быстрых ответов на рутинные запросы до многоминутных сеансов глубокого рассуждения для сложных проблем.

В настоящее время модель доступна в предварительной версии через Gemini API через Google ИИ-студияGemini CLI, агентская платформа разработки Google Antigravity, Vertex AI, Gemini Enterprise, Android Studio, потребительское приложение Gemini и NotebookLM.

Эффект «Deep Think Mini»: регулируемые рассуждения по требованию

Наиболее значимой особенностью Gemini 3.1 Pro является не одно контрольное число, а введение трехуровневой системы уровней мышления, которая дает пользователям детальный контроль над тем, сколько вычислительных усилий модель вкладывает в каждый ответ.

Gemini 3 Pro предлагал всего два режима мышления: низкий и высокий. В новой версии 3.1 Pro добавлен средний уровень (аналогичный предыдущему высокому) и, что особенно важно, переработано понятие «высокий». При высоком значении 3.1 Pro ведет себя как «мини-версия Gemini Deep Think» — специализированной модели рассуждения компании, которая была обновлено только на прошлой неделе.

Read more:  От дела Морандини до сокрушительной отставки Сони Мабрук: три недели, которые повергли CNews в смятение

Последствия для корпоративного развертывания могут быть значительными. Вместо маршрутизации запросов к различным специализированным моделям в зависимости от сложности задачи (распространенная, но обременительная с операционной точки зрения схема) организации теперь могут использовать единую конечную точку модели и корректировать глубину рассуждений в зависимости от поставленной задачи. Рутинное обобщение документов может выполняться при низком мышлении и быстром реагировании, а сложные аналитические задачи могут быть повышены до высокого уровня мышления для рассуждений уровня глубокого мышления.

Тестовая производительность: более чем удвоение производительности по сравнению с 3 Pro

Опубликованные тесты Google рассказывают о значительном улучшении, особенно в областях, связанных с рассуждением и агентскими способностями.

Таблица тестов Google Gemini 3.1 Pro. Кредит: Google

На АРК-АГИ-2тест, оценивающий способность модели решать новые абстрактные модели мышления, оценка 3.1 Pro. 77,1% — более чем в два раза больше, чем у Gemini 3 Pro (31,1%), и существенно опережая Sonnet 4.6 (58,3%) и Opus 4.6 (68,8%) от Anthropic. Этот результат также превосходит GPT-5.2 OpenAI (52,9%).

Выгоды распространяются по всем направлениям. На Последний экзамен человечествастрогого академического теста, 3.1 Pro набрал 44,4% без инструментов по сравнению с 37,5% для 3 Pro и опередил Claude Sonnet 4.6 (33,2%) и Opus 4.6 (40,0%). На GPQA Бриллиантоценка научных знаний, 3.1 Pro достигла 94,3%, превзойдя всех перечисленных конкурентов.

Результаты становятся особенно актуальными для корпоративных групп ИИ в агентных тестах — оценках, которые измеряют, насколько хорошо модели работают при использовании инструментов и многоэтапных задач, вид работы, который все больше определяет промышленное развертывание ИИ.

На Терминал-Скамейка 2.0оценивающий агентное терминальное кодирование, 3.1 Pro набрал 68,5% по сравнению с 56,9% у его предшественника. На МКП Атласэталонном тесте, измеряющем многоэтапные рабочие процессы с использованием протокола контекста модели, 3.1 Pro достиг 69,2%, что на 15 пунктов лучше, чем у 3 Pro с 54,1%, и почти на 10 пунктов опережает Claude и GPT-5.2. И дальше ОбзорКомпкоторый тестирует возможности агентного веб-поиска, 3.1 Pro набрал 85,9%, превысив 59,2% у 3 Pro.

Read more:  Города подчиняются законам живых существ

Почему Google выбрал версию «0.1» и о чем это говорит

Решение о версии само по себе заслуживает внимания. Предыдущие выпуски Gemini следовали шаблону устаревших предварительных версий — например, несколько предварительных версий 2.5, прежде чем они стали общедоступными. Решение обозначить это обновление как 3.1, а не еще одну предварительную версию 3 Pro, предполагает, что Google считает улучшения достаточно существенными, чтобы гарантировать увеличение версии, в то время как формулировка «первая точка» предполагает, что это эволюция, а не революция.

В сообщении в блоге Google говорится, что версия 3.1 Pro основана непосредственно на уроках серии Gemini Deep Think, включая методы как из более ранних, так и из более поздних версий. Результаты тестов убедительно свидетельствуют о том, что обучение с подкреплением сыграло центральную роль в достижениях, особенно в таких задачах, как ARC-AGI-2, тесты кодирования и агентные оценки — именно в этих областях обучение на основе RL может обеспечить четкие сигналы вознаграждения.

Модель выпускается в предварительной версии, а не в виде общедоступной версии, при этом Google заявляет, что продолжит продвигаться вперед в таких областях, как агентские рабочие процессы, прежде чем перейти к полной общедоступной версии.

Конкурентные последствия для вашего корпоративного ИИ-стека

Для лиц, принимающих решения в сфере ИТ, оценивающих поставщиков передовых моделей, выпуск Gemini 3.1 Pro должен не только заставить их переосмыслить, какие модели выбирать, но и то, как адаптироваться к столь быстрому темпу изменений для их собственных продуктов и услуг.

Вопрос теперь в том, вызовет ли этот релиз реакцию конкурентов. Первоначальный запуск Gemini 3 Pro в ноябре прошлого года вызвал волну выпусков моделей как в проприетарных, так и в открытых экосистемах.

Read more:  Ужас: по меньшей мере два человека погибли в результате «фургона, врезавшегося в толпу» в популярном туристическом месте | Мир | Новости

Поскольку 3.1 Pro возвращает себе лидерство в нескольких критических категориях, на Anthropic, OpenAI и сообщество открытого веса оказывается давление, требующее отреагировать — и в нынешней среде ИИ эта реакция, вероятно, измеряется неделями, а не месяцами.

Доступность

Gemini 3.1 Pro доступен в предварительной версии через Близнецы API в Google AI Studio, Gemini CLI, Google Antigravity и Android Studio для разработчиков. Корпоративные клиенты могут получить к нему доступ через Вертексный ИИ и Близнецы Энтерпрайз. Потребители планов Google AI Pro и Ultra могут получить к нему доступ через приложение Gemini и NotebookLM.

2026-02-19 22:26:00


1771564890
#Первые #впечатления #от #Google #Gemini #Pro #Deep #Mini #настраиваемыми #рассуждениями #по #требованию

Ещё по этой теме

Leave a Comment

This site uses Akismet to reduce spam. Learn how your comment data is processed.