Хотя официального релиза Gemini 3.0 Pro ещё не было, на сайте Google уже появилась страница модели с её ключевыми характеристиками и результатами тестов. Новая версия получила контекстное окно до 1 млн токенов и может генерировать ответы объёмом до 64 тыс. токенов. В большинстве сравнительных тестов она показывает заметное превосходство как над предыдущей Gemini 2.5 Pro, так и над основными конкурентами.
Рассмотрим ключевые показатели. В ARC-AGI-2 — тесте на абстрактное мышление, оценивающем умение выводить правила решения задач на основе примеров — модель показывает 31,1%. Это почти вдвое выше свежего результата GPT-5.1 Thinking (17,6%). Тем не менее до среднего человеческого уровня в 66% модели пока далеко.
В MathArena Apex, который проверяет способности в особенно сложной математике, Gemini 3.0 Pro набирает 23,4%, тогда как другие модели не могут преодолеть порог в 1,6%. В ScreenSpot-Pro она достигает 72,7% — это многократно выше результатов конкурентов. Этот тест оценивает понимание интерфейсов и может быть важен для развития агентных возможностей. В Humanity’s Last Exam, проверяющем знания в рамках сложных академических дисциплин, модель показывает 37,5%, обойдя прежнего лидера GPT-5.1 Thinking (26,5%). В остальных тестах она тоже, как правило, занимает первое место, хоть и с меньшим отрывом.
Ожидается, что Gemini 3.0 Pro станет доступна уже в ближайшие часы. Модель сразу появится в Gemini App, Vertex AI, Google AI Studio и через Google API. Теперь остаётся дождаться дополнительных тестов и примеров работы модели на практических задачах.
Рассмотрим ключевые показатели. В ARC-AGI-2 — тесте на абстрактное мышление, оценивающем умение выводить правила решения задач на основе примеров — модель показывает 31,1%. Это почти вдвое выше свежего результата GPT-5.1 Thinking (17,6%). Тем не менее до среднего человеческого уровня в 66% модели пока далеко.
В MathArena Apex, который проверяет способности в особенно сложной математике, Gemini 3.0 Pro набирает 23,4%, тогда как другие модели не могут преодолеть порог в 1,6%. В ScreenSpot-Pro она достигает 72,7% — это многократно выше результатов конкурентов. Этот тест оценивает понимание интерфейсов и может быть важен для развития агентных возможностей. В Humanity’s Last Exam, проверяющем знания в рамках сложных академических дисциплин, модель показывает 37,5%, обойдя прежнего лидера GPT-5.1 Thinking (26,5%). В остальных тестах она тоже, как правило, занимает первое место, хоть и с меньшим отрывом.
Ожидается, что Gemini 3.0 Pro станет доступна уже в ближайшие часы. Модель сразу появится в Gemini App, Vertex AI, Google AI Studio и через Google API. Теперь остаётся дождаться дополнительных тестов и примеров работы модели на практических задачах.