Компания Google объявила о запуске режима Deep Think, который предназначен для модели Gemini 3 и ориентирован на решение сложных математических, научных и логических задач. Этот режим применяет параллельное рассуждение, позволяя модели одновременно работать с несколькими гипотезами и выбирать наиболее оптимальное решение. На тестировании ARC-AGI-2, которое оценивает способности в решении незнакомых абстрактных задач, Deep Think продемонстрировал результат 45.1%, тогда как GPT-5.1 показал 17.6%, а «обычная» версия Gemini 3 Pro — 31.1%.
Аналогичные результаты наблюдаются и в других тестах. В Humanity’s Last Exam, где проверяется академическое мышление на 2500 вопросов, Deep Think достиг 41% без использования вспомогательных инструментов, в то время как GPT-5.1 — лишь 26.5%. В научном тесте GPQA Diamond результат Deep Think составил 93.8%, в то время как его конкурент набрал 88.1%. Модель Gemini 2.5 Deep Think уже завоевала золото на Международной математической олимпиаде (IMO 2025).
Хотя Google не раскрывает детали архитектуры Deep Think, известно, что в его основе работают несколько экземпляров Gemini 3 Pro, каждый из которых генерирует своё решение, а затем специальная модель выбирает лучший ответ. Этот многоагентный подход требует значительных вычислительных ресурсов, что и объясняет стоимость подписки на Google AI Ultra в $250 в месяц. Подобные системы становятся трендом среди ведущих разработчиков ИИ, включая OpenAI и xAI.