Компания Google анонсировала доступ к режиму Deep Think для своей модели Gemini 3, который предназначен для решения сложных математических, научных и логических задач. Этот режим использует метод параллельного рассуждения, что позволяет модели одновременно исследовать несколько гипотез и выбирать наиболее оптимальное решение. В тестах на бенчмарке ARC-AGI-2 Deep Think продемонстрировал результат 45.1%, в то время как GPT-5.1 набрал 17.6%, а «обычная» Gemini 3 Pro – 31.1%.
На других тестах результаты также впечатляют: в Humanity’s Last Exam, состоящем из 2500 вопросов по математике и гуманитарным наукам, Deep Think показал 41%, что значительно выше результата GPT-5.1 в 26.5%. В научном тесте GPQA Diamond он достиг 93.8%, в то время как у конкурента – 88.1%. Предшественник Deep Think, модель Gemini 2.5, стал победителем на Международной математической олимпиаде 2025 года.
Хотя Google не раскрывает детали архитектуры Deep Think, известно, что он использует несколько экземпляров Gemini 3 Pro для генерации решений, а затем арбитр выбирает лучший ответ, что объясняет более длительное время генерации и стоимость подписки в $250 в месяц. Мультиагентный подход становится все более популярным в разработке ИИ, и другие компании, такие как OpenAI и xAI, также внедряют аналогичные системы, требующие значительных вычислительных ресурсов.
