Конкуренция в сфере искусственного интеллекта в технологическом секторе перешла на новый этап. Результаты обновленной флагманской модели Gemini 3 Deep Think продемонстрировали значительный скачок в международных показателях, что привело к переоценке позиций на рынке.
Как сообщает редакция, модель набрала 84,6 балла в оценке ARC-AGI-2, что почти в 2 раза выше результата новой модели Opus 4.6. Отмечается, что в предыдущем тесте эта система показала всего 48,4%, и новый показатель оценивается как резкое увеличение производительности.
Кроме того, Gemini набрал 3455 баллов на платформе Codeforce, обойдя конкурентов. Согласно информации, другие участники не смогли приблизиться к этому результату, и модель продемонстрировала превосходство в задачах программирования.
Модель также показала результат, соответствующий золотой медали в задачах уровня Международной олимпиады по математике, одновременно продемонстрировав высокую производительность в области химии и физики. Разработчики заявляют, что эта модель переформирует классические научные и инженерные концепции и приведет к революционным изменениям в прикладных исследованиях.
