Google анонсировала ИИ-модель Gemini 4 Argon, которая должна составить конкуренцию GPT-6 Astra и Claude Fable 5.1.
Gemini 4 создавалась с упором на рассуждения, написание кода и работу в качестве ИИ-агента. Она уже используется внутри Google для работы с продуктами.
В бенчмарке DeepSWE v1.1 (оценивает выполнение сложных программных задач в реальных кодовых базах) модель установила новый рекорд с показателем 77,9%. Кроме того, Gemini 4 лидирует в тестах Vals Finance Agent v2 (оценивает качество многоэтапных финансовых исследований) и Harvey Legal Agent Benchmark (самый сложный бенчмарк для оценки юридических знаний).

Объём выходных токенов увеличился с 64 тысяч до 1 млн.
Gemini 4 Argon отлично справляется с поиском уязвимостей. Например, модель обнаружила критическую уязвимость, раскрывавшую конфиденциальную персональную информацию в медицинском ПО, используемом больницами по всему миру.
Во внутреннем тесте Google модель обнаружила широкий спектр проблем в сложных кодовых базах, охватывающих 20 языков программирования.
Пока что Gemini 4 Argon доступна группе доверенных специалистов по кибербезопасности. Публичный релиз должен состояться скоро, но конкретные сроки компания не называет. Сначала модель будет доступна пользователям с подпиской AI Ultra и разработчикам по API.
Сюда так и просится мощный комментарий