Технологии

Gemini 4 Argon: Google возвращается в гонку, но модель почти никому не доступна

Новая модель Google DeepMind пишет до 1 млн токенов и лидирует в тестах самой Google, но первыми её получат проверенные киберзащитники
Adrian Kessler
Добавьте нас в Google

Большую часть прошлого года история Google в области искусственного интеллекта сводилась к тому, чего компания так и не выпустила. Gemini 4 Argon — её ответ, и самое показательное в нём — не результат в бенчмарке, а список приглашённых. Новая передовая модель Google DeepMind сначала достаётся небольшой группе проверенных специалистов по киберзащите в рамках программы компании Fairwind Program — и больше никому.

Argon создана для долгосрочных задач: разработки программного обеспечения, юридических и финансовых исследований, киберзащиты. Ключевое механическое изменение — длина вывода: теперь модель может рассуждать и писать сотни тысяч токенов за один проход, чего достаточно, чтобы довести крупную миграцию кода до конца, а не собирать её из фрагментов.

По словам Google, тысячи её инженеров уже пользуются моделью. В анонсе компания описывает агентов Argon, которые высвободили более 300 TiB памяти в её дата-центрах и переносят код на C и C++ на безопасный по памяти язык Rust — вплоть до более чем 800 000 строк ядра Fuchsia Zircon. В libgav1, видеодекодере Google с открытым исходным кодом, Argon переписала 32 000 строк вручную оптимизированного SIMD-кода на безопасный Rust, который работает в 2,7 раза быстрее, чем предыдущий порт на Rust.

Bar chart comparing Gemini 4 Argon and Gemini 3.8 Flash Cyber on vulnerability discovery and the Wiz penetration test benchmark
Image: Google

Потолок вывода поднимается до 1 миллиона токенов с 64 000. Результаты бенчмарков — данные самой Google: 77,9% в DeepSWE v1.1, первое место в Vals Index, оценивающем интеллектуальную работу с учётом её экономического веса, и 91,7% в LVBench на понимание длинных видео. По подсчётам VentureBeat, Argon безоговорочно лидирует в 12 из 18 опубликованных бенчмарков, тогда как GPT-6 Astra от OpenAI по-прежнему опережает её более чем на десять пунктов в FrontierSWE v2. Пока сторонние тестировщики не смогут сами запустить модель, это заявления, а не вердикты.

Акцент на кибербезопасности объясняет закрытый доступ. Google обучила Argon самостоятельно находить, проверять и устранять уязвимости и предоставит доверенным защитникам версию со снятыми киберограничениями. В рамках инициативы Wiz Scan for Good модель обнаружила в больничном программном обеспечении критическую уязвимость, раскрывавшую персональные данные, которую пропустили прежние модели. Неудобный механизм в том, что модель, настолько хорошо закрывающая бреши, по определению так же хорошо их находит.

Поэтому настоящая история — это меры защиты. Google утверждает, что Argon отказывается помогать с кибератаками, а также с химическими, биологическими, радиологическими или ядерными атаками, что это самая устойчивая к prompt injection модель компании на сегодня и что она работает под контролем монитора, который отслеживает её цепочку рассуждений и останавливает выполнение, когда модель выходит за рамки намерений пользователя. Google также участвует в добровольной программе правительства США по предоставлению доступа к моделям до их выпуска.

Кто может пользоваться Gemini 4 Argon сегодня? Только участники Fairwind и собственные команды Google. Сроков для разработчиков, компаний и обычных пользователей нет; доступ начнётся с платных клиентов API и подписчиков Google AI Ultra. Вводная цена — $2 за миллион входных токенов и $10 за миллион выходных, затем она вырастет до $4 и $20 соответственно.

Модель представил 30 сентября Корай Кавукчуоглу, занявший высший пост в Google DeepMind после того, как Демис Хассабис в августе покинул должность генерального директора. Это первый новый флагман Google со времён Gemini 3, вышедшей в ноябре 2025 года, и её настоящая проверка — не рейтинг, а то, останется ли модель, выпущенная без защитных ограничений, в тех руках, для которых она предназначалась.

Теги: , , , , ,

Добавьте нас в Google

Обсуждение

Имеется 0 комментариев.