547

Google показала Gemini 4 Argon, но доступ пока закрыт

По тестам Google, новая модель сильна в бизнес-задачах и киберзащите, но выигрывает далеко не везде.

Google представила Gemini 4 Argon — новую флагманскую модель для сложных многошаговых задач. Пока её получили только отобранные специалисты по кибербезопасности: массового доступа и даты запуска нет.

Gemini 4 Argon анонсировали 30 сентября как первую флагманскую модель поколения Gemini 4. Google делает акцент не на обычном чат-боте, а на продолжительной автономной работе: программировании, финансовом и юридическом анализе, обработке больших массивов документов и киберзащите.

Сейчас Argon получают участники программы Fairwind — проверенные специалисты и организации, работающие с кибербезопасностью. Компания также передаёт модель в добровольную американскую программу предварительной оценки. Для разработчиков, бизнеса и обычных пользователей релиз обещан позже; конкретной даты нет. Первыми из широкой аудитории доступ должны получить платные API-клиенты и подписчики Google AI Ultra.

Одна из заметных технических особенностей — возможность генерировать до миллиона токенов за один длинный проход против 64 тысяч у предыдущих моделей. Это не означает, что система «помнит миллион страниц», но позволяет дольше вести сложную задачу без дробления результата на множество отдельных ответов.

Таблица с результатами, которую Google опубликовала вместе с анонсом, выглядит впечатляюще. На Vals Index для интеллектуальной работы Argon получил 68,9%, на AutomationBench — 51,3%, на DeepSWE v1.1 для реальной разработки ПО — 77,9%, а на LVBench для понимания длинного видео — 91,7%.

Но универсального лидерства нет. В FrontierSWE v2 Argon уступил GPT-6 Astra — 55% против 65,5%. В Terminal-bench 4.0 лучший результат у Claude Opus 5.5 — 66,4% против 57,4% у Argon. В научных задачах через терминал и тесте OSWorld-2.0 модель Google тоже не первая. В опубликованной таблице Argon лидирует в 13 из 19 сравнений, в одном делит первое место и уступает в пяти.

Есть важное ограничение: эти цифры пока нельзя полноценно перепроверить на общедоступной версии продукта — её просто нет. Часть результатов получена Google, часть — внешними организациями и разработчиками тестов. Поэтому речь идёт о сильных стартовых показателях, а не о независимо подтверждённом превосходстве над всеми конкурентами.

Наиболее чувствительная область — кибербезопасность. Google утверждает, что Argon способен самостоятельно находить, проверять и исправлять критические уязвимости. В CWE-bench v1 модель получила 68%, разделив первое место с GPT-6 Astra. Компания Wiz уже использует Argon в программе Scan for Good. По данным Google, модель обнаружила критическую брешь в медицинском ПО, которую пропустили предыдущие системы.

Именно эта способность объясняет осторожный запуск. Доверенным специалистам Google предоставляет версию без части киберзащитных ограничений, чтобы они могли использовать полный набор возможностей для обороны. Для более широкой аудитории компания усиливает фильтры вредоносных запросов, защиту от prompt injection и мониторинг действий модели.

Внутри Google Argon уже применяют для отладки, оптимизации памяти дата-центров и перевода крупных кодовых баз с C/C++ на Rust. Компания сообщает, что один из проектов помог высвободить более 300 TiB памяти. Это внутренний результат Google, а не независимый производственный тест.

Главная особенность Argon пока не рекорд в отдельном тесте, а сам порядок выпуска. Google сначала отдаёт наиболее чувствительные возможности специалистам по защите и только затем готовит массовый доступ. Чем самостоятельнее становится модель, тем важнее уже не только её интеллект, но и границы доступа к нему.

Фото: редакция ИЗНАНКИ.