Google представила Gemini 4 Argon із результатом 68% у CWE-bench
Google представила флагманську модель Gemini 4 Argon, яка показала 68% у тесті CWE-bench і розділила перше місце з GPT-6 Astra. Водночас працівники компанії повідомили Bloomberg, що в реальній роботі модель не завжди повторює результати бенчмарків.

Image: itc.ua · Author: \u0428\u0430\u0434\u0440\u0456\u043d \u0410\u043d\u0434\u0440\u0456\u0439 · source articleEditorial excerpt for news reporting
Google представила Gemini 4 Argon — нову флагманську модель із заявленими можливостями у програмуванні та кібербезпеці. За даними компанії, у тесті CWE-bench вона отримала 68% і розділила перше місце з GPT-6 Astra від OpenAI.
Argon може самостійно знаходити, перевіряти й виправляти критичні вразливості в програмному забезпеченні. Під час ранньої демонстрації модель виявила критичну проблему в медичному програмному забезпеченні, яким користуються лікарні по всьому світу; Google заявила, що вона потенційно могла відкрити доступ до конфіденційної інформації.
Водночас Bloomberg повідомив про розбіжність між тестами та роботою моделі всередині Google. Працівники компанії заявили, що в окремих робочих сценаріях Gemini 4 працює гірше й має труднощі з деякими програмувальними завданнями. Google заперечила, що модель демонструє слабкі результати в програмуванні.
Заявлені можливості та внутрішнє використання
Ліміт вихідних даних Argon збільшили до 1 мільйона токенів. Google використовує модель у дослідженнях квантових обчислень, міграції коду та оптимізації пам’яті в дата-центрах; аналіз телеметрії, за даними компанії, допоміг звільнити близько 300 ТіБ пам’яті.
Агенти Argon також допомагають переносити великі масиви коду C/C++ на Rust. Йдеться, зокрема, про бібліотеки re2 і libgav1 та ядро Fuchsia OS Zircon — понад 800 тисяч рядків коду.
Обмежений старт і ціна
Через кіберзахисні можливості Google спочатку відкриває Argon лише для учасників Fairwind Program — державних структур і перевірених партнерів, які працюють із кібербезпекою. Модель отримала посилений захист від непрямих prompt injection-атак і моніторинг ланцюжка міркувань та дій, який має зупиняти небезпечне виконання.
Заявлена ціна становить $4 за 1 млн вхідних і $20 за 1 млн вихідних токенів. На старті Google планує застосовувати вступну ціну, удвічі нижчу за стандартну.
Усередині компанії оцінки моделі різняться: частина працівників вважає Gemini 4 передовою, тоді як інші побоюються відставання від моделей Anthropic та OpenAI. Наприкінці вересня керівник Google DeepMind Корай Кавукчуоглу заявив, що компанія «завжди буде на передовій».
Що ми знаємо
- Gemini 4 Argon набрала 68% у CWE-bench і розділила перше місце з GPT-6 Astra.
- Модель може знаходити, перевіряти та виправляти критичні вразливості в програмному забезпеченні.
- Ліміт вихідних даних збільшили до 1 мільйона токенів.
- Перший доступ отримують учасники Fairwind Program, а стартова ціна буде вдвічі нижчою за $4 і $20 за мільйон токенів.
Що саме перевіряється
- Редакція перевіряє повідомлення про те, що gemini 4 Argon набрала 68% у CWE-bench і розділила перше місце з GPT-6 Astra.
- Для перевірки зіставляються матеріали ITC.ua; другого незалежного підтвердження поки немає.
Переглянути джерела1
COMMUNITY
Обговорення
Увійдіть, щоб долучитися до обговорення.
Коментарів ще немає. Почніть обговорення.