До стрічки
Штучний інтелектРОЗВИВАЄТЬСЯ

Google представила Gemini 4 Argon із результатом 68% у CWE-bench

Google представила флагманську модель Gemini 4 Argon, яка показала 68% у тесті CWE-bench і розділила перше місце з GPT-6 Astra. Водночас працівники компанії повідомили Bloomberg, що в реальній роботі модель не завжди повторює результати бенчмарків.

Додати в Google
Розмір тексту

Image: itc.ua · Author: \u0428\u0430\u0434\u0440\u0456\u043d \u0410\u043d\u0434\u0440\u0456\u0439 · source articleEditorial excerpt for news reporting

Google представила Gemini 4 Argon — нову флагманську модель із заявленими можливостями у програмуванні та кібербезпеці. За даними компанії, у тесті CWE-bench вона отримала 68% і розділила перше місце з GPT-6 Astra від OpenAI.

Argon може самостійно знаходити, перевіряти й виправляти критичні вразливості в програмному забезпеченні. Під час ранньої демонстрації модель виявила критичну проблему в медичному програмному забезпеченні, яким користуються лікарні по всьому світу; Google заявила, що вона потенційно могла відкрити доступ до конфіденційної інформації.

Водночас Bloomberg повідомив про розбіжність між тестами та роботою моделі всередині Google. Працівники компанії заявили, що в окремих робочих сценаріях Gemini 4 працює гірше й має труднощі з деякими програмувальними завданнями. Google заперечила, що модель демонструє слабкі результати в програмуванні.

Заявлені можливості та внутрішнє використання

Ліміт вихідних даних Argon збільшили до 1 мільйона токенів. Google використовує модель у дослідженнях квантових обчислень, міграції коду та оптимізації пам’яті в дата-центрах; аналіз телеметрії, за даними компанії, допоміг звільнити близько 300 ТіБ пам’яті.

Агенти Argon також допомагають переносити великі масиви коду C/C++ на Rust. Йдеться, зокрема, про бібліотеки re2 і libgav1 та ядро Fuchsia OS Zircon — понад 800 тисяч рядків коду.

Обмежений старт і ціна

Через кіберзахисні можливості Google спочатку відкриває Argon лише для учасників Fairwind Program — державних структур і перевірених партнерів, які працюють із кібербезпекою. Модель отримала посилений захист від непрямих prompt injection-атак і моніторинг ланцюжка міркувань та дій, який має зупиняти небезпечне виконання.

Заявлена ціна становить $4 за 1 млн вхідних і $20 за 1 млн вихідних токенів. На старті Google планує застосовувати вступну ціну, удвічі нижчу за стандартну.

Усередині компанії оцінки моделі різняться: частина працівників вважає Gemini 4 передовою, тоді як інші побоюються відставання від моделей Anthropic та OpenAI. Наприкінці вересня керівник Google DeepMind Корай Кавукчуоглу заявив, що компанія «завжди буде на передовій».

Що ми знаємо

  • Gemini 4 Argon набрала 68% у CWE-bench і розділила перше місце з GPT-6 Astra.
  • Модель може знаходити, перевіряти та виправляти критичні вразливості в програмному забезпеченні.
  • Ліміт вихідних даних збільшили до 1 мільйона токенів.
  • Перший доступ отримують учасники Fairwind Program, а стартова ціна буде вдвічі нижчою за $4 і $20 за мільйон токенів.

Що саме перевіряється

  • Редакція перевіряє повідомлення про те, що gemini 4 Argon набрала 68% у CWE-bench і розділила перше місце з GPT-6 Astra.
  • Для перевірки зіставляються матеріали ITC.ua; другого незалежного підтвердження поки немає.
Якщо з’явиться нове незалежне підтвердження або спростування, воно автоматично буде додане до ланцюжка подій.
Переглянути джерела1

COMMUNITY

Обговорення

0

Коментарів ще немає. Почніть обговорення.