Google отстаивает показатели Gemini 4, несмотря на заявления некоторых о том, что в реальных условиях он «не справляется»

Вчера Google представила свою новую флагманскую модель Gemini 4, продемонстрировав впечатляющие результаты, однако, согласно одному из отчетов, в некоторых случаях она может «испытывать трудности».
Как сообщает Bloomberg, сотрудники Google обнаружили, что реальные результаты работы Gemini 4 не всегда соответствуют оценкам в тестах. Во время презентации Gemini 4 Argon Google показала, что новая модель превосходит конкурентов, включая GPT-6 Astra от OpenAI, по многим ключевым показателям.
В отчете приводятся слова сотрудников Google, которые отметили, что модель «работает хуже, когда сотрудники действительно начинают ее использовать», а также «испытывает трудности с решением некоторых задач программирования». Комментируя эти утверждения для Bloomberg, Google заявила, что «было бы неверно говорить, что Gemini 4 показывает результаты ниже ожидаемых в таких областях, как программирование». Компания также сослалась на комментарии главы Google DeepMind Корая Кавукчуоглу, сделанные в конце сентября: тогда он сказал, что «мы определенно всегда будем среди лидеров». В отчете цитируется один из сотрудников Google, заявивший, что среди коллег существует «широкое согласие» с тем, что Gemini 4 относится к числу передовых моделей. Другие же опасаются, что Gemini «по-прежнему будет отставать» от конкурирующих моделей Anthropic и OpenAI. Очевидно, что сотрудники расходятся во мнениях о возможностях модели.
Gemini 4 Argon получила ряд долгожданных улучшений, в том числе расширенный лимит вывода — до 1 млн токенов. Кроме того, Google отметила, что модель «обладает высокими возможностями в области киберзащиты» и демонстрирует «лидирующие результаты» в других сценариях использования. Gemini 4 Argon стоит «4 доллара за 1 млн входных токенов и 20 долларов за 1 млн выходных токенов», однако на старте ее цена будет вдвое ниже.


