Компания xAI выпустила свою самую мощную языковую модель Grok 4.7, которая в первых же независимых тестах безнадежно отстала от флагманов рынка. Об этом сообщает «Хайтек» со ссылкой на The Decoder.
Американская компания xAI Илона Маска представила новую нейросеть Grok 4.7 для программирования и сложной работы с информацией. Разработчики обучили эту языковую модель на увеличенном базовом массиве данных и применили продленный цикл обучения с подкреплением. Создатели установили на продукт агрессивно низкие цены — два доллара за миллион входных токенов и шесть долларов за миллион выходных. Эксперты сразу связали такой ценовой демпинг со слабыми техническими результатами новинки.
Аналитики независимой платформы Artificial Analysis включили модель Grok 4.7 в свой сводный индекс Intelligence Index v4.3.2. По результатам десяти комплексных тестов американская нейросеть набрала всего 46 баллов и заняла место в середине рейтинга. Главные конкуренты Илона Маска в лице моделей Claude Fable 5.1 от Anthropic и GPT-6 от OpenAI уверенно возглавили список, набрав по 53 балла каждая.
Максимальный провал новинки зафиксировал специализированный тест Terminal-Bench 4.0, который оценивает навыки автономного написания кода. В этом испытании Grok 4.7 показал эффективность всего в 26%. Лидер индустрии GPT-6 Astra от OpenAI продемонстрировал в этом же тесте 60%, а Claude Fable 5.1 набрал 52%. Нейросеть от xAI сумела обойти даже китайская модель DeepSeek V4.1 Flash с результатом 27%.
Обложка: magnific