- Компания xAI выпустила Grok 4.5, который был обучен на десятках тысяч графических процессоров (GPU) Nvidia GB300 и ориентирован на программирование, ИИ-агентов и интеллектуальные задачи.
- В тесте Terminal Bench 2.1 Grok 4.5 набрал 83,3%, что практически на одном уровне с GPT 5.5 (83,4%) и лишь немного ниже, чем у Fable 5 (84,3%).
- В тесте DeepSWE 1.1 Grok 4.5 показал результат 53%, уступив GPT 5.5 (67%) и Fable 5 (70%) в способности устранять реальные баги на GitHub.
- В тесте SWE Bench Pro Grok 4.5 достиг 64,7%, обойдя GLM 5.2 (62,1%), но уступив Opus 4.8 (69,2%) и Fable 5 (80,4%).
- В xAI сообщили, что модель обучалась с использованием строгого процесса фильтрации данных, удаления дубликатов и подбора специализированных данных по секторам для повышения качества.
- Этап обучения с подкреплением задействовал сотни тысяч задач, преимущественно в области программной инженерии, с автоматической системой оценки и асинхронной инфраструктурой обучения для агентов, работающих много часов.
- Стоимость Grok 4.5 составляет 2 доллара США за миллион входных токенов и 6 долларов США за миллион выходных токенов, что является самым низким показателем в группе высокопроизводительных моделей.
- Для сравнения, Opus 4.8 стоит 5 и 25 долларов США, GPT 5.5 вместе с GPT 5.6 стоят 5 и 30 долларов США, а цена Fable 5 доходит до 10 и 50 долларов США за миллион входных и выходных токенов соответственно.
- По заявлению xAI, Grok 4.5 расходует примерно в 4,2 раза меньше токенов, чем Opus 4.8 в тестах SWE Bench Pro, и развивает скорость около 80 токенов в секунду.
- Стратегия xAI аналогична китайским компаниям, таким как Zhipu и DeepSeek: сократить технологический разрыв в производительности, а затем конкурировать за счет низкой цены.
- Grok 4.5 уже доступен на платформах Grok Build, Cursor и xAI Console, а также поддерживает плагины для Word, PowerPoint и Excel.
- Модель пока не выпущена в Европейском союзе (релиз ожидается в середине июля) и разрабатывается параллельно с редактором Cursor после того, как SpaceX приобрела эту компанию в рамках сделки по обмену акциями стоимостью 60 миллиардов долларов США.
- 📌 Заключение: Grok 4.5 не лидирует во всех рейтингах бенчмарков, но создает колоссальное давление благодаря стратегии сверхнизких цен. Тарифы, составляющие всего около 20% от стоимости Fable 5 и значительно уступающие GPT 5.5, в сочетании с меньшим потреблением токенов позволяют резко сократить операционные расходы. Если реальная эффективность совпадет с заявленной, Grok 4.5 может стать привлекательным выбором для бизнеса, которому необходимо сбалансировать производительность и затраты, вместо слепой погони за моделью с наивысшим баллом в бенчмарках.
Grok 4.5 шокирует ценой, которая в несколько раз ниже, чем у GPT 5.5 и Fable 5; важна ли еще разница в баллах?
Related Posts
KONTAKT
Электронная почта: info@vietmetric.vn
Адрес: Дом 34, переулок 91, улица Чан Зуй Хынг, район Йен Хоа, город Ханой
© 2026 Vietmetric

