• Компания xAI выпустила Grok 4.5, который был обучен на десятках тысяч графических процессоров (GPU) Nvidia GB300 и ориентирован на программирование, ИИ-агентов и интеллектуальные задачи.
  • В тесте Terminal Bench 2.1 Grok 4.5 набрал 83,3%, что практически на одном уровне с GPT 5.5 (83,4%) и лишь немного ниже, чем у Fable 5 (84,3%).
  • В тесте DeepSWE 1.1 Grok 4.5 показал результат 53%, уступив GPT 5.5 (67%) и Fable 5 (70%) в способности устранять реальные баги на GitHub.
  • В тесте SWE Bench Pro Grok 4.5 достиг 64,7%, обойдя GLM 5.2 (62,1%), но уступив Opus 4.8 (69,2%) и Fable 5 (80,4%).
  • В xAI сообщили, что модель обучалась с использованием строгого процесса фильтрации данных, удаления дубликатов и подбора специализированных данных по секторам для повышения качества.
  • Этап обучения с подкреплением задействовал сотни тысяч задач, преимущественно в области программной инженерии, с автоматической системой оценки и асинхронной инфраструктурой обучения для агентов, работающих много часов.
  • Стоимость Grok 4.5 составляет 2 доллара США за миллион входных токенов и 6 долларов США за миллион выходных токенов, что является самым низким показателем в группе высокопроизводительных моделей.
  • Для сравнения, Opus 4.8 стоит 5 и 25 долларов США, GPT 5.5 вместе с GPT 5.6 стоят 5 и 30 долларов США, а цена Fable 5 доходит до 10 и 50 долларов США за миллион входных и выходных токенов соответственно.
  • По заявлению xAI, Grok 4.5 расходует примерно в 4,2 раза меньше токенов, чем Opus 4.8 в тестах SWE Bench Pro, и развивает скорость около 80 токенов в секунду.
  • Стратегия xAI аналогична китайским компаниям, таким как Zhipu и DeepSeek: сократить технологический разрыв в производительности, а затем конкурировать за счет низкой цены.
  • Grok 4.5 уже доступен на платформах Grok Build, Cursor и xAI Console, а также поддерживает плагины для Word, PowerPoint и Excel.
  • Модель пока не выпущена в Европейском союзе (релиз ожидается в середине июля) и разрабатывается параллельно с редактором Cursor после того, как SpaceX приобрела эту компанию в рамках сделки по обмену акциями стоимостью 60 миллиардов долларов США.
  • 📌 Заключение: Grok 4.5 не лидирует во всех рейтингах бенчмарков, но создает колоссальное давление благодаря стратегии сверхнизких цен. Тарифы, составляющие всего около 20% от стоимости Fable 5 и значительно уступающие GPT 5.5, в сочетании с меньшим потреблением токенов позволяют резко сократить операционные расходы. Если реальная эффективность совпадет с заявленной, Grok 4.5 может стать привлекательным выбором для бизнеса, которому необходимо сбалансировать производительность и затраты, вместо слепой погони за моделью с наивысшим баллом в бенчмарках.
Share.
VIET NAM CONSULTING AND MEASUREMENT JOINT STOCK COMPANY
KONTAKT

Электронная почта: info@vietmetric.vn
Адрес: Дом 34, переулок 91, улица Чан Зуй Хынг, район Йен Хоа, город Ханой

© 2026 Vietmetric
Exit mobile version