Grok 4.7, Claude Opus 5.5 и DeepSeek V4.1 Flash: какую модель брать в сентябре

tech_post_dev 1 час назад Grok 4.7, Claude Opus 5.5 и DeepSeek V4.1 Flash: какую модель брать в сентябре Средний 4 мин 780 Настройка Linux * Grok 4.7, Claude Opus 5.5 и DeepSeek V4.1 Flash: какую модель брать в...
<5 — 2026'da uzaya kaç SpaceX Starship fırlatması ulaşacak?
В сфере искусственного интеллекта произошло заметное событие. tech_post_dev 1 час назад Grok 4. 1 Flash: какую модель брать в сентябре Средний 4 мин 780 Настройка Linux * Grok 4. 1 Flash: какую модель брать в сентябреЗа две недели сентября обновились сразу три лаборатории: 10-го DeepSeek опубликовал открытые веса V4.
1 Flash, 21-го xAI выпустила Grok 4. 7, 22-го Anthropic показала Claude Opus 5. Ставки разные: DeepSeek давит ценой, Grok — соотношением цены и скорости, Opus — качеством на продолжительных задачах.
Технические детали
Ниже — замеры независимых тестов и собственные отчёты компаний, пересчитанные в стоимость одинаковой работы. Коротко о каждойClaude Opus 5. 5 — старшая модель Anthropic для длительных агентных сценариев: кода, исследований, разбора документов.
Контекст — миллион токенов, вывод — до 128 тысяч. Рассуждение всегда включено, глубину задаёт уровень усилия от low до max. 7 собрана на новой базовой модели большего размера, а не на дообученной 4.
Контекст — 500 тысяч токенов, четыре уровня рассуждения, поиск по вебу и по X встроены. По умолчанию стоит в Cursor и в терминальном агенте xAI Grok Build. 1 Flash — открытая модель под MIT: 552 миллиарда параметров, на каждый токен задействуются 8–16 миллиардов.
Отраслевые последствия
Контекст — миллион токенов, поддерживается ввод изображений. Веса на Hugging Face, API продают около полутора десятков провайдеров. Что показывают тестыОбщая линейка — Intelligence Index от Artificial Analysis: десять тестов, сведённых в одно число, замеры выполняет не сам разработчик модели.
5 — 54 при уровне усилия high, 58 при max;Grok 4. 7 — 46, на два пункта выше предыдущей версии;DeepSeek V4. Для открытой модели это высоко: медиана открытых моделей сопоставимого размера — 18.
В агентном программировании разрыв больше. 0, где модель сама работает в терминале, Anthropic указывает для Opus 5. 7 по замеру Artificial Analysis получает 33 % (xAI называет 38 %), DeepSeek V4.
Этот прогресс даёт важные сигналы о будущем отрасли, и технологический мир внимательно наблюдает.






