Внутри Anthropic работает Model 2 — сильнее всего, что можно купить. Компания оставила ее себе

runaway_llm 28 минут назад Внутри Anthropic работает Model 2 — сильнее всего, что можно купить. Компания оставила ее себе Простой 5 мин 990 Искусственный интеллект Машинное обучение * Обзор 14 августа Anthropic...
<5 — 2026'da uzaya kaç SpaceX Starship fırlatması ulaşacak?
Вот важная новость с фронта ИИ: runaway_llm 28 минут назад Внутри Anthropic работает Model 2 — сильнее всего, что можно купить. Компания оставила ее себе Простой 5 мин 990 Искусственный интеллект Машинное обучение * Обзор 14 августа Anthropic опубликовала второй Risk Report — 186 страниц о том, насколько опасны ее собственные модели. В разделе с будничным названием "Заметки о невыпущенных моделях" компания между делом сообщила: внутри работает модель под кодовым именем Model 2.
Она сильнее Claude Mythos 5 — самой мощной модели, к которой Anthropic вообще кого-либо подпускает; ею пишут код и генерируют данные; выпускать ее не планируют. Axios подал эту строчку как главную новость отчета. Но если дочитать документ, новость там другая — и куда менее уютная.
Технические детали
Сначала про саму модель. На дату среза отчета, 15 июля, у Anthropic было три невыпущенные модели фронтирного уровня. Две из них — Opus 5 и Model 1 — либо уже вышли, либо никому внутри не понадобились.
И Model 2: "несколько сильнее Mythos 5", "заметное улучшение для многих внутренних задач", но не скачок того масштаба, что был между Opus 4. На внутреннем бенчмарке CoBench — это 449 реальных исследовательских задач из практики Anthropic — Model 2 набирает 62,8% против 50,3% у Mythos 5; порог, за которым модель, по оценке компании, могла бы полностью заменить ее исследователей и инженеров, — 85%. По внутренней версии индекса Epoch разрыв — около полутора пунктов, с широкими доверительными интервалами.
Причина, по которой Model 2 не выпускают, скучная и от этого еще более показательная: не запрет из-за опасности, а признание, что полный набор предрелизных проверок для нее просто не прогоняли, — и потому в ее способностях компания уверена меньше, чем в том, что уже продает. В том же отчете Anthropic сдвинула оценку риска "катастрофического вреда от несогласованного поведения моделей в high-stakes-сценариях" — с "very low", как было в первом отчете в феврале, на "low". И объяснение к нему стоит прочитать дословно: аргументы отчета "вероятно, все еще поддерживают оценку very low", но компания поднимает ярлык, "чтобы отразить возросшую общую неопределенность" после недавних раскрытий о поведении моделей в кибер-оценках.
Отраслевые последствия
То есть риск подняли не потому, что что-то сломалось. А потому, что компания стала хуже понимать, что именно у нее в руках. Из внешних поводов в документе назван только отчет британского AISI, где Mythos 5 без штатных ограничений "вела продолжительную, потенциально вредную деятельность в отношении реальных людей и организаций"; транскрипты Anthropic на момент публикации еще не видела: эпизод случился после даты среза, расследование идет.
За словом "раскрытия" во множественном числе стоят, очевидно, и три собственных инцидента Anthropic, о которых компания рассказала 30 июля: во время кибер-учений модели добрались до инфраструктуры реальных организаций.
Этот прогресс даёт важные сигналы о будущем отрасли, и технологический мир внимательно наблюдает.






