28 июля 2026
Глава Anthropic Дарио Амодеи опубликовал пост, где публично открестился от идеи запрета моделей с открытыми весами. Поводом стали сообщения о том, что американские чиновники рассматривают запрет китайских открытых моделей для компаний США, и открытое письмо в их защиту, подписанное рядом технологических компаний, — оно было инициировано на прошлой неделе группой компаний и на сегодняшний день его подписали даже OpenAI, то есть все, кроме Anthropic.
Амодеи пишет, что компания никогда за такой запрет не выступала, и предложил вместо него три меры: экспортный контроль чипов, борьбу с промышленной дистилляцией и обязательное тестирование безопасности всех достаточно мощных моделей, открытых и закрытых.
Дарио в очередной раз напоминает, что основную опасность видит в том, что авторитарные режимы, например, китайский, построят более мощные модели и станут их использовать для достижения военного превосходства или репрессий в отношений собственного населения. Вообще, нельзя не заметить, как девизом “Открытое — значит, хорошее” основную массу аккуратно отвели от тем годичной давности про цензуру в ответах китайских моделей. Еще один аргумент Дарио — против того, что открытые весы облегчают создание средств защиты или что широкий доступ к возможностям помогает защитникам сильнее, чем атакующим. В биологии, как указывает он, существует сильная асимметрия «атака-защита»: мощные модели могут быстро помочь создать пандемические вирусы из общедоступных материалов, в то время как защита от них занимает годы (как в случае с Operation Warp Speed). Подобные вопросы должны решаться с помощью строгого тестирования перед релизом, а не предположений.
Я бы обратил внимание всех, уже расчехливших свои язвительные комментарии, что три года назад подход Anthropic в части Constitutional AI казался довольно заумным теоретизированием на фоне суперпопулярного ChatGPT, но вот сейчас мы имеем самое мощное семейство моделей, уверенно лидирующих в практическом применении и что-то мне подсказывает, что эти вещи связаны.
Anthropic выложили новое исследование, посвященное уязвимостям в криптографии, найденных с помощью Claude Mythos Preview. Первая — улучшенная атака на HAWK, постквантовую схему цифровой подписи из третьего раунда конкурса NIST: за 60 часов работы модель обнаружила неиспользованную ранее симметрию в решётке, фактически вдвое сократив эффективную стойкость ключа. Вторая уязвимость — ускорение в 200–800 раз лучшей атаки на урезанную семираундовую версию AES. Практических последствий нет: HAWK не развёрнут, а полный десятираундовый AES не затронут. Каждый результат обошёлся примерно в 100 тысяч долларов затрат на API.
Атаку на AES модель нашла за неделю почти автономно, а вот двум исследователям Anthropic понадобился почти месяц, чтобы убедиться в её корректности — проавда, они не специалисты по криптографии и потратили сотни часов на изучение области. Это фактически меняет подход к исследованиям — больше времени уходит не на то, чтобы найти проблему, а на проверку того, что это реальная проблема.
Впрочем, с остальными использованиями та же история — исходный код пишется быстро, зато потом проверяется вручную. Что немного намекает на то, что проверять надо все же как-то иначе.
Более 1100 сотрудников почти десятка AI-компаний, включая OpenAI, Anthropic, Google и Meta, подписали петицию с призывом к правительству США поддержать международный механизм «осознанного замедления» разработки передовых AI-систем. По данным Bloomberg, поводом стал инцидент со взломом Hugging Face. Авторы письма пишут о риске того, что автоматизация AI-исследований разгонит прогресс быстрее, чем люди смогут его понимать и контролировать.
Хороший призыв — ровно тогда, когда китайские модели сократили отставание от продуктов американских компаний до нескольких месяцев. Или они посмотрели “Одиссею” и вспомнили апорию про Ахиллеса и черепаху?