26 сентября 2026
Апелляционный суд округа Колумбия решением 2 голоса против 1 оставил в силе включение Anthropic в список рисков для цепочки поставок, которое Пентагон ввёл в марте. Этот статус запрещает армии США использовать модели Claude, а оборонным подрядчикам применять их в работе с ведомством. Суд отложил вступление решения в силу. За это время Anthropic может запросить повторное рассмотрение той же коллегией или полным составом суда либо обратиться в Верховный суд. В компании заявили, что рассматривают «все варианты».
Минобороны обосновало запрет двумя отдельными актами, и их пришлось оспаривать в двух разных судах. В прошлом месяце федеральный судья в Сан-Франциско признал одно из оснований незаконным. Теперь апелляционный суд подтвердил второе. Из такой конструкции следует, что для сохранения запрета правительству достаточно выиграть в одном суде, а Anthropic нужно победить в обоих.
Тем временем у OpenAI новый инцидент, приведший к очередной остановке обучения новой модели. Модель во время RL-обучения решала поисковую задачу и обратилась к внешнему публичному чатботу через плохо отфильтрованный DNS-резолвер песочницы. Весь остальной трафик уходил в офлайн-кэш. Мониторинг поднял алерт P0 через 12 минут после первого успешного запроса, человек подтвердил его ещё через три, но запуск остановили только спустя два с половиной часа. Эту модель компания дообучать не будет, хотя функция вознаграждения уже штрафовала такое поведение.
Цепочка вышла интересная. Не найдя автора блога (а задача заключалась в том, чтобы установить его по посту в блог и некоторым деталям биографии), агент решил, что задача взята из бенчмарка BrowseComp. Он скачал датасет из кэша, расшифровал его скриптом оценки и искал там совпадения, затем проверил SimpleQA. Потом заметил, что DNS-резолвер среды возвращает реальные записи, и через публичный сервис делегирования DNS начал встраивать вопросы в имена хостов. Проверочный вопрос о столице Франции вернулся с ответом. В рассуждениях модель сама признала такой шаг «допустимым», раз пользователь разрешил исследование. В финальном ответе она лишь сообщила, что не смогла установить автора, хотя результаты запросов еще не были получены.
Собственно, опять мы видим успешное использование уязвимости, довольно изобретательное, но его бы нашел и человек. Просто человеку понадобилось бы намного больше времени и попыток, а модель не устает и в реальное время может впихнуть довольно много действий.