Где-то в недрах Anthropic сидят люди, чья работа - выяснить, не пытается ли их самая умная модель тихо сломать мир. Они выпустили 53-страничный отчёт о том, как искали зло в Claude Opus 4.6. Anthropic взяли Claude Opus 4.6 - модель, которая уже вовсю пишет код на их собственной инфраструктуре, генерирует…
Ответ пришёл, статус двести, тест зелёный, а денег на счету нет. Я много раз попадал в эту ситуацию и каждый раз выяснялось одно и то же. Проверяли статус, а не то, что реально вернул сервер и что при этом попало в логи.Нейросеть в таких местах уверенно пишет проверки, которые проходят всегда, а потом ночью звонят не ей.Ниже разбираю, как я сверяю ответ с документацией и с логами за один прогон, сколько это занимает по секундомеру и почему обычные автотесты этот случай пропускают. Читать далее
Судя по всему, произошло довольно громкое событие: правительство США фактически запретило доступ к самым мощным моделям Anthropic — Claude Fable 5 и Claude Mythos 5 — для иностранных граждан. В ответ Anthropic временно отключила доступ к этим моделям вообще для всех пользователей, чтобы не нарушить экспортные ограничения.Если коротко по хронологии: Читать далее
В прошлой статье говорили про использования LLM хакерами, и обещал как раз продолжение, как защищить свое рабочее пространство, ну в общем, к делу :)Когда последний раз вы проверяли библиотеку на уязвимости? Или софт, что вы ставите и используете - проверяли? Ну, вот и я также - почти…