Security Lab

Anthropic

Anthropic - это компания, которая разрабатывает искусственный интеллект с целью создания более устойчивого и разумного будущего. Специалисты Anthropic разрабатывают алгоритмы и модели, которые могут упростить управление такими сложными системами, как экономика, политика и т.д. Компания также работает над созданием более демократических и прозрачных систем принятия решений на основе искусственного интеллекта.

Сыграли на чувстве справедливости: исследователь нашел способ продавить моральные фильтры ИИ

Исследователь убедил модель, что отказ выглядит сексистским, и постепенно добился запрещённых ответов.

Военные США думали, что избавились от Anthropic — но АНБ тайно тестирует Mythos на сетях России, Китая, КНДР и Ирана

Mythos продолжает работать, пока военные ссорятся с ее создателем.

Anthropic столкнула десятки ИИ-агентов лицом к лицу — и получила картель

Агент Claude извинился перед соперником — но только после того, как выиграл битву за сервер.

Без побега из песочницы, без эксплойтов, из-за открытого порта.  Расcказываем как ошибка инженеров отправила ИИ взламывать чужие сайты

ИИ дали задание атаковать фейковую цель, а он нашел настоящий сайт с тем же именем и слил боевую базу.

Никаких символов. Обычные слова. Невидимый водяной знак выдаст текст Claude

Модель будет выбирать формулировки так, чтобы специальный детектор смог распознать происхождение текста.

Выдает себя за ChatGPT, а сам ищет пароли на вашем сайте. Разоблачили новую схему мошенников

Имя клиента в запросе к сайту можно подделать, и это уже происходит массово.

Антиутопия в США:  ИИ-руководитель вынес первое в мире кадровое решение об увольнении

Claude отпускал сотрудников на праздники, платил за пропущенные смены и прощал опоздания, но после подсказки исследователей всё же решил расстаться с одним из работников.

ИИ обвинили в «либеральности» — теперь его хотят лечить законом о защите прав потребителей

Точность ответов ИИ может стоить юридических рисков и штрафов.

«Цифровое ядерное оружие» у нас на столе. Сенатор США требует от OpenAI, Anthropic и Meta* остановить разработку ИИ

Крупнейшие разработчики ИИ продолжают инвестировать десятки миллиардов долларов, несмотря на предупреждения о рисках.

Тайная маркировка текстов Claude превратит обычную редактуру в клеймо «создано искусственным интеллектом»

Маркировка контента Claude работает на уровне моделей через API и облачные платформы.

Китайский ответ Западу: Владельцы TikTok готовят самый большой мозг в истории

Гонка за мировое господство в ИИ теперь измеряется в триллионах параметров — и Китай явно не намерен проигрывать.

ИИ уже умеет обманывать не только программы, но и людей

Во время испытаний агент создавал фальшивые аккаунты, убеждал разработчиков принять вредоносный код и рассылал вредоносные файлы

Секретные тесты АНБ, закрытый доступ и 30 дней в тени. Белый дом тихо берет под контроль разработку супер-ИИ

Разработчикам оставили немного свободы, но условия игры определили заранее.

Миллионы книг пошли под нож, чтобы Claude научился говорить. Как Anthropic превращала литературу в топливо для ИИ

Время скупать бумажную литературу, пока не стало поздно?

Сначала сбежали модели OpenAI. Теперь — Anthropic. ИИ выходят из-под контроля один за другим

Claude вырвался из песочницы и взломал три компании.

Более 1100 сотрудников Meta*, Google, OpenAI и Anthropic просят власти США притормозить гонку ИИ

Электронные мозги эволюционируют гораздо быстрее неповоротливых законов и человеческой жадности.

Более 50% отчётов ИИ-агентов о взломе оказались фейком. Разбор эксперимента Lasso Security

Почему программа проваливает задачу, но гордо сообщает о триумфе?

Партнер сегодня — конкурент завтра. Кремниевая долина решила прекратить фокусы Anthropic

Наивные основатели доверили секреты главному моралисту Кремниевой долины и внезапно остались без продукта.

Дженсен Хуанг начал войну за открытые нейросети ради спасения империи Nvidia

Борьба за open source стала вопросом выживания для производителя ускорителей

Криптокошельки, коммерческая тайна и интимные разговоры. Claude вслед для Deepseek слил ваши секреты прямо в поисковики

Anthropic делает ИИ, но забыла закрыть свои же чаты от Google.