Security Lab

безопасность ИИ

Подделка под службу поддержки и замена комментариев. Исследователь безопасности нашел опасную уязвимость в роботе YouTube

Блогеры рискуют лишиться секретности неопубликованных проектов из-за доверия к ассистенту YouTube.

Белый дом требует чуда. Власти приказали сделать Claude Fable 5 абсолютно неуязвимой

Технические специалисты сочли ультиматум политиков оторванной от реальности фантазией.

Весь мировой интернет держится на двух грустных волонтерах. И ИИ уже идет по их душу

Нейросети научились находить неуловимые баги, и ИТ-гиганты создают секретный альянс.

Anthropic зовёт мир притормозить ИИ — за неделю до подготовки к IPO на триллион

Зачем один из лидеров рынка призывает остановить алгоритмы.

13 моделей и до 96% успеха: голосовой ИИ научились взламывать через звук, который человек почти не слышит

Исследователи показали новую атаку AudioHijack.

ИИ атакует больницы, а эксперты по безопасности спорят о том, что такое «риск». MOSAIC решила положить этому конец

Сразу семь мировых институтов наконец смогли договориться между собой.

Делегируй это хакеру. Популярные системы управления ИИ оказались абсолютно беззащитными

Жажда прогресса снова победила здравый смысл и логику.

Маленький, но гордый. Нейросеть ROME кодит лучше гигантов и сама исправляет свои ошибки

ROME обошла DeepSeek, будучи в 10 раз меньше.

Уволиться из OpenAI, чтобы спасти совесть. Почему лучшие умы ИИ-индустрии увольняются из корпораций в самый разгар технологического бума

Люди, создавшие GPT, больше не хотят иметь к нему отношения.

Почему чат-боты «сходят с ума» в долгих переписках? Все дело в постепенной смене персонажа

Ученые объяснили, как устроены «личности» ИИ.

«Во благо человечества» (и миллиардов Microsoft). Как OpenAI за 10 лет прошла путь от идеализма до империи.

История компании, которая не сразу попала в заголовки новостей, но изменила то, как мы пишем, учимся и работаем.

«Упс, я проговорилась». Sora 2 научилась держать секреты в тексте, но «слила» свой системный промпт через аудио

Внутренняя конфигурация, которую считали закрытой, перестала быть тайной.

«Контрабанда сессий». Palo Alto Networks описали, как злой ИИ-агент может обмануть вашего ИИ-помощника

Unit 42 обнаружила скрытые команды, которые маскируются среди легитимного обмена сообщениями.

RCE без уязвимостей — новая реальность. Claude научил хакера обходить самого себя

Теперь письма учат ИИ взламывать себя.

Один хитрый трюк — и ИИ забывает, что нельзя строить атомные бомбы

Сыграли в ролевую — получили катастрофу.

ИИ-детектив: как DeBackdoor вычисляет бэкдоры в закрытых нейросетях

Новый алгоритм выявляет триггеры там, где другие системы бессильны.

Макс Тегмарк: развитие ИИ может привести к вымиранию человечества

Технологические гиганты специально отвлекают наше внимание от настоящей угрозы?

Технооптимизм глазами Виталика Бутерина: что гений блокчейна думает о будущем ИИ?

«21 век может стать решающим для дальнейшей судьбы человечества».

Искусственный интеллект как угроза выживанию: Юдковский предлагает авиаудары по ЦОДам

Эксперт считает что человечество не понимает серьезность сложившейся ситуации.