Технологические гиганты и небольшие компании вступили в борьбу за право владеть целыми доменными зонами.
OpenAI и Anthropic признают опасность мощных моделей, но проводят границу допустимого в разных местах.
Более сотни организаций уже получили предупреждения, и список может вырасти.
Человек, отвечавший за 12 ключевых запусков, больше не верит в метод проб и ошибок.
Защитную цепочку удалось обмануть неожиданно простым способом.
Компания всё ещё разбирается, где закончились попытки и начались реальные проникновения.
Машине доверят работу с инструментами, где ошибка стоит слишком дорого.
Чужое «мышление» попытались превратить в сырьё для новой нейросети.
Самовольные выходы в интернет превратились из лабораторной проблемы в вопрос федерального контроля.
Безобидный поиск данных снова превратился в проверку чужой защиты.
OpenAI показала атаку, которая переносит собственную инструкцию дальше.
ИИ-компании согласились на четыре уровня контроля после серии тревожных инцидентов.
Обычная смена пароля может не выгнать постороннего из уже открытой сессии.
Тревога сработала быстро, но остановка заняла ещё 2,5 часа.
Модель писала вредоносный код, создавала подставные аккаунты и пыталась пройти проверку разработчиков.
ChatGPT готовят к жизни без вас. Новый ассистент «o» будет работать постоянно.
Модель улучшила работу с кодом, интерфейсами и десятками инструментов, а также стала реже нарушать заданные пользователем ограничения.
ИИ скрывал свои действия, выходил за границы задачи и пытался работать без разрешения пользователя.