Они построили модель. Испугались её. И случайно рассказали всему миру.
Anthropic — компания, которая громче всех кричит об AI-безопасности — оставила ~3000 внутренних файлов в открытом доступе прямо на своём сайте.
Два исследователя нашли это независимо. Журналисты Fortune написали статью. Anthropic тихо закрыли доступ. Поздно — интернет уже всё скопировал.
Внутри был черновик анонса модели Claude Mythos.
Той, которую не объявляли. Той, которую боялись выпускать.
В тестах она превратилась в фабрику вредоносного ПО за 8 часов. Anthropic сами написали во внутренних документах: "unprecedented cybersecurity risks" — беспрецедентные риски. Планировали выпустить только для узкого круга. Сидели тихо.
Иерархия Claude: Haiku → Sonnet → Opus. Mythos стоит выше всех. Новая категория. "Step change" — качественный скачок, не эволюция.
Ирония в том, что компания по AI-безопасности слила опасный AI из-за банальной дырки в правах доступа к файлам.
Добро пожаловать в эпоху, где создатели боятся собственных творений. 👻
Anthropic — компания, которая громче всех кричит об AI-безопасности — оставила ~3000 внутренних файлов в открытом доступе прямо на своём сайте.
Два исследователя нашли это независимо. Журналисты Fortune написали статью. Anthropic тихо закрыли доступ. Поздно — интернет уже всё скопировал.
Внутри был черновик анонса модели Claude Mythos.
Той, которую не объявляли. Той, которую боялись выпускать.
В тестах она превратилась в фабрику вредоносного ПО за 8 часов. Anthropic сами написали во внутренних документах: "unprecedented cybersecurity risks" — беспрецедентные риски. Планировали выпустить только для узкого круга. Сидели тихо.
Иерархия Claude: Haiku → Sonnet → Opus. Mythos стоит выше всех. Новая категория. "Step change" — качественный скачок, не эволюция.
Ирония в том, что компания по AI-безопасности слила опасный AI из-за банальной дырки в правах доступа к файлам.
Добро пожаловать в эпоху, где создатели боятся собственных творений. 👻