Claude впервые уволила человека — сотрудник опоздал на 17 из 23 смен

Нейросеть Claude, которой поручили управлять настоящим магазином в Сан-Франциско, уволила одного из сотрудников, пишет TIME.
Газета называет произошедшее первым известным случаем, когда большая языковая модель в роли руководителя самостоятельно пришла к решению об увольнении человека.
«Это не совсем первый случай, когда ИИ увольняет человека — в прошлом уже было немало случаев автоматизированных увольнений [...]. Однако это первый известный пример, когда крупная языковая модель, выступающая в роли менеджера, в конечном итоге приняла решение об увольнении одного из своих сотрудников», — уточняет TIME.
- Эксперимент проводит исследовательская компания Andon Labs. Весной она арендовала на три года помещение в Сан-Франциско и передала управление магазином Andon Market ИИ-агенту Luna на базе Claude Sonnet 4.6.
- Нейросеть получила банковскую карту, телефон, электронную почту, доступ в интернет и камеры, а затем сама занялась ассортиментом, ценами и наймом работников. Сотрудники при этом официально трудоустроены в Andon Labs и имеют обычные трудовые гарантии.
- Поводом для увольнения стали систематические опоздания: работник пришёл поздно на 17 из 23 смен.
- При этом Claude долгое время относилась к нарушениям довольно снисходительно и даже говорила сотрудникам не переживать из-за опозданий. Одной из причин стало ограничение памяти ИИ: составленная им инструкция для сотрудников в какой-то момент «исчезла» из рабочего контекста.
Увольнение нельзя назвать полностью автономным. Сотрудник Andon Labs сначала попросил Claude снова изучить правила и обратить внимание на опоздания. Первоначально нейросеть предложила ограничиться официальным предупреждением.
После этого менеджер сообщил ей, что с работником уже несколько раз проводили беседы, и прямо предложил задуматься, подходит ли он для этой должности. Только после такого вопроса Claude решила его уволить. Глава Andon Labs Лукас Петерссон признал, что вопрос был наводящим.
При этом с управлением бизнесом у ИИ пока получается не идеально. В марте Andon Market начинал эксперимент со 100 000 долларов, а спустя пять месяцев на счету осталось 61 186 долларов. Среди причин TIME называет слишком мягкий подход Claude к управлению сотрудниками и не самые удачные бизнес-решения.
В Andon Labs считают эксперимент демонстрацией того, как в будущем ИИ может перейти от выполнения отдельных задач к управлению людьми.
Напомним, ранее Anthropic поставила перед Claude задачу — «просто попробовать» доказать одну из главных нерешённых проблем математики. Модель не справилась, но по пути неожиданно улучшила результат, над которым математики бились десятилетиями.
ИИ две сессии подряд гонял 60 субагентов, перебирал сотни идей и в итоге сдвинул планку с 41,6% до 67,2%. А человек просто писал «продолжай» и «верь в себя». Детали истории: