Они создали фейковую софтверную компанию, где все роли — от инженеров до менеджеров — выполняли ИИ-модели от Google, OpenAI и Anthropic. Результат? Полный хаос!
ИИ-агенты не справились даже с простыми задачами. Они путались в чатах, не могли найти нужных «коллег» и придумывали странные решения, вроде переименования пользователей, чтобы «обойти» проблему. Ученые выяснили, что ИИ не хватает здравого смысла, социальных навыков и умения ориентироваться в интернете. Простые задачи они выполняют, но сложные, где нужны человеческие способности, им не по зубам.

ИИ пока не готов заменить людей. Это скорее продвинутая версия автозаполнения текста, чем умный помощник. Ваш худший коллега всё ещё лучше, чем целый ИИ-офис.







