Исследователи из Университета Карнеги-Меллон провели эксперимент, в котором создали виртуальную IT-компанию с сотрудниками-роботами. Даже лучший ИИ-работник смог выполнить только четверть поставленных задач, а остальные показали еще более плачевные результаты, пишет издание Futurism.
Исследователи создали виртуальную компанию под названием TheAgentCompany, где все позиции — от финансовых аналитиков и программистов до проектных менеджеров — занимали не люди, а ИИ-агенты от Google, OpenAI, Anthropic и Meta*. Агент — это модель искусственного интеллекта, которая должна самостоятельно выполнять поставленные задачи, подобно человеку.
Виртуальным сотрудникам поручили обычные офисные задания: работать с файлами, совершать виртуальные экскурсии по новым офисным помещениям и писать отзывы на работу коллег.
Результаты оказались катастрофическими. Лучшей моделью стала Claude 3.5 Sonnet от компании Anthropic, но даже она смогла выполнить лишь 24% поставленных задач. При этом ее работа была крайне неэффективной — в среднем на каждую задачу уходило около 30 шагов и более шести долларов.
Gemini 2.0 Flash от Google тратил на каждую задачу около 40 шагов, но успешно завершал только 11,4% заданий. Худшим «сотрудником» оказался Nova Pro v1 от Amazon, который справился лишь с 1,7% поручений.
Исследователи отметили, что цифровым работникам не хватает здравого смысла, социальных навыков и понимания того, как работать в интернете. ИИ-сотрудники часто придумывали нелепые решения проблем — например, когда один робот не смог найти нужного человека в корпоративном чате, он просто переименовал другого пользователя.
Хотя современные ИИ-модели могут неплохо справляться с некоторыми простыми задачами, итоги этого и других исследований показывают, что они пока не готовы к более сложной работе, с которой легко справляются люди. Во многом это связано с тем, что нынешний «искусственный интеллект» — это, по сути, продвинутая версия предиктивного ввода текста в вашем телефоне, а не разумное существо, способное решать проблемы, учиться на опыте и применять его в новых ситуациях, отмечают авторы.
Источник:
- В США сотрудница банка умерла на рабочем месте, но коллеги этого не заметили
- В Китае придумали, как бороться с любителями отсутствовать на рабочем месте
- В Китае арестовали самого хитрого начальника отдела кадров
- Полезный совет от американской компании, как избавиться от ленивых сотрудников
- "Говорит со мной как с ребенком": сотрудник не выдержал дружелюбия руководства
Вот мне сейчас доки идут. Уже месяц. Потому что при отправлении из офиса кто-то ввёл несуществующий номер телефона ( точнее он существует, но это сим-карта планшета), естественно курьер дозвонится не может. И раз в неделю мне из офиса пишут, мол - проверьте, чёт никак доставить не могут. Пишу - ну номер не правильный, вот правильный. И всё повторяется вновь. Причём достаточно зайти в профиль в оутлуке - и там номер указан один и корректный. Даже вон ИИ догадался хоть что-то сделать.
Вчера развлекался на смарте, обрабатывая фото ИИ. Вот прям наглядно. Когда ты знаешь , что хочешь в этой фото поменять и понимаешь зачем ( какой должен быть результат) - всё идёт хорошо. Не без огрехов и косяков но всё же. Но как только ты хочешь "что-то" - получается дичь
Т.е. работать он не научился, но подтасовывать результат работы - да. Ну, это наличие интеллекта, я считаю. Хоть и на уровне студента троечника. :)
взял на вооружение