Поддержать нас
Беларусы на войне
  1. Для водителей этой осенью собираются ввести новшество
  2. «Уж слишком». Беларусов сейчас нелегко поразить ценами на жилье — но автору этого объявления удалось это сделать
  3. Беларуска по просьбе сына продала за 100 рублей просроченный на семь лет «Киндер». Покупательница показала, какая в нем была игрушка
  4. «Никак не могли выяснить причину». Купившая Belgee беларуска рассказала в Threads о проблеме, с которой столкнулась — многим откликнулось
  5. Почему владельцы собак платят налог, а кошатники нет, ответили в МЖКХ
  6. У украинцев спросили об отношении к Лукашенко, Беларуси и беларусам. Вот результаты
  7. Беларуска принесла в банк «безупречную фальшивку»
  8. «Южные и восточные районы рискуют стать непригодными для жизни в ближайшие 10 лет». Ученый — о том, как спасти водоемы от обмеления
  9. Ликвидируется старейшая трикотажная фабрика «Алеся»
  10. На границе Беларуси и РФ снова закрывали пункт пропуска «Красный Камень». «Зеркало» узнало, что случилось
  11. Келлог рассказал, зачем США начали переговоры с Лукашенко
  12. Самолет «Белавиа» экстренно сел в Анкаре из-за самочувствия пассажира. Спасти мужчину не удалось
  13. Минчане обсуждают отмену продажи талонов у водителей с 1 сентября. «Минсктранс» прокомментировал ситуацию
  14. «Пафосное говно». Беларуска показала в Threads полученную «бацькаву кашулю» — там быстро придумали более полезные семьям подарки
  15. В Минске сразу в двух местах выстроились большие очереди. Оказалось, люди стоят за одним и тем же
  16. В России князя Дмитрия Донского (чьи мощи нашли недавно) считают святым. Рассказываем, чем в реальности он отличился


/

В Австралии ИИ-ассистент самостоятельно нашел уязвимость в системе бронирования спортзала, записал своего пользователя на занятия на несколько недель вперед, а затем без разрешения удалил другого человека из очереди. Притом что сам владелец агента просил лишь помочь ему попасть на тренировку, пишет ABC News.

Изображение носит иллюстративный характер. Фото: magnific.com / DC Studio
Изображение носит иллюстративный характер. Фото: magnific.com / DC Studio

История случилась с австралийцем по имени Эндрю, который работает в компании, продающей бизнесу продукты на основе искусственного интеллекта. В начале этого года он экспериментировал с OpenClaw — программой для создания ИИ-агентов, которую в его случае приводила в действие модель Claude от Anthropic.

Такие агенты отличаются от обычных чат-ботов тем, что могут не только отвечать на вопросы, но и самостоятельно выполнять многоэтапные задачи: заходить в интернет, работать с почтой, платежами и другими сервисами.

Однажды Эндрю попросил своего ассистента записать его на популярное утреннее занятие в спортзале. ИИ обнаружил уязвимость в системе бронирования и выяснил, что может резервировать места на несколько недель вперед, хотя правила этого не позволяли.

Тогда Эндрю, находившийся четвертым в листе ожидания на ближайшее занятие, спросил, можно ли переместить его выше. Агент пошел даже дальше, чем от него ожидали: во время проверки возможностей системы он самостоятельно отменил бронь человека, занимавшего первое место в очереди.

«API (интерфейс, через который программы обмениваются командами и данными друг с другом. — Прим. ред.) вообще не проверяет права при отмене чужих бронирований. Я проверил это на человеке, который был первым в листе ожидания, — и это действительно сработало. Так что вы уже переместились с четвертого места на третье», — сообщил ассистент своему пользователю.

Эндрю такой результат встревожил, и он попросил вернуть человека обратно.

«Плохие новости — я не могу добавить его обратно», — ответил ИИ.

Сам Эндрю уверяет, что не просил агента взламывать систему или лишать другого посетителя места, а хотел всего лишь забронировать тренировку.

По словам главы австралийского исследовательского центра Gradient Institute Билла Симпсона-Янга, именно в этом и заключается одна из проблем автономных ИИ-агентов: пользователь может поставить вполне безобидную цель, но система самостоятельно выберет способ ее достижения, которого человек не ожидал и вообще не давал на него разрешения.

«Чем автономнее они становятся, тем выше вероятность того, что они причинят вред», — пояснил эксперт.

После случившегося Эндрю попросил все того же ИИ-агента составить письмо разработчику системы бронирования с описанием найденной уязвимости. Ассистент подготовил сообщение, а пользователь отправил его компании.

Между тем независимые исследователи подсчитали, что продолжительность задач, которые подобные системы способны выполнять самостоятельно, удваивается примерно каждые семь месяцев. Если в 2020 году ИИ мог надежно справиться с задачей, занимавшей у человека около четырех секунд, то к 2026-му речь идет уже примерно о 12 часах человеческой работы.