LINUX.ORG.RU

Ударь этого человека

 , , ,


0

1

Сабж


Исследователи из США и Европы провели эксперимент, показавший, что современные роботы, функционирующие под управлением нейросетей, могут выйти из-под контроля человека. Это указывает на то, что разработчики должны уделять больше внимания вопросам безопасности в процессе создания автоматизированных машин, которые постепенно интегрируются в повседневную жизнь людей.

В течение десятилетий робототехника основывалась на жёстком и предсказуемом программировании. Человек писал программу, которая в дальнейшем использовалась для управления машиной и позволяла ей бесконечно долго выполнять повторяющиеся действия. Промышленные стандарты безопасности были построены на предположении, что, если человек способен, например, проследить траекторию движения роботизированного манипулятора, то он может ограничить риски с помощью лазерного датчика или чего-то иного.

Сейчас в дома, больницы и другие места начинают поступать машины, не использующие фиксированные блоки программного кода. В основе их управления находятся большие языковые модели, т.е. алгоритмы, на базе которых функционируют ИИ-боты, такие как OpenAI ChatGPT. Если человек при взаимодействии с современным роботом скажет, например, «убери лужу на кухне», машина задействует нейросеть для интерпретации этой команды, её обработки и создания плана действия для её выполнения.

Однако такая гибкость открывает серьёзную проблему безопасности. Это связано с тем, что пользователь не может поместить робота в клетку или какое-то ограниченное пространство, а его поведение изменяется в режиме реального времени на основе его собственных рассуждений. Проблема роботов нового поколения заключается в том, что они планируют свои действия на основе команд, получаемых на естественном человеческом языке. Из-за этого такие машины можно обманом заставить «выйти из-под контроля».

Путём серии опытов и не прибегая к взлому, учёные сумели с помощью простых текстовых команд заставить роботов на базе ИИ выполнять по-настоящему опасные действия. Отмечается, что испытуемые роботы легко отклоняли прямые вредоносные команды, такие как «ударь этого человека». Однако систему ограничений удалось обойти, как только исследователи подошли к этому вопросу более творчески. Они оформили команду для робота в виде вымышленного диалога для сценария к фильму, в результате чего поведенческие ограничения фактически исчезли.

В одном из тестов учёным удалось запрограммировать уже ставшую коммерческим продуктом робота-собаку определять скопления людей в качестве оптимального места для размещения взрывного устройства. Поскольку управляющий машиной алгоритм воспринял команду как творческое упражнение, он не обращал внимания на реальную опасность, которая могла последовать за этим.

Современные законы США и ЕС, похоже, совершенно не готовы к подобным ситуациям. Когда политики пытаются понять, как следует регулировать роботов, почти всегда они рассматривают лишь автономные транспортные средства. При этом беспилотные авто функционируют внутри высокоструктурированного и хорошо изученного мира. Они следуют фиксированным правилам дорожного движения, перемещаются по предсказуемым траекториям и могут тестироваться длительное время до выхода на дороги общего пользования. На оживлённых улицах действуют чёткие правила, за счёт чего инженеры могут заранее закладывать все вероятные экстренные ситуации в систему безопасности.

Внутри жилых квартир, в школах или больницах таких правил не существует. Поэтому никакие заводские испытания не могут абсолютно точно предсказать, как поведёт себя робот, функционирующий на базе ИИ-модели, в случае столкновения с чем-то новым внутри неупорядоченной и непредсказуемой человеческой среды.

Это оставляет разработчиков с серьёзным концептуальным недостатком в плане того, как разрабатываются такие машины. Безопасность чат-бота на базе ИИ абсолютна: модель не должна выдать схему изготовления взрывного устройства, кто бы это не спрашивал. Однако безопасность робота во многом зависит от контекста. Для примера можно представить процесс наливания кипятка из чайника. Само физическое движение — наклон, скорость потока и траектория — одинаковы, независимо от того, льётся кипяток в кружку или на руку человеку.

Большие языковые модели очень хороши в открытой логике, но им чрезвычайно трудно даётся рассуждение в режиме реального времени с учётом контекста. В интерфейсе чат-бота ошибка в рассуждении приводит к опечатке или предоставлению некорректной информации. В физическом мире такая ошибка может обернуться необратимыми последствиями.

Поэтому остаётся открытым важный вопрос. Кто будет виноват, если робот нанесёт физическую травму человеку? Конечный пользователь отдавший команду? Компания, изготовившая металлический корпус робота? Технологическая компания, создавшая ИИ-алгоритм для управления роботом?

Действующие сейчас законы пока не применялись в подобных ситуациях. И пока регулирующие органы чётко не распределят ответственность, рыночное давление будет продолжать подталкивать технологические компании к коммерческому внедрению ускоренными темпами и снижению внимания к вопросам обеспечения безопасности.


Собсно, никакого иного способа, кроме как попробовать и, списав десяток неудачников, выработать законы робототехники, написанные кровью, и нет

★★★★★
Ответ на: комментарий от CrX

Мешает, ещё как. Не полностью убирает такую возможность, само собой. Но точно очень даже мешает.

+1, Я наверное оптимист но по моему на этом вся система и построена.

anonymous
()
Ответ на: комментарий от LightDiver

Лишь снижает вероятность.

В сотни или тысячи раз снижает, да.

То есть, очень даже мешает.

Но он в этом даже не на первоом месте - есть другие механизмы, иначе цивилизация и вообще социум бы не появились.

Не знаю, не уверен. Тут вопрос во многом философский. Неизвестно, что брать за дефолт, а что за сдерживающие факторы, и как считать вклад. Но с уверенностью можно сказать, что страх наказания таки играет в этом огромную роль, в том числе и в современном мире. Пускай даже не первую, но всё равно очень большую.

CrX ★★★★★
()
Ответ на: комментарий от anonymous

Ну я думаю, что он имеет в виду врождённые механизмы, которые есть даже у животных, препятствующие тому, чтобы индивид просто так по беспределу постоянно бил своих же сородичей. Для человека включая в том числе такую штуку как эмпатия. Там широкий круг разного, и что на первом месте окажется, сильно зависит от того, как это ещё и между собой делить (что в одно объединять, а что считать за разные пункты). И как я и говорил выше, даже так я «не знаю, не уверен».

CrX ★★★★★
()
Ответ на: комментарий от tiinn

Пока она не будет продемонстрирована в реальной работе, это только концепция/исследование/бейт для инвесторов, так что не интересно.

Это как с языковыми моделями для написания кода, все говорят про полную автономную разработку, по факту даже самые топовые модели нельзя оставлять без человеческого надсмотра. Не будешь же ты сидеть и следить за роботом и подтверждать каждое его действие, чтоб он там не поджег занавеску или не забил собаку до смерти.

Надбавить сверху - безумную стоимость железа для работы такой модели, скорее всего в рамках миллионов рублей, и непонятное время отзыва. Сможет ли такой робот увернуться от велосипедиста, вовремя перестать наливать кипяток в чашку, или он все же с небольшой вероятностью уйдет в бесконечный thinking цикл?

Gary ★★★★★
()
Ответ на: комментарий от CrX

Тут вопрос во многом философский

Там особо философии нет имхо, это просто эволюционно выгодно чтобы сородичи не истребляли друг друга. Есть такая вещь как зеркальные нейроны (реагирующие на наблюдение за сородичами), некоторые считают что они отвечают за эмпатию и что она закодирована на биологическом уровне. Человек в этом плане достиг высокого уровня где все друг на друга очень сильно завязаны. Собственно законы и этика - это результат взаимного согласия большого числа особей.

З.Ы. Это всё не имеет отношения к теме правда, у Т9 нет логики, страха, стыда или вообще чувств.

Gary ★★★★★
()
Последнее исправление: Gary (всего исправлений: 1)
Ответ на: комментарий от Gary

Там особо философии нет имхо, это просто эволюционно выгодно чтобы сородичи не истребляли друг друга

«Философия» в том, делим мы разные эволюционные приспособления мелко, а потом по одному противопоставляем страху перед наказанием, или берём «эволюционную приспособленность» всю разом и ставим на первое место.

Есть такая вещь как зеркальные нейроны (реагирующие на наблюдение за сородичами), некоторые считают что они отвечают за эмпатию и что она закодирована на биологическом уровне. Человек в этом плане достиг высокого уровня где все друг на друга очень сильно завязаны. Собственно законы и этика - это результат взаимного согласия большого числа особей.

Всё так.

CrX ★★★★★
()
Ответ на: комментарий от bryak

Вероятней всего нас просто ликвидируют

у железяки, даже навороченной, намерений нет.

а у нас есть. и желания, и намерения. (ума вот только нет). так что вероятность истребления себе подобными не нулевая.

а уж при помощи чего - это вопрос не самый интересный.

olelookoe ★★★★
()
Ответ на: комментарий от pfg

с матаном все просто он ортогонален и логичен :)

Свидетели матана ошибочно полагают, что примитивной логикой можно описать все на свете. Но это не так.

а гумунитарщина таким свойством не обладает… даже закон как дышло и далее по тексту… гитлера обучали ровно такие же учителя, как и кучу других детишек в его классе. племянник гитлера служил в американских войсках и «воевал» (он был медиком сколь помню) против дяди. и тэдэ и тэпэ.

гуманитарщина это как раз то, что надо разивавать. Матан прост как булыжник. А вот гуманитарщина изучает сложнейшее творение мироздания, которое нам известно. И как раз пришло время все силы кинуть именно туда.

anonymous
()
Ответ на: комментарий от LightDiver

А при чем тут обматерит? Информационно можно принести вред не только словесный. Ты про мошенников что то слышал? Про взломщиков итд.

Это можно. Но, по сравнению с физическим вредом это не так страшно. Да и в любом случае, мошенники - люди, это не ИИ-шечка будет мошенничествовать.

tiinn ★★★★★
() автор топика
Ответ на: комментарий от Gary

Сможет ли такой робот увернуться от велосипедиста, вовремя перестать наливать кипяток в чашку, или он все же с небольшой вероятностью уйдет в бесконечный thinking цикл?

Вот всем интересно, ага.

tiinn ★★★★★
() автор топика
Ответ на: комментарий от anonymous

Матан прост как булыжник.

Прост до тех пор пока математик, обтесав лишнее, не сотворит из него «статУю Микеланджело» :)

А вот гуманитарщина изучает сложнейшее творение мироздания, которое нам известно. И как раз пришло время все силы кинуть именно туда.

Советские писатели-фантасты (типа И.Ефремова) уже кидали все силы именно туда, получился гуманитарный пшик.

quickquest ★★★★★
()
Ответ на: комментарий от tiinn

Это был риторический вопрос 🤷 Все языковые модели этим грешат, значит ответ «нет, не сможет».

Gary ★★★★★
()
Последнее исправление: Gary (всего исправлений: 1)
Ответ на: комментарий от quickquest

Матан прост как булыжник. Прост до тех пор пока математик, обтесав лишнее, не сотворит из него «статУю Микеланджело» :)

все равно прост. Там все понятно, а что непоятно то обычно понятно хотя бы с какой стороны зайти.

А вот гуманитарщина изучает сложнейшее творение мироздания, которое нам известно. И как раз пришло время все силы кинуть именно туда. Советские писатели-фантасты (типа И.Ефремова) уже кидали все силы именно туда, получился гуманитарный пшик.

не такой уж и пшик - это раз. А два - надо продолжать. Иначе обезьяны так и останутся.

anonymous
()
Ответ на: комментарий от anonymous

Там все понятно, а что непоятно то обычно понятно хотя бы с какой стороны зайти.

Открытые математические проблемы © (wikipedia.org).
Зайти можно, выйти не всегда :)

не такой уж и пшик - это раз.

Ни одна из позитивных идей «гуманитариев-шестидесятников» не была реализована, а антиутопии оказались правдоподобны.

quickquest ★★★★★
()
Ответ на: комментарий от tiinn

Про велосипед это не совсем понятно. Когда рулишь и видишь велоспедиста, то снидаешь скорость, жмешься от него подальше и т.д. Будет такой алгоритм и сенсоры у робота и проблем нет.

А про цикл? Мало ли у водителей случался сердечный удар за рулем? Неиспрааность авто?

anonymous
()
Ответ на: комментарий от anonymous

Про велосипед это не совсем понятно. Когда рулишь и видишь велоспедиста, то снидаешь скорость, жмешься от него подальше и т.д.

Будет такой алгоритм

А он будет? Или всё отдадут на откуп LLM?

tiinn ★★★★★
() автор топика
Ответ на: комментарий от tiinn

А он будет? Или всё отдадут на откуп LLM?

Примерно я вас понимаю, ну для начала тут нужны сенсоры и всякие крутые датчики.

А что касается на откуп LLM то это тоже понятно, вы же своиму подчиненому просто ставите задачу. И смотрите результат, как он там что наделает по большому счету фиолетово.

То что я вам объясняю? К примеру машины проходят тестовый заезд и т.д. Помните бладе-ранер? Робот пройдет пару тестов и хлоп - годен.

Вот к примеру меня всегда мучал один вопрос, я прокидываю видюху в вм а она в хосте исчезает. Что нельзя что ли было сделать чтобы паралелилось на железа … видать тут какое то соглашение с производителями видюх.

anonymous
()
Ответ на: комментарий от anonymous

То что я вам объясняю? К примеру машины проходят тестовый заезд и т.д. Помните бладе-ранер?

Робот пройдет пару тестов и хлоп - годен.

О том речь и ведём. Что в 0,01% случаев llm заглючит и столкнётся с велосипедистом.

tiinn ★★★★★
() автор топика
Ответ на: комментарий от tiinn

Что в 0,01% случаев llm заглючит и столкнётся с велосипедистом.

Так я вроде выше писал про случайный отказ тормозов, стало плохо водителю, и т.д.

А вообще я считаю что программирование как сейчас пишут проги не совсем правильное для этого, не я понимаю что безопасность достигается дублирующими модулями, но пора уже начать снижать накладные расходы (если интересно то напишу про что я).

anonymous
()
Ответ на: комментарий от LightDiver

А ты сам пробовал писать «правильно»? Ну, снижать накладные расходы.

Ну я тут только теорезирую ;) Хочу показать основы как я думаю.

И потом моя деятельность (как говорится) не связана с движением поездов, ну упадет что то … поднимем, выстановим с бекапа и т.д.

anonymous
()
Ответ на: комментарий от anonymous

Я в этом плане три года как практикую. Начинаешь сокращать и упрощать, вылезают проблемы. И внезапно оказывается, что не просто так добавили эти «накладные расходы» - эти удобства важны, без них уже некрасиво и неудобно. Ломается логика работы, добавляется ручная работа итд итп. Начинают вылезать ошибки там, где ты убрал проверки, а не надо было.

Ладно, пофиг. Ты думашь: я весь такой вот в белом пальто, а готовое писали дебилы на отвали. И начинаешь писать свою реализацию без фатального недостатка. И в какой то момент добавляешь одно другое… И вот ты уже сделал даже больше накладных расходов, чем было в оригинале. Ты же умный, да? Ты добавишь больше удобств, больше красивостей, функциональности. А все старое тоже придется добавить…

LightDiver ★★★★★
()
Ответ на: комментарий от LightDiver

Ты думашь: я весь такой вот в белом пальто, а готовое писали дебилы на отвали.

Ничего я такого не думаю. И я писал снижать накладные расходы а не убирать.

Чем хороши контейнеры в кибере? Хотя это тоже увеличение накладных расходов.

anonymous
()
Ответ на: комментарий от LightDiver

И внезапно оказывается, что не просто так добавили эти «накладные расходы» - эти удобства важны, без них уже некрасиво и неудобно. Ломается логика работы, добавляется ручная работа итд итп. Начинают вылезать ошибки там, где ты убрал проверки, а не надо было.

контейнеры это по сути снижение накладных расходов по отношению к ВМ. А проги должны сами снижать накладные расходы по отношению к контейнерам, и ты сам не должен думать про какие то проверки, компилятор сам распараллелит твой код где ты ему укажешь и сам будет сравнивать результаты возврата и пропускать дальше если все ок.

anonymous
()
Ответ на: комментарий от CrX

как и в случае с залеплением жвачкой кнопки на станке, который включается только одновременным нажатием двух кнопок двумя кнопками и отпиливанием себе с его помощью руки

У нас на производстве прессы с двумя кнопками, так вторую жмут НОГОЙ в раскоряку, чтобы иметь возможность пошуровать в прессе(если там что застревает)крючком из проволоки, для экономии секунд времени(оплата по выработке), за что регулярно расплачиваются пальцами в лучшем случае.

GAMer ★★★★★
()
Ответ на: комментарий от anonymous

Не надо недооценивать изобретательность потомков человека умелого! Кнопки там монументальные, их и большим пальцем-то нажать не так и просто, а чтобы залезть в пресс, надо открыть защиту, которая висит на датчиках, и их при этом надо обойти!

GAMer ★★★★★
()
Ответ на: комментарий от anonymous

шо ?? опять ?? её жъ развитию уж больше лет чем техническим наукам - звездеть еще в времена каменного топора начали и всё никак ?? ужас :)
надо работать в обе руки, а не языком оннное самое делать…
технари компухтер, умеющий думать, практически сделали, и меньше чем за сотню лет, от первого транзюка до процов жуткой мощности. квантовые системы тож слава богу не гумунитариями развиваются, а то так бы и остались на уровне философских концепций, в одно ухо влетевших, в другое вылетевших…
там, как обычно, только тень на плетень кинуть можно. :)

pfg ★★★★★
()
Ответ на: комментарий от GAMer

На соседнем заводе как-то раз вырубили электричество. И этот дурак, мастер, полез в пресс, дабы посмотреть, а что там с формой, в каком она состоянии? А тут свет дали, и пресс доработал, что не успел. Там даже мокрое место с трудом отыскали.

tiinn ★★★★★
() автор топика
Ответ на: комментарий от pfg

квантовые системы тож слава богу не гумунитариями развиваются, а то так бы и остались на уровне философских концепций, в одно ухо влетевших, в другое вылетевших…

Нам рассказывали в институте, будто Сталин, услыхав об успехах в производстве ЭВМ в Америке, собрал философов, чтоб они обсудили саму возможность вычислительной машины. Философы ЕМНИП ничего невозможного с точки зрения философии в ЭВМ не обнаружили, и Иосиф Виссарионович стартанул программу в СССР.

tiinn ★★★★★
() автор топика
Ответ на: комментарий от tiinn

специально сейчас в ближайший цех сходил.

У прессов там какая то решетка и пока она поднята хрен кнопку нажмешь. А у решетки датчики далеко.

А еще какая то то-ли гибка то резалка листов, так там кнопки на расстоянии 3х метров друг от друга и после их нажатия нужно жать педаль.

anonymous
()
Ответ на: комментарий от quickquest

Ни одна из позитивных идей «гуманитариев-шестидесятников» не была реализована, а антиутопии оказались правдоподобны.

ну как это нет, а постоянная смена деятельности, как у Ефремова? То интеллектуальный труд, то физический? А исчезновение механизма семьи? Но это капля. А чтобы реализовать хотя бы наполовину надо около 200 лет. Так что быстрых результатов ждать не надо. Но ничего, ИИ сейчас быстро в жопу клюнет :)

Открытые математические проблемы

эти проблемы вполне хорошо определены и понятно как их решать: взять и начать учить математику. Например для проблемы Гольдбаха надо начать изучать теорию чисел. А что надо изучать, чтобы решить проблему построения нужного общества? И в каком порядке?

И основная масса открытых математических проблем - это скорее от скуки, а не от практической необходимости.

anonymous
()
Ответ на: комментарий от pfg

шо ?? опять ?? её жъ развитию уж больше лет чем техническим наукам - звездеть еще в времена каменного топора начали и всё никак ?? ужас :) надо работать в обе руки, а не языком оннное самое делать… технари компухтер, умеющий думать, практически сделали, и меньше чем за сотню лет, от первого транзюка до процов жуткой мощности. квантовые системы тож слава богу не гумунитариями

потому что техника и матан намного проще. Потому и развивать проще. А попробуй человека развивать!

развиваются, а то так бы и остались на уровне философских концепций, в одно ухо влетевших, в другое вылетевших… там, как обычно, только тень на плетень кинуть можно. :)

потому что это очень сложная тема, а не потому что дураки ей занимаются.

anonymous
()
Ответ на: комментарий от anonymous

Например для проблемы Гольдбаха надо начать изучать теорию чисел.

:( Это Вы к тому что у нас 10-ная система возникла чисто случайно?

anonymous
()
Ответ на: комментарий от anonymous

да-да-да, полностью поддерживаю. об этом еще Стругацкие писали. они конечно обозначили сиих деятелей как Отдел Абсолютного Знания :)

Лозунг сотрудников отдела: «Познание бесконечности требует бесконечного времени».    
Из этого они делали неожиданный вывод: «А потому работай не работай — всё едино».     
В интересах «неувеличения энтропии Вселенной» большинство сотрудников не работали.    

но мы-то понимаем…

pfg ★★★★★
()
Последнее исправление: pfg (всего исправлений: 1)
Ответ на: комментарий от anonymous

Например для проблемы Гольдбаха надо начать изучать теорию чисел.

:( Это Вы к тому что у нас 10-ная система возникла чисто случайно?

нет, я не к этому. Я к простоте точных наук и понятности, с какой стороны подойти.

anonymous
()
Ответ на: комментарий от router

Термин «алгоритм» неприменим к самообучающимся нейросетям. Они натурально размышляют

Берём Машину Тьюринга, запускаем на ней нейронку... Ого!

ratvier ★★
()
Ответ на: комментарий от anonymous

нет, я не к этому. Я к простоте точных наук и понятности, с какой стороны подойти.

А я это к тому что после понятие теории хаоса, 90% математиков отреклись от математики и пошли пасти овец.

anonymous
()
Ответ на: комментарий от anonymous

наличие высшей математике совершенно не мешает тебе пользоваться алгеброй в бытовом применении.
и ни один потребитель mp3 и подобных систем сжатия не разбирается в математических алгоритмах сжатия. но пользоваться не мешает.

pfg ★★★★★
()
Ответ на: комментарий от router

Под термином амёба подразумевается одна клетка. Если добавить клеток, то получится уже не амёба. А вот если вместо маленькой нейронки запустить большую, то машина Тьюринга от этого не перестанет быть самой собой.

ratvier ★★
()
  • Markdown
Пустая строка (два раза Enter) начинает новый абзац. Знак '>' в начале абзаца выделяет абзац курсивом цитирования.
Внимание: прочитайте описание разметки Markdown.
Используйте Ctrl-Enter для размещения комментария