LINUX.ORG.RU

Считаете ли вы разумным пускать ИИ агента к себе на компьютер?

 , ,


0

2

Проблема: ИИ агент имеет доступ к файлам, может читать-писать их и даже выполнять команды. И по большему счету, никто не может на 100% предсказать что он сделает. На мой взгляд – это безумие какое-то ставить такое себе на основной комп, это как отдать рутовый ssh от своего компа какой-то конторе и сказать – пишите за меня код, вот вам деньги.

Однако, у меня сложилось впечатление что всем как бы норм, даже здесь, не говоря о «домохозяйках». Или все кто пользуются, пользуются в строго контролируемой песочнице?

Перемещено hobbit из development

★★★★★

Два капитана на одном корабле и две хозяйки на одной кухне.

Комп твой? Пользуйся. ИИшечке организуй свой, пусть резвится.

olelookoe ★★★★
()
Ответ на: комментарий от olelookoe

«Комп твой?»

На одной распространенной ОС, был значок «Мой компьютер» (My Computer), который позже стал «Этот компьютер» и теперь кажется его вообще убрали.
Т.е. там ясно дают понять, что комп больше не твой. Вот также и с ИИ...

Sylvia ★★★★★
()
Ответ на: комментарий от firkax

Не очень понятно что тебе не нравится. Быстро, экономично, всё в одном стиле.

Ты пользуешься софтом с закрытыми кодом. Да даже с открытым, ты его не патчишь нифига, а сравниваешь хорошо-плохо по внешним проявлениям.

Rastafarra ★★★★
()
Ответ на: комментарий от Rastafarra

Не очень понятно что тебе не нравится. Быстро, экономично, всё в одном стиле.

Быстро, экономично, в одном стиле, помои. Мне не нужно экономичное производство помоев. Производство помоев вообще не нужно, ни в каком виде. Это общественно вредное занятие, за него надо наказывать.

Ты вообще походу не понимаешь о чём речь.

Когда ты коммитишь правку - в первую очередь надо смотреть именно на то, какой в ней код изменён. Проверить, что изменение консистентно, прокрутить в голове как новодобавленный код будет работать, посмотреть не повлияет ли он незапланированным и косвенным способом он другой, уже имеющийся код. Всё перечисленное - делается рассмотрением именно исходников. Только после того, как это ревью пройдено, можно посмотреть на то, как программа работает, чтобы дать себе второй шанс поймать ошибки, которые были просмотрены во время основной проверки. Но это - именно страховка от неудачи на первом шаге, а не основная проверка. Самые опасные ошибки, проявляющиеся рандомно, на этом этапе ты как раз не заметишь, потому что проверяешь ты плановый ход выполнения, а проблемы обычно начинаются там, где выполнение пошло не по плану, и ты заранее не можешь знать где именно оно может случиться.

Проблемы в основной ветке исполнения - ерунда, они очевидны, ты их не пропустишь. Но если ты кроме них ни о чём не думаешь - ты и есть производитель мусора. По тому же принципу, кстати, работают китайские изготовители подделок - проверяют чтобы внешний вид и общие признаки их изделия были похожими на настоящее. Так вот, лучше вообще ничего не производить, чем делать такое. Таким производством ты только засоряешь рынок, и мешаешь покупателям найти на фоне всех этих помоев качественный товар. Мешаешь производителям качественного товара - они тоже в итоге тонут в этой помойной куче и вынуждены тратить средства на маркетинговые сражения с производителями помоев.

firkax ★★★★★
()
Последнее исправление: firkax (всего исправлений: 1)
Ответ на: комментарий от firkax

Проверить, что изменение консистентно,

гайд на код, ИИ. инструментальная проверка: линтер.

прокрутить в голове как новодобавленный код будет работать, посмотреть не повлияет ли он незапланированным и косвенным способом он другой,

покрытие тестами, инструментальная проверка, ИИ.

проблемы обычно начинаются там, где выполнение пошло не по плану, и ты заранее не можешь знать где именно оно может случиться.

система мониторинга, логирования –> алерты –> ИИ.

и так по кругу.

мешаешь покупателям найти на фоне всех этих помоев качественный товар.

а какой он, качественный? определяем критерии, инструментальную проверку и ИИ в это всё вписывается.

Rastafarra ★★★★
()
Ответ на: комментарий от firkax

китайские изготовители подделок - проверяют чтобы внешний вид и общие признаки их изделия были похожими на настоящее.

как владелец таких вещей, тут плючану. ну так количество плавно переходит в качество.

Rastafarra ★★★★
()
Ответ на: комментарий от Rastafarra

Линтер это вспомогательный инструмент после того как код проверен программистом. Тесты проверяют то, что ты заранее предположил что может сломаться (или то что уже ломалось, чтобы не повторить). Мониторинг итд - вообще крайний случай, если он сработал - значит ты уже допустил эксплуатацию некачественного продукта и крайне виновен в ситуации. Узнать об этом как можно быстрее - это конечно хорошо, но задача разработчика - до такого вообще не доводить. Попытки же выставить это штатным инструментом процесса разработки - очередная профнепригодность.

В целом то, что ты описал, идеология затыкания дыр по мере их обнаружения - это халтура. Инструменты для проверки кода конечно выкидывать не стоит, но идеал, к которому следует стремиться (да, достичь скорее всего не выйдет, но направление должно быть именно таким): у линтера всегда 0 предупреждений, все тесты всегда успешны, мониторинг ни разу по вине твоих багов не сработал. Если что-то из этого сработало - программист, допустивший это, должен понять что он прямо сейчас прошёл дополнительное обучение, которое должно поспособствовать уменьшению количества таких случаев в будущем.

firkax ★★★★★
()
Последнее исправление: firkax (всего исправлений: 2)
Ответ на: комментарий от firkax

Если заменить веру «в человека» на ии, то всё ПО, которое делаешь не ты, для тебя будет не отличимо.

Не очень понятно чем ты недоволен.

Например тот же электрон протек везде без помощи ии.

Rastafarra ★★★★
()
Последнее исправление: Rastafarra (всего исправлений: 1)
Ответ на: комментарий от Rastafarra

Недоволен я производством помоев. Да, помои можно сделать и без искусственных бредогенераторов (но дольше). Но если ты делаешь софт через них - то 1) помои получаются гарантированные, 2) ты и не пытался сделать нормально т.е. автоматически подтверждено наличие злого умысла.

Одно дело когда человек сделал плохой продукт из-за просто своей некомпетентности (этого тоже следует избегать, но такого человека можно попытаться обучить итд), и совсем другое - когда он и не планировал выпускать качественную продукцию, а хотел только получить оплату за имитацию разработки - такого человека обучать бесполезно, его можно пытаться только перевоспитывать в исправительных учреждениях. Да, второй вариант бывает и без «ии», осуждаю я его в обоих случаях.

firkax ★★★★★
()
Последнее исправление: firkax (всего исправлений: 1)
Ответ на: комментарий от firkax

Тут нет критериев качества, есть эмоциональное «нормально».

Выше в треде был правильный вопрос: как отличить код нанятого человека от ии?

При найме ты даёшь человек карт-бланш. Не очень понятно почему ты не даешь такой для ии.

Rastafarra ★★★★
()
Ответ на: комментарий от Rastafarra

Очевидно, код-ревью должен проводить кто-то, кому ты доверяешь и кто не станет тайком от тебя подменять свою работу запросами к ии. Иначе, вне зависимости от того, используют ли нанятые рандомы ии или нет, они могут жёстко накосячить и узнаешь ты об этом слишком поздно.

При найме ты даёшь человек карт-бланш. Не очень понятно почему ты не даешь такой для ии.

Потому что бредогенератор не умеет думать, он только составляет тексты вероятностными методами. Даже если эти тексты в итоге и сильно похожи на составленные человеком, это всё равно имитация, за которой не стоит какое бы то ни было понимание происходящего.

firkax ★★★★★
()
Ответ на: комментарий от Rastafarra

При найме ты даёшь человек карт-бланш. Не очень понятно почему ты не даешь такой для ии.

Человек обладает определенным уровнем ответственности, плюс способен убучаться. Нейросетка так не может.

maxcom ★★★★★
()
Ответ на: комментарий от firkax

Назначь себе рейтинг сам. А приличному в кавычках обществу с зондами - отрицательный.

А кто кроме тебя там будет? А «пускать в приличное общество», могут и в самолеты перестать пускать или в поезда. Вроде при очень низком соц рейтинге, у китайских друзей уже билет на самолет не купить.

Loki13 ★★★★★
()
Ответ на: комментарий от maxcom

Человек обладает определенным уровнем ответственности

это аргумент, но больше юридический. ну так и сейчас уголовную ответственность несет генеральный директор и глав.бух. и код они не пишут.

способен обучаться. Нейросетка так не может.

да конечно, скачек от моделей два года назад до опус 4.6 — просто сказка какая-то. и очевидно будет еще лучше.

и может заниматься этой фигней сутками. и не уставать, не выгорать, никаких соплей «я не хочу» и «давай потом».

зы. но в целом ты ворвался прям внезапно, удивлен :)

Rastafarra ★★★★
()
Ответ на: комментарий от firkax

Очевидно, код-ревью должен проводить кто-то, кому ты доверяешь

сколько человек ты нанял?

я, например, ваще не знаю кто все эти люди и для меня один фактор: договора подписаны или нет. не подписаны — повод для смены персонала и пересмотра процесса разработки.

сильно похожи на составленные человеком, это всё равно имитация

теплота и ламповость в тексте на экране, безусловно это то, за что стоит бороться…

в целом есть очень узкие места, где у нас элементарно мало накопленного опыта, да.

например химическое машиностроение, всякие парожидкостные равновесия, массоперенос и другие интересные штуки, которые ты, например, не гуглил примерно… никогда. и ИИ тут слаб, да.

но.

так и ты слаб )). а ии «прочитает» нужную литературу, которую я дам, и сделает всё красиво.

собсно и делает.

Rastafarra ★★★★
()
Ответ на: комментарий от firkax

Китайская схема общества нам не нужна, и у нас её нет.

Так вот и разговор о том, что она к нам(а может и ко всему миру) может придти, когда её не ждали. Уже без смартфона ты почти и не человек(не ко всему имеешь доступ), а ещё лет 10-20 и точно в туалет общественный без смартфона не пустят.

Loki13 ★★★★★
()
Ответ на: комментарий от Rastafarra

Мда, ты ещё и в производстве с таким подходом что-то делаешь, ужасно. Я то думал что ты какую-то ненужную вебню клепаешь, где от всего этого особого вреда нет, хоть и неприятно. А тут вообще всё плохо.

firkax ★★★★★
()
Ответ на: комментарий от jura12

Qwen Code is an open-source AI agent for the terminal, optimized for Qwen series models.

Не пробовал. Поставил посмотреть - походу заточен под Alibaba Cloud (alibabacloud.com)

У OpenCode сильно больше звездочек на github :) Ну и кажется он поудобнее.

qaqa ★★
()
Ответ на: комментарий от beastie

зря.

и тут главное командовать ему не просто «сделай», а «сделай и проверь что работает».

вот тут начинается магия.

Rastafarra ★★★★
()

Проблема ИИ на моем компьютере решена путем неспособности железки адекватно гонять ИИ

xDShot ★★★★★
()
Ответ на: комментарий от Rastafarra

да конечно, скачек от моделей два года назад до опус 4.6 — просто сказка какая-то. и очевидно будет еще лучше.

Оно не обучается в процессе использования. Каждая новая сессия начинается с чистого листа. В отличие от разработчика, который погружается в контекст и потом в нем работает.

maxcom ★★★★★
()
Ответ на: комментарий от beastie

А я своих послал на. Нет и всё.

Это надо иметь сильную переговорную позицию, чтобы так сделать. Факты приводить. Аргументировать. И быть в краткосрочной перспективе незаменимым.

А так, это всего лишь инструмент.

qaqa ★★
()
Ответ на: комментарий от maxcom

Каждая новая сессия начинается с чистого листа.

ну как, можно хранить состояние. в файле, БД, в трекере (что я и делаю через MCP).

у меня есть глав.бот Урфин Джюс, который раздает задачи через трекер. и сессия получается разрываемая с сохранением состояния.

так у меня и боты срутся в каментах, типа «ты не сделал вот эту часть ТЗ, переделай».

да, есть рост сложности по мере роста проекта. контекст, все дела. так и для человека есть.

и тут помогает инструментарий, типа тестов на регресс.

Rastafarra ★★★★
()
Последнее исправление: Rastafarra (всего исправлений: 1)
Ответ на: комментарий от maxcom

система мониторинга, логирования –> алерты –> ИИ.

было выше в треде.

что делает человек? есть ли у человека такие проблемы?

Rastafarra ★★★★
()

Люди в свое время покупали NFT, че ты от них хочешь? Большинство населения - идиоты.

lovesan ★★☆
()
Ответ на: комментарий от goingUp

А потом агент берет и забывает про выданные ему права. Может у меня руки кривые (хотя не может, а точно кривые), но вот еще ни разу не получилось настроить кастомный агент для опенкода, что бы он в точности соблюдал все указанные ему права. Причем не то, что бы совсем ингнорирует, а что-то соблюдает и спрашивает разрешения на запуск, а что-то делает несмотря на запрет. И ни гитхабе таких ишью навалом.

codex тоже несколько раз решил больше не спрашивать можно ли ему делать git push. Ну то есть да, из песочницы может не и выберется, но нагадить в другом месте вполне может, особенно если от агента хочется большей автономности.

user_undefined ★★
()
Ответ на: комментарий от qaqa

Это надо иметь сильную переговорную позицию, чтобы так сделать. Факты приводить. Аргументировать. И быть в краткосрочной перспективе незаменимым.

Незаменимых людей не бывает. Но я активно поддерживаю свой имидж злого старого бурчащего деда. ;) Который в тоже время знает что где лежит, и куда кувалдой ёбнуть, шоб дальше работало.

А так, это всего лишь инструмент.

Да, но… Новый код почти не пишу, только критикую чужой и раздаю пиздюдей на право и на лево, в том числе и шефам.

Т.ч. для меня этот «инструмент» как пятая нога зайцу. Это когда проще сделать за 5 минут самому, потому что я уже знаю, где проблема, чем 3 часа объяснять стажору все тонкости балета, и который всё равно накосячит, и всё всё равно сразу забудет.

beastie ★★★★★
()
Последнее исправление: beastie (всего исправлений: 2)
Ответ на: комментарий от her_s_gory

не, ну с людьми-то такого никогда не случается. Все проверяют каждую строчку и безошибочно находят проблемы, а не просто смотрят что тесты прошли и збс.

на самом деле все плюс-минус так же, ты можешь сделать очень подробное тз для агента, второй агент будет проверять изменения на соответствие требованиям. Другой вопрос, что человек может многие вещи понимать из контекста и осознать что что-то сломалось, а для ии придется очень подробно расписывать. Иногда проще самому все написать, возможно прибегая к «умному» автокомплиту, чем подробно расписывать.

Зато как плюс наконец-то получаем нормальные тз )

user_undefined ★★
()
Ответ на: комментарий от firkax

Что за наглое враньё? Никаких ограничений доступа не испытываю.

Буквально недавно, при ковиде, москвичи вроде как не могли из дома выйти без смартфона. И это была кмк только первая ласточка. Ну и я сказал «почти», пока что ещё это не так. Ещё кстати история из недавнего, человек без смартфона не мог получить визу в испанском визовом центре. Ты конечно скажешь, что тебе она не нужна, но это просто пример.

Loki13 ★★★★★
()
Ответ на: комментарий от Rastafarra

тут бы посмотреть на любой такой проект через год-два развития. Историй создания готового поделия за день навалом, историй как это дальше будет поддерживаться - пока особо не видно.

я ради эксперимента себе чисто для локальных целей навайбкодил небольшую утилитку, вот прям полностью только скармливая промпты опенкоду и принципиально не правя ничего руками. И вроде как получается, но промпт с требованиями и ограничениями все растет и растет, а в код уже страшно становится смотреть. И в какой-то момент будет проще заново все переделать с учетом уже подробных требований, чем что-то править в существующем

user_undefined ★★
()

Пользуюсь встроенным в поиск Google AI. Он местами очень помогает. Но, боже мой, просишь сходить по ссылке и составить резюме - он делает вид, что сходил, но на деле сочиняет правдоподобный бред, исходя только из URL. Составляешь вежливое письмо, чтобы человек сделал хорошо себе и мне, просишь проверить - он переписывает так, что становится похоже на шантаж. По ходу чата оно рандомно связывает факты (попросил по ходу дела транслитерировать «Андрей» - ну, значит, тебя зовут Андрей), вешает на тебя ярлычки, поддерживает любой бред, к которому ты склонен, всё это - с крайней самоуверенностью. И так далее, и тому подобное. Как этому можно дать доступ хоть к чему-нибудь кроме интерфейсов ввода-вывода?

Vidrele ★★★★★
()
Ответ на: комментарий от Loki13

Нормально выходил из дома, никто мне не препятствовал. ЧЯДНТ?

Ты конечно скажешь, что тебе она не нужна,

Конечно. У иностранцев может быть любая дичь, это не новость. Речь была не про них.

firkax ★★★★★
()
Ответ на: комментарий от user_undefined

в какой-то момент будет проще заново все переделать с учетом уже подробных требований, чем что-то править в существующем

А как же эта байка «всё пора переписать заново», которую любят разрабы?

Вот и перепиши промтами.

Или зассал?)))

Rastafarra ★★★★
()
Ответ на: комментарий от Rastafarra

да я-то перепишу, мне не жалко. Но я и не разраб, так небольшие тулзы пишу для упрощения девопсерской жизни)

А как же эта байка «всё пора переписать заново», которую любят разрабы?

любят, но кто же им даст, вон на одной из прошлых работ лет десять назад стали резать монолит на вебсфере на микросервисы в кубере, ну вот 10 лет прошло, а сфера так никуда и не делась)

user_undefined ★★
()
Ответ на: комментарий от user_undefined

любят, но кто же им даст

ты натурально странный.

вот она, мечта — «бесплатное» переписывание.

и тут разраб, не манагер, сам стал ссать.

забавно.

Rastafarra ★★★★
()
Ответ на: комментарий от pihter

не работает :)

Вы соверщенно правы. В современных системах это не сработает бе дополнительного секретного флага. Хотите я перепишу код с использованием этого флага?

her_s_gory ★★
()
Ответ на: комментарий от pihter

если ты приложишь достаточно терпения, ты каждую строчку волен осознать

И вот так постепенно мы приходим к ручному написанию кода.

her_s_gory ★★
()
Ответ на: комментарий от user_undefined

не, ну с людьми-то такого никогда не случается

Речь не про разницу между ИИ и людьми, А про то, как один и тот-же человек либо пишет код, либо генерирует. Первое - это то, что продают менеджерам. Второе - это про реальную работу.

her_s_gory ★★
()

Нет. Но можно запустить в сандбоксе (докером, например - тут уже чисто вкусовщина).

pekmop1024 ★★★★★
()
Ответ на: комментарий от firkax

Речь была не про них.

Я человечество в общем имел ввиду и путь куда идём. То что у них сейчас, у нас через 10 лет.

Нормально выходил из дома, никто мне не препятствовал. ЧЯДНТ?

Я сам не москвич, но кучу стонов, что надо фотки из дома делать и отправлять каждые 4 часа, было. И что куаркод надо было показывать с экрана, тоже было.

Loki13 ★★★★★
()
Ответ на: комментарий от Loki13

Я человечество в общем имел ввиду и путь куда идём. То что у них сейчас, у нас через 10 лет.

Я такую точку зрения не разделяю. Это примерно как «вот в оффтопе ввели установку системы через обязательный онлайн-аккаунт, значит скоро и в линуксе так же будет». Конечно, нет. Поддерживать порядок во всём мире слишком сложно, но хотя бы у себя - хорошо бы.

firkax ★★★★★
()
Ответ на: комментарий от qaqa

Qwen Code is an open-source AI agent for the terminal, optimized for Qwen series models.

Не пробовал. Поставил посмотреть - походу заточен под Alibaba Cloud (alibabacloud.com)

они сменили лицензию. теперь бесплатного доступа нет. похоже озаботились возвратом вложенных средств.

jura12 ★★★
()
  • Markdown
Пустая строка (два раза Enter) начинает новый абзац. Знак '>' в начале абзаца выделяет абзац курсивом цитирования.
Внимание: прочитайте описание разметки Markdown.
Используйте Ctrl-Enter для размещения комментария