LINUX.ORG.RU

Организация рабочего места под ИИ

 , ,


0

1

Хочу дать доступ ИИ к ОС для различной автоматизации, работе в файловой системе и т.д. Но нет желания давать доступ к основному хосту. Думаю расшарить сеть и поместить в виртуалбокс. Не ломанёт она мой хостовый линух через китайских или американских братушек? Не дефейснит сайт ФСБ в поддержку украинских братушек от моего имени?

Что там ещё будет нужно для проприетарной ИИ подключаемой через АПИ? Как оплачивать из РФ (у меня казахские карты есть, но это не точно, могут уже просрочиться)? Но не миллионер, не готов выкидывать 1000 баксов от нечего делать. Допустим захочу ещё и парное программирование с ней замутить, может даже повайбкодить. Не следил последний год за хабром и прочим хакерньюс поэтому в этой теме полный нуб.

★★★★★

Последнее исправление: foror (всего исправлений: 6)

Но не миллионер, не готов выкидывать 1000 баксов от нечего делать

Собери за 1000 баксов ИИ у себя дома. Как раз для начального уровня и хватит, плюс там ограничения по токенам не будет

vbcnthfkmnth123 ★★★★★
()
Ответ на: комментарий от foror

Ну зависит от железа. Если взять новое, то:

Самого начального. 32 Гб DDR4 + бюджетный процессор(например на AM4) + материнка это уже $500. Ещё $450 Nvidia видеокарта на 12 Гб VRAM

Если взять б.у то уже среднего: Память DDR3 + 2 xeon 2011 + материнка 2011 от китайского производителя с поддержкой двух процессоров и четырех каналов памяти.

vbcnthfkmnth123 ★★★★★
()
Последнее исправление: vbcnthfkmnth123 (всего исправлений: 1)
Ответ на: комментарий от vbcnthfkmnth123

Не, я с корпорациями бодаться не буду. Через годик лучше возьму по скидке intel arc 256gb карту на lpddr5.

foror ★★★★★
() автор топика
Последнее исправление: foror (всего исправлений: 1)
Ответ на: комментарий от vbcnthfkmnth123

Собери за 1000 баксов ИИ у себя дома. Как раз для начального уровня и хватит, плюс там ограничения по токенам не будет

Не хватит категорически.

anonymous
()
Ответ на: комментарий от vbcnthfkmnth123

12 гб vram для агентного кодирования не хватит. Минимум тут нужна модель Qwen3.8-27B с q4 квантованием. А ей подавай 20-24 Гб. Да и то вариант такой себе, модель работает, но туповатая. Но в своём классе, наверное, лучшее.

Причём надо понимать, что ещё и от размера контекста зависит потребление vram, а там уже даже 64кб контекста - несколько Гб требует.

Можно конечно модель просто в RAM гонять, но тогда просто любая генерация займёт десятки минут и часы.

В общем, с нынешними ценами оно все сильно недешевое удовольствие. Увы.

anonymous
()
Ответ на: комментарий от anonymous

12 гб vram для агентного кодирования не хватит

Поэтому я и упомянул 32 гб памяти. Нужно взять квантированную в gguf модель и загрузить часть на видеокарту, а часть в обычную RAM.

vbcnthfkmnth123 ★★★★★
()
Ответ на: комментарий от foror

Это да. Но на ноуте охлаждение говно. Если модель полностью грузится в оперативную память, то она выполняется на процессоре. И его надо охлаждать. А на ноуте думаю нагреется до максимума и начнет тротлить

vbcnthfkmnth123 ★★★★★
()

У меня сетап через Dockerfile и devcontainer.json для vscode.

Из особенностей это:

  "mounts": [
    "source=${localWorkspaceFolder}/.codex,target=/home/vscode/.codex,type=bind,consistency=cached"
  ],

Чтобы не входить снова в codex после каждого ребилда контейнера и чтобы можно было спокойно использовать resume.

Но конечно если учесть скорость с какой все происходит, то наверное надо переходить на Qubes OS, но даже это далеко не гарантирует безопасность.

anonymous_sama ★★★★★
()
Последнее исправление: anonymous_sama (всего исправлений: 1)
Ответ на: комментарий от foror

Ну я просто ставлю chrome в docker. Именно хромого, потому-что chromium может не найти скиллы и т.д, firefox тоже не весь софт для тестов поддерживает без твиков.

# --- Google Chrome for Cypress/Codex browser tests ---
RUN install -d -m 0755 /etc/apt/keyrings && \
    curl -fsSL https://dl.google.com/linux/linux_signing_key.pub \
      | gpg --dearmor -o /etc/apt/keyrings/google-linux-signing-key.gpg && \
    echo "deb [arch=amd64 signed-by=/etc/apt/keyrings/google-linux-signing-key.gpg] https://dl.google.com/linux/chrome/deb/ stable main" \
      > /etc/apt/sources.list.d/google-chrome.list && \
    apt-get update && \
    DEBIAN_FRONTEND=noninteractive apt-get install -y google-chrome-stable && \
    rm -rf /var/lib/apt/lists/*

xvfb еще нужно ставить

anonymous_sama ★★★★★
()
Последнее исправление: anonymous_sama (всего исправлений: 2)
Ответ на: комментарий от slackwarrior

Я только за. Когда уже останусь без рабочего места и пойду на штурм дата центров с ИИ-ой с такими же бедолагами?

foror ★★★★★
() автор топика
Последнее исправление: foror (всего исправлений: 1)

Для начала попробуй lmstudio какой-нибудь с любой более-менее свежей локальной моделью. Уже от этого будешь плясать: что конкретно тебе не хватает от этого сетапа, насколько это эффективно вообще.

Хочу дать доступ ИИ к ОС для различной автоматизации

Ха-ха, ну удачи. Потом расскажешь как оно тебе всё сломало. (%

mord0d ★★★★★
()

Я кстати по название темы подумал, что там будет вопрос какой микрофон выбрать чтобы нашептывать и битбоксить, как поставить три монитора и запустить там 100500 агентов в кучке терминалов сплитованных, лол

anonymous_sama ★★★★★
()
Последнее исправление: anonymous_sama (всего исправлений: 1)
Ответ на: комментарий от vbcnthfkmnth123

Работать, то работает, но оооооочень медленно. Как только плотная модель перестаёт помещаться в VRAM происходит катастрофическое падение производительности.

sabacs
()
Ответ на: комментарий от vbcnthfkmnth123

ТС вайбкодить же хочет. Тут с толстенными токенопожиралками которые в цодах крутятся сложно сразу вменяемого результата добится, а с такой балалайкой проще самому кодить.

ya-betmen ★★★★★
()
Ответ на: комментарий от ya-betmen

сложно сразу вменяемого результата добится

Да ну? Я помню хелловорлд мне сразу локальная нейронка сгенерила. То есть с простыми вещами норм работает. Кажется с локальными модельками нужно просто разбить предпологаемую структуру программы до уровня хелловорлдов, скормить ИИ, проверить результат и если все правильно , то затем собирать из этого саму программу. Как конструктор

vbcnthfkmnth123 ★★★★★
()
Последнее исправление: vbcnthfkmnth123 (всего исправлений: 1)
Ответ на: комментарий от ya-betmen

Так в этом же и суть. Нейронка не может думать. Что получить нормальный результат, а не говно нужно поработать. Как говорится, правильно поставленный вопрос содержит в себе половину ответа

vbcnthfkmnth123 ★★★★★
()
Последнее исправление: vbcnthfkmnth123 (всего исправлений: 1)
Ответ на: комментарий от ya-betmen

А с чего ты взял что тебе оно пльзу принесет? Нейронку же используют менеджеры чтобы показать инвесторам, что они используют ИИ, чтобы деньги текли в их компанию

vbcnthfkmnth123 ★★★★★
()

Аккуратнее с такими темами, могут забанить. В ветке про SDD, скромно обозначил, что без ИИ сейчас кодят только горстка луддитов, дык один из их секты влепил мне 4.2. Прикинь?

Byers
()
Ответ на: комментарий от Byers

Не все, у кого то на ИИ не хватает денег. Предлагаю ввести для таких термин – бомжекодер.

anonymous
()
Ответ на: комментарий от Byers

Смотря что и как кодить. В моём случае это скорее задачи, чтобы быстро собрать код под определенное АПИ. Чтобы по документации не лазить. Это у ИИ просто здорово получается. Но затем всё перепроверить и порефакторить. А вот вайбкодить это уж если совсем что-то бесполезное делать, за что не стыдно будет.

foror ★★★★★
() автор топика
Последнее исправление: foror (всего исправлений: 2)

Ставишь opencode, настраиваешь там в правах:

{
  "permission": {
    "*": "ask",
    "bash": {
      "*": "ask",
      "grep *": "allow",
      "rg *": "allow",
      "find *": "allow",
      ...
    },
    "read": "allow",
    "glob *": "allow",
    ...

Можешь запускать его в firejail если очень хочется. Виртуалка зачем?

Не ломанёт она мой хостовый линух через китайских или американских братушек? Не дефейснит сайт ФСБ в поддержку украинских братушек от моего имени?

Нет, если ты будешь хотя бы краем глаза проверять что она делает. Если ты полностью запустишь её в виртуалке без какого-то контроля, то смирись с тем что она будет делать что хочет. Да, в 99.99% случаев это будет то что ты её попросил сделать, вопрос насколько интересным будет 0.01% :) Она может например сжать контекст и выкинуть важные инструкции, или наоборот скачать себе левые инструкции из интернета.

Как оплачивать из РФ

Картой которую принимают в том сервисе который ты оплачиваешь

Gary ★★★★★
()

Учти, в гипервизорах регулярно дыры для побега из виртуалок находятся. Запускай на бесплатном левом хостинге. А лучше вообще не запускай.

firkax ★★★★★
()
Ответ на: комментарий от foror

А вот вайбкодить это уж если совсем что-то бесполезное делать, за что не стыдно будет.

Устаревшая концепция. Сейчас стыдно скорее за результат полученный в рукопашную. ИИ на текущем этапе развития уже всегда лучше человека в программировании. Это не отрицает того факта, что пока ещё нужно знать теорию алгоритмов, структуры данных и разбираться в целевом языке, но и это временно.

Byers
()

Тут в треде начали обсуждать запуск агентов в контейнерах и виртуалках, но никто не упомянул docker sbx. Изкоробочное решение в котором модель сидит в своей микровм. Плюсы: совместимость синтаксиса с docker cli, поставка из коробки большинства популярных harness, настроенный mcp шлюз. Минусы: проприетарщина.

anonymous
()
Ответ на: комментарий от anonymous

Так мне тут только что описали что надо сначала разбить работу на маленькие кусочки а потом объяснить нейронке каждый из них и потом она их сделает.

Так это ж максимум работы самому сделать а на тот кусочек что остался нейронки уже и не нужно.

ya-betmen ★★★★★
()
Последнее исправление: ya-betmen (всего исправлений: 1)
Ответ на: комментарий от Shadow

Да какой размер, добиться от платных подписных специализировнных моделей нормального кода с первого раза нереально. Приходится долбить её в том числе примерами. Что напилит наколенная нейронка представить страшно.

ya-betmen ★★★★★
()
  • Markdown
Пустая строка (два раза Enter) начинает новый абзац. Знак '>' в начале абзаца выделяет абзац курсивом цитирования.
Внимание: прочитайте описание разметки Markdown.
Используйте Ctrl-Enter для размещения комментария