LINUX.ORG.RU

Что вы думаете об этом PrismML Bonsai 2

 bonsai, троичная логика


0

2

Типа из-за тернарных весов можно меньше и лучше юзать ресурсы? Кто-то юзал ?

Лаборатория искусственного интеллекта PrismML представила новую языковую >модель, которая имеет достаточно компактные размеры, чтобы работать на >обычных ПК и мощных смартфонах. Компания делает ставку на то, что подобные >системы не обязательно должны иметь колоссальные размеры.

https://3dnews.ru/1148687/prismml-predstavila-ne-ochen-bolshuyu-yazikovuyu-model-kotoraya-pochti-ne-huge-bolshogo-originala

★★★★★

Новая в линейке языковая модель PrismML Bonsai 2 27B представляет собой версию популярной открытой системы Alibaba Qwen3.8 27B, но в достаточно компактном размере — всего 5,9 Гбайт.

Они сжали обычный советский китайский Qwen в тернарное представление. В чем новость?

Что вы думаете

Думаю, что магии не бывает, квантование убивает точность в любом случае. Но как способ экономии ресурсов - рабочая тема.

wandrien ★★★★
()
Ответ на: комментарий от wandrien

В чем новость?

типа прорыв маленький

  • Технология сжатия, которую применяет PrismML, уникальна, утверждает разработчик: созданные компанией модели практически не теряют в показателях производительности в сравнении с оригиналами. Новая Bonsai 2 демонстрирует 98 % от совокупных результатов бенчмарков, которые показала Qwen. *
pinachet ★★★★★
() автор топика

На моих типичных тестовых заданиях обе этим модели такую чушь городят… Окей. Решил дать более простое задание:

Напиши обёртку на bash, показывающую аналог `git status --short`, но с информацией mtime о каждом файле.

Результат:

Размышлял 30 минут и был прерван сервером по таймауту. Сгенерировал 93 килобайта текста рассуждений. Какой только чуши там не понаписал. До чистового ответа добраться так и не успел.

Не хочу сказать, что проблема конкретно в Bonsai. Просто данная разновидность Qwen сама по себе слабая модель.

wandrien ★★★★
()
Последнее исправление: wandrien (всего исправлений: 1)

Новую не пробовал. Предыдущие были дико тормозными по сравнению с оригинальными Qwen на том же оборудовании.

i7
()
Ответ на: комментарий от i7

Год назад модели «размером в сотни ГБ» запросто несли лютую дичь, так же как Qwen3.8-27B – в этом смысле паритет, да.

Но сейчас мы уже имеем, например, Qwen3.8-Flash-Next, которая в своих 125B вполне адекватна внутри агента.

А Qwen3.8-27B у меня ни одного тестового задания не смогла сделать. Я просто не знаю, для чего её применить в таком качестве.

Для обычного классификатора изображений и текстов она слишком большая, для работы над кодом – глупая.

wandrien ★★★★
()
Ответ на: комментарий от wandrien

на каком стеке задач и языках тестил? использую как вспомогательную модель для разработки на расте и администрирования, полет нормальный.

логические ошибки находит, код пишет в соответствии с качеством промпта, с контекстом норм работает, в тулзах не путается.

уровень опуса годовой давности и есть, примерно.

anonymous
()
Ответ на: комментарий от anonymous

на каком стеке задач и языках тестил?

Если говорить о задачах, которые я решаю с участием облачных моделей:

js, python, php, bash по работе, всякая вебня

python, bash, c - для себя

Задачи - рефакторинг кода, ревью легаси, ревью правок/коммитов, локализация багов.

Я пробовал давать Qwen 27B ряд таких задач, для которых уже знаю, какие результаты ожидать от других моделей – результат не удовлетворил.

Выше также был частный пример, который я дал Bonsai - написать несложный скрипт «по памяти», вне агентного цикла. Думал, написать полстраницы кода на bash для неё будет более простым заданием. Оказалось, что нет.

wandrien ★★★★
()
Последнее исправление: wandrien (всего исправлений: 1)
Ответ на: комментарий от wandrien

Используя Q27b, недавно создал web shell для IP камеры tenda, просто скормив описание уязвимости и коротко описав, какой результат нужен. Уязвимость позволяет выполнять команды от root. Результат выполнения возвращается POST запросом через wget.

Код получился рабочим с первой попытки.

Использую квант с весами в Q8/Q6_K/Q4_K и kv=f16, контекст 160k.

Из моего опыта, Qwen3.8-Flash-Next у меня работает практически также, как Qwen3.8-27B, только медленнее.

i7
()
Ответ на: комментарий от pinachet

Комп уже был и стоял почти все время без дела, докупал только видеокарты. Взял их прошлой осенью перед подорожанием за 85к + 56к. Память покупалсь на али еще в 2022. В сумме за 2 комплекта (32GB + 64GB) отдал 23к.

i7
()
  • Markdown
Пустая строка (два раза Enter) начинает новый абзац. Знак '>' в начале абзаца выделяет абзац курсивом цитирования.
Внимание: прочитайте описание разметки Markdown.
Используйте Ctrl-Enter для размещения комментария