LINUX.ORG.RU

Проект GCC отказался принимать значимые фрагменты кода, созданные нейросетями

 , ,


0

2

Управляющий комитет GNU Compiler Collection утвердил правила использования больших языковых моделей при разработке компилятора. Согласно официальному объявлению, проект пока будет отклонять все «юридически значимые» изменения, содержащие созданный LLM код или основанные на результатах работы LLM. Решение было опубликовано 29 июля 2026 года.

Под «юридически значимыми» подразумеваются достаточно самостоятельные и оригинальные фрагменты, на которые потенциально распространяется авторское право. Таким образом, запрет касается не только полностью сгенерированных патчей: простого редактирования или частичной переработки ответа нейросети человеком недостаточно, если итоговое изменение всё ещё основано на созданном моделью содержимом. Судя по формулировкам документа, разработчиков беспокоит прежде всего происхождение кода и возможность законно распространять его в составе GCC, а не только качество сгенерированных решений.

Для небольших изменений оставлено исключение. Сопровождающие могут принять созданные LLM правки, которые не имеют самостоятельного значения с точки зрения авторского права, если они соответствуют обычным требованиям проекта и явно помечены как сгенерированные. Речь может идти, например, о механических исправлениях или тривиальных изменениях, хотя окончательное решение остаётся за сопровождающим. Отдельное исключение сделано для тестов: GCC разрешает принимать даже значимые тестовые примеры, полностью или частично созданные языковой моделью.

Подготовкой правил занималась специальная рабочая группа, созданная в апреле 2026 года под руководством разработчика GCC Джонатана Уэйкли. В неё также вошли Карлос О’Донелл, Судакшина Дас, Джейсон Меррилл, Джоэл Шеррилл, Сэм Джеймс, Робин Дапп и Артур Коэн. Управляющий комитет предупредил, что нынешняя политика не считается окончательной: её будут пересматривать по мере развития инструментов и прояснения юридического статуса создаваемого ими кода.

Новые правила не запрещают разработчикам обсуждать с нейросетями идеи или использовать их для изучения кода. Ограничение относится к содержимому, которое непосредственно попадает в принимаемые проектом изменения. При этом автору патча придётся раскрывать применение LLM даже в тех случаях, когда сгенерированная правка считается незначительной.

>>> Источник

★★★★★

Проверено: cetjs2 ()

вот это годный подход.

etwrq ★★★★★
()
Ответ на: комментарий от yatazet

Шланг - корпорастический инструмент по борьбе со свободными инструментами разработки, нельзя им пользоваться. Не говоря уж о том что он падает от unsigned int argc, это вообще верх идиотизма.

firkax ★★★★★
()
Ответ на: комментарий от firkax

Шланг - корпорастический инструмент по борьбе со свободными инструментами разработки

А теперь посмотри на список мейнтейнеров GCC и удивись тому, как много имейлов там оканчиваются на @intel.com, @nvidia.com, @redhat.com, @oracle.com и прочие интересные домены. Кстати, гнутых авторов там почему-то меньше чем редхатовцев. Неужели гнутые не хотят свой собственный компилятор поддерживать?

yorshka
()

Зря, продвинулись бы быстрее) Нейросетка хороша в умелых ручках и глазе алмазе, чтобы проверить все, перед публикацией)

REDDERa
()
Ответ на: комментарий от yorshka

Не важно кто где работает. Важно, что тут и корпорации и все остальные работают над открытым инструментом совместно. Это статус-кво.

PcheloBiaka
()
Ответ на: комментарий от Bad_ptr

Но как доказать, что пользовался нейронкой, если код это код, просто можно убрать например из него различные подсказки которые оставляют нейронки, и что тогда м?)

REDDERa
()
Ответ на: комментарий от REDDERa

Если сопровождающий не сможет определить, что предлагаемый код нейрослоп, значит - не нейрослоп.

James_Holden ★★★★★
()
Ответ на: комментарий от PcheloBiaka

Не важно кто где работает. Важно, что тут и корпорации и все остальные работают над открытым инструментом совместно. Это статус-кво.

Ну, да. Как и в случае с LLVM.

yorshka
()
Ответ на: комментарий от REDDERa

Там проблема еще хуже. Нейронка может подставить код, который «вспомнила» из исходников на которых обучалась. А там есть как другие опенсорсные проекты, так и утекшая проприетарщина. И тогда могут уже сказать: «А чего это в вашем проекте целое полотно функции дословно совпадает с нашими патентованными внутренними сорцами? С вас бульен мильенов.».

Playermet
()
Последнее исправление: Playermet (всего исправлений: 1)
Ответ на: комментарий от REDDERa

Они же не запретили скармливать код нейронке для проверки/анализа, они запрещают приём кода с неизвестным авторским правом. Разрабы GNU явно ещё помнят, как BSD судили.

можно убрать например из него различные подсказки

А тут уже должны быть юридические нюансы. Если кто-то принёс в проект код и скрыл его происхождение, то он ввёл мантенеров в заблуждение и это одно, а если проект просто принимает код, не глядя на его чистоту, то это другое. И последнее, в случае чего, может дать повод закрыть весь проект, а не просто удалить из него чужой код. Адвокаты найдут правильные формулировки...

mky ★★★★★
()
Ответ на: комментарий от Bad_ptr

А потом получить иски – вы пользовались нашими нейронками, ваш код принадлежит нам.

А если вы пользовались нашим IDE, компилятором, СУБД, облаком, и т.д., то ваш код тоже принадлежит нам? Что-то я не слышал про такие иски.

yvv1 ★★
()
Ответ на: комментарий от nullb0t

сборка кода clang 22 с использованием компилятора clang 22 приводили к аварийным завершениям

На китайском некромипсе, на который и создатели забили. Не вижу ничего удивительного.

GAMer ★★★★★
()
Ответ на: комментарий от Playermet

Нейронка может подставить код, который «вспомнила» из исходников на которых обучалась.

Если вы так говорите, то скорее всего вы не испоьзовали их ни разу, она генерирует сама код, функции, вообще не совпадают , ни с чем кроме как из возможно всяких учебников по программированию. Она не умеет писать много и пишет мелкими кусочками.

Шанс того что она навыдумывает конкретный код—мал. Она просто обучалась программровать на огромных массивах данных, а не тупо компипастит с интернета.

REDDERa
()
Ответ на: комментарий от mky

Мне очень тяжело представить, что ИИ, будет писать чужим кодом, я в душе не чаю что это должен быть за проект где код будет чужой, не думаю что люди просто скажут «напиши мне чтобы было как у гугл» И ИИ привносит, защищенный авторским правом код😅 Мне кажется что программист должен просто писать по строчке от ИИ, и регулировать то что получается, это не полная замена человека, а ускорение разработки, так что бездумно все делать, моветон.

REDDERa
()
Ответ на: комментарий от REDDERa

Пользуюсь уже больше года. Типичные функции не совпадают, потому что типичные задачи широкие и простые, их решение можно на ходу выдумывать. Если же совпадет так, что нужно что-то специфичное, и было готовое специфичное решение, то дело остается только в вероятности. Гарантии никто не даст. А в случае с агентным подходом так и вообще не исключен прямой копипастинг с интернета. Или например просто реализация алгоритма который под патентом находится, там построчное совпадение и не требуется для создания проблем.

По поводу мелких кусочков не понял. Код на сотни строк вполне себе выдает за один промпт.

Playermet
()

А не приведёт ли это к тому, что китайский опенсорс вырвется вперёд? Китайцам-то пофиг происхождение кода и возможность законно распространять его

tiinn ★★★★★
()
Ответ на: комментарий от nullb0t

сборка кода clang 22 с использованием компилятора clang 22 приводили к аварийным завершениям

Падумаешь.. Метапрог на Метапроге тоже не собирался!

pihter ★★★★★
()
Ответ на: комментарий от PcheloBiaka

Его и создавали на лицензии Apache, чтобы можно было грабить корованы, в отличие от.

Ичо? Много корованов ограблено?

yorshka
()
Ответ на: комментарий от yatazet

зачем в 2026 пользоваться gcc когда есть божественный clang

Я примерно так же рассуждал в 2012-2013, но с тех пор gcc исправил свои самые заметные косяки

annulen ★★★★★
()
Ответ на: комментарий от REDDERa

Мне кажется что программист...

Мне кажется, что вы пропустили слово «идеальный». Открытые проекты массово стонут от засилия нейрослоп патчей. Обычное поведение — это сгенерить хз что и заслать.

очень тяжело представить

Может быть воспроизведение не кода, а алгоритма (патентованного), а, с другой стороны, вроде как ИИ способен дословно воспроизвести код из обучающей выборки. Но, в целом, тут ведь не прецедентные, а превентивные меры. С ИИ вобще мутно и в законодательстве дыры, и в пользовательских соглашених разное понаписано. Утверждается, что в некторых странах владелец ИИ признаётся правообладателем всего с его помощью сгенерённого. Пока GCC закрылся от ИИ, потом всё поменяется.

Вобще, не совсем понятно, как доказывать авторство ИИ сгенерённого кода. Как-то считается, что если вы автор, то вы без проблем должны заново написать свой же код, объяснить алогоритм, смысл каждой переменной и т.д.. А вайб-кодер на это способен?

mky ★★★★★
()
Последнее исправление: mky (всего исправлений: 1)
Ответ на: комментарий от mky

А вайб-кодер на это способен?

Вайбкодер просто попросит ИИ объяснить код.

troizet
()
Последнее исправление: troizet (всего исправлений: 1)
Ответ на: комментарий от mky

в некторых странах владелец ИИ признаётся правообладателем всего с его помощью сгенерённого

Звучит как лёгкий способ отмывать закопирайченный код от любых лицензий!

Logopeft ★★★
()

Хм. А как они это контролировать собираются? Ну, у меня лично, когда функция не работает, запрашиаваю ИИ. Смотрю, проверяю. Действительно, работает. Но, понимаю, что через жопу. Исправляю. Не, ну естественно, что прежние выпердыши, в смысле кода, учитываю. Пересобрал - работает. Ну ёптыть.

ЗЫ: Я в том смысле, что ИИ - очень и очень хороший, но инструмент. Типо молотка или шуруповёрта. Прогу написать за тебя в принципе может, но фигня получится, не взлетит. Заданную функцию - может написать-выдать запросто. Только, не сам, а где-то, когда-то уже написанную из сети выудить.

cadaber ★★
()
Последнее исправление: cadaber (всего исправлений: 1)
Ответ на: комментарий от cadaber

Заданную функцию - может написать-выдать запросто. Только, не сам, а где-то, когда-то уже написанную из сети выудить.

Как я понял, здесь дьявол и зарывает собаку. Дело не в плохом коде от ИИ, а в ЧУЖОМ коде, выданном ИИ.

mister_VA ★★★
()
Ответ на: комментарий от mky

А вайб-кодер на это способен?

Разве ли не попросит вайб кодер объяснить ему же, все это, с помощью того же ИИ?

это сгенерить хз что и заслать

Это печально(

REDDERa
()
Ответ на: комментарий от yatazet

gcc на микроконтроллеры портируют довольно часто. Там ему и место, вместе с сишкой. Про нормальные языки другой разговор.

peregrine ★★★★★
()
Ответ на: комментарий от mky

Пока GCC закрылся от ИИ

Лично я поддерживаю на 100%: как по мне - весьма дальновидное и обоснованное решение.

потом всё поменяется.

Очень бы хотелось верить что нет, или по крайней мере - не в обозримом будущем.

bugfixer ★★★★★
()
Ответ на: комментарий от mky

Я не напишу вечером код, который написал утром. А через пару дней вообще не вспомню что писал. Потому комментарии, git вот это вот всё.

peregrine ★★★★★
()

Справлялово про лицензионную чистоту, конечно, интересное. Но мы все прекрасно понимаем, почему на самом деле не хотят принимать код от нейросеток. Потому что люди генерируют тонны помойного кода и не утруждаются его вычиткой. Зачастую лепят полностью автоматические пайплайны, которые вообще без малейшего участия человека генерят нейрослоп и отправляют пулреквесты. Разгребать это говно никто не хочет.

ox55ff ★★★★★
()
Ответ на: комментарий от mister_VA

Ну, в принципе, так и есть. Ну вот ты, например, чем руководствуешься при написании кода? Правильно, как тебя научили. Или научился сам, опять-же, на примерах.

В таком вот аксепте.

cadaber ★★
()
Ответ на: комментарий от bugfixer

Это только историк-патологоанатом узнает, что когда поменялось и нужную ли сторону :)

mky ★★★★★
()
Ответ на: комментарий от peregrine

Ну, комментарии в коде тоже можно рассматривать и историю коммитов в git. А в Китае, вроде как, в суде готовы рассматривать промпты для ИИ, если кто-то хочет доказать, авторское право на результат ИИ. Нужно доказать, что человек внёс существенный вклад в результат. А иначе результат ИИ — общественное достояние. А в некоторых странах, вроде как, результат ИИ всегда общественное достояние. А такой программный код (общественное достояние) вобще может быть под GPL выпущен? Понятно, что вопрос не про какой-нибудь hello world, а про большой кусок кода.

mky ★★★★★
()
Ответ на: комментарий от ox55ff

Разве те, кто шлют нейрослоп буду читать заявлние управляющего комитетета GCC? Им, ИМХО, вобще по барабану, примут их код или нет, генеряй/отправляй. А мантейнер, вроде как, всегда имел право отказать в приёме мусора, не важно кем написаным.

mky ★★★★★
()
Ответ на: комментарий от mky

Осталось понять как отличить такой код от человеческого. Я на ЛОР постил, специалисты по всему не справились, не видят где я код писал, а где ИИ-шка (естественно я не первый шум что оно нагенерило постил, а пинал до удовлетворительного результата). А вот владельцы ИИ-шки логи пишут и смогут всегда сказать кто писал. ИМХО теперь если оставаться лицензионно чистым, то нельзя больше ничей код принимать. Ну или переходить в общественное достояние.

peregrine ★★★★★
()
Последнее исправление: peregrine (всего исправлений: 2)
Ответ на: комментарий от mky

А в некоторых странах, вроде как, результат ИИ всегда общественное достояние. А такой программный код (общественное достояние) вобще может быть под GPL выпущен?

Так ведь «общественное достояние» - это public domain, а вовсе не GPL...

А вот если ты (ну, или кто-то ещё) на основе вот этого вот всего «общественного достояния» «накреативишь» нечто, «существенно своё» - то да, это повод и право лицензию на результаты твоего труда «подприкрыть»... ;))

В общем, «трудитися, и будет вам!..»... Если и не счастье, то GPL какая-нить... ;P ;))

Somebody ★★★★
()
Последнее исправление: Somebody (всего исправлений: 2)
Ответ на: комментарий от REDDERa

Что говорит, скорее, что ты мало пользовался.

Не так давно была тема про типа который пиарился в стиле «я написал жс-движок за месяц, это было оч сложно но я справелса», где дифф с открытыми проектами светился зеленым

BruteForce ★★★★
()
Ответ на: комментарий от Playermet

Пользуюсь уже больше года. Типичные функции не совпадают, потому что типичные задачи широкие и простые, их решение можно на ходу выдумывать. Если же совпадет так, что нужно что-то специфичное, и было готовое специфичное решение, то дело остается только в вероятности. Гарантии никто не даст. А в случае с агентным подходом так и вообще не исключен прямой копипастинг с интернета. Или например просто реализация алгоритма который под патентом находится, там построчное совпадение и не требуется для создания проблем.

Именно так. Пользовался несколько раз за последний месяц. Для экзотических задач написания ебилдов выдаёт в точности то, что кто-то когда-то предлагал на форумах. (В моём случае, это оказывалось самым близким к требуемому, но не работало.)

question4 ★★★★★
()
Ответ на: комментарий от REDDERa

Но как доказать, что пользовался нейронкой, если код это код, просто можно убрать например из него различные подсказки которые оставляют нейронки

  1. Известно, что LLM обучались на закрыто-несвободном коде.
  2. Известно, что LLM в качестве ответа может скопировать фрагмент кода, на котором обучалась. Чем меньше аналогичного, тем вероятнее.

Поэтому никто не хочет рисковать появлением куска чужого особо ценного кода. Проверяющий не сможет это отследить — ведь оригинал ему недоступен. А вот владелец утёкшего кода его легко обнаружит. Никто не хочет лишних проблем.

question4 ★★★★★
()
Ответ на: комментарий от yvv1

А если вы пользовались нашим IDE, компилятором, СУБД, облаком, и т.д., то ваш код тоже принадлежит нам? Что-то я не слышал про такие иски.

Что-то такое было во времена MS-DOS, с IDE и компилятором. Не права на код, а требовали что-то за распространение бинарников. (Или я путаю, и заявили права на диалект языка высокого уровня?) Но с какого-то момента стала доминировать Visual C++, владельцы которой таким решили не заниматься, и все последовали их примеру, но кто-нибудь может тряхнуть стариной.

question4 ★★★★★
()
Ответ на: комментарий от cadaber

А как они это контролировать собираются?

Возможно, никак, а требование нужно чтобы повесить всю ответственность на приславшего.

В принципе, если приславший неспособен объяснить, как оно работает — можно считать код сгенерированным и отказать.

question4 ★★★★★
()
Для того чтобы оставить комментарий войдите или зарегистрируйтесь.