mjbommar/linux-as-a-model-32M - Каталог нейросетей
Генерация текста

mjbommar/linux-as-a-model-32M

Добавлено:
mjbommar/linux-as-a-model-32M

Что произойдет, если мы научим простую модель-трансформер запоминать исходный код ядра Linux под лицензией GPL2? Проще говоря, OSI совершает серьезную ошибку, игнорируя самую важную транзитивную зависимость в ИИ — данные обучения. Что касается последней версии «Определения искусственного интеллекта с открытым исходным кодом» (проект версии 0.0.8), OSI решило, что правовой статус обучающих данных не имеет значения для их последующего «утверждения» моделей как «открытых». Аргументом в пользу этого упущения является то, что такое требование было бы неудобным и юридически двусмысленным в некоторых юрисдикциях. Это было бы похоже на то, как Creative Commons поощряет авторов текстовых или аудиовизуальных произведений игнорировать условия лицензий с авторским левом. Проще говоря, такие организации, как OSI, должны занять четкую, здравую позицию: модели «ИИ», такие как текстовые или мультимодальные LLM, не могут считаться «открытыми», если они обучены на «украденных» или «закрытых» данных. Чтобы продемонстрировать, насколько нелепа позиция OSI, я обучил простые модели-трансформеры запоминать исходный код Linux версии 1.0, который распространяется под лицензией GPL2. Эта модель документирована и обучена в полном соответствии с проектом руководства OSI по информации о данных, коду и…

Модальности:
Генерация текста


Задача: Генерация текста
Автор: mjbommar
Теги: llama, linux, gpl2, mit, en, text-generation-inference, endpoints_compatible
Лайков: 4  |  Загрузок: 11

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.