Modelos e plataformas de IA

Processo GitHub Copilot: GitHub Vence o Caso

mm
Adicione Unite.AI às suas fontes preferidas no Google

Lançado em 2021, o GitHub Copilot se tornou uma ferramenta útil para desenvolvedores. É um gerador de código de IA que sugere trechos de código e completa linhas automaticamente. Desde seu lançamento, o Copilot melhorou significativamente a produtividade e a qualidade do código dos desenvolvedores.

O GitHub Copilot está envolvido em um caso judicial desde 2022. Um grupo de desenvolvedores entrou com a ação judicial porque acreditavam que o Copilot reutilizava código de fonte aberta existente sem a devida atribuição aos codificadores originais.

Como começou o processo GitHub Copilot, o que significa a decisão atual e quais são as implicações mais amplas deste caso? Vamos explorar.

Visão Geral das Reclamações Iniciais e Dispensas

Em novembro de 2022, um grupo de desenvolvedores entrou com uma ação coletiva contra o GitHub, a Microsoft (MSFT ) e a OpenAI. A ação inicialmente consistia em 22 reclamações. Ela se concentrou principalmente no GitHub Copilot. O GitHub treinou o Copilot com dados de fonte aberta existentes para fornecer trechos de código aos usuários à medida que codificam.

Os autores da ação disseram que o Copilot estava copiando trechos de código sem creditar os desenvolvedores originais. Os desenvolvedores também invocaram a Lei de Direitos Autorais do Milênio Digital. A seção 1202(b)(2) da DMCA e suas subseções abordam a violação de informações de gestão de direitos autorais. Eles acusaram o GitHub de violação de direitos autorais da DMCA por remover informações importantes de trechos de código, como a fonte do código.

O tribunal dispensou muitas dessas reclamações ao longo da duração do processo. Em 9 de julho, eles dispensaram três reclamações adicionais em uma grande vitória para os réus.

De acordo com o tribunal, não há evidências suficientes de semelhança de código entre a saída produzida pelo GitHub e o código de fonte aberta no qual eles treinaram o software. Portanto, o juiz também decidiu contra qualquer violação da DMCA.

As modificações recentes do GitHub no Copilot influenciaram significativamente a decisão do tribunal. As alterações no assistente de programação garantiram que a ferramenta mostrasse variações de trechos de código em vez de cópias exatas.

Além disso, as reclamações incluíam um estudo de IA para enfatizar ainda mais a inevitabilidade do código sendo reutilizado pelo GitHub. O tribunal também negou esse argumento, citando falta de provas de plágio.

No entanto, o tribunal observou um problema potencial com o filtro de verificação de duplicatas do GitHub Copilot. Os usuários podem desativar esse filtro, que fornece avisos de semelhança de código. A desaprovação do tribunal sugere que esse aspecto requer uma análise mais detalhada. Isso é uma oportunidade para os desenvolvedores modificarem e reenviarem suas reclamações, focando mais nesse aspecto específico.

As Reclamações Restantes Contra o GitHub Copilot

Embora o tribunal tenha dispensado a maioria das reclamações, o caso não está encerrado. Duas alegações principais permanecem em jogo na ação coletiva do GitHub Copilot:

  • Uma violação de licença de fonte aberta.
  • Uma violação de confiança entre o GitHub e os provedores de código de fonte aberta.

Essas reclamações criticam o GitHub por usar código de fonte aberta de forma antiética. Elas incluem não reconhecer o uso de dados públicos disponíveis para treinar o Copilot e não dar crédito aos codificadores originais. Como resultado, o GitHub violou seu acordo com seus parceiros.

Ambas as partes também discutiram sobre o comportamento uma da outra durante o processo de descoberta. De acordo com os desenvolvedores, os réus não forneceram as informações necessárias durante os procedimentos, como e-mails relevantes. Essa acusação pode se tornar importante durante as etapas finais do caso.

Quais São as Implicações Mais Amplas do Processo GitHub Copilot?

Esse processo em andamento levanta questões sobre seu impacto no ecossistema de IA mais amplo. Os resultados dessas reclamações restantes provavelmente estabelecerão precedentes para o uso de código de fonte aberta no treinamento de IA.

O sucesso do GitHub em dispensar muitas das reclamações do processo provavelmente encorajará outras empresas a continuar usando IA no desenvolvimento de software. De acordo com o GitHub, tecnologias de IA como o Copilot ajudam os usuários a codificar de forma mais eficiente, aumentando a produtividade. Mais e mais empresas e desenvolvedores buscarão alcançar benefícios semelhantes.

Esse caso também aumentou a conscientização sobre leis de direitos autorais. Ele deu poder aos desenvolvedores para entender melhor seus direitos. As empresas podem usar novas políticas para garantir que não violam licenças de fonte aberta.

Por outro lado, essa conscientização aumentada também pode aumentar a desconfiança de ferramentas de codificação de IA. Essa falta de confiança pode levar a repositórios de fonte aberta menos extensos, à medida que os desenvolvedores removem suas contribuições. A falta de dados suficientes prejudicará o aprendizado eficaz de software de IA.

Projetos de fonte aberta também podem reexaminar os termos de licença para fornecer diretrizes mais explícitas sobre o uso de seu código no treinamento de IA. Eles podem adotar licenças mais restritivas para proteger suas contribuições.

A decisão também não isenta completamente o GitHub Copilot, enfatizando a necessidade de quadros regulamentares mais abrangentes. A redução de possíveis reclamações de violação de direitos autorais pode encorajar empresas de IA. Essas empresas podem continuar usando código público disponível para fins de treinamento. No entanto, esse caso também pede diretrizes mais claras para prevenir o mau uso de dados de fonte aberta.

A Necessidade de Leis Atualizadas

O processo do Copilot trouxe à atenção a questão dos direitos autorais de código gerado por IA. Ele enfatizou a necessidade de leis atualizadas para proteger os direitos dos desenvolvedores originais.

Os quadros legais atuais não podem lidar com as complexidades introduzidas por conteúdo gerado por IA. Como resultado, as autoridades devem atualizar as leis para garantir a conformidade.

Por exemplo, estabelecer um limite onde a semelhança de código além de um determinado número não é permitida pode ajudar a proteger os direitos dos desenvolvedores originais. As autoridades também podem tornar obrigatório o display da fonte dos dados de treinamento.

Além disso, as autoridades devem regular o código público para evitar o uso não licenciado. Exigir auditorias regulares de ferramentas de IA e sua saída é outra iniciativa viável.

Esse processo aumentará a vigilância do uso de código público no treinamento de IA. À medida que ferramentas de codificação de IA evoluem, as leis para seu uso também devem evoluir. Essa prática garantirá que a inovação não entre em conflito com padrões éticos e legais.

Explore Unite.ai para mais recursos sobre o GitHub e ferramentas de codificação de IA.

Haziqa é uma Cientista de Dados com ampla experiência em escrever conteúdo técnico para empresas de IA e SaaS.