Modelos e plataformas de IA

O AI de CÃģdigo Aberto Contra-Ataca com o Llama 4 da Meta

mm
Adicione Unite.AI às suas fontes preferidas no Google

Nos Últimos anos, o mundo do AI passou de uma cultura de colaboraçÃĢo aberta para uma dominada por sistemas proprietÃĄrios altamente protegidos. A OpenAI – uma empresa literalmente fundada com “aberto” em seu nome – mudou para manter seus modelos mais poderosos em segredo apÃģs 2019. Concorrentes como Anthropic e Google (GOOGL ) tambÃĐm construíram AI de ponta atrÃĄs de paredes de API, acessíveis apenas nos seus prÃģprios termos. Essa abordagem fechada foi justificada em parte por interesses de segurança e negÃģcios, mas deixou muitos na comunidade lamentando a perda do espírito de cÃģdigo aberto dos primÃģrdios.

Agora, esse espírito estÃĄ montando uma volta. Os novos modelos Llama 4 da Meta sinalizam uma tentativa ousada de reviver o AI de cÃģdigo aberto nos mais altos níveis – e atÃĐ mesmo jogadores tradicionalmente guardados estÃĢo prestando atençÃĢo. O CEO da OpenAI, Sam Altman, recentemente admitiu que a empresa estava “do lado errado da histÃģria” em relaçÃĢo a modelos abertos e anunciou planos para uma “nova variante GPT-4 de peso aberto”. Em resumo, o AI de cÃģdigo aberto estÃĄ contra-atacando, e o significado e valor de “aberto” estÃĢo evoluindo.

(Fonte: Meta)

Llama 4: O Desafiador Aberto da Meta para GPT-4o, Claude e Gemini

A Meta lançou o Llama 4 como outro desafio direto aos novos modelos dos pesos-pesados do AI, posicionando-o como uma alternativa de peso aberto. O Llama 4 vem em duas versÃĩes disponíveis hoje – Llama 4 Scout e Llama 4 Maverick – com especificaçÃĩes tÃĐcnicas impressionantes. Ambos sÃĢo modelos de mistura de especialistas (MoE) que ativam apenas uma fraçÃĢo de seus parÃĒmetros por consulta, permitindo um tamanho total maciço sem esmagar os custos de tempo de execuçÃĢo. O Scout e o Maverick cada um possuem 17 bilhÃĩes de “parÃĒmetros ativos” (a parte que funciona em qualquer entrada dada), mas graças ao MoE, o Scout distribui esses entre 16 especialistas (109B parÃĒmetros totais) e o Maverick entre 128 especialistas (400B totais). O resultado: os modelos Llama 4 entregam um desempenho formidÃĄvel – e o fazem com benefícios exclusivos que atÃĐ mesmo alguns modelos fechados nÃĢo possuem.

Por exemplo, o Llama 4 Scout ostenta uma janela de contexto de token de 10 milhÃĩes de indÚstria, vÃĄrias ordens de magnitude alÃĐm da maioria dos rivais. Isso significa que ele pode ingerir e raciocinar sobre documentos ou bases de cÃģdigo verdadeiramente maciços de uma vez. Apesar de seu tamanho, o Scout ÃĐ eficiente o suficiente para executar em uma Única GPU H100 quando altamente quantizado, sugerindo que os desenvolvedores nÃĢo precisarÃĢo de um supercomputador para experimentar com ele.

Enquanto isso, o Llama 4 Maverick ÃĐ ajustado para o mÃĄximo de poder. Testes iniciais mostram o Maverick igualando ou superando os melhores modelos fechados em tarefas de raciocínio, codificaçÃĢo e visÃĢo. Na verdade, a Meta jÃĄ estÃĄ brincando com um irmÃĢo ainda maior, o Llama 4 Behemoth, ainda em treinamento, que internamente “supera o GPT-4.5, o Claude 3.7 Sonnet e o Gemini 2.0 Pro em vÃĄrios benchmarks de STEM”. A mensagem ÃĐ clara: os modelos abertos nÃĢo sÃĢo mais de segunda linha; o Llama 4 estÃĄ mirando no status de estado da arte.

Equally importante, a Meta tornou o Llama 4 imediatamente disponível para download e uso. Os desenvolvedores podem pegar o Scout e o Maverick do site oficial ou Hugging Face sob a Licença ComunitÃĄria Llama 4. Isso significa que qualquer pessoa – desde um hacker de garagem atÃĐ uma empresa Fortune 500 – pode se meter debaixo do capÃī, ajustar o modelo às suas necessidades e implantÃĄ-lo em seu prÃģprio hardware ou nuvem. Isso ÃĐ um contraste marcante com ofertas proprietÃĄrias como o GPT-4o da OpenAI ou o Claude 3.7 da Anthropic, que sÃĢo servidos via APIs pagas sem acesso aos pesos subjacentes.

A Meta enfatiza que a abertura do Llama 4 ÃĐ sobre empoderar os usuÃĄrios: “Estamos compartilhando os primeiros modelos da manada Llama 4, que permitirÃĢo que as pessoas construam experiÊncias multimodais mais personalizadas”. Em outras palavras, o Llama 4 ÃĐ uma ferramenta destinada a estar nas mÃĢos de desenvolvedores e pesquisadores em todo o mundo. Ao lançar modelos que podem rivalizar com os likes do GPT e do Claude em capacidade, a Meta estÃĄ revivendo a noçÃĢo de que o AI de ponta nÃĢo precisa viver atrÃĄs de uma porta de pagamento.

(Fonte: Meta)

Idealismo AutÊntico ou Jogo EstratÃĐgico?

A Meta apresenta o Llama 4 em termos grandiosos, quase altruístas. “Nosso modelo de AI de cÃģdigo aberto, Llama, foi baixado mais de um bilhÃĢo de vezes”, anunciou recentemente o CEO Mark Zuckerberg recentemente, acrescentando que “o cÃģdigo aberto de modelos de AI ÃĐ essencial para garantir que as pessoas em todo o mundo tenham acesso aos benefícios do AI”. Essa moldura pinta a Meta como a defensora da democratizaçÃĢo do AI – uma empresa disposta a compartilhar seus modelos de coroa para o bem maior. E de fato, a popularidade da família Llama apoia isso: os modelos foram baixados em escala impressionante (saltando de 650 milhÃĩes para 1 bilhÃĢo de downloads totais em apenas alguns meses), e jÃĄ estÃĢo sendo usados em produçÃĢo por empresas como Spotify, AT&T e DoorDash.

A Meta se orgulha de notar que os desenvolvedores apreciam a “transparÊncia, customizabilidade e segurança” de ter modelos abertos que eles podem executar sozinhos, o que “ajuda a atingir novos níveis de criatividade e inovaçÃĢo”, em comparaçÃĢo com APIs de caixa preta. Em princípio, isso soa como a velha ÃĐtica de software de cÃģdigo aberto (pense em Linux ou Apache) sendo aplicada ao AI – uma vitÃģria inquestionÃĄvel para a comunidade.

No entanto, nÃĢo se pode ignorar o cÃĄlculo estratÃĐgico por trÃĄs dessa abertura. A Meta nÃĢo ÃĐ uma instituiçÃĢo de caridade, e “cÃģdigo aberto” nesse contexto vem com ressalvas. Notavelmente, o Llama 4 ÃĐ lançado sob uma licença comunitÃĄria especial, nÃĢo uma licença permissiva padrÃĢo – entÃĢo, embora os pesos do modelo sejam gratuitos para uso, hÃĄ restriçÃĩes (por exemplo, certos casos de uso de alto recurso podem exigir permissÃĢo, e a licença ÃР“proprietÃĄria” no sentido de que foi criada pela Meta). Isso nÃĢo ÃĐ a definiçÃĢo aprovada de cÃģdigo aberto pela Open Source Initiative (OSI), o que levou alguns críticos a argumentar que as empresas estÃĢo mal utilizando o termo.

Na prÃĄtica, a abordagem da Meta ÃĐ frequentemente descrita como “peso aberto” ou “cÃģdigo disponível”: o cÃģdigo e os pesos estÃĢo abertos, mas a Meta ainda mantÃĐm algum controle e nÃĢo divulga tudo (dados de treinamento, por exemplo). Isso nÃĢo diminui a utilidade para os usuÃĄrios, mas mostra que a Meta ÃĐ estrategicamente aberta – mantendo apenas o suficiente para se proteger (e talvez sua vantagem competitiva). Muitas empresas estÃĢo colando rÃģtulos “cÃģdigo aberto” em modelos de AI enquanto retÊm detalhes importantes, subvertendo o verdadeiro espírito de abertura.

Por que a Meta abriria? O cenÃĄrio competitivo oferece pistas. Lançar modelos poderosos de graça pode rapidamente construir uma ampla base de usuÃĄrios de desenvolvedores e empresas – Mistral AI, uma startup francesa, fez exatamente isso com seus modelos abertos iniciais para ganhar credibilidade como um laboratÃģrio de ponta.

Ao semear o mercado com o Llama, a Meta garante que sua tecnologia se torne fundamental no ecossistema de AI, o que pode render dividendos a longo prazo. É uma estratÃĐgia clÃĄssica de abraçar e estender: se todos usam seu “modelo aberto”, vocÊ indiretamente define padrÃĩes e talvez atÃĐ direcione as pessoas para suas plataformas (por exemplo, os produtos de assistente de AI da Meta aproveitam o Llama). HÃĄ tambÃĐm um elemento de RP e posicionamento. A Meta assume o papel do inovador benevolente, especialmente em contraste com a OpenAI – que enfrentou críticas por sua abordagem fechada. Na verdade, a mudança de coraçÃĢo da OpenAI sobre modelos abertos destaca parcialmente o quÃĢo eficaz foi a jogada da Meta.

Depois do modelo de AI aberto chinÊs DeepSeek-R1 emergir em janeiro e ultrapassar modelos anteriores, Altman indicou que a OpenAI nÃĢo queria ficar do “lado errado da histÃģria”. Agora a OpenAI promete um modelo aberto com fortes habilidades de raciocínio no futuro, marcando uma mudança de atitude. É difícil nÃĢo ver a influÊncia da Meta nessa mudança. A postura de cÃģdigo aberto da Meta ÃĐ ao mesmo tempo autÊntica e estratÃĐgica: ela genuinamente amplia o acesso ao AI, mas tambÃĐm ÃĐ uma manobra astuta para superar rivais e moldar o futuro do mercado nos termos da Meta.

ImplicaçÃĩes para Desenvolvedores, Empresas e o Futuro do AI

Para os desenvolvedores, o ressurgimento de modelos abertos como o Llama 4 ÃĐ um sopro de ar fresco. Em vez de estarem presos no ecossistema de um Único fornecedor e taxas, eles agora tÊm a opçÃĢo de executar AI poderoso em sua prÃģpria infraestrutura ou personalizÃĄ-lo livremente.

Isso ÃĐ um grande benefício para empresas em setores sensíveis – pense em finanças, saÚde ou governo – que sÃĢo cautelosas em alimentar dados confidenciais em uma caixa preta de alguÃĐm. Com o Llama 4, um banco ou hospital poderia implantar um modelo de linguagem de ponta atrÃĄs de seu prÃģprio firewall, ajustando-o em dados privados, sem compartilhar um token com uma entidade externa. HÃĄ tambÃĐm uma vantagem de custo. Enquanto as taxas de API baseadas no uso para os melhores modelos podem disparar, um modelo aberto nÃĢo tem taxas de uso – vocÊ paga apenas pelo poder de computaçÃĢo para executÃĄ-lo. Empresas que aumentam a carga de trabalho de AI pesado podem economizar significativamente optando por uma soluçÃĢo aberta que possam dimensionar internamente.

NÃĢo ÃĐ surpreendente, entÃĢo, que estamos vendo mais interesse em modelos abertos por parte das empresas; muitas começaram a perceber que o controle e a segurança do AI de cÃģdigo aberto se alinham melhor com suas necessidades do que serviços fechados de tamanho Único.

Os desenvolvedores tambÃĐm colhem benefícios em inovaçÃĢo. Com acesso aos internos do modelo, eles podem ajustar e melhorar o AI para domínios de nicho (leis, biotecnologia, línguas regionais – vocÊ nomeia) de maneiras que uma API fechada talvez nunca atenda. A explosÃĢo de projetos comunitÃĄrios em torno de modelos Llama anteriores – desde chatbots ajustados em conhecimento mÃĐdico atÃĐ aplicativos de smartphone de hobby que executam versÃĩes em miniatura – provou como os modelos abertos podem democratizar a experimentaçÃĢo.

No entanto, o renascimento do modelo aberto tambÃĐm levanta questÃĩes difíceis. A “democratizaçÃĢo” realmente ocorre se apenas aqueles com recursos computacionais significativos podem executar um modelo de 400B parÃĒmetros? Embora o Llama 4 Scout e o Maverick reduzam a barreira de hardware em comparaçÃĢo com modelos monolíticos, eles ainda sÃĢo pesados – um ponto nÃĢo perdido para alguns desenvolvedores cujos PCs nÃĢo podem lidar com eles sem ajuda na nuvem.

A esperança ÃĐ que tÃĐcnicas como compressÃĢo de modelo, destilaçÃĢo ou variantes de especialistas menores possam transferir o poder do Llama 4 para tamanhos mais acessíveis. Outra preocupaçÃĢo ÃĐ o mau uso. A OpenAI e outros argumentaram hÃĄ muito tempo que lançar modelos poderosos abertamente poderia permitir que atores mal-intencionados (para gerar desinformaçÃĢo, cÃģdigo de malware, etc.).

Essas preocupaçÃĩes permanecem: um modelo de AI aberto como o Claude ou o GPT poderia ser mal utilizado sem os filtros de segurança que as empresas aplicam em suas APIs. Por outro lado, os defensores argumentam que a abertura permite que a comunidade tambÃĐm identifique e corrija problemas, tornando os modelos mais robustos e transparentes ao longo do tempo do que qualquer sistema secreto. HÃĄ evidÊncias de que as comunidades de modelos abertos levam a segurança a sÃĐrio, desenvolvendo suas prÃģprias barreiras e compartilhando as melhores prÃĄticas – mas ÃĐ uma tensÃĢo contínua.

O que estÃĄ cada vez mais claro ÃĐ que estamos nos dirigindo para um cenÃĄrio de AI híbrido onde os modelos abertos e fechados coexistem, cada um influenciando o outro. Fornecedores fechados como a OpenAI, a Anthropic e o Google ainda mantÊm uma vantagem em desempenho absoluto – por enquanto. De fato, atÃĐ o final de 2024, pesquisas sugeriram que os modelos abertos estavam cerca de um ano atrÃĄs dos melhores modelos fechados em capacidade. Mas essa lacuna estÃĄ se fechando rapidamente.

No mercado de hoje, “AI de cÃģdigo aberto” nÃĢo significa mais apenas projetos de hobby ou modelos mais antigos – agora estÃĄ no coraçÃĢo da estratÃĐgia de AI para gigantes da tecnologia e startups alike. O lançamento do Llama 4 da Meta ÃĐ um lembrete poderoso do valor evoluído da abertura. É ao mesmo tempo uma posiçÃĢo filosÃģfica para democratizar a tecnologia e uma jogada tÃĄtica em uma batalha industrial de alto risco. Para os desenvolvedores e empresas, abre novas portas para inovaçÃĢo e autonomia, mesmo enquanto complica as decisÃĩes com novas compensaçÃĩes. E para o ecossistema mais amplo, levanta a esperança de que os benefícios do AI nÃĢo estarÃĢo presos nas mÃĢos de algumas corporaçÃĩes – se o ethos de cÃģdigo aberto pode manter seu terreno.

Alex McFarland ÃĐ um jornalista e escritor de IA que explora os Últimos desenvolvimentos em inteligÊncia artificial. Ele colaborou com inÚmeras startups de IA e publicaçÃĩes em todo o mundo.