Modelos e plataformas de IA

Tudo o que VocÊ Precisa Saber Sobre o Llama 3 | O Modelo de CÃģdigo Aberto Mais Potente AtÃĐ o Momento | Conceitos para Uso

mm
Adicione Unite.AI às suas fontes preferidas no Google

A Meta recentemente lançou o Llama 3, a prÃģxima geraçÃĢo de seu modelo de linguagem grande de cÃģdigo aberto de ponta (LLM). Construindo sobre os fundamentos estabelecidos por seu antecessor, o Llama 3 visa melhorar as capacidades que posicionaram o Llama 2 como um concorrente de cÃģdigo aberto significativo para o ChatGPT, como detalhado na revisÃĢo abrangente no artigo Llama 2: Uma AnÃĄlise Aprofundada do Desafiador de CÃģdigo Aberto para o ChatGPT.

Neste artigo, discutiremos os conceitos principais por trÃĄs do Llama 3, exploraremos sua arquitetura inovadora e o processo de treinamento, e forneceremos orientaçÃĢo prÃĄtica sobre como acessar, usar e implantar esse modelo revolucionÃĄrio de forma responsÃĄvel. Seja vocÊ um pesquisador, desenvolvedor ou entusiasta de IA, este post equiparÃĄ vocÊ com o conhecimento e os recursos necessÃĄrios para aproveitar o poder do Llama 3 para seus projetos e aplicaçÃĩes.

A EvoluçÃĢo do Llama: Do Llama 2 para o Llama 3

O CEO da Meta, Mark Zuckerberg, anunciou o lançamento do Llama 3, o Último modelo de IA desenvolvido pela Meta AI. Este modelo de ponta, agora de cÃģdigo aberto, estÃĄ pronto para melhorar os vÃĄrios produtos da Meta, incluindo o Messenger e o Instagram. Zuckerberg destacou que o Llama 3 posiciona a Meta AI como o assistente de IA mais avançado disponível gratuitamente.

Antes de falarmos sobre os detalhes do Llama 3, vamos revisitar brevemente seu antecessor, o Llama 2. Lançado em 2022, o Llama 2 foi um marco significativo no cenÃĄrio de LLM de cÃģdigo aberto, oferecendo um modelo poderoso e eficiente que podia ser executado em hardware de consumidor.

No entanto, embora o Llama 2 tenha sido um feito notÃĄvel, ele tinha suas limitaçÃĩes. Os usuÃĄrios relataram problemas com recusas falsas (o modelo se recusando a responder a prompts benignos), utilidade limitada e espaço para melhoria em ÃĄreas como raciocínio e geraçÃĢo de cÃģdigo.

EntÃĢo, entra o Llama 3: a resposta da Meta para esses desafios e o feedback da comunidade. Com o Llama 3, a Meta busca construir os melhores modelos de cÃģdigo aberto, equivalentes aos principais modelos proprietÃĄrios disponíveis hoje, priorizando tambÃĐm prÃĄticas de desenvolvimento e implantaçÃĢo responsÃĄveis.

Llama 3: Arquitetura e Treinamento

Uma das principais inovaçÃĩes no Llama 3 ÃĐ seu tokenizador, que apresenta um vocabulÃĄrio significativamente expandido de 128.256 tokens (em comparaçÃĢo com os 32.000 do Llama 2). Esse vocabulÃĄrio maior permite uma codificaçÃĢo de texto mais eficiente, tanto para entrada quanto para saída, potencialmente levando a uma multilingualidade e melhorias gerais de desempenho.

O Llama 3 tambÃĐm incorpora AtençÃĢo de Consulta Agrupada (GQA), uma tÃĐcnica de representaçÃĢo eficiente que melhora a escalabilidade e ajuda o modelo a lidar com contextos mais longos de forma mais eficaz. A versÃĢo 8B do Llama 3 utiliza a GQA, enquanto as versÃĩes 8B e 70B podem processar sequÊncias de atÃĐ 8.192 tokens.

Dados de Treinamento e Escalabilidade

Os dados de treinamento utilizados para o Llama 3 sÃĢo um fator crucial em seu desempenho melhorado. A Meta curou um conjunto de dados massivo de mais de 15 trilhÃĩes de tokens de fontes online disponíveis publicamente, sete vezes maior do que o conjunto de dados utilizado para o Llama 2. Esse conjunto de dados tambÃĐm inclui uma porcentagem significativa (mais de 5%) de dados de alta qualidade nÃĢo em inglÊs, cobrindo mais de 30 idiomas, em preparaçÃĢo para aplicaçÃĩes multilíngues futuras.

Para garantir a qualidade dos dados, a Meta empregou tÃĐcnicas de filtragem avançadas, incluindo filtros heurísticos, filtros NSFW, deduplicaçÃĢo semÃĒntica e classificadores de texto treinados no Llama 2 para prever a qualidade dos dados. A equipe tambÃĐm realizou experimentos extensivos para determinar a mistura ideal de fontes de dados para prÃĐ-treinamento, garantindo que o Llama 3 se saia bem em uma ampla gama de casos de uso, incluindo trivia, STEM, codificaçÃĢo e conhecimento histÃģrico.

A escalabilidade do prÃĐ-treinamento foi outro aspecto crítico do desenvolvimento do Llama 3. A Meta desenvolveu leis de escalabilidade que permitiram prever o desempenho de seus maiores modelos em tarefas-chave, como geraçÃĢo de cÃģdigo, antes de realmente treinÃĄ-los. Isso informou as decisÃĩes sobre a mistura de dados e alocaçÃĢo de computaçÃĢo, levando a um treinamento mais eficiente e eficaz.

Os maiores modelos do Llama 3 foram treinados em dois clusters de 24.000 GPUs personalizados, utilizando uma combinaçÃĢo de paralelizaçÃĢo de dados, paralelizaçÃĢo de modelo e paralelizaçÃĢo de pipeline. A pilha de treinamento avançada da Meta automatizou a detecçÃĢo de erros, tratamento e manutençÃĢo, maximizando o tempo de atividade da GPU e aumentando a eficiÊncia do treinamento em aproximadamente trÊs vezes em comparaçÃĢo com o Llama 2.

Ajuste Fino de InstruçÃĢo e Desempenho

Para desbloquear o potencial total do Llama 3 para aplicaçÃĩes de chat e diÃĄlogo, a Meta inovou sua abordagem para o ajuste fino de instruçÃĩes. Seu mÃĐtodo combina ajuste fino supervisionado (SFT), amostragem de rejeiçÃĢo, otimizaçÃĢo de política proximal (PPO) e otimizaçÃĢo de preferÊncia direta (DPO).

A qualidade dos prompts utilizados no SFT e as classificaçÃĩes de preferÊncia utilizadas no PPO e DPO desempenharam um papel crucial no desempenho dos modelos alinhados. A equipe da Meta cuidadosamente curou esses dados e realizou vÃĄrias rodadas de garantia de qualidade nas anotaçÃĩes fornecidas por anotadores humanos.

O treinamento em classificaçÃĩes de preferÊncia via PPO e DPO tambÃĐm melhorou significativamente o desempenho do Llama 3 em tarefas de raciocínio e codificaçÃĢo. A Meta descobriu que, mesmo quando um modelo tem dificuldade em responder a uma pergunta de raciocínio diretamente, ele pode ainda produzir a trilha de raciocínio correta. O treinamento em classificaçÃĩes de preferÊncia permitiu que o modelo aprendesse a selecionar a resposta correta a partir dessas trilhas.

Resultados da Arena

Os resultados falam por si: o Llama 3 supera muitos modelos de chat de cÃģdigo aberto disponíveis em benchmarks da indÚstria, estabelecendo um novo padrÃĢo de desempenho para LLMs nas escalas de parÃĒmetro de 8B e 70B.

Desenvolvimento ResponsÃĄvel e ConsideraçÃĩes de Segurança

Enquanto busca o desempenho de ponta, a Meta tambÃĐm priorizou prÃĄticas de desenvolvimento e implantaçÃĢo responsÃĄveis para o Llama 3. A empresa adotou uma abordagem de nível de sistema, imaginando os modelos do Llama 3 como parte de um ecossistema mais amplo que coloca os desenvolvedores no comando, permitindo que eles projetem e personalizem os modelos para seus casos de uso específicos e requisitos de segurança.

A Meta realizou extensos exercícios de red team, avaliaçÃĩes adversÃĄrias e implementou tÃĐcnicas de mitigaçÃĢo de segurança para reduzir os riscos residuais em seus modelos ajustados por instruçÃĩes. No entanto, a empresa reconhece que riscos residuais provavelmente permanecerÃĢo e recomenda que os desenvolvedores avaliem esses riscos no contexto de seus casos de uso específicos.

Para apoiar a implantaçÃĢo responsÃĄvel, a Meta atualizou seu Guia de Uso ResponsÃĄvel, fornecendo um recurso abrangente para que os desenvolvedores implementem as melhores prÃĄticas de segurança de nível de modelo e sistema para suas aplicaçÃĩes. O guia aborda tÃģpicos como moderaçÃĢo de conteÚdo, avaliaçÃĢo de risco e o uso de ferramentas de segurança como Llama Guard 2 e Code Shield.

O Llama Guard 2, construído sobre a taxonomia MLCommons, ÃĐ projetado para classificar entradas (prompts) e respostas do LLM, detectando conteÚdo que possa ser considerado inseguro ou prejudicial. O CyberSecEval 2 expande seu antecessor, adicionando medidas para prevenir o abuso do interpretador de cÃģdigo do modelo, capacidades de cibersegurança ofensiva e suscetibilidade a ataques de injeçÃĢo de prompts.

O Code Shield, uma nova introduçÃĢo com o Llama 3, adiciona filtragem de tempo de inferÊncia de cÃģdigo inseguro produzido por LLMs, mitigando riscos associados a sugestÃĩes de cÃģdigo inseguras, abuso do interpretador de cÃģdigo e execuçÃĢo segura de comandos.

Acessando e Usando o Llama 3

ApÃģs o lançamento do Llama 3 da Meta AI, vÃĄrias ferramentas de cÃģdigo aberto foram disponibilizadas para implantaçÃĢo local em vÃĄrios sistemas operacionais, incluindo Mac, Windows e Linux. Esta seçÃĢo detalha trÊs ferramentas notÃĄveis: Ollama, Open WebUI e LM Studio, cada uma oferecendo recursos Únicos para aproveitar as capacidades do Llama 3 em dispositivos pessoais.

Ollama: Disponível para Mac, Linux e Windows, Ollama simplifica a operaçÃĢo do Llama 3 e outros grandes modelos de linguagem em computadores pessoais, mesmo aqueles com hardware menos robusto. Ele inclui um gerenciador de pacotes para gerenciamento de modelo fÃĄcil e suporta comandos em plataformas para baixar e executar modelos.

Open WebUI com Docker: Essa ferramenta fornece uma interface amigÃĄvel baseada em Docker, compatível com Mac, Linux e Windows. Ele integra-se perfeitamente com modelos do registro Ollama, permitindo que os usuÃĄrios implantem e interajam com modelos como o Llama 3 dentro de uma interface web local.

LM Studio: Direcionado a usuÃĄrios em Mac, Linux e Windows, LM Studio suporta uma variedade de modelos e ÃĐ construído sobre o projeto llama.cpp. Ele fornece uma interface de chat e facilita a interaçÃĢo direta com vÃĄrios modelos, incluindo o modelo Instruct 8B do Llama 3.

Essas ferramentas garantem que os usuÃĄrios possam utilizar o Llama 3 em seus dispositivos pessoais de forma eficiente, acomodando uma gama de habilidades tÃĐcnicas e requisitos. Cada plataforma oferece processos passo a passo para configuraçÃĢo e interaçÃĢo com o modelo, tornando a IA avançada mais acessível a desenvolvedores e entusiastas.

Implantando o Llama 3 em Escala

AlÃĐm de fornecer acesso direto aos pesos do modelo, a Meta se associou a vÃĄrios provedores de nuvem, serviços de API de modelo e plataformas de hardware para permitir a implantaçÃĢo sem esforço do Llama 3 em escala.

Uma das principais vantagens do Llama 3 ÃĐ sua eficiÊncia de token melhorada, graças ao novo tokenizador. Os benchmarks mostram que o Llama 3 requer atÃĐ 15% menos tokens em comparaçÃĢo com o Llama 2, resultando em inferÊncia mais rÃĄpida e mais econÃīmica.

A integraçÃĢo da AtençÃĢo de Consulta Agrupada (GQA) na versÃĢo 8B do Llama 3 contribui para manter a eficiÊncia de inferÊncia em par com a versÃĢo 7B do Llama 2, apesar do aumento no nÚmero de parÃĒmetros.

Para simplificar o processo de implantaçÃĢo, a Meta forneceu o repositÃģrio Llama Recipes, que contÃĐm cÃģdigo de fonte aberto e exemplos para ajuste fino, implantaçÃĢo, avaliaçÃĢo de modelo e mais. Esse repositÃģrio serve como um recurso valioso para desenvolvedores que buscam aproveitar as capacidades do Llama 3 em suas aplicaçÃĩes.

Para aqueles interessados em explorar o desempenho do Llama 3, a Meta integrou seus modelos mais recentes à Meta AI, um assistente de IA de ponta construído com a tecnologia do Llama 3. Os usuÃĄrios podem interagir com a Meta AI por meio de vÃĄrios aplicativos da Meta, como Facebook (META ), Instagram, WhatsApp, Messenger e a web, para realizar tarefas, aprender, criar e se conectar com as coisas que importam para eles.

O Que Vem a Seguir para o Llama 3?

Enquanto as versÃĩes 8B e 70B marcam o início do lançamento do Llama 3, a Meta tem planos ambiciosos para o futuro desse LLM revolucionÃĄrio.

Nos prÃģximos meses, podemos esperar ver novas capacidades introduzidas, incluindo multimodalidade (a capacidade de processar e gerar diferentes modalidades de dados, como imagens e vídeos), multilingualismo (suporte a vÃĄrios idiomas) e janelas de contexto muito mais longas para melhor desempenho em tarefas que exigem contexto extensivo.

AlÃĐm disso, a Meta planeja lançar tamanhos de modelo maiores, incluindo modelos com mais de 400 bilhÃĩes de parÃĒmetros, que estÃĢo atualmente em treinamento e mostrando tendÊncias promissoras em termos de desempenho e capacidades.

Para avançar ainda mais no campo, a Meta tambÃĐm publicarÃĄ um artigo de pesquisa detalhado sobre o Llama 3, compartilhando suas descobertas e insights com a comunidade de IA mais ampla.

Como uma prÃĐvia do que estÃĄ por vir, a Meta compartilhou algumas imagens iniciais do desempenho de seu maior modelo de LLM em vÃĄrios benchmarks. Embora esses resultados sejam baseados em um checkpoint inicial e estejam sujeitos a alteraçÃĩes, eles fornecem um vislumbre emocionante do potencial futuro do Llama 3.

ConclusÃĢo

O Llama 3 representa um marco significativo na evoluçÃĢo dos grandes modelos de linguagem de cÃģdigo aberto, impulsionando os limites de desempenho, capacidades e prÃĄticas de desenvolvimento responsÃĄveis. Com sua arquitetura inovadora, conjunto de dados de treinamento maciço e tÃĐcnicas de ajuste fino de ponta, o Llama 3 estabelece novos benchmarks de desempenho para LLMs nas escalas de parÃĒmetro de 8B e 70B.

No entanto, o Llama 3 ÃĐ mais do que apenas um modelo de linguagem poderoso; ÃĐ um testemunho do compromisso da Meta em promover um ecossistema de IA aberto e responsÃĄvel. Ao fornecer recursos abrangentes, ferramentas de segurança e as melhores prÃĄticas, a Meta capacita os desenvolvedores a aproveitar todo o potencial do Llama 3, garantindo a implantaçÃĢo responsÃĄvel adaptada a seus casos de uso e audiÊncias específicas.

À medida que a jornada do Llama 3 continua, com novas capacidades, tamanhos de modelo e descobertas de pesquisa no horizonte, a comunidade de IA aguarda ansiosamente as aplicaçÃĩes inovadoras e os avanços que, sem dÚvida, surgirÃĢo desse LLM revolucionÃĄrio.

Seja vocÊ um pesquisador impulsionando os limites do processamento de linguagem natural, um desenvolvedor construindo a prÃģxima geraçÃĢo de aplicaçÃĩes inteligentes ou um entusiasta de IA curioso sobre os Últimos avanços, o Llama 3 promete ser uma ferramenta poderosa em seu arsenal, abrindo novas portas e desbloqueando um mundo de possibilidades.

Eu passei os Últimos cinco anos me imergindo no fascinante mundo de Aprendizado de MÃĄquina e Aprendizado Profundo. Minha paixÃĢo e expertise me levaram a contribuir para mais de 50 projetos de engenharia de software diversificados, com um foco particular em IA/ML. Minha curiosidade contínua tambÃĐm me levou em direçÃĢo ao Processamento de Linguagem Natural, um campo que estou ansioso para explorar mais.