Modelos e plataformas de IA

O Facebook Cria um Chatbot de Domínio Aberto com Som Natural Treinado em 1,5 Bilhões de Postagens do Reddit

mm
Adicione Unite.AI às suas fontes preferidas no Google

O Facebook (META ) lançou recentemente um chatbot de domínio aberto chamado “Blender”. De acordo com a BBC, o Blender do Facebook é o maior chatbot de domínio aberto da empresa e, de acordo com a empresa, é capaz de mostrar empatia, personalidade e conhecimento, superando e se sentindo mais humano do que outros chatbots. O Blender está disponível para uso em três variantes diferentes, cada uma com um nível diferente de complexidade e sofisticação do modelo. Há um modelo neural de 90 milhões de parâmetros, um modelo de 2,7 bilhões de parâmetros e um modelo de 9,4 bilhões de parâmetros. O modelo de 9,4 bilhões de parâmetros é aproximadamente 3,6 vezes maior do que o maior chatbot existente atualmente.

O Facebook afirma que o Blender é o primeiro chatbot amplamente disponível que combina uma conjunto complexo e diversificado de habilidades conversacionais, como conhecimento e empatia. O chatbot Blender é capaz de discutir uma variedade de tópicos e manter uma conversa que acompanha até 14 “turnos” conversacionais. Relatadamente, aproximadamente 49% das pessoas que interagiram com o chatbot preferiram interagir com o bot em vez de outra pessoa.

O Blender foi treinado usando dados coletados de conversas de domínio público coletadas de sites de mídia social, como o Reddit. O conjunto de dados usado para treinar o Blender incluiu aproximadamente 1,5 bilhão de exemplos de conversas. Embora os dados de treinamento e a sofisticação do modelo tenham permitido que o chatbot realizasse discussões complexas e tivesse um som mais natural e humano, surgiram alguns problemas como resultado dessa técnica de treinamento. De acordo com os pesquisadores, o Blender às vezes respondia a prompts conversacionais de forma agressiva ou com linguagem ofensiva. Além disso, o chatbot ocasionalmente respondia com falsidades e fatos inventados. A equipe de pesquisa é otimista de que revisões no modelo lidarão com esses problemas, mas eles queriam lançar os modelos de qualquer forma.

De acordo com um porta-voz do Facebook, citado pela BBC, “lançar modelos é essencial para permitir insights completos e confiáveis sobre suas capacidades”.

Os pesquisadores do Facebook ainda precisarão superar dois grandes desafios para ter sucesso, de acordo com o diretor executivo da consultoria de inteligência artificial The Envisioners, Dave Choplin. Citado pela BBC, Choplin acredita que os pesquisadores enfrentarão desafios significativos para replicar as muitas nuances das conversas que os humanos frequentemente dão como certas e que os dados usados para treinar o modelo podem inibir o modelo de maneiras que os pesquisadores do Facebook podem encontrar difíceis de superar.

“Como grande plataforma que é o Reddit, treinar algoritmos com base nas conversas que você encontra lá vai te dar muito lixo junto com o trigo”, disse Choplin.

O Facebook fez comparações entre seu próprio chatbot Blender e o chatbot contemporâneo do Google (GOOGL ) chamado Meena. O post do blog do Facebook exibiu comparações entre Meena e Blender, e de acordo com os dados do Facebook, aproximadamente 75% dos respondentes que haviam mantido uma conversa com o Blender disseram que prefeririam ter uma discussão prolongada com o Blender em vez do Meena. Além disso, aproximadamente 67% dos respondentes afirmaram que o Blender era mais natural e humano do que o Meena quando se tratava de conversas longas.

No futuro, a equipe de pesquisa do Facebook deseja melhorar a capacidade conversacional dos modelos, projetando modelos que possam suportar conversas ainda mais longas com a ajuda de novas funções de perda e arquiteturas. Além disso, os pesquisadores estão visando lidar com viés de gênero e linguagem potencialmente prejudicial, construindo classificadores melhores e dados de treinamento mais representativos.

Blogueiro e programador com especialidades em Machine Learning e Deep Learning tópicos. Daniel espera ajudar os outros a usar o poder da IA para o bem social.