Entrevistas

Andrea Vattani, Co-Fundador e Cientista Chefe da Spiketrap – Série de Entrevistas

mm
Adicione Unite.AI às suas fontes preferidas no Google

Andrea Vattani é o Co-Fundador e Cientista Chefe da Spiketrap, uma empresa de contextualização que fornece inteligência de audiência e desempenho de mídia para criadores, plataformas e marcas. A tecnologia de IA proprietária Clair extrai o sinal do ruído de conjuntos de dados não estruturados, fornecendo clareza e contexto sem precedentes, especialmente em ambientes online de alta velocidade.

O que o atraiu inicialmente para a ciência da computação e a IA?

Foi uma combinação de circunstâncias fortuitas. Eu cheguei à Universidade de Roma para fazer o exame de admissão em Estatística e descobri que estava um dia atrasado! Fui aconselhado a me inscrever em Ciência da Computação em vez disso e mudar para o departamento de Estatística um ano depois. Fui ao exame de admissão em Ciência da Computação (que era naquele dia!) e passei… nunca mais mudei para Estatística! Meu interesse em IA realmente começou com a realização de como os computadores podem ajudar a automatizar coisas, e a IA é a máquina de automação definitiva. Além disso, a linguagem natural e como as pessoas a usam sempre me interessaram: eu me concentrei em estudos clássicos no ensino médio, estudando grego antigo e latim, o que é provavelmente semelhante a como uma máquina se sente quando alimentada com um fluxo de palavras.

Você trabalhou anteriormente como Líder de Engenharia de Software Sênior na Amazon (AMZN ) Goodreads. Quais foram alguns dos projetos em que trabalhou e quais foram algumas das principais lições aprendidas com essa experiência?

Enquanto estava na Goodreads, eu trabalhei em vários projetos de aprendizado de máquina que incluíam detecção de spam e escalabilidade do mecanismo de recomendação de livros. Minhas lições aprendidas durante meu tempo lá foram aprender a importância de definir métricas de ML que correspondam aos objetivos dos negócios e dos clientes. Para dar um exemplo, os mecanismos de recomendação existem há muito tempo. Lembre-se da competição “Netflix (NFLX ) Prize” em 2009 para descobrir recomendações de filmes melhores? Algumas percepções das soluções vencedoras sugeriram que a probabilidade de você assistir a um filme não é muito impulsionada por gostar ou não, mas principalmente se é semelhante aos seus interesses. Isso pode funcionar para filmes, pois é um compromisso curto de 90 minutos, mas para livros não é o caso. Integrar o objetivo certo às suas métricas é fundamental.

Outra lição que eu apliquei na Spiketrap é construir equipes de IA que sejam orientadas à entrega e integradas ao roadmap do produto, em vez de uma equipe isolada apenas focada em explorações e pesquisas. Isso leva a uma melhor definição de objetivos, prazos e compreensão do ROI. Isso também favorece naturalmente a equipe a se concentrar na velocidade e praticidade de um modelo, em vez de apenas olhar para a precisão. Voltando ao exemplo da competição Netflix, os modelos das equipes vencedoras nunca foram integrados porque não eram práticos o suficiente, apesar de terem melhorado a precisão.

Sua pesquisa foi publicada em numerosos jornais. Qual, na sua opinião, é o artigo mais importante até agora?

Durante meu Ph.D., tive a sorte de colaborar com vários pesquisadores de diferentes áreas, incluindo aprendizado de máquina, “big data”, análise de dados sociais e teoria dos jogos. Um artigo que eu gosto por sua simplicidade e aplicabilidade é “K-Means++ escalável“: K-means++ é um método de agrupamento não supervisionado amplamente utilizado para dividir um conjunto de dados em K grupos coerentes. Ele faz isso adicionando um grupo de cada vez, então, quando você tem toneladas de dados e grupos, torna-se muito lento. Nesse artigo, mostramos como você pode alcançar o mesmo, se não melhor, precisão, paralelizando o método. Nossa metodologia é extremamente simples e foi implementada em várias bibliotecas de aprendizado de máquina.

Pode compartilhar a história de criação da Spiketrap?

Depois de trabalhar na Goodreads, eu e os co-fundadores da Spiketrap, Kieran e Virgilio, entendemos que havia uma lacuna na indústria para acessar insights de marca avançados de plataformas sociais de nicho. Ao aplicar tecnologias de IA, podemos abordar o problema de forma eficiente.

Na economia de hoje, é fundamental que as empresas ouçam seus clientes e suas respectivas indústrias como um todo. No entanto, muito do que os clientes têm a dizer sobre as marcas permanece inaudível. Milhões de pessoas expressam suas opiniões abertamente todos os dias, em plataformas como Twitter, Reddit, Twitch e outras. Isso se mostrou um recurso extremamente valioso para qualquer pesquisador de mercado, desde que o conteúdo possa ser contextualizado em escala. O problema é que a indústria de insights não acompanhou os comportamentos digitais e a linguagem em evolução.

As ferramentas de escuta ainda dependem de palavras-chave e buscas booleanas, perdendo grande parte da conversa que poderia e deveria ser atribuída a uma marca específica. Enquanto isso, as firmas de pesquisa de mercado foram pegos em um ato de equilíbrio cada vez mais difícil, tentando obter insights qualitativos de metodologias quantitativas e limitadas por custos.

Em resumo, as pessoas carecem das ferramentas necessárias para entender seu público em escala. Números de vendas e contagens de visualizações respondem ao “o quê” do comportamento do público, mas não ao “por quê”. Sem contexto, descobrir o que é correlação versus causalidade é um jogo de adivinhação. Reconhecendo esse vazio, mergulhamos no que uma solução para a compreensão contextual seria e a Spiketrap nasceu.

Quais são algumas das tecnologias de aprendizado de máquina utilizadas na Spiketrap?

Nós usamos uma multidão de tecnologias, desde a sua Scikit-learn usual até bibliotecas de aprendizado profundo como Pytorch. Além das bibliotecas, as metodologias, modelos e conjuntos de dados que usamos são principalmente proprietários. Aprendemos que os métodos e modelos prontos só levam você até certo ponto, mas para realmente resolver um problema, você precisa colocar seu próprio trabalho, começando com os objetivos e chegando à arquitetura do modelo e conjuntos de dados. Para dar um exemplo, a modelagem de tópicos é a tarefa de extrair temas de uma coleção de textos. Nosso “Spiketrap Convos” fornece aos nossos clientes insights cruciais sobre seu público e usa a modelagem de tópicos como um dos sinais. O método usual para modelagem de tópicos é o LDA (Alocação Latente de Dirichlet), mas infelizmente é muito inconsistente e imprevisível e simplesmente não é poderoso o suficiente. Do outro lado do espectro, você pode tentar um modelo pré-treinado moderno como o Bert-Topics, que – embora poderoso e abrangente – também é muito rígido e lento. O NLP e a IA de linguagem fizeram grandes avanços na última década, mas transformar modelos existentes em produtos ainda está longe do ideal e é um risco.

Pode elaborar sobre como a Spiketrap fornece compreensão instantânea da audiência para criadores, plataformas e marcas?

Os anunciantes e agências usam nossas tabelas de classificação de influenciadores e ferramentas de afinidade de marca para identificar criadores cujas comunidades são seguras para a marca em várias categorias, incluindo notas para conteúdo tóxico, profano e sexual, bem como segurança geral da comunidade.

Os criadores podem usar a ferramenta para mergulhar em transmissões individuais e ver quais conversas foram as mais ou menos seguras, quais impulsionaram o engajamento positivo para seus patrocinadores e onde eles poderiam melhorar seus esforços de moderação.

Um artigo recente intitulado ‘FeelsGoodMan: Inferindo Semântica de Neologismos do Twitch‘ foi publicado pela Spiketrap. Pode descrever brevemente o que é esse artigo?

A forma como as pessoas se comunicam e expressam online tem se tornado cada vez mais complexa e desafiadora de decifrar. Primeiro vieram os emoticons :-). Depois vieram os emojis. Depois vieram as memas… e agora “emotes”, uma nova forma de comunicação baseada em ícones que se tornou muito popular na plataforma de transmissão Twitch. Lembre-se de como os emojis são usados com texto regular, apresentam desafios semelhantes às memas, pois são gerados pelo usuário e seu significado criptográfico não tem conexão óbvia com a imagem real representada. Existem mais de 8 milhões de emotes distintos até o momento, com mais de 400 mil usados semanalmente. Ainda assim, as pessoas se comunicam efetivamente usando-os para expressar qualquer tipo de sentimento, como alegria, tédio, excitação ou sarcasmo. Nosso artigo recente é um “cookbook” de IA para inferir o significado semântico dos emotes. Nossa abordagem não requer manter e atualizar um conjunto de dados curado manualmente e é capaz de se adaptar automaticamente à introdução contínua de novos emotes, bem como à evolução do significado de emotes populares. Isso é particularmente importante quando um emote se torna carregado politicamente ou racialmente, o que vimos acontecer com emotes extremamente populares, como “TriHard”, “PogChamp” e “FeelsGoodMan”. O uso dinâmico da linguagem e as mudanças de significado apresentam problemas enormes para sistemas de moderação ou estruturas de análise de sentimento, então estamos orgulhosos de abordar esse problema da maneira certa na Spiketrap.

Há algo mais que você gostaria de compartilhar sobre a Spiketrap?

À medida que olhamos para o novo ano, a Spiketrap está trabalhando no desenvolvimento e aperfeiçoamento de uma nova ferramenta que fornecerá uma compreensão mais profunda do sentimento da marca para nossos clientes. A nova Ferramenta de Afinidade da Spiketrap fornece uma maneira interativa e intuitiva de identificar e quantificar afinidades de audiência entre criadores, marcas, jogos e mais. Para qualquer consulta, a ferramenta gera pontuações de índice de afinidade que indicam quão bem uma entidade específica está correlacionada positivamente a outra. Vários sinais contextuais compõem a pontuação, incluindo a frequência e o sentimento de menções relacionadas. A pilha de tecnologia da Spiketrap está posicionada de forma única para indexar afinidades entre jogos, marcas e criadores. A IA de NLP proprietária Clair processa milhões de mensagens de usuário geradas publicamente todos os dias, atribuindo conteúdo ambíguo a entidades dentro do extenso gráfico de conhecimento da Spiketrap, identificando tópicos de conversa, determinando sentimento, e monitorando segurança. A adição da nova Ferramenta de Afinidade empodera desenvolvedores, criadores, marcas e mais a entender melhor seu público e impacto de marca.

Obrigado pela grande entrevista, leitores que desejam aprender mais devem visitar Spiketrap.

Antoine é um líder visionário e sócio-fundador da Unite.AI, impulsionado por uma paixão inabalável por moldar e promover o futuro da IA e da robótica. Um empreendedor serial, ele acredita que a IA será tão disruptiva para a sociedade quanto a eletricidade, e é frequentemente pego falando sobre o potencial das tecnologias disruptivas e da AGI.

Como um futurista, ele está dedicado a explorar como essas inovações moldarão nosso mundo. Além disso, ele é o fundador da Securities.io, uma plataforma focada em investir em tecnologias de ponta que estão redefinindo o futuro e remodelando setores inteiros.