Entrevistas

Fabiana Clemente, Co-fundadora e Diretora de Dados da YData – Série de Entrevistas

mm
Adicione Unite.AI às suas fontes preferidas no Google

Fabiana Clemente é a Co-fundadora e Diretora de Dados da YData. A YData é uma startup de IA que criou a primeira solução de desenvolvimento centrada em dados para combinar descoberta, melhoria e escalabilidade em uma única plataforma.

O que a atraiu inicialmente para a IA e o aprendizado de máquina?

Minha formação é em Matemática Aplicada, onde tive a oportunidade de aprender e entender como podemos extrair informações a partir de dados, bem como fazê-lo utilizando código. Na época, não era tão “sexy” quanto o Aprendizado de Máquina, mas definitivamente foi o que despertou minha paixão pela área.

Pode compartilhar a história por trás da criação da YData?

Como uma Cientista de Dados que trabalhou tanto em startups quanto em empresas, tive minha cota de lutas – às vezes, o acesso aos dados era bloqueado sob a justificativa de segurança ou privacidade, outras vezes o acesso era fácil, mas a qualidade dos dados não estava nem perto do que era necessário para construir soluções baseadas em IA. Sabendo que essas lutas são muito frequentes na maioria das organizações, nos inspirou a criar a empresa com o objetivo de ajudar essas equipes a superar esses obstáculos, acelerando seu desenvolvimento de IA com dados melhorados.

Pode descrever para nosso público o que é dados sintéticos?

Dados sintéticos são considerados qualquer dado que não foi gerado no mundo real, ou seja, qualquer dado criado artificialmente. Existem métodos que permitem a geração de dados sintéticos – desde estratégias baseadas em regras até o uso de modelos de Aprendizado de Máquina ou Aprendizado Profundo para aprender essas “regras” para nós. Na YData, adotamos e nos especializamos em uma estratégia baseada em Aprendizado Profundo para gerar novos dados que mantêm o comportamento de eventos do mundo real, sem preocupações com privacidade.

O que torna os dados sintéticos tão importantes?

Quanto mais as organizações percebem a importância dos dados para impulsionar seus negócios, mais a importância e o papel dos dados sintéticos serão entendidos. Coletar dados reais não é apenas demorado e caro, mas às vezes, impossível. Para construir aplicações de IA, os dados são um requisito difícil – é aqui que os dados sintéticos entram em cena. A capacidade de gerar cenários não vistos ou simplesmente desbloquear o acesso aos dados é fundamental para evoluir em um mundo onde pioneiros, como Andrew Ng, afirmam que se tornar centrado em dados é fundamental para uma adoção de IA bem-sucedida.

Em carros autônomos ou outras atividades de automação de máquinas, já podemos perceber a importância dos dados sintéticos, então eu diria que é apenas natural que essa compreensão se espalhe por todos os verticais da indústria.

Como a YData gera dados sintéticos?

A YData utiliza principalmente modelos gerativos profundos para aprender os atributos estatísticos e correlações entre variáveis dos dados originais. Isso permite que o modelo gere um conjunto de dados estatisticamente relevante que tem o mesmo valor comercial do original, sem permitir a rastreabilidade dos registros originais.

A YData está impulsionando essa tecnologia para frente e é a empresa por trás da Comunidade de Dados Sintéticos – um grupo de especialistas em ciência de dados comprometidos em evangelizar e ajudar qualquer um que queira aprender e usar essa tecnologia.

Como a plataforma da YData ajuda a descobrir e desbloquear novas fontes de dados?

A plataforma da YData inclui conectores integrados para qualquer tipo de banco de dados, armazenamento de dados ou lago de dados, que permite aos usuários acessar facilmente metadados relevantes e entender se os dados existentes são úteis para responder às perguntas de negócios que têm em mãos – sem sequer olhar para os registros reais.

Pode compartilhar alguns detalhes sobre a Comunidade de Dados Sintéticos de Código Aberto?

Dados sintéticos estão apenas em seus primeiros dias e, por isso, a conscientização sobre como são gerados, os benefícios ou limitações ainda são desconhecidos para uma audiência mais ampla. Por isso, na YData, decidimos tomar um caminho mais educacional, criando a Comunidade de Dados Sintéticos – além de ser um lugar para trocar ideias ou obter ajuda de especialistas no campo de dados sintéticos, é também um lugar onde cientistas de dados e outros perfis técnicos podem começar sua jornada em dados sintéticos, com alguns dos algoritmos mais interessantes da literatura.

Além disso, também oferecemos uma perspectiva sobre a qualidade dos dados, para que os cientistas de dados possam primeiro entender os dados com os quais estão trabalhando, antes de sintetizar ou melhorar a sintetização de dados. Estamos verdadeiramente comprometidos em ajudar equipes de dados a se tornarem cada vez mais centradas em dados.

A YData anunciou recentemente $2,7 milhões em financiamento para acelerar sua expansão internacional. Pode compartilhar alguns detalhes sobre o que isso significa para o futuro da empresa e sua estratégia de expansão?

A YData nasceu internacional – sabíamos que esse tipo de tecnologia precisa de adotantes precoces que geralmente estão nos países mais sofisticados. Por isso, nossos primeiros clientes já estavam fora de Portugal, por toda a Europa, e agora estamos estabelecendo uma presença na América do Norte também. Esse financiamento nos permitirá fortalecer nossa presença em ambos os continentes, não apenas comercialmente, mas também para crescer a equipe: somos uma equipe totalmente distribuída, o que nos permite contratar os melhores talentos, onde quer que estejam.

Há algo mais que você gostaria de compartilhar sobre a YData?

A YData está impulsionando a barreira da IA centrada em dados e criando uma nova categoria: DataPrepOps – embora seja um nome feio, é uma dor que a maioria das empresas enfrenta hoje em dia quando se trata de desenvolvimento de ciência de dados. A tendência de Qualidade de Dados continua a crescer e, após os Pipelines de Dados e a Observabilidade de Dados, a Qualidade de Dados para equipes de Ciência de Dados ainda está em sua infância, e a YData está emergindo como uma líder de pensamento na preparação de dados.

Obrigada pela grande entrevista, leitores que desejam aprender mais devem visitar YData.

Antoine é um líder visionário e sócio-fundador da Unite.AI, impulsionado por uma paixão inabalável por moldar e promover o futuro da IA e da robótica. Um empreendedor serial, ele acredita que a IA será tão disruptiva para a sociedade quanto a eletricidade, e é frequentemente pego falando sobre o potencial das tecnologias disruptivas e da AGI.

Como um futurista, ele está dedicado a explorar como essas inovações moldarão nosso mundo. Além disso, ele é o fundador da Securities.io, uma plataforma focada em investir em tecnologias de ponta que estão redefinindo o futuro e remodelando setores inteiros.