AI-modeller og plattformer
Åpen datasett for Covid-19 lansert for maskinlæring
Det hvite hus’ kontor for vitenskap og teknologi ber forskere om å analysere tusenvis av fagartikler med kunstig intelligens (KI)-teknologi
Alle artiklene, som utgjør rundt 29 000, kan gi svar på spørsmål om koronaviruset. Rundt 13 000 av artiklene i databasen er i sin helhet og er maskinlesbare. For de andre 16 000 artiklene har databasen delvis tekst og sammenfatninger.
I løpet av de siste dagene har amerikanske regjeringsfunksjonærer arbeidet med amerikanske teknologiselskaper og forskningsinstitusjoner for å sikre juridisk tillatelse til å gjøre koronavirus-papirene tilgjengelige.
Den åpne datasettet kalles COVID-19 Open Research Dataset, eller CORD-19. Det vil hele tiden legge til ny informasjon i ett sentralisert nav, og gi forskere og andre en enkelt plass å få tilgang til det.
Partnerskapet kunngjort av Det hvite hus inkluderer Chan Zuckerberg Initiative, Microsoft (MSFT ) Research, Allen Institute for Artificial Intelligence, National Institute of Healths National Library of Medicine, Georgetown Universitys Center for Security and Emerging Technology, Cold Spring Harbor Laboratory og Kaggle AI-plattformen, som eies av Google.
Ifølge USAs CTO Michael Kratsios er CORD-19-datasettet den “mest omfattende samlingen av maskinlesbare koronavirus-litteratur til dags dato”.
National Academy of Sciences, Engineering, and Medicine arbeidet med Verdens helseorganisasjon (WHO) for å utvikle “høy prioritet” spørsmål. Disse spørsmålene dreier seg om forholdet mellom koronavirus og genetikk, inkubasjon, behandling, symptomer og forebygging.
Noen av forskningen i databasen er pre-publikasjon forskning hentet fra ressurser som medRxiv og bioRxiv. Disse er åpne arkiver.
Cori Bargmann er sjef for vitenskap i Chan Zuckerberg Initiative.
“Deling av vital informasjon på tvers av vitenskapelige og medisinske samfunn er nøkkel til å akselerere vår evne til å respondere på koronavirus-pandemien,” sa Bargmann.
Ifølge oppropet lansert av Det hvite hus, ble databasen utviklet gjennom bruk av Microsofts web-skala litteratur kurering verktøy, som identifiserte og samlet forskjellig vitenskapelig arbeid fra hele verden. Chan Zuckerberg Initiative ga tilgang til pre-publikasjon innhold, National Library of Medicine ga tilgang til litteratur innhold, og Allen AI-teamet formaterer innholdet så det kan analyseres.
Dr. Eric Horvitz er Chief Scientific Officer i Microsoft.
“Det er alle hendene på dekk når vi møter COVID-19-pandemien,” sa Horvitz. “Vi må komme sammen som selskaper, regjeringer og vitenskapsmenn og arbeide for å bringe våre beste teknologier til å bære over biomedisin, epidemiologi, KI og andre vitenskaper. COVID-19-litteratur ressursen og utfordringen vil stimulere arbeid som kan akselerere veien til løsninger på COVID-19.”
Mange håper at denne tilnærmingen fungerer og gir en ny måte å bruke KI-teknologi og maskinlæring i fremtiden. En av disse personene er Dr. Dewey Murdick, direktør for data vitenskap i Georgetown Universitys Center for Security and Emerging Technology. Dr. Murdick hjalp å koordinere prosjektet.
“Denne verdifulle nye ressursen er frukten av uselvisk samarbeid og tilbyr nå muligheten til å finne svar på viktige spørsmål om COVID-19,” sa Dr. Murdick. “Når krisen er over, håper vi at dette prosjektet vil inspirere nye måter å bruke maskinlæring til å fremme vitenskapelig forskning.”
Hvis dette prosjektet lykkes i å gi nødvendige svar om koronavirus, kan det brukes som en modell i fremtiden. KI-teknologi er et kraftig verktøy, og det kan analysere resultater fra eksperter og institusjoner over hele verden mye raskere enn mennesker. Dette betyr en raskere respons tid når en pandemi eller annen krise bryter ut, hvilket kan redde mange liv og forhindre økonomisk uro.












