KI-Modelle und Plattformen

Neue vordefinierte (OTS) Datensätze von Appen beschleunigen die AI-Implementierung

mm
Unite.AI zu deinen bevorzugten Quellen auf Google hinzufügen

Appen Limited (ASX:APX), der führende Anbieter von hochwertigen Trainingsdaten für Organisationen, die effektive AI-Systeme im großen Maßstab aufbauen, gab heute die Einführung neuer vordefinierter (OTS) Datensätze bekannt. Diese Datensätze sind darauf ausgelegt, es Unternehmen zu erleichtern, die hochwertigen Trainingsdaten zu erwerben, die für die Beschleunigung ihrer künstlichen Intelligenz (AI) und maschinellen Lernprojekte (ML) erforderlich sind. Die neuen OTS-Datensätze umfassen menschliche Körperbewegungen und innovative Babyschreigefänge sowie skriptierte Sprache und Bilder mit Text, die für die optische Zeichenerkennung (OCR) geeignet sind, für hoch gefragte, aber schwer zu beschaffende Sprachen wie Arabisch, Kroatisch, Griechisch, Ungarisch, Thai und viele mehr. Mit den erweiterten Datensätzen umfasst Appens Gesamtangebot an OTS-Datensätzen über 250 Datensätze, die mehr als 11.000 Stunden Audio, über 25.000 Bilder und über 8,7 Millionen Wörter in 80 Sprachen und mehreren Dialekten enthalten.

Appens OTS-Datensätze sind ein schnelles, kosteneffizientes Werkzeug, um ein AI- oder ML-Projekt mit konsistenten, hochwertigen Trainingsdaten zu starten. Teams, die ihre AI-Fähigkeiten erweitern, können auch OTS-Datensätze nutzen, um die Genauigkeit effektiv zu verbessern, neue Modellfähigkeiten zu entwickeln und andere Verbesserungen in ihre AI-Modelle zu integrieren. Ein OTS-Datensatz wird oft innerhalb einer Woche geliefert, beispielsweise im Vergleich zu den acht bis zwölf Wochen für ein neues Datensammlungs- und Anreicherungsprojekt – oder sogar länger, je nach Komplexität. Alle Appen-Datensätze werden unter Verwendung einer vollständig transparenten, opt-in-Methode entwickelt, sodass AI-Spezialisten sicherstellen können, dass ihre Daten sauber und konform sind, was das potenzielle Risiko von Gegenreaktionen und Rufschädigung eliminiert.

„AI-Teams auf der ganzen Welt, die an Projekten mit engen Fristen und flexiblen Datenanforderungen arbeiten, können von der Verwendung von vordefinierten Datensätzen profitieren“, sagte Wilson Pang, CTO von Appen. „OTS-Datensätze verkürzen die Zeit bis zum Wert und bieten Zugang zu hochwertigen Daten zu einem niedrigeren Gesamtpreis als bei der Verwendung traditioneller Methoden. Wir bei Appen unternehmen die notwendigen Schritte, um sicherzustellen, dass alle unsere Datensätze ethisch beschafft und demografisch ausgewogen sind, was es Unternehmen ermöglicht, verantwortungsvolle AI-Praktiken durch die Minimierung von Voreingenommenheit in ihren Modellen und die faire Behandlung von Datenanreicherern aufrechtzuerhalten. Sie wissen immer genau, welche Qualität ein OTS-Datensatz hat, was dazu beiträgt, bessere AI zu entwickeln, die in der realen Welt funktioniert.“

MediaInterface hat Sprachtechnologielösungen für Gesundheitseinrichtungen in Deutschland und anderen Teilen Europas über 20 Jahre hinweg bereitgestellt. Als das Unternehmen nach Frankreich expandierte, verfügte es über vollständig lokalisierte Software, aber es fehlten französische Lexikondaten, insbesondere französische Namen und Orte, die oft in Patientengesundheitsinformationen referenziert werden. Durch die Verwendung von Appen-OTS-Datensätzen erwarb MediaInterface etwa 21.000 französische Namen und 14.000 Ortsnamen. „Die kritischen Daten von Appen wurden in unseren Hintergrundlexikon integriert, um erfolgreich in einem neuen Markt zu starten, und dies hilft uns, neue Vokabularien für unsere Kunden aufzubauen und unseren Ansatz für zukünftige Markteinführungen zu stärken“, sagte Ines Wendler, Produktmanagerin bei MediaInterface.

Die erfahrensten AI-Experten kombinieren OTS-Datensätze mit On-Demand-Datensammlungs- und Anreicherungsprojekten, um ihre komplexen AI-Modell-Trainingsdatenbedürfnisse zu erfüllen. Appen ist der Marktführer bei der Bereitstellung kontinuierlicher Unterstützung durch eine Reihe spezifischer Datensammlungsdienste, wie z.B. laufender Datenanreicherung und intelligenter Beschriftung, durch AI-gesteuerte Werkzeuge und automatisierte Workflows, um die Effizienz zu maximieren.

„Wir interagieren mit AI vom Moment des Aufwachens bis zum Moment des Schlafengehens – durch virtuelle Assistenten, Chatbots, Suchmaschinen, soziale Netzwerke, medizinische Geräte, intelligente Autos und andere Anwendungen“, sagte Judith Bishop, Appens Senior Director of AI-Spezialisten, die ein Team von 100 AI-Linguisten und Sprachexperten leitet. „Sprache ist oft die primäre Schnittstelle für viele dieser überzeugenden AI-Anwendungsfälle, sodass die Garantie einer großartigen Erfahrung erfordert, dass das Modell so trainiert wird, dass es für jeden funktioniert. Appens Engagement für hochwertige Daten und verantwortungsvolle, ethische AI-Entwicklung ermöglicht es Unternehmen, die unsere vordefinierten Datensätze kaufen, ihre AI-Projekte mit voller Zuversicht in ihre Daten zu beschleunigen.“

Zu den bereits bestehenden hunderten von Datensätzen, die bereits auf appen.com verfügbar sind, gehören die folgenden neuen Appen-OTS-Datensätze, die jetzt verfügbar sind:

  • Skriptierte Sprache für Arabisch (Ägypten), Arabisch (Saudi-Arabien), Arabisch (Vereinigte Arabische Emirate), Zentrales Khmer (Kambodscha), Kroatisch, Griechisch, Ungarisch, Polnisch, Spanisch (Spanien) und Türkisch
  • Bild-OCR für vereinfachtes Chinesisch, gedruckten Text, Thai, gedruckten Text und Finnisch, gedruckten Text – Enthält vorab aufgezeichnete Werbetafeln, Außenverpackungen, Schilder, Magazine und Menüs, um Computer-Vision-OCR-Modelle zu trainieren und zu aktualisieren
  • Menschliche Körperbewegung (China) – Enthält annotierte Videos von Menschen in Bewegung, die auf Pixel-Ebene verfolgt werden, geeignet für die Entwicklung von Spielen, Fitness-Apps und mehr
  • Babyschreigefänge (China) – Enthält vorab aufgezeichnete und annotierte Babyschreie, die verwendet werden können, um AI-Modelle zu trainieren, um unterschiedliche Schreie zu erkennen und Eltern zu alarmieren

Für weitere Informationen und um ein Appen-OTS-Datensatz-Beispiel anzufordern, klicken Sie hier.

Daniel ist ein großer Befürworter davon, wie künstliche Intelligenz letztendlich alles durcheinanderbringen wird. Er lebt und atmet Technologie und lebt dafür, neue Gadgets auszuprobieren.