Μοντέλα και πλατφόρμες AI
Νέα προκατασκευασμένα (OTS) Δεδομένα από την Appen για την Επιτάχυνση της Ανάπτυξης του AI
Appen Limited (ASX:APX), ο ηγέτης στην παροχή υψηλής ποιότητας δεδομένων εκπαίδευσης για οργανισμούς που κατασκευάζουν αποτελεσματικά συστήματα AI σε μεγάλη κλίμακα, ανακοίνωσε σήμερα νέα προκατασκευασμένα (OTS) δεδομένα. Αυτά τα δεδομένα σχεδιάζονται για να κάνουν πιο εύκολη και ταχύτερη την απόκτηση των υψηλής ποιότητας δεδομένων εκπαίδευσης που απαιτούνται για την επιτάχυνση των έργων τεχνητής νοημοσύνης (AI) και μηχανικής μάθησης (ML). Τα νέα OTS δεδομένα περιλαμβάνουν κίνηση του ανθρώπινου σώματος και καινοτόμα ήχους κλαψιάρικων μωρών, καθώς και προγραμματισμένη ομιλία και εικόνες με κείμενο που είναι κατάλληλα για οπτική αναγνώριση χαρακτήρων (OCR) για γλώσσες που είναι σε υψηλή ζήτηση αλλά δύσκολο να αποκτηθούν, όπως τα Αραβικά, τα Κροατικά, τα Ελληνικά, τα Ουγγρικά, τα Ταϊλανδικά και πολλά άλλα. Με τα επεκταμένα δεδομένα, η συνολική προσφορά OTS της Appen περιλαμβάνει πάνω από 250 δεδομένα, που αποτελούνται από πάνω από 11.000 ώρες ήχου, πάνω από 25.000 εικόνες και πάνω από 8,7 εκατομμύρια λέξεις σε 80 γλώσσες και πολλαπλά ιδιώματα.
Τα OTS δεδομένα της Appen είναι ένα γρήγορο και οικονομικό εργαλείο για την έναρξη ενός έργου AI ή ML με συνεπή υψηλής ποιότητας δεδομένα εκπαίδευσης. Οι ομάδες που επεκτείνουν τις ικανότητες AI τους μπορούν επίσης να χρησιμοποιήσουν OTS δεδομένα για να βελτιώσουν αποτελεσματικά την ακρίβεια, να αναπτύξουν νέες δεξιότητες μοντέλου και να ενσωματώσουν άλλες βελτιώσεις στα μοντέλα AI τους. Ένα OTS δεδομένο παραδίδεται συχνά μέσα σε μία εβδομάδα, για παράδειγμα, σε σύγκριση με τις οκτώ έως δώδεκα εβδομάδες για ένα νέο έργο συλλογής και αναnotation δεδομένων – ή ακόμη περισσότερο, ανάλογα με την πολυπλοκότητα. Όλα τα δεδομένα της Appen αναπτύσσονται χρησιμοποιώντας μια πλήρως διαφανή, opt-in μεθοδολογία, ώστε οι ειδικοί AI να possono να είναι βέβαιοι ότι τα δεδομένα τους είναι καθαρά και συμμορφώνονται, εξαλείφοντας τον πιθανό κίνδυνο αντίδρασης και ζημιάς στην φήμη.
«Οι ομάδες AI σε όλο τον κόσμο που εργάζονται σε έργα με στενές προθεσμίες και ευέλικτες απαιτήσεις δεδομένων possono να ωφεληθούν από τη χρήση προκατασκευασμένων δεδομένων», είπε ο Wilson Pang, CTO της Appen. «Τα OTS δεδομένα缩ρύνουν τον χρόνο για να φτάσουν στην αξία και παρέχουν πρόσβαση σε υψηλής ποιότητας δεδομένα σε χαμηλότερο συνολικό κόστος σε σύγκριση με τις παραδοσιακές μεθόδους. Εμείς στην Appen λαμβάνουμε τα απαραίτητα βήματα για να διασφαλίσουμε ότι όλα τα δεδομένα μας είναι ηθικά πηγαμένα και δημογραφικά ισορροπημένα, επιτρέποντας στις εταιρείες να διατηρούν υπεύθυνες πρακτικές AI με τη μείωση του προκατασκευασμένου στα μοντέλα τους και την εξασφάλιση της δίκαιης μεταχείρισης των annotators δεδομένων. Πάντα γνωρίζετε την ακριβή ποιότητα ενός OTS δεδομένου, το οποίο βοηθά στην κατασκευή καλύτερου AI που λειτουργεί στον πραγματικό κόσμο».
Η MediaInterface έχει παραδώσει λύσεις τεχνολογίας γλώσσας σε ιδρύματα υγείας στη Γερμανία και σε άλλες περιοχές της Ευρώπης για πάνω από 20 χρόνια. Όταν η εταιρεία επεκτεινόταν στη Γαλλία, είχε πλήρως τοπικοποιημένο λογισμικό αλλά έλλειπε γαλλικό λεξικό δεδομένων, ιδιαίτερα γαλλικά ονόματα και τοπωνύμια, τα οποία αναφέρονται συχνά σε πληροφορίες υγείας ασθενών. Χρησιμοποιώντας OTS δεδομένα της Appen, η MediaInterface απέκτησε περίπου 21.000 γαλλικά ονόματα και 14.000 ονόματα τόπων. «Τα κρίσιμα δεδομένα από την Appen έχουν ενσωματωθεί στο φόντο λεξικού μας για να εκκινήσουμε με επιτυχία σε μια νέα αγορά, και αυτό μας βοηθά να κατασκευάσουμε νέες λεξικές για τους πελάτες μας και να ενισχύσουμε την προσέγγισή μας για μελλοντικές εκκινήσεις αγοράς», είπε η Ines Wendler, product manager της MediaInterface.
Οι πιο έμπειροι ειδικοί AI συνδυάζουν OTS δεδομένα με έργα συλλογής και αναnotation δεδομένων κατά παραγγελία για να ικανοποιήσουν τις σύνθετες απαιτήσεις δεδομένων εκπαίδευσης των μοντέλων AI τους. Η Appen είναι ο ηγέτης στην παροχή συνεχούς υποστήριξης μέσω μιας σειράς συγκεκριμένων υπηρεσιών συλλογής δεδομένων, όπως η συνεχής αναnotation δεδομένων και η έξυπνη ετικέτα, μέσω εργαλείων AI και αυτοματοποιημένων ροών εργασίας για τη μεγιστοποίηση της αποδοτικότητας.
«Συμμετέχουμε με το AI από τη στιγμή που ξυπνάμε μέχρι τη στιγμή που κοιμούμαστε – μέσω εικονικών βοηθών, chatbots, μηχανών αναζήτησης, κοινωνικών δικτύων, ιατρικών συσκευών, έξυπνων αυτοκινήτων και άλλων εφαρμογών», είπε η Judith Bishop, senior director των ειδικών AI της Appen, η οποία ηγείται μιας ομάδας 100 AI γλωσσολόγων και ειδικών γλώσσας. «Η γλώσσα είναι συχνά η πρωταρχική διεπαφή για πολλές από αυτές τις ελκυστικές περιπτώσεις AI, ώστε να εγγυηθεί μια υπέροχη εμπειρία, το μοντέλο πρέπει να εκπαιδευτεί για να λειτουργεί για όλους. Η δέσμευση της Appen για υψηλής ποιότητας δεδομένα και υπεύθυνη, ηθική ανάπτυξη AI επιτρέπει στις εταιρείες που αγοράζουν τα προκατασκευασμένα δεδομένα μας να επιταχύνουν τα έργα AI τους με πλήρη εμπιστοσύνη στα δεδομένα τους».
Προσθέτοντας τα υπάρχοντα εκατοντάδες δεδομένα που ήδη υπάρχουν στο appen.com, η λίστα με τα νέα OTS δεδομένα της Appen που είναι τώρα διαθέσιμα περιλαμβάνει:
- Προγραμματισμένη ομιλία για Αραβικά (Αίγυπτος), Αραβικά (Σαουδική Αραβία), Αραβικά (Ηνωμένα Αραβικά Εμιράτα), Κεντρικά Χμερ (Καμπότζη), Κροατικά, Ελληνικά, Ουγγρικά, Πολωνικά, Ισπανικά (Ισπανία) και Τουρκικά
- Εικόνα OCR για απλοποιημένα Κινέζικα εκτυπωμένα κείμενα, Ταϊλανδικά εκτυπωμένα κείμενα και Φινλανδικά εκτυπωμένα κείμενα – Περιλαμβάνει προηχογραφημένα πινακίδες, εξωτερική συσκευασία, σημάδια, περιοδικά και μενού για να εκπαιδεύσει και να ενημερώσει μοντέλα OCR οπτικής αναγνώρισης
- Κίνηση του ανθρώπινου σώματος (Κίνα) – Περιλαμβάνει αναnotated βίντεο ανθρώπων που κινούνται, tracked at pixel level, κατάλληλα για ανάπτυξη παιχνιδιών, εφαρμογές φυσικής κατάστασης και άλλα
- Ήχος κλαψιάρικων μωρών (Κίνα) – Περιλαμβάνει προηχογραφημένα και αναnotated ήχους μωρών που μπορούν να χρησιμοποιηθούν για να εκπαιδεύσουν μοντέλα AI να αναγνωρίζουν διαφορετικούς ήχους κλαψιάρικων και να ειδοποιούν τους γονείς
Για περισσότερες πληροφορίες και για να ζητήσετε ένα δείγμα OTS δεδομένων της Appen, κάντε κλικ εδώ.












