Wawancara

Ingo Mierswa, Pendiri & Presiden di RapidMiner, Inc – Seri Wawancara

mm
Tambahkan Unite.AI ke sumber pilihan Anda di Google

Ingo Mierswa adalah Pendiri & Presiden di RapidMiner, Inc. RapidMiner membawa kecerdasan buatan ke perusahaan melalui platform ilmu data yang terbuka dan dapat diperluas. Dibangun untuk tim analitik, RapidMiner menyatukan seluruh siklus hidup ilmu data dari persiapan data hingga pembelajaran mesin hingga pemodelan prediktif. Lebih dari 625.000 profesional analitik menggunakan produk RapidMiner untuk menghasilkan pendapatan, mengurangi biaya, dan menghindari risiko.

Apa yang menginspirasi Anda untuk meluncurkan RapidMiner?

Saya telah bekerja di bisnis konsultasi ilmu data selama banyak tahun dan saya melihat kebutuhan akan platform yang lebih intuitif dan dapat diakses oleh orang-orang tanpa pendidikan formal di ilmu data. Banyak solusi yang ada pada saat itu bergantung pada pengkodean dan scripting dan mereka tidak ramah pengguna. Selain itu, ini membuat data sulit untuk dikelola dan dipelihara solusi yang dikembangkan dalam platform tersebut. Secara dasar, saya menyadari bahwa proyek-proyek ini tidak perlu begitu sulit, sehingga kami mulai menciptakan platform RapidMiner untuk memungkinkan siapa saja menjadi ilmuwan data yang hebat.

Bagaimana Anda dapat membahas tentang tata kelola transparansi penuh yang saat ini digunakan oleh RapidMiner?

Ketika Anda tidak dapat menjelaskan model, itu sangat sulit untuk menyetel, mempercayai, dan menerjemahkan. Banyak pekerjaan ilmu data adalah komunikasi hasil kepada orang lain sehingga pemangku kepentingan dapat memahami bagaimana meningkatkan proses. Ini memerlukan kepercayaan dan pemahaman yang mendalam. Juga, masalah kepercayaan dan terjemahan dapat membuatnya sangat sulit untuk mengatasi persyaratan perusahaan untuk mendapatkan model ke produksi. Kami sedang melawan pertempuran ini dengan beberapa cara:

Sebagai platform ilmu data visual, RapidMiner secara inheren memetakan penjelasan untuk semua pipa data dan model dalam format yang sangat dapat dikonsumsi yang dapat dipahami oleh ilmuwan data atau non-ilmuwan data. Ini membuat model transparan dan membantu pengguna memahami perilaku model dan mengevaluasi kekuatan dan kelemahan serta mendeteksi potensi bias.

Selain itu, semua model yang dibuat di platform datang dengan visualisasi ekstensif untuk pengguna – biasanya pengguna yang membuat model – untuk mendapatkan wawasan model, memahami perilaku model, dan mengevaluasi bias model.

RapidMiner juga menyediakan penjelasan model – bahkan ketika dalam produksi: Untuk setiap prediksi yang dibuat oleh model, RapidMiner menghasilkan dan menambahkan faktor-faktor yang mempengaruhi keputusan yang diambil oleh model dalam produksi.

Akhirnya – dan ini sangat penting bagi saya secara pribadi karena saya mendorong ini dengan tim teknik kami beberapa tahun yang lalu – RapidMiner juga menyediakan kemampuan simulator model yang sangat kuat, yang memungkinkan pengguna untuk mensimulasikan dan mengamati perilaku model berdasarkan data input yang disediakan oleh pengguna. Data input dapat diatur dan diubah dengan sangat mudah, memungkinkan pengguna untuk memahami perilaku prediktif model pada berbagai kasus hipotetis atau dunia nyata. Simulator juga menampilkan faktor-faktor yang mempengaruhi keputusan model. Pengguna – dalam hal ini bahkan pengguna bisnis atau ahli domain – dapat memahami perilaku model, memvalidasi keputusan model terhadap hasil nyata atau pengetahuan domain, dan mengidentifikasi masalah. Simulator memungkinkan Anda untuk mensimulasikan dunia nyata dan melihat ke masa depan – ke masa depan Anda, sebenarnya.

Bagaimana RapidMiner menggunakan pembelajaran dalam?

Penggunaan pembelajaran dalam oleh RapidMiner adalah sesuatu yang kita banggakan. Pembelajaran dalam dapat sangat sulit untuk diterapkan dan non-ilmuwan data sering berjuang dengan pengaturan jaringan tanpa dukungan ahli. RapidMiner membuat proses ini semudah mungkin bagi pengguna semua jenis. Pembelajaran dalam, misalnya, adalah bagian dari produk Auto machine learning (ML) kami yang disebut RapidMiner Go. Di sini, pengguna tidak perlu tahu apa-apa tentang pembelajaran dalam untuk menggunakan model-model yang canggih ini. Selain itu, pengguna kuat dapat lebih dalam dan menggunakan perpustakaan pembelajaran dalam populer seperti Tensorflow, Keras, atau DeepLearning4J langsung dari alur kerja visual yang mereka bangun dengan RapidMiner. Ini seperti bermain dengan balok bangunan dan menyederhanakan pengalaman bagi pengguna dengan keterampilan ilmu data yang lebih sedikit. Melalui pendekatan ini, pengguna kami dapat membangun arsitektur jaringan yang fleksibel dengan fungsi aktivasi yang berbeda dan jumlah node yang ditentukan pengguna, lapisan berganda dengan jumlah node yang berbeda, dan memilih dari teknik pelatihan yang berbeda.

Jenis pembelajaran mesin apa lagi yang digunakan?

Semua! Kami menawarkan ratusan algoritma pembelajaran yang berbeda sebagai bagian dari platform RapidMiner – semua yang dapat diterapkan dalam bahasa pemrograman ilmu data yang umum digunakan Python dan R. Di antaranya, RapidMiner menawarkan metode untuk Naive Bayes, regresi seperti Model Linear Umum, clustering seperti k-Means, FP-Growth, Pohon Keputusan, Hutan Acak, Pembelajaran Dalam Paralel, dan Pohon Boosting Gradien. Ini dan banyak lagi adalah bagian dari perpustakaan pemodelan RapidMiner dan dapat digunakan dengan satu klik.

Bagaimana Anda dapat membahas tentang bagaimana Auto Model mengetahui nilai optimal untuk digunakan?

RapidMiner AutoModel menggunakan otomatisasi cerdas untuk mempercepat semua yang dilakukan pengguna dan memastikan model yang akurat dan kuat dibangun. Ini termasuk pemilihan instance dan penghapusan outlier otomatis, teknik rekayasa fitur untuk jenis data kompleks seperti tanggal atau teks, dan rekayasa fitur otomatis multi-tujuan penuh untuk memilih fitur optimal dan membangun yang baru. Auto Model juga termasuk metode pembersihan data lainnya untuk memperbaiki masalah umum dalam data seperti nilai yang hilang, profil data dengan menilai kualitas dan nilai kolom data, normalisasi data, dan berbagai transformasi lainnya.

Auto Model juga mengekstrak metadata kualitas data – misalnya, bagaimana sebuah kolom berperilaku seperti ID atau apakah ada banyak nilai yang hilang. Metadata ini digunakan sebagai tambahan dari metadata dasar dalam mengotomatisasi dan membantu pengguna dalam ‘menggunakan nilai optimal’ dan menangani masalah kualitas data.

Untuk detail lebih lanjut, kami telah memetakan semua ini dalam Blueprint Auto Model kami. (Gambar di bawah untuk konteks tambahan)

Ada empat fase dasar di mana otomatisasi diterapkan:

– Persiapan data: Analisis otomatis data untuk mengidentifikasi masalah kualitas umum seperti korelasi, nilai yang hilang, dan stabilitas.
– Pemilihan model dan optimasi otomatis, termasuk validasi dan perbandingan kinerja, yang menyarankan teknik pembelajaran mesin terbaik untuk data yang diberikan dan menentukan parameter optimal.
– Simulasi model untuk membantu menentukan tindakan preskriptif spesifik untuk diambil untuk mencapai hasil yang diinginkan yang diprediksi oleh model.
– Dalam fase penerapan model dan operasi, pengguna ditampilkan faktor-faktor seperti drift, bias, dan dampak bisnis, secara otomatis tanpa pekerjaan tambahan yang diperlukan.

Bias komputer adalah masalah dengan jenis AI, apakah ada kontrol yang ada untuk mencegah bias dari muncul dalam hasil?

Ya, ini sangat penting untuk ilmu data etis. Fitur tata kelola yang disebutkan sebelumnya memastikan bahwa pengguna dapat selalu melihat data apa yang telah digunakan untuk membangun model, bagaimana data tersebut telah diubah, dan apakah ada bias dalam pemilihan data. Selain itu, fitur-fitur kami untuk deteksi drift adalah alat yang sangat kuat untuk mendeteksi bias. Jika model dalam produksi menunjukkan banyak drift dalam data input, ini dapat menjadi tanda bahwa dunia telah berubah secara dramatis. Namun, ini juga dapat menjadi indikator bahwa ada bias yang parah dalam data pelatihan. Di masa depan, kami mempertimbangkan untuk membangun model pembelajaran mesin yang dapat mendeteksi bias dalam model lain.

Bagaimana Anda dapat membahas tentang RapidMiner AI Cloud dan bagaimana ia membedakan diri dari produk lain?

Persyaratan untuk proyek ilmu data dapat besar, kompleks, dan intensif komputasi, yang telah membuat penggunaan teknologi cloud menjadi strategi yang menarik bagi ilmuwan data. Sayangnya, platform ilmu data cloud asli mengikat Anda ke layanan cloud dan penawaran penyimpanan data dari vendor cloud tertentu.

RapidMiner AI Cloud adalah layanan cloud kami yang disampaikan melalui platform RapidMiner. Penawaran ini dapat disesuaikan dengan lingkungan pelanggan mana pun, terlepas dari strategi cloud mereka. Ini sangat penting saat ini karena sebagian besar bisnis mendekati manajemen data cloud dengan sangat cepat dalam iklim saat ini. Fleksibilitas adalah apa yang membedakan RapidMiner AI Cloud. Ini dapat berjalan di layanan cloud mana pun, tumpukan cloud pribadi, atau dalam setup hibrida. Kami adalah cloud portabel, cloud agnostik, multi-cloud – apa pun yang Anda suka.

RapidMiner AI Cloud juga sangat mudah, karena kami menawarkan kemampuan untuk mengelola semua atau sebagian penerapan untuk klien sehingga mereka dapat fokus menjalankan bisnis mereka dengan AI, bukan sebaliknya. Ada bahkan opsi on-demand, yang memungkinkan Anda untuk memutar lingkungan sesuai kebutuhan untuk proyek singkat.

RapidMiner Radoop menghilangkan beberapa kompleksitas di balik ilmu data, bagaimana Radoop menguntungkan pengembang?

Radoop sebagian besar untuk non-pengembang yang ingin memanfaatkan potensi big data. RapidMiner Radoop menjalankan alur kerja RapidMiner langsung di dalam Hadoop dengan cara tanpa kode. Kami juga dapat memasukkan mesin eksekusi RapidMiner ke dalam Spark sehingga mudah untuk mendorong alur kerja lengkap ke Spark tanpa kompleksitas yang datang dari pendekatan berbasis kode.

Apakah entitas pemerintah dapat menggunakan RapidMiner untuk menganalisis data untuk memprediksi wabah potensial, mirip dengan bagaimana BlueDot beroperasi?

Sebagai platform ilmu data dan pembelajaran mesin umum, RapidMiner dimaksudkan untuk mempermudah dan meningkatkan proses pembuatan dan pengelolaan model, terlepas dari subjek atau domain yang ada di pusat masalah ilmu data/pembelajaran mesin. Meskipun fokus kami tidak pada memprediksi wabah, dengan data yang tepat, seorang ahli subjek (seperti seorang virolog atau ahli epidemiologi, dalam hal ini) dapat menggunakan platform untuk membuat model yang dapat memprediksi wabah dengan akurat. Faktanya, banyak peneliti menggunakan RapidMiner – dan platform kami gratis untuk tujuan akademis.

Apakah ada yang lain yang ingin Anda bagikan tentang RapidMiner?

Cobalah! Anda mungkin terkejut betapa mudahnya ilmu data dapat dilakukan dan betapa baiknya platform yang baik dapat meningkatkan produktivitas Anda dan tim Anda.

Terima kasih atas wawancara yang luar biasa ini, pembaca yang ingin mempelajari lebih lanjut harus mengunjungi RapidMiner.

Antoine adalah seorang pemimpin visioner dan rekan pendiri Unite.AI, yang dipandu oleh semangat tak tergoyahkan untuk membentuk dan mempromosikan masa depan AI dan robotika. Sebagai seorang wirausaha serial, ia percaya bahwa AI akan menjadi sangat mengganggu masyarakat seperti listrik, dan sering tertangkap berbicara tentang potensi teknologi disruptif dan AGI.

Sebagai seorang futuris, ia berdedikasi untuk mengeksplorasi bagaimana inovasi ini akan membentuk dunia kita. Selain itu, ia adalah pendiri Securities.io, sebuah platform yang berfokus pada investasi di teknologi-teknologi canggih yang mendefinisikan kembali masa depan dan membentuk kembali seluruh sektor.