Pendanaan
Collov Labs Mengumpulkan $23M Seri A untuk Bertaruh pada Visual AI sebagai Antarmuka Berikutnya

Collov Labs telah mengumpulkan $23 juta Seri A dan meluncurkan laboratorium penelitian baru yang bertujuan untuk meningkatkan sistem visual AI, menandai pergeseran yang lebih luas dalam cara kecerdasan buatan mungkin berkembang di luar interaksi berbasis teks.
Putaran ini, yang didukung oleh Brightway Future Capital, Taihill Venture, dan Mindworks Capital, akan mendanai pengembangan sistem yang dirancang untuk menafsirkan gambar dan input kamera, dengan tujuan untuk memungkinkan AI memahami dan bertindak pada dunia fisik.
Pergeseran dari Chat-Based AI
Banyak dari adopsi AI hari ini telah berpusat pada antarmuka chat. Collov Labs membangun di sekitar premis yang berbeda: bahwa input visual akan menjadi cara utama orang berinteraksi dengan AI.
Alih-alih memicu sistem dengan teks, perusahaan ini fokus pada memungkinkan pengguna untuk menunjuk kamera ke adegan dan memiliki AI menafsirkan konteks, bernalar tentang apa yang dilihat, dan membantu dengan tindakan dunia nyata. Ini mencerminkan transisi industri yang lebih luas menuju AI multimodal, di mana sistem menggabungkan visi, bahasa, dan penalaran menjadi pengalaman yang terintegrasi.
Gagasan ini tidak sepenuhnya baru, tetapi kemajuan baru-baru ini dalam komputasi, model, dan pemrosesan perangkat membuatnya semakin praktis.
Membangun Menuju Interaksi AI Dunia Nyata
Collov Labs mengembangkan sistem yang menggabungkan model difusi, penalaran spasial, dan aliran kerja agen. Tujuannya adalah untuk melampaui pengenalan gambar statis menuju sistem yang dapat memahami hubungan dalam adegan dan melaksanakan tindakan multi-langkah.
Bagian ini sejalan dengan dorongan yang tumbuh menuju sistem AI yang berinteraksi dengan lingkungan fisik, terutama karena perangkat keras berkembang untuk mendukung pemrosesan waktu nyata dan konteks yang persisten.
Latar belakang perusahaan mencerminkan fokus ini. Tim mereka memiliki pengalaman dalam AI multimodal, sistem rekomendasi skala besar, dan pembelajaran mesin terapan di seluruh akademisi dan industri.
Dari Alat Desain ke Lapisan AI yang Lebih Luas
Produk Collov yang ada, termasuk alat desain AI-nya, memberikan gambaran tentang bagaimana sistem ini berfungsi dalam praktek. Perusahaan ini awalnya mendapatkan traksi di bidang seperti desain interior dan generasi konten visual, di mana AI dapat menafsirkan tata letak spasial dan menghasilkan output yang realistis.
Iterasi sebelumnya dari bisnis ini berfokus pada platform desain yang didorong AI dan alat otomatisasi, pendekatan yang telah melihat traksi komersial di seluruh kasus penggunaan real estat, ritel, dan e-commerce.
Produk ini sekarang bertindak sebagai umpan balik, menyediakan data dunia nyata yang membantu meningkatkan model perusahaan dan memperbaiki bagaimana mereka memahami lingkungan visual.
Mengapa Visual AI Mungkin Meningkatkan Adopsi
Salah satu asumsi dasar di balik strategi Collov Labs adalah bahwa antarmuka berbasis teks memiliki jangkauan terbatas. Sementara chatbot telah meningkatkan kesadaran, sebagian besar populasi global belum terlibat secara signifikan dengan alat AI.
Antarmuka visual, di sisi lain, secara inheren lebih intuitif. Perubahan ini mencerminkan transisi sebelumnya dalam komputasi, di mana antarmuka grafis membuat sistem dapat diakses oleh audiens yang lebih luas di luar pengguna teknis.
Jika berhasil, pendekatan ini dapat menurunkan hambatan untuk adopsi AI dan memperluas penggunaannya di seluruh industri di mana konteks visual sangat penting, termasuk ritel, desain, logistik, dan operasi lapangan.
Peran Perangkat Keras dan AI Perangkat
Kemajuan perangkat keras adalah pendorong utama di balik munculnya visual AI. Ketika kemampuan pemrosesan meningkat pada smartphone, perangkat yang dapat dikenakan, dan chip khusus, lebih banyak pekerjaan yang diperlukan untuk menafsirkan gambar dan video dapat terjadi secara lokal dalam waktu nyata. Ini mengurangi latensi dan memungkinkan sistem untuk merespons secara instan terhadap apa yang dilihat pengguna, bukan hanya bergantung pada pemrosesan berbasis awan.
Perubahan ini juga mengubah cara AI disampaikan. Alih-alih ada terutama sebagai aplikasi mandiri, kecerdasan visual dapat menjadi terintegrasi dalam perangkat itu sendiri, beroperasi terus-menerus di latar belakang. Ini membuka pintu untuk interaksi yang lebih sadar konteks, tetapi juga memunculkan kekhawatiran praktis tentang akurasi, keandalan, dan bagaimana sistem ini berperilaku dalam lingkungan dunia nyata yang tidak terduga.
Implikasi yang Lebih Luas untuk Interaksi AI
Pergerakan menuju visual AI menunjukkan pergeseran bertahap dalam interaksi manusia-komputer. Sistem yang dapat menafsirkan adegan dan hubungan spasial mungkin mengurangi kebutuhan akan input terstruktur, membuat AI lebih dapat diakses oleh pengguna yang kurang nyaman dengan alat berbasis teks.
Pada saat yang sama, kompleksitas lingkungan dunia nyata memperkenalkan tantangan baru. Menafsirkan adegan yang salah atau melewatkan konteks kunci dapat menyebabkan output yang salah, dan konsekuensi dari kesalahan tersebut menjadi lebih signifikan ketika AI semakin dekat dengan pengambilan keputusan.
Daripada menggantikan antarmuka yang ada, visual AI lebih mungkin berkembang bersama mereka, menambahkan lapisan interaksi lain. Dalam waktu, ini dapat menyebabkan pengalaman yang lebih terintegrasi di mana AI merespons konteks sebanyak instruksi eksplisit.












