Gọi vốn

Collov Labs Nâng Cấp 23 Triệu Đô La Mỹ Cho Loạt A Để Đặt Cược Vào Trí Tuệ Nhân Tạo Hình Ảnh Là Giao Diện Tiếp Theo

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Collov Labs đã huy động được 23 triệu đô la Mỹ cho loạt A và ra mắt một phòng thí nghiệm nghiên cứu mới nhằm phát triển các hệ thống trí tuệ nhân tạo hình ảnh, báo hiệu một sự thay đổi lớn trong cách trí tuệ nhân tạo có thể phát triển vượt ra ngoài tương tác dựa trên văn bản.

Vòng này, được hỗ trợ bởi Brightway Future Capital, Taihill VentureMindworks Capital, sẽ tài trợ cho việc phát triển các hệ thống được thiết kế để giải thích hình ảnh và đầu vào camera, với mục tiêu cho phép trí tuệ nhân tạo hiểu và thực hiện các hành động trong thế giới thực.

Chuyển Đổi Khỏi Trí Tuệ Nhân Tạo Dựa Trên Trò Chuyện

Nhiều ứng dụng trí tuệ nhân tạo ngày nay đã tập trung vào các giao diện trò chuyện. Collov Labs đang xây dựng dựa trên một tiền đề khác: rằng đầu vào hình ảnh sẽ trở thành cách chính mà mọi người tương tác với trí tuệ nhân tạo.

Thay vì kích hoạt các hệ thống bằng văn bản, công ty đang tập trung vào việc cho phép người dùng chỉ camera vào một cảnh và trí tuệ nhân tạo sẽ giải thích ngữ cảnh, suy luận về những gì nó nhìn thấy và hỗ trợ các hành động trong thế giới thực. Điều này phản ánh một sự chuyển đổi lớn hơn trong ngành công nghiệp hướng tới trí tuệ nhân tạo đa phương thức, nơi các hệ thống kết hợp tầm nhìn, ngôn ngữ và suy luận thành một trải nghiệm thống nhất.

Ý tưởng này không hoàn toàn mới, nhưng những tiến bộ gần đây trong tính toán, mô hình và xử lý trên thiết bị đang làm cho nó trở nên thực tế hơn.

Xây Dựng Hướng Đến Tương Tác Trí Tuệ Nhân Tạo Trong Thế Giới Thực

Collov Labs đang phát triển các hệ thống kết hợp mô hình khuếch tán, suy luận không gian và luồng công việc đại lý. Mục tiêu là di chuyển khỏi nhận dạng hình ảnh tĩnh đến các hệ thống có thể hiểu mối quan hệ trong một cảnh và thực hiện các hành động đa bước.

Phần này phù hợp với một xu hướng ngày càng tăng hướng tới các hệ thống trí tuệ nhân tạo tương tác với các môi trường vật lý, đặc biệt là khi phần cứng phát triển để hỗ trợ xử lý thời gian thực và ngữ cảnh liên tục.

Nền tảng của công ty phản ánh sự tập trung này. Đội ngũ của họ có kinh nghiệm trong trí tuệ nhân tạo đa phương thức, hệ thống khuyến nghị quy mô lớn và học máy ứng dụng trên cả học thuật và công nghiệp.

Từ Công Cụ Thiết Kế Đến LAYER Trí Tuệ Nhân Tạo Rộng Lớn Hơn

Các sản phẩm hiện có của Collov, bao gồm cả công cụ thiết kế trí tuệ nhân tạo của họ, cung cấp một cái nhìn về cách các hệ thống này hoạt động trong thực tế. Công ty ban đầu đã đạt được sự thành công trong các lĩnh vực như thiết kế nội thất và tạo nội dung hình ảnh, nơi trí tuệ nhân tạo có thể giải thích bố cục không gian và tạo ra đầu ra thực tế.

Các phiên bản trước của doanh nghiệp tập trung vào các nền tảng thiết kế và công cụ tự động hóa được thúc đẩy bởi trí tuệ nhân tạo, một cách tiếp cận đã thấy sự thành công thương mại trên các trường hợp sử dụng trong bất động sản, bán lẻ và thương mại điện tử.

Các sản phẩm này hiện đang hoạt động như một vòng phản hồi, cung cấp dữ liệu thế giới thực giúp cải thiện mô hình của công ty và tinh chỉnh cách chúng hiểu môi trường hình ảnh.

Tại Sao Trí Tuệ Nhân Tạo Hình Ảnh Có Thể Mở Rộng Việc Sử Dụng

Một trong những giả định cơ bản đằng sau chiến lược của Collov Labs là rằng các giao diện dựa trên văn bản có phạm vi hạn chế. Mặc dù các rô-bốt trò chuyện đã thúc đẩy nhận thức, nhưng hầu hết dân số toàn cầu vẫn chưa tham gia một cách có ý nghĩa với các công cụ trí tuệ nhân tạo.

Ngược lại, các giao diện hình ảnh vốn dĩ trực quan hơn. Sự thay đổi này phản ánh các chuyển đổi trước đó trong tính toán, nơi các giao diện đồ họa đã làm cho các hệ thống trở nên dễ tiếp cận hơn với khán giả rộng lớn hơn ngoài người dùng kỹ thuật.

Nếu thành công, cách tiếp cận này có thể giảm rào cản gia nhập cho việc áp dụng trí tuệ nhân tạo và mở rộng việc sử dụng nó trên các ngành công nghiệp mà ngữ cảnh hình ảnh là thiết yếu, bao gồm bán lẻ, thiết kế, hậu cần và hoạt động trên lĩnh vực.

Vai Trò Của Phần Cứng Và Trí Tuệ Nhân Tạo Trên Thiết Bị

Các tiến bộ trong phần cứng là một yếu tố quan trọng cho sự xuất hiện của trí tuệ nhân tạo hình ảnh. Khi khả năng xử lý trên điện thoại thông minh, thiết bị đeo và chip chuyên dụng được cải thiện, nhiều công việc cần thiết để giải thích hình ảnh và video có thể diễn ra cục bộ trong thời gian thực. Điều này giảm độ trễ và cho phép hệ thống phản hồi ngay lập tức với những gì người dùng đang xem, thay vì dựa hoàn toàn vào xử lý dựa trên đám mây.

Sự thay đổi này cũng thay đổi cách trí tuệ nhân tạo được phân phối. Thay vì tồn tại chủ yếu như các ứng dụng độc lập, trí tuệ hình ảnh có thể được nhúng trong chính thiết bị, hoạt động liên tục trong nền. Điều này mở ra cánh cửa cho các tương tác nhận thức ngữ cảnh hơn, nhưng cũng đặt ra các mối quan ngại thực tế về độ chính xác, độ tin cậy và cách các hệ thống này hoạt động trong môi trường thực không thể đoán trước.

Áp Lực Rộng Lớn Hơn Cho Tương Tác Trí Tuệ Nhân Tạo

Chuyển dịch hướng tới trí tuệ nhân tạo hình ảnh gợi ý một sự thay đổi dần dần trong tương tác giữa con người và máy tính. Các hệ thống có thể giải thích cảnh và mối quan hệ không gian có thể giảm nhu cầu về đầu vào có cấu trúc, làm cho trí tuệ nhân tạo trở nên dễ tiếp cận hơn với người dùng ít thoải mái với các công cụ dựa trên văn bản.

Đồng thời, sự phức tạp của các môi trường thực giới thiệu các thách thức mới. Việc hiểu lầm một cảnh hoặc bỏ lỡ ngữ cảnh quan trọng có thể dẫn đến đầu ra không chính xác, và hậu quả của những sai lầm trở nên nghiêm trọng hơn khi trí tuệ nhân tạo tiến gần hơn đến việc ra quyết định.

Rather than replacing existing interfaces, visual AI is more likely to evolve alongside them, adding another layer of interaction. Over time, this could lead to a more integrated experience where AI responds to context as much as it does to explicit instructions.

Antoine là một nhà lãnh đạo có tầm nhìn và là đối tác sáng lập của Unite.AI, được thúc đẩy bởi niềm đam mê không ngừng nghỉ để định hình và quảng bá tương lai của AI và robot. Là một doanh nhân hàng loạt, ông tin rằng AI sẽ gây ra sự gián đoạn cho xã hội giống như điện, và thường được bắt gặp khi nói về tiềm năng của các công nghệ phá vỡ và AGI.

Là một nhà tương lai học, ông dành để khám phá cách những đổi mới này sẽ định hình thế giới của chúng ta. Ngoài ra, ông là người sáng lập của Securities.io, một nền tảng tập trung vào đầu tư vào các công nghệ tiên tiến đang định nghĩa lại tương lai và thay đổi toàn bộ lĩnh vực.