Συνεντεύξεις

Patricia Thaine, CEO tại Private AI – Interview Series

mm
Προσθέστε το Unite.AI στις προτιμώμενες πηγές σας στο Google

Patricia Thaine là Đồng sáng lập và CEO của Private AI, một ứng viên tiến sĩ khoa học máy tính tại Đại học Toronto, và là thành viên sau đại học tại Viện Vector đang thực hiện nghiên cứu về xử lý ngôn ngữ tự nhiên bảo mật, với trọng tâm vào mật mã ứng dụng. Cô cũng thực hiện nghiên cứu về các phương pháp tính toán để giải mã ngôn ngữ bị mất.

Patricia là người nhận học bổng sau đại học NSERC, học bổng sau đại học RBC, học bổng sau đại học Beatrice “Trixie” Worsley về khoa học máy tính, và học bổng sau đại học Ontario. Cô có tám năm kinh nghiệm nghiên cứu và phát triển phần mềm, bao gồm tại Phòng thí nghiệm phát triển ngôn ngữ McGill, Phòng thí nghiệm ngôn ngữ học tính toán của Đại học Toronto, Bộ phận ngôn ngữ học của Đại học Toronto, và Cơ quan Y tế Công cộng Canada.

Tại sao bạn lại bị thu hút bởi khoa học máy tính?

Khả năng giải quyết vấn đề và sáng tạo cùng một lúc. Nó giống như một nghề thủ công. Bạn có thể thấy ý tưởng sản phẩm của mình trở thành hiện thực, giống như một thợ mộc xây dựng đồ nội thất. Khi tôi nghe ai đó nói một lần: lập trình là công cụ sáng tạo tối thượng. Việc sản phẩm bạn xây dựng có thể mở rộng và được sử dụng bởi mọi người trên toàn thế giới là một điểm cộng tuyệt vời.

Có thể bạn hãy thảo luận về câu chuyện nguồn gốc đằng sau Private AI và cách nó xuất hiện từ quan sát của bạn rằng có thiếu các công cụ dễ dàng tích hợp để bảo vệ quyền riêng tư?

Thông qua lời nói và viết, một số thông tin nhạy cảm nhất của chúng ta được tạo ra và chuyển giao cho các công ty cung cấp dịch vụ mà chúng ta sử dụng. Khi chúng tôi xem xét các sản phẩm NLP nào để xây dựng, có một lớp bảo mật mà chúng tôi phải tích hợp mà đơn giản là không tồn tại trên thị trường. Để sử dụng các giải pháp bảo mật, các công ty cần phải chuyển dữ liệu của người dùng cho một bên thứ ba, sử dụng các giải pháp mã nguồn mở kém chất lượng mà chỉ không đủ để bảo vệ quyền riêng tư của người dùng, hoặc xây dựng một giải pháp trong nhà với rất ít chuyên môn về bảo mật. Vì vậy, chúng tôi quyết định tập trung vào việc tạo ra các sản phẩm tốt nhất có thể cho các nhà phát triển và nhóm AI cần có đầu ra của các công nghệ tăng cường quyền riêng tư dễ dàng hoạt động cho nhu cầu của họ.

Tại sao AI bảo vệ quyền riêng tư lại quan trọng?

Khoảng 80 phần trăm thông tin được tạo ra là không cấu trúc và AI là cách duy nhất để hiểu tất cả dữ liệu đó. Nó có thể được sử dụng cho mục đích tốt, như giúp phát hiện té ngã cho dân số già, hoặc cho mục đích xấu, như tạo hồ sơ và theo dõi các cá nhân thuộc dân số thiểu số. Đảm bảo rằng quyền riêng tư được tích hợp vào phần mềm chúng ta tạo ra làm cho nó trở nên khó khăn hơn để AI được sử dụng theo cách có hại.

Làm thế nào quyền riêng tư trở thành lợi thế cạnh tranh?

Có nhiều lý do, nhưng đây chỉ là một vài lý do:

  1. Nhiều người dùng hơn quan tâm đến quyền riêng tư và khi người tiêu dùng trở nên thông minh hơn, mối quan tâm này đang tăng lên: 70 phần trăm người tiêu dùng quan tâm đến quyền riêng tư của dữ liệu.
  2. Nó dễ dàng hơn để kinh doanh với các doanh nghiệp khác nếu bạn có các giao thức và công nghệ bảo vệ dữ liệu và quyền riêng tư phù hợp.
  3. Khi bạn xây dựng sản phẩm của mình theo cách bảo vệ quyền riêng tư, bạn đang theo dõi tốt hơn các điểm dễ bị tấn công trong dịch vụ của mình và, đặc biệt là thông qua việc giảm thiểu dữ liệu, bạn đang loại bỏ dữ liệu mà bạn không cần và sẽ gây rắc rối khi xảy ra cuộc tấn công mạng.

Có thể bạn hãy thảo luận về tầm quan trọng của quyền riêng tư dữ liệu đào tạo và tại sao nó dễ bị đảo ngược?

Đây là một câu hỏi tuyệt vời và cần phải có nhiều giáo dục hơn về vấn đề này. Một cách đơn giản, các mô hình học máy ghi nhớ thông tin. Các mô hình lớn hơn, chúng ghi nhớ nhiều trường hợp hơn. Điều này có nghĩa là thông tin mà các mô hình đó được đào tạo có thể được đưa ra trong sản xuất. Điều này đã được chỉ ra trong một số bài nghiên cứu, bao gồm The Secret Sharer: Evaluating and Testing Unintended Memorization in Neural NetworksExtracting Training Data from Large Language Models.

Nó cũng đã được chỉ ra rằng thông tin cá nhân có thể được trích xuất từ các bản nhúng từ và, đối với những người có bất kỳ nghi ngờ nào về vấn đề này là một vấn đề thực sự, cũng có một scandal này năm khi một rô-bốt tình yêu Hàn Quốc đang viết chi tiết người dùng trong các cuộc trò chuyện với người dùng khác.

Các bạn có quan điểm gì về học tập phân tán và quyền riêng tư của người dùng?

Học tập phân tán là một bước tiến lớn khi trường hợp sử dụng cho phép. Tuy nhiên, vẫn có thể trích xuất thông tin về đầu vào của người dùng từ các bản cập nhật trọng lượng gửi đến đám mây từ thiết bị của người dùng cụ thể, vì vậy điều quan trọng là phải kết hợp học tập phân tán với các công nghệ tăng cường quyền riêng tư khác (quyền riêng tư khác biệt và mã hóa đồng nhất / tính toán bảo mật đa bên). Mỗi công nghệ tăng cường quyền riêng tư phải được chọn theo trường hợp sử dụng – không có công nghệ nào có thể được sử dụng như một chiếc búa để giải quyết tất cả các vấn đề. Chúng tôi sẽ đi qua cây quyết định này. Một lợi ích lớn là bạn không bao giờ gửi dữ liệu thô của mình ra ngoài thiết bị của mình. Một điểm bất lợi lớn là nếu bạn cần dữ liệu để gỡ lỗi hệ thống hoặc xem liệu nó có được đào tạo đúng cách hay không, nó sẽ trở nên khó khăn hơn để có được. Học tập phân tán là một bước khởi đầu tuyệt vời với nhiều vấn đề chưa được giải quyết mà cả nghiên cứu và ngành công nghiệp đều đang làm việc.

Private AI cho phép các nhà phát triển tích hợp phân tích quyền riêng tư với vài dòng mã để đảm bảo quyền riêng tư, làm thế nào điều này hoạt động?

Công nghệ của chúng tôi chạy như một API REST mà người dùng của chúng tôi gửi yêu cầu POST đến với văn bản họ muốn xóa, ẩn danh, hoặc thay thế bằng dữ liệu thực tế. Một số khách hàng của chúng tôi gửi qua bản ghi cuộc gọi cần được xóa để tuân thủ PCI, trong khi những người khác gửi qua toàn bộ cuộc trò chuyện để họ có thể sử dụng thông tin đó để đào tạo rô-bốt trò chuyện, phân tích cảm xúc, hoặc các mô hình NLP khác. Người dùng của chúng tôi cũng có thể chọn các thực thể họ cần giữ hoặc thậm chí sử dụng làm siêu dữ liệu để theo dõi nơi dữ liệu cá nhân được lưu trữ. Chúng tôi loại bỏ nỗi đau của việc phải đào tạo một hệ thống chính xác để phát hiện và thay thế thông tin cá nhân trong dữ liệu thực sự bẩn.

Tại sao quyền riêng tư cho các thiết bị IoT lại là một vấn đề hiện tại và bạn có quan điểm gì về việc giải quyết nó?

Cuối cùng, cách tốt nhất để giải quyết một vấn đề quyền riêng tư là phụ thuộc rất nhiều vào trường hợp sử dụng, và các thiết bị IoT không khác gì. Trong khi một số trường hợp sử dụng có thể dựa vào việc triển khai cạnh, suy luận cạnh, và học tập phân tán bảo vệ quyền riêng tư (ví dụ: cảm biến đám đông trong các thành phố thông minh), các trường hợp sử dụng khác có thể cần dựa vào việc tổng hợp dữ liệu và ẩn danh (ví dụ: thông tin sử dụng năng lượng). Với điều đó được nói, các thiết bị IoT là một ví dụ tuyệt vời về cách quyền riêng tư và bảo mật phải đi đôi với nhau. Các thiết bị này nổi tiếng là không an toàn trước các cuộc tấn công mạng, vì vậy chỉ có thể làm được nhiều việc với các công nghệ tăng cường quyền riêng tư mà không sửa các lỗ hổng cốt lõi của thiết bị. Mặt khác, nếu không nghĩ cách tăng cường quyền riêng tư của người dùng, thông tin thu thập từ trong nhà của chúng ta có thể được chia sẻ, không kiểm soát, với các bên không xác định, khiến nó trở nên rất khó để đảm bảo an toàn cho thông tin. Chúng tôi có hai mặt trận để cải thiện ở đây và dự thảo luật đang được Ủy ban Châu Âu soạn thảo về bảo mật thiết bị IoT có thể trở thành điều gì đó làm cho các nhà sản xuất thiết bị nghiêm túc thực hiện trách nhiệm của họ đối với bảo mật và quyền riêng tư của người tiêu dùng.

Có điều gì khác bạn muốn chia sẻ về Private AI?

Chúng tôi là một nhóm chuyên gia về quyền riêng tư, ngôn ngữ tự nhiên, ngôn ngữ nói, xử lý hình ảnh, triển khai mô hình học máy trong môi trường tài nguyên thấp, được hỗ trợ bởi M12, quỹ đầu tư mạo hiểm của Microsoft (MSFT ).

Chúng tôi đảm bảo rằng các sản phẩm chúng tôi tạo ra, ngoài việc chính xác cao, còn hiệu quả về mặt tính toán để bạn không phải đối mặt với một hóa đơn đám mây khổng lồ vào cuối tháng. Ngoài ra, dữ liệu của khách hàng chúng tôi không bao giờ được chuyển đến chúng tôi – mọi thứ đều được xử lý trong môi trường của họ.

Cảm ơn bạn vì cuộc phỏng vấn tuyệt vời, để tìm hiểu thêm, hãy truy cập Private AI.

Ο Antoine είναι ένας οραματιστής ηγέτης και συνιδρυτής της Unite.AI, οδηγείται από μια αμετάβλητη страсть για το σχήμα και την προώθηση του μέλλοντος της τεχνητής νοημοσύνης και της ρομποτικής. Ένας σειριακός επιχειρηματίας, πιστεύει ότι η τεχνητή νοημοσύνη θα είναι τόσο διαταρακτική για την κοινωνία όσο και η ηλεκτρική ενέργεια, και συχνά πιάνεται να μιλάει για το δυναμικό των διαταρακτικών τεχνολογιών και της AGI.

Ως μελλοντολόγος, είναι αφιερωμένος στο να εξερευνήσει πώς αυτές οι καινοτομίες θα σχήματίσουν τον κόσμο μας. Επιπλέον, είναι ο ιδρυτής του Securities.io, μιας πλατφόρμας που επικεντρώνεται στις επενδύσεις σε ακριβές τεχνολογίες που ανασχεδιάζουν το μέλλον και αναμορφώνουν ολόκληρες βιομηχανίες.