Lãnh đạo tư tưởng

Trước Hết Là An Toàn Khi Sử Dụng Trí Tuệ Nhân Tạo

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Mua một chiếc xe đạp mới cho một đứa trẻ, và chiếc xe đạp sẽ nhận được tất cả sự chú ý – không phải chiếc mũ bảo hiểm sáng bóng đi kèm với nó. Nhưng phụ huynh đánh giá cao chiếc mũ bảo hiểm.

Tôi sợ rằng nhiều người trong chúng ta ngày nay giống như những đứa trẻ khi nói đến trí tuệ nhân tạo. Chúng ta tập trung vào việc nó thật tuyệt vời và chúng ta có thể đi nhanh như thế nào với nó. Không nhiều lắm về việc chúng ta có thể làm gì để ở an toàn khi sử dụng nó. Đó là một điều đáng tiếc vì bạn không thể có được lợi ích của một trong những điều đó mà không có cái còn lại.

Đơn giản nói, áp dụng trí tuệ nhân tạo mà không lập kế hoạch cẩn thận cho an toàn trước hết không chỉ rủi ro. Đó là một con đường thẳng đến vực thẳm.

Trí Tuệ Nhân Tạo An Toàn Có Nghĩa Là Gì?

An toàn trí tuệ nhân tạo bao gồm một loạt các bước. Nhưng có lẽ yếu tố quan trọng nhất là khi thực hiện chúng. Để hiệu quả, an toàn trí tuệ nhân tạo phải được thiết kế.

Điều đó có nghĩa là chúng ta xem xét cách ngăn chặn thiệt hại trước khi chúng ta đưa nó vào thử nghiệm. Chúng ta tìm ra cách đảm bảo trí tuệ nhân tạo hoạt động và tạo ra kết quả phù hợp với giá trị và kỳ vọng xã hội của chúng ta trước – không sau khi chúng ta nhận được một số kết quả khủng khiếp.

Thiết kế cho an toàn trí tuệ nhân tạo cũng bao gồm việc suy nghĩ về cách làm cho nó trở nên mạnh mẽ, hoặc có thể hoạt động dự đoán được ngay cả trong những tình huống bất lợi. Nó có nghĩa là làm cho trí tuệ nhân tạo trở nên minh bạch, để các quyết định trí tuệ nhân tạo đưa ra có thể hiểu được, kiểm toán và không bị thiên vị.

Nó cũng bao gồm việc xem xét thế giới trong đó trí tuệ nhân tạo sẽ hoạt động. Những biện pháp an toàn và pháp lý nào chúng ta cần, đặc biệt là để tuân thủ các quy định của chính phủ? Và tôi không thể nhấn mạnh quá mức thành phần con người: Tác động của việc sử dụng trí tuệ nhân tạo sẽ như thế nào đối với những người tương tác với nó?

An toàn theo thiết kế có nghĩa là tích hợp an toàn trí tuệ nhân tạo vào tất cả các quy trình, công việc và hoạt động của chúng ta trước khi chúng ta nhập câu lệnh đầu tiên.

Rủi Ro Vượt Qua Lo Lắng

Không phải mọi người đều đồng ý. Khi họ nghe “an toàn trước hết”, một số người nghe “hành động cẩn thận và chậm rãi đến mức bạn bị bỏ lại phía sau.” Tất nhiên, đó không phải là những gì an toàn trước hết có nghĩa. Nó không cần phải kìm hãm sự đổi mới hoặc làm chậm thời gian đưa ra thị trường. Và nó không có nghĩa là một loạt các thử nghiệm mà không bao giờ mở rộng quy mô. Ngược lại.

Nó có nghĩa là hiểu rủi ro của không thiết kế an toàn vào trí tuệ nhân tạo. Hãy xem xét chỉ một vài.

  • Trung tâm Dịch vụ Tài chính của Deloitte dự đoán rằng GenAI có thể chịu trách nhiệm cho tổn thất gian lận lên tới 40 tỷ đô la Mỹ tại Mỹ alone vào năm 2027, từ 12,3 tỷ đô la vào năm 2023, tốc độ tăng trưởng hàng năm là 32%.
  • Quyết định thiên vị. Các trường hợp chăm sóc y tế thiên vị do trí tuệ nhân tạo đã được đào tạo trên dữ liệu thiên vị.
  • Quyết định tồi tệ dẫn đến quyết định tồi tệ hơn. Kém hơn một quyết định ban đầu tồi tệ do trí tuệ nhân tạo bị lỗi, các nghiên cứu chỉ ra rằng những quyết định tồi tệ đó có thể trở thành một phần của cách chúng ta suy nghĩ và đưa ra quyết định trong tương lai.
  • Hậu quả thực tế. Trí tuệ nhân tạo đưa ra lời khuyên y tế tồi tệ đã gây ra kết quả tử vong cho bệnh nhân. Các vấn đề pháp lý đã phát sinh từ việc trích dẫn ảo giác của trí tuệ nhân tạo như một tiền lệ pháp lý. Và lỗi phần mềm do trợ lý trí tuệ nhân tạo đưa ra thông tin sai đã làm ô nhiễm sản phẩm của công ty và danh tiếng của họ và dẫn đến sự không hài lòng rộng rãi của người dùng.

Và mọi thứ sắp trở nên thú vị hơn.

Sự ra đời và sự áp dụng nhanh chóng của trí tuệ nhân tạo tự động, trí tuệ nhân tạo có thể hoạt động tự chủ để đưa ra hành động dựa trên quyết định nó đã đưa ra, sẽ làm tăng tầm quan trọng của việc thiết kế cho an toàn trí tuệ nhân tạo.

Một tác nhân trí tuệ nhân tạo có thể hoạt động thay mặt bạn có thể rất hữu ích. Thay vì nó cho bạn biết về các chuyến bay tốt nhất cho một chuyến đi, nó có thể tìm thấy chúng và đặt chúng cho bạn. Nếu bạn muốn trả lại một sản phẩm, tác nhân trí tuệ nhân tạo của một công ty có thể không chỉ cho bạn biết chính sách trả lại và cách nộp đơn trả lại, mà còn xử lý toàn bộ giao dịch cho bạn.

Tuyệt vời – miễn là tác nhân không ảo giác một chuyến bay hoặc xử lý sai thông tin tài chính của bạn. Hoặc sai về chính sách trả lại của công ty và từ chối trả lại hợp lệ.

Nó không quá khó để thấy làm thế nào những rủi ro an toàn trí tuệ nhân tạo hiện tại có thể dễ dàng lan truyền với một loạt các tác nhân trí tuệ nhân tạo đang hoạt động và đưa ra quyết định, đặc biệt là vì chúng sẽ không hoạt động một mình. Phần lớn giá trị thực sự của trí tuệ nhân tạo tự động sẽ đến từ các đội tác nhân, nơi từng tác nhân xử lý các phần của nhiệm vụ và cộng tác – tác nhân với tác nhân – để hoàn thành công việc.

Vậy làm thế nào bạn có thể áp dụng an toàn trí tuệ nhân tạo theo thiết kế mà không cản trở sự đổi mới và giết chết tiềm năng giá trị của nó?

An Toàn Theo Thiết Kế Trong Hành Động

Các kiểm tra an toàn tùy ý không phải là câu trả lời. Nhưng tích hợp các thực hành an toàn vào mọi giai đoạn của việc triển khai trí tuệ nhân tạo là.

Bắt đầu với dữ liệu. Đảm bảo dữ liệu được gắn nhãn, chú thích khi cần, không thiên vị và chất lượng cao. Điều này đặc biệt đúng đối với dữ liệu đào tạo.

Đào tạo mô hình của bạn với phản hồi của con người, vì phán quyết của con người là điều cần thiết để định hình hành vi của mô hình. Học tăng cường với Phản hồi của Con người (RLHF) và các kỹ thuật tương tự cho phép người chú thích đánh giá và hướng dẫn phản hồi, giúp LLM tạo ra đầu ra an toàn và phù hợp với giá trị của con người.

Sau đó, trước khi bạn phát hành một mô hình, hãy kiểm tra căng thẳng nó. Các đội đỏ cố gắng kích động hành vi không an toàn bằng cách sử dụng các lệnh thúc đẩy đối thủ, các trường hợp biên và các cuộc cố gắng phá vỡ có thể暴 lộ các điểm yếu. Việc sửa chữa chúng trước khi chúng đến tay công chúng giúp mọi thứ an toàn trước khi có vấn đề.

Khi việc kiểm tra này đảm bảo rằng mô hình trí tuệ nhân tạo của bạn mạnh mẽ, hãy tiếp tục theo dõi chúng với mắt đến các mối đe dọa mới nổi và các điều chỉnh có thể cần thiết cho mô hình.

Trong một ý nghĩa tương tự, hãy theo dõi thường xuyên các nguồn nội dung và tương tác kỹ thuật số để tìm kiếm các dấu hiệu của gian lận. Quan trọng là, hãy sử dụng một phương pháp kết hợp trí tuệ nhân tạo và con người, cho phép tự động hóa trí tuệ nhân tạo xử lý khối lượng lớn dữ liệu cần được theo dõi, và con người có kỹ năng xử lý các đánh giá để thực thi và đảm bảo độ chính xác.

Áp dụng trí tuệ nhân tạo tự động đòi hỏi sự cẩn thận hơn. Một yêu cầu cơ bản: đào tạo tác nhân để biết giới hạn của nó. Khi nó gặp sự không chắc chắn, các tình huống khó khăn, các quyết định quan trọng hoặc các quyết định có tầm quan trọng cao, hãy đảm bảo nó biết cách hỏi giúp đỡ.

Cũng vậy, hãy thiết kế khả năng theo dõi vào các tác nhân của bạn. Điều này đặc biệt quan trọng để các tương tác của nó chỉ xảy ra với người dùng đã xác minh, để tránh các tác nhân gian lận ảnh hưởng đến hành động của tác nhân.

Nếu chúng có vẻ hoạt động hiệu quả, có thể rất cám dỗ để thả lỏng chúng và để chúng làm việc của mình. Kinh nghiệm của chúng tôi nói rằng hãy tiếp tục theo dõi chúng và các nhiệm vụ chúng đang thực hiện để theo dõi các lỗi hoặc hành vi không mong muốn. Hãy sử dụng cả kiểm tra tự động và xem xét của con người.

Trên thực tế, một yếu tố thiết yếu của an toàn trí tuệ nhân tạo là sự tham gia thường xuyên của con người. Con người nên được tham gia có chủ đích ở những nơi phán quyết quan trọng, đồng cảm hoặc tinh tế và模糊性 liên quan đến một quyết định hoặc hành động.

Một lần nữa, để làm rõ, đây là tất cả các thực hành mà bạn xây dựng vào việc triển khai trí tuệ nhân tạo trước, theo thiết kế. Chúng không phải là kết quả của việc điều gì đó đi sai và sau đó vội vàng tìm cách để giảm thiểu thiệt hại.

Nó Có Hoạt Động?

Chúng tôi đã áp dụng một triết lý An toàn Trí tuệ Nhân tạo Đầu tiên và khuôn khổ “theo thiết kế” với khách hàng của mình trong suốt sự xuất hiện của GenAI và bây giờ trên đường đua đến trí tuệ nhân tạo tự động. Chúng tôi nhận thấy rằng, trái với những lo ngại về việc nó làm chậm mọi thứ, nó thực sự giúp tăng tốc chúng.

Trí tuệ nhân tạo tự động có tiềm năng giảm 25-50% chi phí hỗ trợ khách hàng, trong khi tăng cường sự hài lòng của khách hàng. Nhưng tất cả điều đó phụ thuộc vào niềm tin.

Con người sử dụng trí tuệ nhân tạo phải tin tưởng vào nó, và khách hàng tương tác với các tác nhân trí tuệ nhân tạo hoặc với các tác nhân trí tuệ nhân tạo thực sự không thể trải qua một lần tương tác nào có thể làm suy yếu niềm tin của họ. Một trải nghiệm tồi tệ có thể xóa bỏ niềm tin vào một thương hiệu.

Chúng ta không tin vào những gì không an toàn. Vì vậy, khi chúng ta xây dựng an toàn vào mọi lớp của trí tuệ nhân tạo mà chúng ta sắp triển khai, chúng ta có thể làm như vậy với sự tự tin. Và khi chúng ta sẵn sàng mở rộng quy mô nó, chúng ta có thể làm như vậy nhanh chóng – với sự tự tin.

Khi áp dụng An toàn Trí tuệ Nhân tạo Đầu tiên vào thực tế có thể có vẻ choáng ngợp, bạn không đơn độc. Có nhiều chuyên gia để giúp đỡ và các đối tác có thể chia sẻ những gì họ đã học và đang học để bạn có thể tận dụng giá trị của trí tuệ nhân tạo một cách an toàn mà không làm chậm bạn lại.

Trí tuệ nhân tạo đã là một chuyến đi thú vị cho đến nay, và khi chuyến đi này tăng tốc, tôi thấy nó rất phấn khích. Nhưng tôi cũng rất vui vì tôi đang đội mũ bảo hiểm.

Joe Anderson là Giám đốc Tư vấn và Chuyển đổi Số cao cấp tại TaskUs, nơi ông lãnh đạo chiến lược thị trường và đổi mới. Ông tập trung vào sự giao thoa giữa Trí tuệ Nhân tạo, trải nghiệm khách hàng và hoạt động số, và đứng đầu thực hành tư vấn Trí tuệ Nhân tạo mới của TaskUs.