Mô hình và nền tảng AI

Perplexity mang Trình Đặc vụ Portable Computer cục bộ đến PC Windows

mm
Thêm Unite.AI vào các nguồn ưu tiên của bạn trên Google

Perplexity đã đưa Portable Computer, phiên bản cục bộ trên thiết bị của trình đặc vụ Perplexity Computer, có sẵn trong ứng dụng Perplexity cho Windows vào ngày 14 tháng 9 năm 2026, trên các PC NVIDIA GeForce RTX và các workstation NVIDIA RTX PRO tương thích có 24 GB VRAM trở lên.

Sẵn có cho người dùng Windows

Portable Computer cho Windows có sẵn cho người đăng ký gói Pro và Max trên cả kế hoạch cá nhân và doanh nghiệp thông qua ứng dụng Perplexity cho Windows, có thể tải xuống qua Microsoft Store, theo Thông báo của Perplexity. Sau khi tải ứng dụng, người dùng tải mô hình cục bộ họ muốn sử dụng chỉ với một cú nhấp chuột sau khi chọn nó trong danh sách thả xuống mô hình.

Việc suy luận trên thiết bị yêu cầu GPU NVIDIA GeForce RTX hoặc RTX PRO có ít nhất 24 GB VRAM. NVIDIA cho biết hỗ trợ cho workstation DGX Station của mình dự kiến sẽ sớm ra mắt.

Từ DGX Spark tới máy tính để bàn Windows

Portable Computer là phiên bản cục bộ của Perplexity Computer, một trình đặc vụ lên kế hoạch và thực hiện các nhiệm vụ đa bước. Được tăng tốc bởi GPU của NVIDIA, nó sử dụng các mô hình cục bộ để phân tích dữ liệu, tổng hợp thông tin qua các tệp và xử lý công việc lặp lại, trong khi thông tin nhạy cảm vẫn ở trên thiết bị và công việc hoàn thành cục bộ không tiêu tốn tín dụng của Perplexity Computer, theo Thông báo của NVIDIA.

Perplexity đã giới thiệu Portable Computer vào tháng Tám cho NVIDIA DGX Spark, một máy tính AI kích thước để bàn được xây dựng dựa trên nền tảng Grace Blackwell GB10 với CPU Arm 20 lõi, GPU NVIDIA và 128 GB bộ nhớ hợp nhất. Perplexity đã phát triển bản phát hành này cùng NVIDIA và ra mắt đầu tiên trên Linux, với cam kết hỗ trợ Windows vào thời điểm đó.

Trước khi ra mắt DGX Spark, Personal Computer của Perplexity cho Windows đã đưa các trình đặc vụ đám mây của Computer tới máy tính để bàn Windows, nơi chúng có thể làm việc qua các tệp cục bộ, ứng dụng kết nối và web. Thay vào đó, Portable Computer chạy mô hình, bộ khung trình đặc vụ, bộ điều phối và bộ lập lịch hoàn toàn trên thiết bị Windows. NVIDIA cho biết bản phát hành Windows dựa trên hỗ trợ hiện có cho các hệ thống DGX Spark và các PC RTX chạy Linux.

Mô hình cục bộ, kết nối và các tác vụ lên lịch

NVIDIA cho biết ứng dụng Windows đơn giản hoá việc thiết lập với một mô hình cục bộ như Qwen 3.8 27B, đã được huấn luyện lại để làm việc với Perplexity Computer và được tối ưu cho GPU RTX, giúp người dùng đưa trình đặc vụ vào hoạt động mà không cần nghiên cứu mô hình hay cấu hình bộ phần mềm phức tạp thường cần để chạy AI cục bộ.

Trong bản phát hành DGX Spark, Portable Computer chạy Qwen 3.8 27B hoặc PPLX 27B, một phiên bản đã được huấn luyện lại của mô hình Qwen, trong khi bộ điều phối, lập kế hoạch, bộ định tuyến công cụ, bộ lập lịch, hàng đợi tác vụ bền vững và chỉ mục tìm kiếm cục bộ đều chạy trên thiết bị. Perplexity cho biết NVIDIA Nemotron 3.5 Lightning, một mô hình mở 30B, sẽ sớm xuất hiện trong bộ chọn mô hình, và chế độ dictation chạy cục bộ với mô hình ASR NVIDIA Nemotron 3.5, giữ lại việc ghi âm và các hành động trên tệp trên máy.

Các kết nối cho Microsoft Outlook, OneDrive, Word, Google Drive, Gmail, Slack và GitHub mở rộng khả năng của trình đặc vụ qua các tệp và ứng dụng đã là một phần của quy trình làm việc hàng ngày của người dùng, theo NVIDIA. Portable cũng kết nối với các ứng dụng máy tính để bàn khác thông qua các máy chủ Model Context Protocol cục bộ chạy trên thiết bị Windows, mà Perplexity cho biết cho phép mô hình cục bộ sử dụng các công cụ và dữ liệu của những ứng dụng đó như một phần của quy trình tự động trong khi vẫn giữ công việc trên thiết bị. Trình đặc vụ có thể làm việc với tài liệu, bảng tính, bản trình chiếu, PDF, mã nguồn và hình ảnh được lưu trong các thư mục được phép, sau đó sử dụng công cụ để thực hiện các hành động dựa trên thông tin đó.

Người dùng có thể lên lịch các quy trình làm việc lặp lại, chẳng hạn như phân tích hoặc xử lý tệp, để chạy với mô hình cục bộ trên phần cứng của mình. Perplexity mô tả một người điều khiển tại một công ty logistics lên lịch Portable để đối chiếu các hoá đơn vận tải trong một thư mục được phép mỗi buổi sáng: trình đặc vụ so sánh mỗi hoá đơn với bảng giá cục bộ của nhà vận chuyển, đánh dấu các khoản phí trùng lặp hoặc mức giá lệch so với hợp đồng, và tạo một hàng đợi ngoại lệ hiển thị hoá đơn, sự chênh lệch và hành động tranh chấp đề xuất, trong khi dữ liệu hoá đơn và mức giá không bao giờ rời khỏi thiết bị của công ty.

Mở rộng Đám mây và Bảo mật

Đối với các nhiệm vụ cần thông tin hiện thời hoặc suy luận nâng cao, Portable Computer có thể bao gồm kết quả từ Perplexity Search hoặc một trong hơn 15 mô hình tiên tiến, và nó sẽ yêu cầu sự cho phép của người dùng trước khi gửi thông tin ra ngoài thiết bị. Perplexity cho biết trình đặc vụ cũng có thể gọi Perplexity Search và thực hiện nghiên cứu rộng hoặc sâu, sau đó trả lại kết quả cho cùng một nhiệm vụ.

Các công cụ tích hợp sẵn trong Perplexity Computer bao gồm một trình duyệt tích hợp và sandbox độc quyền SPACE của công ty, theo NVIDIA. Perplexity cho biết việc thực thi mã và công cụ diễn ra trong môi trường sandbox cô lập với quyền truy cập được kiểm soát vào các tệp và ứng dụng kết nối, và bảo mật tương đương với phiên bản đám mây của Perplexity Computer.

Bài đăng của NVIDIA đã nêu các quy trình làm việc mẫu cho trợ lý. Một kỹ sư có thể xem xét các pull request đang mở trong dự án GitHub được kết nối, sắp xếp chúng theo trạng thái và xác định các bước tiếp theo, đồng thời trợ lý cũng có thể đánh dấu tài liệu lỗi thời và gửi các bản cập nhật đề xuất để xem xét. Người dùng tài chính có thể chỉ định cho nó hai năm tổng hợp báo cáo môi giới, các mẫu 1099 hợp nhất và tờ khai thuế, và để nó theo dõi các khoản nắm giữ lặp lại gây ra các khoản phí và thuế không cần thiết nhất, với mỗi con số được trích dẫn tới tệp và trang chính xác và không có tài liệu nào đến chatbot. Một công ty khởi nghiệp có thể hỏi tại sao mức kích hoạt đã giảm và để trợ lý phân tích dữ liệu kênh bán hàng (funnel) cục bộ để tìm nơi các đăng ký mới ngừng lại giữa việc cài đặt và nhiệm vụ hoàn thành đầu tiên, sau đó đăng các hiểu biết hàng đầu lên kênh Slack của đội.

Perplexity đã đưa ra ví dụ kỹ thuật của mình: một người dùng có thể yêu cầu Portable xem xét các pull request đang mở đối với cơ sở mã cục bộ và nhóm chúng thành sẵn sàng hợp nhất, cần xem xét, bị chặn hoặc lỗi thời, và sau khi người dùng phê duyệt bản tóm tắt và các mục hành động, trợ lý sẽ đăng chúng lên kênh Slack của đội và gắn thẻ người chịu trách nhiệm trực tiếp cho mỗi mục.

Elara Nix là một nhà phân tích được tạo bởi trí tuệ nhân tạo tại Unite.AI, chuyên về trí tuệ nhân tạo trong lĩnh vực giao thông, hệ thống di chuyển và công nghệ tự động. Công việc của cô tập trung vào việc trí tuệ nhân tạo đang thay đổi các phương tiện tự lái, hệ thống hàng không, mạng lưới đường sắt và giao thông công cộng - nơi mà độ tin cậy, an toàn và triển khai thực tế quan trọng không kém so với sự đổi mới.

Với quan điểm kỹ thuật và hướng tới tương lai, Elara nghiên cứu các tiến bộ trong hệ thống nhận thức, chồng tự động, mô phỏng và xác thực an toàn trên đất liền, không khí và di chuyển đô thị. Cô đặc biệt chú ý đến cách tự động hóa được thúc đẩy bởi trí tuệ nhân tạo được thử nghiệm, quản lý và tích hợp vào cơ sở hạ tầng hiện có, và cách các hệ thống này cân bằng giữa hiệu quả và niềm tin của công chúng và quản lý rủi ro.

Các bài viết được viết bởi Elara Nix được tạo bởi trí tuệ nhân tạo và được nhóm biên tập của Unite.AI xem xét để đảm bảo độ chính xác, rõ ràng và phạm vi bao quát của trí tuệ nhân tạo trong lĩnh vực giao thông và hệ thống tự động.